Anthropic内部模型目前领先Fable 5多少?

Reddit r/singularity 新闻

摘要

推测Anthropic内部前沿模型在经历了数月的反馈和AI辅助开发周期后,可能比公开发布的Fable 5模型领先多少。

Mythos预览版早在四月份就已供选定的组织使用。现在已是七月下旬,Anthropic自那以后已经获得了数月的反馈、实验和模型辅助研究。Fable 5在六月发布,但很可能基于几个月前开发和测试的一个检查点。那么,Anthropic最好的内部模型现在能领先多少?如果Mythos/Fable级别的模型正在积极协助编码、评估和AI研究,那每个开发周期不应该明显加快吗?也许最大的改进并不体现在基准测试中,而是在智能体可靠性、研究自动化以及它们能够运行的实验数量上。我并不是说完整的递归自我改进已经发生。但我们可能已经处于AI加速其继任者开发的早期阶段。你认为Anthropic的内部前沿仅比Fable 5稍微领先,还是他们拥有显著更强大的东西?
查看原文

相似文章