Anthropic 的 Opus 5 关乎 Token 效率,而非能力飞跃
摘要
Anthropic 发布了 Opus 5,专注于 Token 效率和成本降低,而非重大的能力飞跃,提供接近 Fable 的性能,成本减半。
<p><!-- obsidian --></p>
<p>今天,Anthropic <a href="https://www.anthropic.com/news/claude-opus-5">推出了 Opus 5</a>,这是该模型的最新更新,该模型最近成为编程和其他软件开发任务的热门选择。</p>
<p>虽然这对 Opus 来说是一个值得注意的提升,但似乎并非 Opus 4.5 级别的智能体编码性能突破。</p><p><a href="https://arstechnica.com/ai/2026/07/anthropics-opus-5-is-about-token-efficiency-not-a-capability-leap/">阅读全文</a></p>
<p><a href="https://arstechnica.com/ai/2026/07/anthropics-opus-5-is-about-token-efficiency-not-a-capability-leap/#comments">评论</a></p>
查看缓存全文
缓存时间: 2026/07/24 23:05
# Anthropic发布Opus 5:关注Token效率而非能力飞跃
来源:https://arstechnica.com/ai/2026/07/anthropics-opus-5-is-about-token-efficiency-not-a-capability-leap/
今天,Anthropic推出了Opus 5(https://www.anthropic.com/news/claude-opus-5),这是该模型的最新更新版本。近来,Opus系列在编程及其他软件开发任务中已成为热门选择。
虽然这对Opus而言是一次值得关注的升级,但似乎并未像Opus 4.5那样在智能体编码性能上实现突破性进展。
Anthropic提供的图表展示了多项基准测试结果(如Frontier-Bench和DeepSWE),数据显示Opus 5在编码任务上的表现与备受赞誉的Anthropic Fable模型大致相当或略微领先。在几乎所有类型的任务中,它显然超过了Opus 4.8和OpenAI的竞品GPT-5.6-Sol。
各项基准测试显示其性能呈递增式提升,但并非飞跃式突破——其主要卖点在于:以大约一半的成本提供接近Fable的性能表现。
值得一提的是,Anthropic刻意未让Opus 5在网络安全任务上接受前沿训练,因此在这方面它远远落后于Fable和Mythos。Anthropic声称该模型在发现网络安全漏洞方面表现尚可,但由于训练模型时的决策,它"在利用这些漏洞的能力上明显落后于Mythos 5"。
因此,Opus 5并未配备Fable所拥有的那些颇具争议的保护措施,例如将数据保留审查30天以防事故的政策。
相似文章
Anthropic 发布 Opus 5
Anthropic 发布了 Opus 5,其重量级模型的新版本,比 Fable 5 更便宜且限制更少,并在某些基准测试中表现更优。该模型还引入了更轻量级的安全措施和面向 API 用户的全新 Automatic Fallbacks 功能。
Anthropic 发布 Opus 5,能力‘接近’Fable 5
Anthropic 发布了 Claude Opus 5,据称该模型在能力上接近其更强大的 Fable 5 模型,同时提供更强的网络安全防护和更低的价格。
@PrajwalTomar_: 等等。Anthropic刚刚证明了你不需要Fable 5做所有事情。根据他们自己的基准测试。他们测试了"Fable 5编排…
Anthropic的基准测试显示,使用更大的模型(Fable)作为编排器,搭配更便宜的模型(Sonnet)作为执行者,可以达到Fable完整性能的96%,成本仅为46%,现已可在Claude Code中使用。
Opus 5 的使用成本并不比 Fable 低多少
Opus 5 的使用成本并不比 Fable 便宜多少。
让 Fable 比 Opus 更便宜(12 分钟阅读)
Cognition 在 Devin 的 Fusion 架构中将 Opus 模型替换为 Fable,尽管 Fable 的每 token 价格更高,但通过更好的委托和减少主导模型回合,实现了更高的性能和更低的成本。