Opus 5.5 在 ArtificialAnalysis.ai 的所有三项性能指标中占主导地位
摘要
Opus 5.5 在 ArtificialAnalysis.ai 的所有三项性能指标中占主导地位,并提供了相较于 Fable 5.1 的高性价比替代选择。
ArtificialAnalysis.ai 的图表存在一个 bug,使得更难看清绿色象限中的内容(至少在我的显示器上是这样)。因此,我让 Opus 5.5 修复了这个问题。我想我能听到 Opus 在所有三个领域为其胜利欢呼。一个有趣的数据点:Opus 5.5 在高努力下的表现与 Fable 5.1 在最大努力下的表现相当... 但它只花费了 1.82 美元,而不是 7.63 美元。 https://preview.redd.it/rtyfm77ei5rh1.png?width=2220&format=png&auto=webp&s=38c06f7f52144c8bddd32441c67907bef871af6f
相似文章
Opus 5.5 发布:性能更优,价格更低
AI模型Opus 5.5现已发布,性能得到增强,成本有所降低。
Opus 5 目前在人工智能分析智能排行榜上排名第一
Opus 5 已荣登 Artificial Analysis Intelligence Leaderboard 榜首,该排行榜通过多个基准测试评估AI模型,包括 Artificial Analysis Intelligence Index 和 AA-Briefcase。
Anthropic 发布 Opus 5.5,价格更低,性能达到 Fable 级别
Anthropic 已发布 Opus 5.5,这是一款新的 AI 模型,价格更低,性能匹配或超越像 Fable 这样的大型模型,特点是改进了沟通能力并与安全节奏努力保持一致。
Opus 5.5 在 Terminal-Bench 4.0 上的成本与性能对比
本文评估了 Opus 5.5 AI 模型在 Terminal-Bench 4.0 基准测试中的成本效益和性能。
Opus 5在3D破坏物理方面优于Fable 5
Opus 5在3D破坏物理基准测试中优于Fable 5