Opus 5在3D破坏物理方面优于Fable 5
摘要
Opus 5在3D破坏物理基准测试中优于Fable 5
暂无内容
相似文章
@rohanpaul_ai: Fable 5 在 HTML5 物理竞赛中绝对碾压了对手,但成本是 Opus 4.8 的 6 倍、GLM 5.2 的 39 倍……
对四个 AI 模型(Fable 5、Opus 4.8、GLM 5.2、GPT 5.5)生成 HTML5 Canvas 物理演示的比较显示,Fable 5 在质量上优于其他模型,但每次测试的成本显著更高。
Fable 5 基准测试(使用 remotion 视频)
Fable 5 在视频生成基准测试中相比 Opus 4.8 整体有所改进,但 Gemini 3.1 Pro 展现了更多艺术视野,尽管在工具调用和编写有 bug 的代码方面存在问题。
Fable 5 的 ProgramBench 结果已出,性能是 Opus 4.8 的两倍,即使 99% 的运行回退到 4.8
ProgramBench 结果显示,Fable 5 的性能是 Opus 4.8 的两倍,即使在 99% 的运行中回退到 4.8。
@FinanceYF5: 同一个任务给4个模型,Fable 5 全胜,但贵了 Opus 4.8 六倍 任务:3个 HTML5 物理场景,断桥脱轨、峡谷碰撞、怪兽卡车 Fable 5:$3.12,A+,无穿模 GPT 5.5:$1.14,最接近 Fable Opus…
比较了四个AI模型(Fable 5、GPT 5.5、Opus 4.8、GLM 5.2)在三个HTML5物理场景任务上的表现和成本,Fable 5质量最好但价格是Opus的近6倍,质量与价格尚未兼得。
Anthropic 发布 Opus 5,能力‘接近’Fable 5
Anthropic 发布了 Claude Opus 5,据称该模型在能力上接近其更强大的 Fable 5 模型,同时提供更强的网络安全防护和更低的价格。