Fable 5.1 不同凡响!
摘要
在科学工作中表现卓越,基于用户体验,超越了 GPT 5.6 和 Opus 5。
我非常喜欢 Fable 5。我尝试了 Fable 5.1,它非常出色!它好到了另一个层次!我会说它是科学工作的最佳模型。我试过 GPT 5.6,它写得很好,但远不如 Fable 5.1。根据 Antropic 的基准测试,Opus 5 应该比 Fable 5 更好,但我的经验却相反。
相似文章
@hqmank: Fable 5 > GPT-5.6 Sol,改变我的想法。
一位用户声称Fable 5的性能优于GPT-5.6,并挑战其他人提出不同意见。
Fable 5 基准测试(使用 remotion 视频)
Fable 5 在视频生成基准测试中相比 Opus 4.8 整体有所改进,但 Gemini 3.1 Pro 展现了更多艺术视野,尽管在工具调用和编写有 bug 的代码方面存在问题。
@heyshrutimishra: 1. Fable 5 在几乎所有重要基准测试中都是最先进的。软件工程。科学。知识工作。视觉……
Anthropic 发布了 Fable 5,声称它在软件工程、科学、知识工作和视觉等关键基准测试中达到了最先进水平,超过了所有先前可用的模型。
Fable 5 的 ProgramBench 结果已出,性能是 Opus 4.8 的两倍,即使 99% 的运行回退到 4.8
ProgramBench 结果显示,Fable 5 的性能是 Opus 4.8 的两倍,即使在 99% 的运行中回退到 4.8。
Opus 5.5 在 ArtificialAnalysis.ai 的所有三项性能指标中占主导地位
Opus 5.5 在 ArtificialAnalysis.ai 的所有三项性能指标中占主导地位,并提供了相较于 Fable 5.1 的高性价比替代选择。