Fable 5不再是第一了!?根据公司公告,Sakana的Fugu在某些情况下击败了它
摘要
根据Sakana AI的公司博客,其新模型Fugu在LiveCodeBench和Terminal Bench 2.1上以微小的优势超越了Fable 5,尽管结果尚未得到独立确认。
Sakana.ai的基准测试显示,Fugu在LiveCodeBench(高出3%)和Terminal Bench 2.1(高出约1.7%)上至少击败了Fable 5,根据其公司博客官方发布:https://sakana.ai/fugu-release/ 这些数字尚未得到独立确认。
相似文章
Sakana Fugu在Claude被封禁后推出,LiveCodeBench得分93.2(3分钟阅读)
Sakana AI推出多模型编排API Fugu,此前Anthropic暂停了对Claude Fable 5和Mythos 5的访问。Fugu Ultra在LiveCodeBench上获得93.2分,表现优于Fable 5,起价为每百万输入代币5美元。
Fable 5 位居 KernelBench 榜首。Jack Clark 称其为“RSI 循环的起点”
Fable 通过编写高效 CUDA 超内核(megakernel),实现 18.71 倍加速,登上 KernelBench-Mega 榜首,标志着 AI 研发向递归自我改进迈出一步。
Fable 5在96小时内销声匿迹,四天后一个MIT许可的模型夺走了它的竞技场桂冠
Anthropic的Fable 5模型因出口管制在96小时后消失,几天后,Z.ai以MIT许可证开源了GLM-5.2,在Design Arena上超越了Fable 5。这凸显出最好的模型并不总是最容易获取的,将焦点从基准测试转向了可用性和许可。
Fable 5 Is Dead. And Honestly? We Might Be Better Off
美国政府迫使Anthropic在发布仅数天后撤下了其最强大的模型Fable 5。OpenRouter的新基准测试显示,融合的预算模型面板能以一半的成本达到或超过Fable 5的性能,引发了对前沿模型价值的质疑。
@hqmank: Fable 5 > GPT-5.6 Sol,改变我的想法。
一位用户声称Fable 5的性能优于GPT-5.6,并挑战其他人提出不同意见。