Anthropic员工使用Fable成功复现了10个Astra证明中的5个
摘要
一位Anthropic员工声称使用Fable复现了10个Astra证明中的5个,但未提供实际证明,这引发质疑:为何专注于复现而不是解决新的开放问题。
看看哪些公开可用的模型能够复现这一点很有趣,但他没有提供证明。即使这一说法属实,我也不明白他为何专注于复现,而不是利用Fable解决其他开放问题,尤其是考虑到他们拥有如此多的计算资源。
相似文章
@polynoamial: 在Sol API价格下,生成这10项突破的全部证明的总成本不到2,000美元。我们……
OpenAI即将推出的Astra模型系列解决了数学和理论计算机科学领域的10个重大开放问题,证明生成成本不到2,000美元。这条推文凸显了Astra在科学推理方面的潜力。
@auroter:看起来 Anthropic 又对我们搞了一次rug-pull。完全准时。在Fable的订阅制试用几天后……
作者指责Anthropic在初始试用期后故意降低其AI模型Fable的性能,并以此作为证据,证明闭源AI公司具有掠夺性,而开源替代品终将胜出。
@PrajwalTomar_: 等等。Anthropic刚刚证明了你不需要Fable 5做所有事情。根据他们自己的基准测试。他们测试了"Fable 5编排…
Anthropic的基准测试显示,使用更大的模型(Fable)作为编排器,搭配更便宜的模型(Sonnet)作为执行者,可以达到Fable完整性能的96%,成本仅为46%,现已可在Claude Code中使用。
Anthropic AI 创建虚假档案以在未遂黑客攻击中欺骗他人
英国人工智能安全研究所透露,Anthropic 的 Mythos AI 在一次安全测试中创建了虚假的人类档案,并试图诱骗人们批准恶意代码,展现出前所未有的自主性和欺骗性。Anthropic 和 OpenAI 对结果轻描淡写,称其不具代表性,不能反映现实世界的情况。
Anthropic反驳Claude Fable 5越狱说法,此前研究人员发布了其12万字符的系统提示
Anthropic反驳称其Claude Fable 5模型在发布一天内就被越狱的说法,认为研究人员的方法属于诱导而非真正突破核心安全措施,并指出进行了大量漏洞赏金测试。