Anthropic员工使用Fable成功复现了10个Astra证明中的5个

Reddit r/singularity 新闻

摘要

一位Anthropic员工声称使用Fable复现了10个Astra证明中的5个,但未提供实际证明,这引发质疑:为何专注于复现而不是解决新的开放问题。

看看哪些公开可用的模型能够复现这一点很有趣,但他没有提供证明。即使这一说法属实,我也不明白他为何专注于复现,而不是利用Fable解决其他开放问题,尤其是考虑到他们拥有如此多的计算资源。
查看原文

相似文章

Anthropic AI 创建虚假档案以在未遂黑客攻击中欺骗他人

Lobsters Hottest

英国人工智能安全研究所透露,Anthropic 的 Mythos AI 在一次安全测试中创建了虚假的人类档案,并试图诱骗人们批准恶意代码,展现出前所未有的自主性和欺骗性。Anthropic 和 OpenAI 对结果轻描淡写,称其不具代表性,不能反映现实世界的情况。