一个未发布的Anthropic模型在数学最重大未解问题之一上取得进展
摘要
一个未发布的Anthropic模型在黎曼猜想上取得了重大进展,使用60个子代理和3100万个token测试了650个想法,并改进了下界,结果在Lean中形式化。
150多年来,黎曼猜想一直是数学中主要的未解决问题之一。Anthropic并未解决它——但该公司的模型取得的进展比你预期的要多。
查看缓存全文
缓存时间: 2026/08/12 08:18
# 一个未发布的Anthropic模型在数学最大未解难题之一上取得了进展 | TechCrunch
来源:https://techcrunch.com/2026/08/11/an-unreleased-anthropic-model-made-progress-on-one-of-maths-biggest-unsolved-problems/
150多年来,黎曼猜想一直是数学领域最重要的未解难题之一,这个关于素数分布的谜团长期悬而未决。目前,该猜想完整一般性证明的悬赏奖金为100万美元(https://www.claymath.org/millennium/riemann-hypothesis/),至今无人认领。
当代AI模型同样无法证明它——但它们能取得的进展可能远超你的预期,这一发现很可能将重新引发关于当代AI发现新科学和数学思想能力的长期争论。
周一(https://www.anthropic.com/research/riemann-zeta),Anthropic宣布,一个尚未发布的模型在黎曼猜想上取得了重大进展,显著提高了该猜想成立解的下界。
更令人印象深刻的是取得这一进展的方式:一位没有深厚数学训练的Anthropic员工提示模型“认真尝试一下”证明该猜想,然后让模型在接下来的一天半时间里自行协调任务。
总体而言,该模型测试了650种不同的解题思路,协调了60个子代理,总共花费了3100万输出token。
“在60个子代理中,有两个负责提出了关键的数学思想,”论文脚注解释道,“13个为这些代理贡献了思路,30个尝试(但未能)提出新想法,13个作为验证者检查论证的正确性,最后两个帮助撰写了初始论文。”
这一发现得到了Anthropic内部两位数学家的确认,并使用开源证明助手Lean(https://lean-lang.org/)进行了形式化验证。
这是大型语言模型(LLM)带来的一系列数学突破中的最新成果。今年已有多个Erdős问题(https://techcrunch.com/2026/01/14/ai-models-are-starting-to-crack-high-level-math-problems/)被AI模型解决,而更强模型的发布也带来了更令人瞩目的结果。OpenAI最近发布(https://openai.com/index/ten-advances-in-mathematics/)了由其内部“Astra”模型证明的10项重大成果,而Anthropic的另一项工作则否证了长期存在的雅可比猜想(https://www.sciencedaily.com/releases/2026/08/260804034634.htm)。
日益增多的成果在数学界引发了兴奋与担忧。在一份于六月签署的公开声明(https://leidendeclaration.ai/)中,一群著名数学家对AI可能削弱该领域的核心价值表示担忧——尤其是真正的数学证明应“归功于特定作者,由他们为自己的发现赢得荣誉并承担正确性责任”这一标准。
但数学界对于如何对待这些新研究技术仍然存在分歧。在一篇回应上述声明的博客文章中(https://gowers.wordpress.com/2026/07/26/thoughts-about-the-leiden-declaration/),菲尔兹奖得主Timothy Gowers质疑,AI的影响是否可能以更复杂且积极的方式改变数学。
“如果我们进入一个数学定理不再与数学家相关联的世界,也许这并不会比星星不以天文学家命名、而且大多数星星根本没有名字更有问题,”Gowers写道。
*当您通过我们文章中的链接购买商品时,我们可能会获得少量佣金(https://techcrunch.com/techcrunch-affiliate-monetization-standards/)。这不会影响我们的编辑独立性。*
Russell Brandom自2012年起报道科技行业,重点关注平台政策与新兴技术。他曾在The Verge和Rest of World工作,并为Wired、The Awl和MIT的Technology Review撰稿。可通过[email protected]或Signal(412-401-5489)与他联系。
查看简介(https://techcrunch.com/author/russell-brandom/)
相似文章
@AnthropicAI:我们让一个未发布的研究版Claude尝试攻克黎曼猜想。它没有解决,但它……
Anthropic未发布的研究版Claude将满足黎曼猜想的黎曼ζ函数零点的比例下界从41.6%提高到67.2%,展示了AI数学能力的快速进步。
OpenAI 未发布模型 Astra 解决十大开放数学难题(34分钟阅读)
OpenAI 未发布的模型 Astra 据称解决了十大开放数学难题,结果已通过 Lean 证书形式化验证,标志着 AI 数学推理能力的重大飞跃。
数学与理论计算机科学的十项进展
OpenAI使用内部模型Astra解决了十个停滞了十多年的数学问题,每个问题花费不到2000美元,并发布了Lean 4形式化证明及一篇论文。这些结果引发了对AI在数学中作用的反思。
OpenAI模型解决困扰人类80年的著名数学难题
OpenAI的AI模型推翻了埃尔德什单位距离猜想(Erdős unit distance conjecture),这是一个困扰数学家80年的离散几何著名难题,标志着AI数学领域的里程碑。
关于Anthropic新成果的一些笔记
Anthropic发布了两篇使用其未发布的Claude Mythos模型进行的密码分析论文,攻击了HAWK签名方案和简化轮数的AES,凸显了AI有效结合现有密码工具的能力。