OpenAI表示其模型在长期悬而未决的数学问题上取得了十项进展。AI辅助的发现应达到何种证明标准?
摘要
OpenAI发布了十项关于十年来无进展的数学问题的结果,引发了关于AI辅助证明验证标准的辩论。
OpenAI发布了十项关于至少十年来主要结果无进展的问题的结果,并附有推理过程详解。有趣的问题不在于“AI是否解决了数学”,而是什么样的验证过程能将生成的证明转化为公认的知识。一个模型可以生成看似合理的推理链。只有当专家能够检查假设、复现步骤、区分新意与现有文献,并找出论证可能失败的点时,数学才会进步。对于AI辅助的发现,在结果被视为真实之前,什么是必须的:完整的证明追踪、独立复现、指定的人类审查员、机器可检查的形式化,还是以上所有?来源:OpenAI,2026年8月1日 — https://openai.com/index/ten-advances-in-mathematics/
相似文章
数学和理论计算机科学领域的十项进展
OpenAI 宣布在数学和理论计算机科学的长期未解问题上取得十项成果,这些成果由其下一代模型 Astra 的内部版本实现,证明已用 Lean 形式化。
数学与理论计算机科学的十项进展
OpenAI使用内部模型Astra解决了十个停滞了十多年的数学问题,每个问题花费不到2000美元,并发布了Lean 4形式化证明及一篇论文。这些结果引发了对AI在数学中作用的反思。
OpenAI 未发布模型 Astra 解决十大开放数学难题(34分钟阅读)
OpenAI 未发布的模型 Astra 据称解决了十大开放数学难题,结果已通过 Lean 证书形式化验证,标志着 AI 数学推理能力的重大飞跃。
OpenAI 声称解决了80年前的数学难题——这次是真的
OpenAI 声称其新推理模型自主生成了一个原创数学证明,推翻了保罗·埃尔德什(Paul Erdős)一个80年未解的几何猜想。这标志着人工智能首次解决了一个数学领域核心的著名开放问题。
@OpenAI: 我们下一个主要模型的内部版本在数学和理论计算机科学的长期开放问题上产生了10项新成果……
OpenAI 的内部下一代主要模型在数学和理论计算机科学的长期开放问题上产生了10项新成果,按 GPT-5.6 Sol API 价格计算,使用了价值约 2,000 美元的 token。