@MLStreetTalk: 一个看似AI生成的Lean形式化证明,声称是对Collatz猜想的反证,实际上却是利…
摘要
一个由AI生成的Lean形式化证明声称推翻了Collatz猜想,实际上利用了Lean内核中的两个漏洞(现已修复)。Lean创始人Leo de Moura警告说,这种情况还会继续发生,因为AI非常擅长发现健全性漏洞。
查看缓存全文
缓存时间: 2026/07/31 04:48
一个明显由 AI 生成、用 Lean 编写的形式化证明,声称推翻了考拉兹猜想,实际上是在利用 Lean 内核中的一个漏洞!
来自 Lean 创始人 Leo de Moura 的独家消息:
“这种事还会继续发生。AI 非常擅长利用内核中的可靠性漏洞。”
它似乎同时通过了 Lean 官方内核和 Nanoda,因为正好踩中了两个不同的漏洞。
这两处漏洞现在都已被修补——@Leonard41111588.
相似文章
@rohanpaul_ai: Google DeepMind 的新论文。表明人工智能现在可以搜索形式化数学证明,但仅限于精心限制的范围内……
Google DeepMind 的新论文介绍了 AlphaProof Nexus,这是一个结合了 LLM 与 Lean 证明检查器的 AI 系统,用于在受限的数学领域中搜索形式化证明。该系统解决了来自 Erdős 和 OEIS 集合的几个未解问题,展示了一种新的分工:AI 提出候选证明,验证器确保正确性。
@logic_int: 新消息:Aleph Prover 已形式化 OpenAI 对保罗·埃尔德什平面单位问题的反证。我们正在发布形式化…
Aleph Prover 已在 Lean 4 中形式化了 OpenAI 对保罗·埃尔德什平面单位问题的反证,并将其作为开源发布以供独立验证,展示了人工智能在加速数学研究中的作用,同时提供了可验证的证明数据。
@mattshumer_: 又一个长期未解的猜想被AI推翻了。疯狂的是提示词……基本上:- “做一次突破…”
一条推文报道,AI(很可能是GPT-5.6 Pro)推翻了图论中一个长期未解的Dinitz-Garg-Goemans猜想,使用的提示词很简单,比如“做一次突破”。
@VitalikButerin: 许多人声称,在AI辅助的漏洞查找下,安全的代码(因而任何无需信任的东西)将是不可能的…
Vitalik Buterin分享了一个乐观的看法,认为AI辅助的形式化验证是实现安全、无需信任的代码的途径,并链接到他的博客文章,该文章解释了使用Lean进行形式化验证的基础知识。
Claude 找到了雅可比猜想的一个反例
据报道,AI模型Claude找到了一个长期未解决的雅可比猜想的反例,该反例得到了多个LLM的验证,引发了关于AI在数学发现中的作用的讨论。