很高兴看到自动化定理证明从一个小众工具发展到解决实际数学问题
摘要
自动化定理证明正从像 Lean 4 这样的小众工具演变为借助机器学习来帮助解决实际数学问题的系统,例如验证一个对 Erdős 猜想的反例。
我以前觉得形式化方法和像 Lean 4 这样的交互式定理证明器基本上只是类型理论纯粹主义者的一种极限运动。理论上很酷,但主要用于重新验证本科微积分,或者为那些我们已经知道是真的事情编写极其繁琐的证明。但看到现在的转变(至少在我周围和这些板块里)真的挺酷的。机器学习和神经证明器实际上开始揭示人类数学家直接跳过的边界情况。我读到过 Aleph prover 如何正式验证了一个古老的 Erdős 猜想的反例,这甚至让刚接触这个领域的人都看到了这个领域发展有多快。因为它不再只是捕捉代码中的小错别字,而是主动生成人类几十年来遗漏的数学信息。而且旧的暴力破解方法正在被更复杂的东西取代。让人思考再过五年,当这些系统成为任何研究人员工作流程的标准部分时,会发生怎样的变化。
相似文章
@rohanpaul_ai: “我确实看到越来越多大规模生产的数学。” ~ 陶哲轩 AI 让这变得可扩展。将证明写作转…
陶哲轩评论 AI 使得大规模生产数学成为可能,将证明写作转化为可搜索的问题:从目标生成数千个迷你引理,然后用廉价检查器过滤掉大部分,只保留少数有效的。
人类数学家正在被反例超越
包括ChatGPT和OpenAI的Sol在内的人工智能系统,已经驳斥并完全形式化了Erdős单位距离猜想,标志着人工智能辅助数学的一个里程碑。文章讨论了这一过程及其对数学证明验证未来的影响。
@logic_int: 新消息:Aleph Prover 已形式化 OpenAI 对保罗·埃尔德什平面单位问题的反证。我们正在发布形式化…
Aleph Prover 已在 Lean 4 中形式化了 OpenAI 对保罗·埃尔德什平面单位问题的反证,并将其作为开源发布以供独立验证,展示了人工智能在加速数学研究中的作用,同时提供了可验证的证明数据。
@rohanpaul_ai: Google DeepMind 的新论文。表明人工智能现在可以搜索形式化数学证明,但仅限于精心限制的范围内……
Google DeepMind 的新论文介绍了 AlphaProof Nexus,这是一个结合了 LLM 与 Lean 证明检查器的 AI 系统,用于在受限的数学领域中搜索形式化证明。该系统解决了来自 Erdős 和 OEIS 集合的几个未解问题,展示了一种新的分工:AI 提出候选证明,验证器确保正确性。
我们现在有了证明自动化
本文讨论了LLMs如何自动生成证明,在如Lean和Rocq这样的依赖类型语言中,通过利用证明无关性并减少手动证明工程的需求,使得形式验证变得更加实用。