automated-reasoning

标签

Cards List
#automated-reasoning

ProofEvolve:用于形式化自动定理证明的神经符号进化

arXiv cs.AI · 2026-08-28 缓存

ProofEvolve是一个神经符号框架,通过使用神经模型进化形式化验证的证明结构来增强自动定理证明,通过保留来自未完成尝试的验证知识,在Lean基准测试中实现高求解率。

0 人收藏 0 人点赞
#automated-reasoning

问题本身即问题:迈向可扩展的数学发现

arXiv cs.AI · 2026-08-19 缓存

该论文介绍了FAR,一种人机发现范式,它自动化了从文献中搜索数学问题的过程,并在组合数学的试点中展示了其在识别猜想和解决方案方面的有效性。

0 人收藏 0 人点赞
#automated-reasoning

Theo Conjecture 解决了35年前的数学问题,发现了一个无人预见的项

Hacker News Top · 2026-07-29 缓存

一个名为 Theo Conjecture 的AI系统,利用了大型语言模型,解决了一个35年前的图论问题,该问题最初由数学家 Paul Erdős 提出,发现了一个意想不到的项。该系统通过循环提出、测试和修正数学想法来工作。

0 人收藏 0 人点赞
#automated-reasoning

Lean 4 grind中的学习型干预

arXiv cs.LG · 2026-07-28 缓存

一篇研究论文,介绍了一种故障触发级联方法,用于将机器学习安全地集成到Lean 4的grind策略中,实现了效率提升并解决了之前无法解决的证明,且没有回归问题。

0 人收藏 0 人点赞
#automated-reasoning

OpenProver: 基于 Lean 4 的智能体和交互式定理证明

arXiv cs.AI · 2026-07-13 缓存

OpenProver 是一个开源系统,利用 Lean 4 进行 LLM 驱动的自动定理证明,采用规划器-工作器-验证器架构,并支持自主和交互两种模式。它实现了数学证明搜索中的可重复评估和人机协同。

0 人收藏 0 人点赞
#automated-reasoning

RMA:面向研究级数学问题的智能体系统

arXiv cs.AI · 2026-05-25 缓存

Research Math Agents (RMA) 是一个用于研究级数学问题自动推理的智能体框架,在 First Proof 基准测试中取得最先进结果,解决了10个问题中的8个,优于 GPT-5.2R 和 Aletheia 等强基线。

0 人收藏 0 人点赞
#automated-reasoning

形式化猜想:数学中可验证发现的开放且持续演进的基准

arXiv cs.AI · 2026-05-14 缓存

本文介绍了形式化猜想(Formal Conjectures),这是一个持续演进的基准,包含2615个在 Lean 4 中形式化的数学陈述,其中包括用于证明发现的开放研究猜想和用于自动形式化的已解决问题,旨在零污染地评估自动推理系统。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈