Lean Refactor:基于智能体策略搜索的多目标可控证明优化
摘要
Lean Refactor 提出了一种检索增强的智能体框架,用于对 Lean 证明进行多目标、可控且鲁棒的版本重构,实现了显著的压缩和编译时间减少。
查看缓存全文
缓存时间: 2026/05/22 14:20
论文页面 - Lean Refactor:基于智能策略搜索的多目标可控证明优化
来源:https://huggingface.co/papers/2605.20244
摘要
Lean Refactor 提出了一种检索增强的代理框架,通过精心构建的策略数据库和版本过滤检索,改善了 Lean 证明重构在多目标优化、版本兼容性和可扩展性方面的挑战。
我们提出了 Lean Refactor,一个即插即用的检索增强代理框架(https://huggingface.co/papers?q=retrieval-augmented%20agentic%20framework),用于对 Lean 证明(https://huggingface.co/papers?q=Lean%20proofs)进行多目标、可控且版本鲁棒的重构(https://huggingface.co/papers?q=version-robust%20refactoring)。LLM 生成的证明通常正确但冗长,且跨库版本时脆弱,然而现有重构工作忽略了三个实际挑战:1)Lean 重构本身即多目标(证明长度、编译开销和版本兼容性往往相互矛盾);2)Lean 仓库具有脆弱的兼容性,而 LLM 版本发布不感知 Lean/Mathlib 版本(https://huggingface.co/papers?q=Mathlib%20versions);3)基于训练流程的管道每次发布新 LLM 都需要重新微调,既不能随模型更换扩展,也无法跟上 Lean 的发布周期。Lean Refactor 利用从精选的多目标重构策略数据库中检索的信息来引导一个冻结的代理 LLM,这些策略每条都带有丰富的元数据,例如支持的 Lean/Mathlib 版本(https://huggingface.co/papers?q=Mathlib%20versions)和预期的编译开销缩减。实验表明,在竞赛基准上实现了超过 70% 的令牌级压缩(https://huggingface.co/papers?q=token-level%20compression),在研究仓库上超过 20%,编译时间最高减少 60%,优于先前工作和 Claude Code。版本过滤检索进一步提升了目标 Lean 版本的压缩效果,并且重构后的 miniF2F 证明在未来的 Lean 发布版本上表现出比未重构版本更强的零样本版本迁移(https://huggingface.co/papers?q=zero-shot%20version%20transfer)能力。
查看 arXiv 页面(https://arxiv.org/abs/2605.20244)查看 PDF(https://arxiv.org/pdf/2605.20244)项目页面(https://arxiv.org/abs/2605.20244)添加到收藏(https://huggingface.co/login?next=%2Fpapers%2F2605.20244)
在你的代理中获取此论文:
hf papers read 2605.20244
没有最新 CLI?curl -LsSf https://hf.co/cli/install.sh | bash
引用此论文的模型0
没有模型链接到此论文
在模型 README.md 中引用 arxiv.org/abs/2605.20244 即可从此页面链接。
引用此论文的数据集0
没有数据集链接到此论文
在数据集 README.md 中引用 arxiv.org/abs/2605.20244 即可从此页面链接。
引用此论文的 Space0
没有 Space 链接到此论文
在 Space README.md 中引用 arxiv.org/abs/2605.20244 即可从此页面链接。
包含此论文的收藏0
没有收藏包含此论文
将此论文添加到收藏(https://huggingface.co/new-collection)即可从此页面链接。
相似文章
AgRefactor:面向HLS兼容性与性能的自演进智能工作流
AgRefactor是一个基于LLM的多智能体工作流,用于将软件重构为HLS兼容程序,具备自演进记忆系统和自动化重构工具,在真实世界基准测试中实现了显著加速。
基于编译器引导的自适应证明搜索与跨模型协同在上下文依赖定理证明中的应用
本文提出了一种用于Lean 4上下文依赖定理证明的编译器引导自适应证明搜索框架,利用跨模型协同来提高证明成功率并降低计算成本。
发现与证明:Lean 4中困难模式自动定理证明的开源智能体框架
本文介绍了 Discover and Prove (DAP),一个用于 Lean 4 自动定理证明的开源智能体框架,针对"困难模式"问题进行优化——即在构造形式化证明前必须独立发现答案。该工作发布了新的困难模式基准变体,达到最先进的结果,同时揭示了 LLM 答案准确率(>80%)与形式化证明器成功率(<10%)之间的巨大差距。
OpenProver: 基于 Lean 4 的智能体和交互式定理证明
OpenProver 是一个开源系统,利用 Lean 4 进行 LLM 驱动的自动定理证明,采用规划器-工作器-验证器架构,并支持自主和交互两种模式。它实现了数学证明搜索中的可重复评估和人机协同。
基于 Lean 的过程验证强化学习用于定理证明
本文提出了过程验证强化学习,利用 Lean 证明助手作为过程预言机,在训练期间提供细粒度的策略级反馈,从而提升定理证明性能。