ai-for-math

标签

Cards List
#ai-for-math

从符号感知到逻辑推理:一个引导语言模型进行几何推理的框架

arXiv cs.AI ↗ · 2026-09-11 缓存

本文提出一个框架,通过几何视觉解析和符号求解来增强大型语言模型,使其在复杂几何问题上达到先进多模态模型的水平,并使用来自2025年中国中考的新基准进行评估。

0 人收藏 0 人点赞
#ai-for-math

供职于Peking College Hospital的神经外科住院医师使用GPT 5.6 Sol证明了一个已有二十年历史的数学猜想,该猜想是数值线性代数中一个重大问题的基础——这一切都是为了他的经颅超声研究。

Reddit r/singularity ↗ · 2026-08-14

Peking College Hospital的一位神经外科住院医师使用GPT 5.6 Sol证明了一个已有二十年历史的数值线性代数猜想,以支持经颅超声研究。

0 人收藏 0 人点赞
#ai-for-math

@sophiamyang: 介绍 Leanstral 1.5 一个119B(6B活跃)的开放模型,用于Lean 4的形式化证明工程:在miniF2F上达到100% 587/672…

X AI KOLs Following ↗ · 2026-07-03 缓存

介绍 Leanstral 1.5,一个119B参数(6B活跃)的开放模型,用于Lean 4的形式化证明工程,在miniF2F上达到100%,在PutnamBench和FATE基准测试上达到最先进分数,并发现了开源仓库中先前未知的漏洞。

0 人收藏 0 人点赞
#ai-for-math

我的嵌入表示是否反映了 $A = B$?评估嵌入模型中的数学等价性

arXiv cs.CL ↗ · 2026-06-24 缓存

本文介绍了MELD数据集,用于评估文本嵌入模型是否能够捕捉不同术语之间的数学等价性,并发现当前模型无法做到。本文提出了一种对比学习方法,用于对齐非正式和正式的数学表述,从而在非正式-正式检索任务以及自然语言任务上均取得改进。

0 人收藏 0 人点赞
#ai-for-math

用于预测有限群可解性的图神经网络

arXiv cs.LG ↗ · 2026-06-09 缓存

本文应用图神经网络预测有限群的可解性,展示了人工智能方法解决群论中经典问题的能力。

0 人收藏 0 人点赞
#ai-for-math

OpenAI声称其通用推理模型找到了Erdos单位距离猜想的一个反例 [D]

Reddit r/MachineLearning ↗ · 2026-05-20

OpenAI声称其通用推理模型发现了Erdős平面单位距离问题中一个猜想上界的反例,并生成了一个经数学家审阅的证明。

0 人收藏 0 人点赞
#ai-for-math

Lean Refactor:基于智能体策略搜索的多目标可控证明优化

Hugging Face Daily Papers ↗ · 2026-05-18 缓存

Lean Refactor 提出了一种检索增强的智能体框架,用于对 Lean 证明进行多目标、可控且鲁棒的版本重构,实现了显著的压缩和编译时间减少。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈