用于自动定理证明的生成语言建模

OpenAI Blog 论文

摘要

# 用于自动定理证明的生成语言建模 来源: [https://openai.com/index/generative-language-modeling-for-automated-theorem-proving/](https://openai.com/index/generative-language-modeling-for-automated-theorem-proving/) OpenAI## 摘要 我们探索了基于 Transformer 的语言模型在自动定理证明中的应用。这项工作的动力来自于一种可能性,即自动定理证明器与人类相比的一个主要局限——原始内容的生成

暂无内容
查看原文
查看缓存全文

缓存时间: 2026/04/20 14:55

# 生成式语言模型在自动定理证明中的应用 来源:https://openai.com/index/generative-language-modeling-for-automated-theorem-proving/ OpenAI ## 摘要 我们探索了基于 transformer 的语言模型在自动定理证明中的应用。这项工作的动力来自于一种可能性:自动定理证明器相比人类的一个主要限制——生成原创数学项——可能可以通过语言模型的生成来解决。我们为 Metamath 形式化语言呈现了一个自动证明器和证明助手 GPT-f,并分析了其性能。GPT-f 发现的新的简短证明被接纳进了主要的 Metamath 库,据我们所知,这是深度学习系统首次为形式化数学社区贡献了被采纳的证明。

相似文章

更好的语言模型及其影响

OpenAI Blog

OpenAI 推出 GPT-2,这是一个拥有 15 亿参数的基于 Transformer 的语言模型,在 40GB 的互联网文本上进行训练,在语言建模基准上达到了最先进的性能,并在阅读理解、翻译、问答和摘要生成等任务上展示了零样本学习能力。出于安全考虑,仅公开发布了较小的模型和技术论文,而非完整的训练模型。

openai-community/gpt2

Hugging Face Models Trending

本页详细介绍了GPT-2,这是一个基于Transformer的语言模型,经过英语文本预训练用于文本生成,可在Hugging Face上获取,并附有使用说明和示例。

用GPT-5.2推进科学与数学

OpenAI Blog

OpenAI发布了GPT-5.2,包括专门针对科学和数学工作优化的GPT-5.2 Pro与GPT-5.2 Thinking变体。该模型在GPQA Diamond(93.2%)和FrontierMath(40.3%)等基准测试中达到了最先进的性能,展现出更强的推理能力,旨在加速物理、化学、生物和数学等领域的科学研究。

首次体验 GPT-5

OpenAI Blog

OpenAI 首次展示 GPT-5,代表了大语言模型的重大进步,具有潜在的范式转变能力。