推出 GPT-4.5

OpenAI Blog 模型

摘要

OpenAI 推出了 GPT-4.5,这是他们迄今为止最大、最强的聊天模型,作为研究预览版提供给 Pro 用户和开发者使用。该模型通过扩展计算和数据来推进无监督学习,相比 GPT-4o 展现出更好的事实准确性、更少的幻觉现象,以及对人类意图的更深层理解。

我们发布了 GPT-4.5 的研究预览版——这是我们迄今为止最大、最强的聊天模型。GPT-4.5 是在预训练和后训练规模扩展方面的又一次进步。
查看原文
查看缓存全文

缓存时间: 2026/04/20 14:54

# 介绍 GPT-4.5 来源:https://openai.com/index/introducing-gpt-4-5/ 我们最强大的 GPT 模型的研究预览版。向全球 Pro 用户和开发者开放。 我们发布了 GPT-4.5 的研究预览版——这是我们迄今为止最大、最好的对话模型。GPT-4.5 在扩展预训练和后训练方面迈出了重要一步。通过扩展无监督学习,GPT-4.5 在不需要推理的情况下,增强了识别模式、建立关联和产生创意洞察的能力。 早期测试表明,与 GPT-4.5 的交互感觉更加自然。它更广泛的知识库、改进的用户意图理解能力和更高的"情商"使其在改进写作、编程和解决实际问题等任务中都很有用。我们也预期它的幻觉问题会更少。 我们以研究预览版的形式分享 GPT-4.5,以更好地了解它的优势和局限性。我们仍在探索它的功能,并很期待看到人们以我们可能没有想到的方式使用它。 我们通过扩展两个互补的范式来推进人工智能能力:无监督学习和推理。这些代表了智能的两个轴线。 1. 无监督学习增强了世界模型的准确性和直觉。GPT-3.5、GPT-4 和 GPT-4.5 等模型推进了这一范式。 2. 扩展推理 (https://openai.com/index/learning-to-reason-with-llms/),另一方面,教导模型在响应前进行思考和生成思维链,使它们能够解决复杂的 STEM 或逻辑问题。OpenAI o1 和 OpenAI o3-mini 等模型推进了这一范式。 GPT-4.5 是通过扩展计算和数据,以及架构和优化创新来扩展无监督学习的一个例子。GPT-4.5 在 Microsoft Azure AI 超级计算机上进行了训练。结果是一个模型具有更广泛的知识和对世界的更深层理解,在各种广泛的主题上减少了幻觉,提高了可靠性。 ##### SimpleQA 准确率(越高越好) ##### SimpleQA 幻觉率(越低越好) 37.1%61.8%44%80.3%幻觉率 *SimpleQA 在直接但具有挑战性的知识问题上测量大型语言模型 (LLM) 的事实准确性。* 随着我们扩展模型并解决更复杂的问题,教导它们更深入地理解人类的需求和意图变得越来越重要。对于 GPT-4.5,我们开发了新的可扩展技术,使用来自较小模型的数据来训练更大、更强大的模型成为可能。这些技术改进了 GPT-4.5 的可控性、对微妙含义的理解,以及自然对话能力。 ##### 与人类测试者的对比评估 56.8%63.2%57.0%GPT-4.5 相对于 GPT-4o 的胜率 *人类偏好衡量的是测试者更喜欢 GPT-4.5 而不是 GPT-4o 的查询百分比。* 将对世界的深刻理解与改进的协作相结合,产生了一个模型,能够在温暖和直观的对话中自然地整合想法,更好地适应人类协作。GPT-4.5 对人类意思的理解更深,能够以更细微的方式和更高的"情商"解释微妙的线索或隐含的期望。GPT-4.5 还表现出更强的审美直觉和创意能力。它擅长帮助写作和设计。 GPT-4.5 不在响应前进行思考,这使其优势与 OpenAI o1 等推理模型有很大不同。与 OpenAI o1 和 OpenAI o3-mini 相比,GPT-4.5 是一个更通用、更聪明的通才模型。我们相信推理将是未来模型的核心能力,两种扩展方法——预训练和推理——将互补。随着 GPT-4.5 等模型通过预训练变得更聪明、更有知识,它们将为推理和工具使用代理提供更强有力的基础。 每次模型能力的提升也是使模型更安全的机会。GPT-4.5 采用新的监督技术进行训练,这些技术与传统的监督微调 (SFT) 和强化学习从人类反馈 (RLHF) 方法相结合,类似于 GPT-4o 所使用的方法。我们希望这项工作能够为对齐更强大的未来模型奠定基础。 为了对我们的改进进行压力测试,我们在部署前进行了一系列安全测试,符合我们的准备框架 (https://cdn.openai.com/openai-preparedness-framework-beta.pdf)。我们发现扩展 GPT 范式在我们的所有评估中都提高了能力。我们在随附的系统卡 (https://openai.com/index/gpt-4-5-system-card/) 中发布了这些评估的详细结果。 从今天开始,ChatGPT Pro 用户将能够在网络、移动和桌面的模型选择器中选择 GPT-4.5。我们将在下周开始向 Plus 和 Team 用户推出,随后的一周向 Enterprise 和 Edu 用户推出。 GPT-4.5 可以通过搜索访问最新信息,支持文件和图像上传,并且可以使用画布来处理写作和代码。但是,GPT-4.5 目前不支持 ChatGPT 中的多模态功能,如语音模式、视频和屏幕共享。未来,我们将致力于简化用户体验,使 AI 对你"无缝工作"。 我们还在向所有付费使用层 (https://platform.openai.com/docs/guides/rate-limits#usage-tiers) 的开发者预览 Chat Completions API、Assistants API 和 Batch API 中的 GPT-4.5。该模型支持函数调用、结构化输出、流式传输和系统消息等关键功能。它还通过图像输入支持视觉能力。 根据早期测试,开发者可能会发现 GPT-4.5 对于受益于其更高情感智能和创意的应用特别有用——例如写作帮助、通讯、学习、辅导和头脑风暴。它在代理规划和执行方面也表现出很强的能力,包括多步骤编码工作流和复杂任务自动化。 GPT-4.5 是一个非常大的、计算密集型的模型,使其成本更高 (https://openai.com/api/pricing/) 且不是 GPT-4o 的替代品。因此,我们正在评估是否继续在 API 中长期提供它,以平衡当前能力的支持与构建未来模型。我们期待在真实世界的设置中了解更多关于它的优势、能力和潜在应用。如果 GPT-4.5 为你的用例提供了独特的价值,你的反馈 (https://community.openai.com/t/gpt-4-5-is-live-in-the-api/1131571) 将对指导我们的决定起到重要作用。 每一个计算能力数量级的提升都会带来新的能力。GPT-4.5 是一个处于无监督学习前沿的模型。我们继续对社区发现新能力和意外用途的创意感到惊讶。有了 GPT-4.5,我们邀请你与我们一起探索无监督学习的前沿,并发现新的能力。 下面,我们提供了 GPT-4.5 在标准学术基准上的结果,以说明它在传统上与推理相关的任务上的当前性能。即使纯粹通过扩展无监督学习,GPT-4.5 相比 GPT-4o 等之前的模型也表现出了有意义的改进。尽管如此,我们期待通过这个发布获得更完整的 GPT-4.5 能力图景,因为我们认识到学术基准并不总是反映真实的实用价值。 *显示的数字代表最佳内部性能。*

相似文章

介绍 GPT-5.4

OpenAI Blog

# 介绍 GPT-5.4 Source: [https://openai.com/index/introducing-gpt-5-4/](https://openai.com/index/introducing-gpt-5-4/) 今天,我们在 ChatGPT(作为 GPT‑5\.4 Thinking)、API 和 Codex 中发布 **GPT‑5\.4**。它是我们用于专业工作的最强大、最高效的前沿模型。我们还将在 ChatGPT 和 API 中发布 **GPT‑5\.4 Pro**,适合希望在复杂任务上获得极致性能的用户。GPT‑5\.4 融合了我们近期在推理、编码和智能体方面的最佳进展。

OpenAI GPT-4.5 System Card

OpenAI Blog

# GPT-4.5 系统卡 来源:[https://openai.com/index/gpt-4-5-system-card/](https://openai.com/index/gpt-4-5-system-card/) 我们正在发布 OpenAI GPT-4.5 的研究预览版,这是我们迄今为止规模最大、知识最丰富的模型。GPT-4.5 建立在 GPT-4o 的基础上,进一步扩展了预训练规模,设计目标是比我们强大的 STEM 焦点推理模型具有更广泛的适用性。我们采用新的监督技术结合传统方法(如监督微调 (SFT))来训练该模型

推出 GPT-4o 及更多工具供 ChatGPT 免费用户使用

OpenAI Blog

# 推出 GPT-4o 及更多工具供 ChatGPT 免费用户使用 来源: [https://openai.com/index/gpt-4o-and-more-tools-to-chatgpt-free/](https://openai.com/index/gpt-4o-and-more-tools-to-chatgpt-free/) OpenAI 我们推出了最新的旗舰模型,并在 ChatGPT 中为更多功能提供免费访问。根据我们的使命,我们致力于推进人工智能技术的发展,并确保它对所有人都是可访问和有益的。今天我们推出最新的模型 GPT-4o,并将开始推出

ChatGPT 介绍

OpenAI Blog

OpenAI 推出 ChatGPT,这是一个基于 GPT-3.5 的对话型 AI 模型,通过人类反馈强化学习(RLHF)进行微调。该模型旨在回答后续问题、承认错误和拒绝不当请求,在研究预览期间提供免费访问。

Introducing GPT‑Live

Simon Willison's Blog

OpenAI 终于升级了驱动 ChatGPT 语音模式的模型,推出了 GPT‑Live。它能够在保持对话流畅的同时,将复杂任务委托给 GPT‑5.5。新模型的能力远超此前基于 GPT‑4o 的语音模式。