OpenAI o3 和 o4-mini 系统卡

OpenAI Blog 模型

摘要

OpenAI 发布了 o3 和 o4-mini 模型的系统卡,这些模型具有先进的推理能力,结合了工具集成(网络浏览、Python、图像分析等),并根据 OpenAI 的 Preparedness Framework v2 在生物、网络安全和 AI 自我改进等领域进行了安全性评估。

OpenAI o3 和 OpenAI o4-mini 将最先进的推理能力与完整的工具功能相结合——网络浏览、Python、图像和文件分析、图像生成、画布、自动化、文件搜索和记忆。
查看原文
查看缓存全文

缓存时间: 2026/04/20 14:48

# OpenAI o3 和 o4-mini 系统卡 来源:https://openai.com/index/o3-o4-mini-system-card/ OpenAI o3 和 OpenAI o4-mini 结合了最先进的推理能力与完整的工具功能——网页浏览、Python、图像和文件分析、图像生成、画布、自动化、文件搜索和记忆。这些模型在解决复杂的数学、编码和科学挑战方面表现出色,同时展现出强大的视觉感知和分析能力。这些模型在思维链中使用工具来增强其功能;例如,在思考过程中裁剪或转换图像、搜索网页或使用 Python 分析数据。 OpenAI o 系列模型使用大规模强化学习在思维链上训练。这些先进的推理能力为改进我们模型的安全性和稳健性提供了新的途径。特别是,我们的模型可以通过深思熟虑的对齐,在回应可能不安全的提示时,在上下文中对我们的安全政策进行推理。 这是在我们《预防框架》版本 2(https://openai.com/index/updating-our-preparedness-framework/)下发布的首个版本和系统卡。OpenAI 安全咨询小组 (SAG) 审查了我们预防框架评估的结果,并确定 OpenAI o3 和 o4-mini 在我们三个追踪类别中的任何一个都未达到"高"阈值:生物和化学能力、网络安全和 AI 自我改进。我们在下文中详细说明这些评估,并提供我们在这些领域风险缓解工作的最新进展。 阅读 o3 和 o4-mini 系统卡附录:Codex(https://openai.com/index/o3-o4-mini-codex-system-card-addendum/)。 阅读 o3 和 o4-mini 系统卡附录:OpenAI o3 Operator(https://openai.com/index/o3-o4-mini-system-card-addendum-operator-o3/)。

相似文章

OpenAI o3-mini 系统卡

OpenAI Blog

OpenAI 发布了 o3-mini 系统卡,记录了其通过强化学习训练的高级推理模型的安全评估和风险评估。该模型在某些基准测试中达到了最先进的安全性能,在 OpenAI 的《准备框架》下总体被列为中等风险。

OpenAI o1 系统卡

OpenAI Blog

OpenAI 发布了 o1 系统卡,详细介绍了 o1 和 o1-mini 模型的安全评估和准备框架评估。这些模型采用思路链推理,并通过大规模强化学习进行训练,以提高安全性和稳健性。

OpenAI o3 和 o4-mini 发布

OpenAI Blog

OpenAI 发布了最新的推理模型 o3 和 o4-mini,可以自主访问和组合所有 ChatGPT 工具(网络搜索、代码执行、图像分析、图像生成)。o3 在编程、数学和科学基准测试中达到业界最先进水平,主要错误比 o1 少 20%,而 o4-mini 则提供成本和速度优化的高效推理能力。

OpenAI o3-mini

OpenAI Blog

OpenAI 发布 o3-mini,一款成本高效的推理模型,具备强大的 STEM 能力,现已在 ChatGPT 和 API 中可用,支持函数调用、结构化输出和三个推理力度级别。该模型在数学和编码方面与 o1 性能相当,同时更快且更便宜,免费计划用户首次获得推理模型的访问权限。