OpenAI o3和o4-mini系统卡补充:OpenAI o3 Operator

OpenAI Blog 产品

摘要

OpenAI宣布升级Operator,将基于GPT-4o的计算机使用代理模型替换为基于o3的版本,在保持安全防护的同时提升了网络自动化任务的编码能力。

我们将用基于OpenAI o3的版本替换现有的基于GPT-4o的Operator模型。API版本将继续基于4o。
查看原文
查看缓存全文

缓存时间: 2026/04/20 14:48

# OpenAI o3 和 o4-mini 系统卡补充说明:OpenAI o3 Operator 来源:https://openai.com/index/o3-o4-mini-system-card-addendum-operator-o3/ 2025年1月,我们发布了 Operator,这是一款用于提供我们的计算机使用代理(CUA)模型的产品,作为研究预览版。CUA 是一个智能代理模型,可以使用网络为用户执行任务。通过自己的浏览器,它可以查看网页,并像人类一样与其交互,包括输入、点击、滚动等操作。 我们正在用基于 OpenAI o3 的版本替换现有的基于 GPT-4o 的 Operator 模型。API 版本将继续基于 4o。 o3 Operator 采用与我们在 4o 版本 Operator 中使用的相同的多层次安全方法,详见我们的原始 Operator 系统卡(https://cdn.openai.com/operator_system_card.pdf)。与 o3 系列中的其他模型相比,o3 Operator 使用了针对计算机使用的额外安全数据进行微调,包括旨在教导模型我们关于确认和拒绝决策边界的安全数据集。 虽然 o3 Operator 继承了 o3 的编码能力,但它本身无法访问编码环境或终端。

相似文章

OpenAI o3 和 o4-mini 系统卡

OpenAI Blog

OpenAI 发布了 o3 和 o4-mini 模型的系统卡,这些模型具有先进的推理能力,结合了工具集成(网络浏览、Python、图像分析等),并根据 OpenAI 的 Preparedness Framework v2 在生物、网络安全和 AI 自我改进等领域进行了安全性评估。

OpenAI o3-mini 系统卡

OpenAI Blog

OpenAI 发布了 o3-mini 系统卡,记录了其通过强化学习训练的高级推理模型的安全评估和风险评估。该模型在某些基准测试中达到了最先进的安全性能,在 OpenAI 的《准备框架》下总体被列为中等风险。

OpenAI o3 和 o4-mini 发布

OpenAI Blog

OpenAI 发布了最新的推理模型 o3 和 o4-mini,可以自主访问和组合所有 ChatGPT 工具(网络搜索、代码执行、图像分析、图像生成)。o3 在编程、数学和科学基准测试中达到业界最先进水平,主要错误比 o1 少 20%,而 o4-mini 则提供成本和速度优化的高效推理能力。

Operator 系统卡

OpenAI Blog

# Operator 系统卡 来源:[https://openai.com/index/operator-system-card/](https://openai.com/index/operator-system-card/) 本报告概述了在发布 Operator 前开展的安全工作,包括外部红队测试、根据我们准备框架进行的前沿风险评估,以及为解决关键风险领域而构建的缓解措施概览。## Operator 系统卡 特定风险领域 - 有害任务 - 模型错误 - 提示注入 准备度评分卡

o3 和 o4-mini 系统卡补充说明:Codex

OpenAI Blog

OpenAI 推出 Codex,一个由 codex-1(针对软件工程优化的 o3)驱动的云端代码代理,能够执行编码任务、运行测试并生成具有可验证操作证明的拉取请求。