Codex 升级功能介绍

OpenAI Blog 模型

摘要

OpenAI 发布 GPT-5-Codex,这是 GPT-5 的优化版本,专为代理软件工程任务设计,可通过 API 和 Codex 集成开发环境获取,具有改进的代码审查功能和长形式任务执行能力。

Codex 现在速度更快,可靠性更高,在实时协作和独立完成任务方面表现更好,无论你在终端、IDE、网页还是手机上开发都能使用。
查看原文
查看缓存全文

缓存时间: 2026/04/20 14:49

# Codex 升级功能介绍 来源:https://openai.com/index/introducing-upgrades-to-codex/ ***2025年9月23日更新****:GPT‐5‐Codex 现已向通过 API 密钥使用 Codex 的开发者提供(除了通过 ChatGPT 订阅使用 Codex 的开发者)。GPT‐5 Codex 的价格与 GPT‐5 相同,仅在 Responses API 中提供。底层模型快照将定期更新。查看 Codex**开发者文档**(在新窗口打开)(http://platform.openai.com/docs/models/gpt-5-codex) 和**更新日志**(在新窗口打开)(https://developers.openai.com/codex/changelog) 了解更多详情。 今天,我们发布 GPT‐5‐Codex——一个为 Codex 中的代理式编程进一步优化的 GPT‐5 版本。GPT‐5‐Codex 经过训练,专注于现实世界的软件工程工作;它在快速交互式编程和独立完成长期复杂任务上都表现出色。其代码审查功能可以在问题上线前捕获关键错误。GPT‐5‐Codex 可在你使用 Codex 的任何地方使用——它是云端任务和代码审查的默认选择,开发者也可以通过 Codex CLI 和 IDE 扩展选择在本地任务中使用它。 自去年4月我们首次推出 Codex CLI(在新窗口打开)(https://github.com/openai/codex) 和5月推出 Codex (https://openai.com/index/introducing-codex/) Web 版本以来,Codex 已稳步演进成更高效的编程协作工具。两周前,我们将 Codex 统一为单一产品体验,通过你的 ChatGPT 账户连接,让你能在本地环境和云端之间无缝移动工作,不会丢失上下文。Codex 现在支持在你开发的任何地方运行——在你的终端或 IDE、Web 上、GitHub 中,甚至在 ChatGPT iOS 应用中。Codex 包含在 ChatGPT Plus、Pro、Business、Edu 和 Enterprise 计划中。 通过这些更新,Codex 更接近我们一直以来的目标——一个理解你的需求、与你并肩工作、能可靠地承担团队任务的队友。 ## GPT‐5‐Codex:为代理式编程优化 GPT‐5‐Codex 是一个为 Codex 中的代理式软件工程进一步优化的 GPT‐5 版本。它经过复杂现实工程任务的训练,如从零开始构建完整项目、添加功能和测试、调试、执行大规模重构和进行代码审查。它更易于引导,更好地遵循 AGENTS.md(在新窗口打开)(http://agents.md/) 指令,并生成更高质量的代码——你只需告诉它需要什么,无需编写冗长的风格或代码整洁度说明。 ***SWE‐bench Verified:*** 历史上,包括在 GPT‐5 发布时,我们报告了 477 个 SWE‐bench Verified 任务的结果,因为某些任务无法在我们的基础设施中运行。我们已解决此问题,现在报告所有 500 个任务的结果。 ***代码重构任务:*** 我们的代码重构评估包含来自大型知名代码库的重构风格任务,包括 Python、Go 甚至 OCaml 中的任务。一个示例任务是 **Gitea 中的以下拉取请求**(在新窗口打开)(https://github.com/go-gitea/gitea/commit/fd7d83ace60258acf7139c4c787aa8af75b7ba8c),它修改了 232 个文件和 3,541 行代码,在应用逻辑中传递 ctx 变量。 ## 动态推理和独立执行 GPT‐5‐Codex 根据任务的复杂性动态调整思考时间。该模型结合了编程代理的两项基本技能:与开发者进行交互式配对,以及在较长任务上的持续独立执行。这意味着 Codex 在处理小型定义明确的请求或与你聊天时会更快响应,而在大型重构等复杂任务中会工作更长时间。在测试中,我们看到 GPT‐5‐Codex 在大型复杂任务上独立工作超过 7 小时,对其实现进行迭代、修复测试失败,并最终交付成功的实现。 在 OpenAI 员工流量中,对于按模型生成令牌数排序的底部 10% 用户回合(包括隐藏推理和最终输出),GPT‐5‐Codex 使用的令牌比 GPT‐5 少 93.7%。反过来说,对于顶部 10%,GPT‐5‐Codex 思考更多,花费两倍的时间进行推理、编辑和测试代码以及迭代。 ## 高级代码审查 GPT‐5‐Codex 经过专门训练,可进行代码审查并发现关键缺陷。审查时,它浏览你的代码库,推理依赖关系,运行你的代码和测试以验证正确性。我们在流行开源代码库的最近提交上评估了代码审查性能。对于每个提交,经验丰富的软件工程师评估了审查评论的正确性和重要性。我们发现 GPT‐5‐Codex 的评论不太可能出现错误或不重要,为关键问题保留了更多用户注意力。 ## 前端开发能力 GPT‐5‐Codex 是前端任务的可靠合作伙伴。除了创建美观的桌面应用,GPT‐5‐Codex 在创建移动网站时的人类偏好评估中也显示出显著改进。在云端工作时,它可以查看你提供的图像或截图,直观检查其进度,并向你显示其工作的截图。 ## 专为 Codex 设计 GPT‐5‐Codex 是专为 Codex CLI、Codex IDE 扩展、Codex 云环境和 GitHub 工作而构建的,也支持多功能的工具使用。与 GPT‐5 是通用模型不同,我们建议仅在 Codex 或类似 Codex 环境中的代理式编码任务中使用 GPT‐5‐Codex。 ## Codex CLI 改进 我们最近还进行了一些更新,使 Codex 成为更好的编程伙伴,包括改版的 Codex CLI 和新的 Codex IDE 扩展。 Codex CLI 是开源的,过去几个月的社区反馈在塑造其演进中非常宝贵。根据这些反馈,我们围绕代理式编码工作流重建了 Codex CLI,以利用我们的模型成为更强大可靠的伙伴。你现在可以在 CLI 中直接附加和共享图像——截图、线框和图表——建立关于设计决策的共享上下文,获得你想要的确切结果。在处理更复杂的工作时,Codex 现在通过待办事项列表跟踪进度,包括网络搜索和 MCP 等工具,用于连接外部系统,总体工具使用更准确。 终端 UI 也得到了升级:工具调用和差异格式更好,更容易理解。批准模式简化为三个级别:只读带明确批准、自动带完全工作区访问但需要工作区外批准,以及完全访问可读取任何地方的文件和运行具有网络访问权限的命令。它还支持压缩对话状态,使较长的会话更容易管理。 ## Codex IDE 扩展 Codex 会在你已有的工作地点与你相遇,包括在你的 IDE 中。IDE 扩展将 Codex 代理引入 VS Code、Cursor 和其他 VS Code 分支,让你可以无缝预览本地更改并与 Codex 编辑代码。当你在 IDE 中使用 Codex 时,你可以编写更短的提示并获得更快的结果,因为 Codex 可以利用你打开的文件或选定代码等上下文。 Codex IDE 扩展还让你在云端和本地环境之间顺利移动工作。你可以创建新的云端任务,跟踪进行中的工作,以及查看已完成的任务,而无需离开编辑器。为了完成最后的调整,你可以在 IDE 中打开云端任务,Codex 会保持上下文。在**快速入门**(在新窗口打开)(https://developers.openai.com/codex/ide) 中了解如何充分利用 IDE 扩展。 除了 Codex CLI,新的 IDE 扩展和 GitHub 集成将 Codex 云代理与开发者工作流更紧密地结合,让你现在可以在不离开编辑器或 GitHub 的情况下委派任务。 ## 云端基础设施改进 在幕后,我们也在持续改进云端基础设施性能。通过缓存容器,我们将新任务和后续任务的中位完成时间缩短了 90%。Codex 现在还通过扫描常见的设置脚本并执行它们来自动设置自己的环境,通过可配置的互联网访问可以在运行时执行 pip install 等命令以根据需要获取依赖项。 就像在 CLI 和 IDE 扩展中一样,你现在可以使用图像共享前端设计规范或解释 UI 错误。当它为你构建时,Codex 可以启动自己的浏览器、查看它构建的内容、迭代,并将结果的截图附加到任务和 GitHub PR。更多详情,查看**文档**(在新窗口打开)(https://developers.openai.com/codex/cloud)。 ## GitHub 代码审查 Codex 现在也包括经过训练以捕获关键缺陷的代码审查功能。与静态分析工具不同,它将 PR 的规定意图与实际差异相匹配,推理整个代码库和依赖关系,并执行代码和测试以验证行为。只有最彻底的人类审查者才会在审查的每个 PR 中投入这个水平的工作量,所以 Codex 填补了这个空白——帮助团队更早发现问题、减少审查者负担,并以更高的信心交付。 为 GitHub 仓库启用后,Codex 会在 PR 从草稿变为就绪时自动审查,在 PR 上发布其分析。如果它建议进行编辑,你可以留在同一线程中并要求 Codex 实现它们。你也可以通过在 PR 中提及 "@codex review" 来明确要求审查,并给予额外指导,如 "@codex review for security vulnerabilities"(安全漏洞审查)或 "@codex review for outdated dependencies"(过时依赖审查)。查看**快速入门**(在新窗口打开)(https://developers.openai.com/codex/cloud/code-review) 了解如何为你的仓库设置代码审查。 在 OpenAI,Codex 现在审查了我们大部分 PR,每天捕获数百个问题——通常在人类审查开始之前。它在让 Codex 团队以更高信心快速迭代中一直是关键。 ## 安全与数据保护 我们构建 Codex 时重点关注保护代码和数据不被泄露,防止滥用。默认情况下,Codex 在沙箱环境中运行,**网络访问**(在新窗口打开)(https://platform.openai.com/docs/codex/agent-network) 被禁用,无论是在本地还是云端。这有助于确保 Codex 无法在你的计算机上采取有害行为,并减少来自不可信来源的提示注入风险。 Codex 可以在采取潜在危险行为之前要求许可,并经过训练以运行命令来验证其输出。开发者可以自定义安全设置以匹配其风险承受度。在云端,你可以限制网络访问到可信域。在 CLI 和 IDE 扩展中,开发者可以批准带有完全访问权限的命令运行或允许代理使用网络搜索和连接到 MCP 服务器。这可以扩展代理的功能,同时增加风险——在这里了解更多关于如何安全地运行和管理 Codex 的信息(在新窗口打开)(https://developers.openai.com/codex/security)。 我们始终鼓励开发者在进行更改或部署到生产前审查代理的工作。Codex 为每个任务提供引文、终端日志和测试结果以协助审查。虽然 Codex 代码审查有助于减少危险问题被部署到生产的风险,无论是由人类还是代理创建的,我们始终建议将 Codex 作为额外审查者——而不是人类审查的替代品。 与我们对 GPT‐5 的处理方式一致,我们决定在生物和化学领域将 GPT‐5‐Codex 视为高能力,并实施了保障措施以最小化相关风险。在**系统卡片附录** (https://openai.com/index/gpt-5-system-card-addendum-gpt-5-codex/) 中阅读更多关于我们的评估和强大安全方法的内容。 ## 定价和可用性 Codex 包含在 ChatGPT Plus、Pro、Business、Edu 和 Enterprise 计划中。使用量随计划扩展:Plus、Edu 和 Business 座位可以覆盖每周几个有针对性的编码会话,而 Pro 可以支持跨多个项目的整个工作周。 Business 计划可以购买额度以让开发者超过其包含的限制,而 Enterprise 计划提供共享额度池,因此你只需为开发者使用的部分付费。在 ChatGPT 中了解更多关于使用限制的信息(在新窗口打开)(https://developers.openai.com/codex/pricing)。 对于通过 API 密钥使用 Codex CLI 的开发者,我们计划很快在 API 中提供 GPT‐5‐Codex。 ## 结语 Codex 正在成为我们一直设想的编程伙伴——更快、更可靠,并与你已有的工具深度集成。我们很兴奋看到你用它构建什么,并将继续改进 Codex,使其成为你最雄心勃勃项目的更好队友。

相似文章

GPT-5.2-Codex 介绍

OpenAI Blog

OpenAI 发布了 GPT-5.2-Codex,这是一个先进的代理型编码模型,针对复杂软件工程任务进行了优化,在长上下文理解、Windows 支持和网络安全能力方面有所改进。该模型在 SWE-Bench Pro 和 Terminal-Bench 2.0 上取得了最先进的性能,现已向付费 ChatGPT 用户开放,API 访问将在未来几周内提供。

GPT-5 系统卡补充:GPT-5-Codex

OpenAI Blog

# GPT-5 系统卡补充:GPT-5-Codex 来源:[https://openai.com/index/gpt-5-system-card-addendum-gpt-5-codex/](https://openai.com/index/gpt-5-system-card-addendum-gpt-5-codex/) GPT-5-Codex 是 GPT-5 的一个版本,针对 Codex 中的代理编码进行了优化。与其前身 codex-1 一样,该模型采用强化学习方法在各种环境中的真实编码任务上进行了训练,以生成与人类编码风格和 PR 偏好相近的代码,并精确遵循指令

推出 GPT-5.3-Codex

OpenAI Blog

OpenAI 推出 GPT-5.3-Codex,这是一款先进的智能编程模型,融合了前沿编程能力、推理能力和专业知识,在 SWE-Bench Pro 和 Terminal-Bench 上实现了最先进的性能,同时比前代模型快 25%。

Codex 现已正式发布

OpenAI Blog

OpenAI 宣布 Codex 正式发布,并推出三项新功能:Slack 集成可委派任务、Codex SDK 可嵌入工作流,以及工作区管理的管理工具。自 8 月以来,GPT-4-Codex 的使用量增长了 10 倍,三周内已服务超过 40 万亿个令牌。

Codex 正式推出

OpenAI Blog

OpenAI 推出 Codex,一个基于云的 AI 软件工程助手,由 codex-1(优化的 o3)驱动,能够编写功能、修复错误和提出带有并行任务执行的拉取请求。现已面向 ChatGPT Pro、Business、Enterprise 用户提供,Plus 和 Edu 支持即将推出。