推进 GPT‑5.6 的性价比前沿
摘要
OpenAI 宣布 GPT-5.6 Luna(降价 80%)和 Terra(降价 20%)大幅降价,并推出 GPT-5.6 Sol 的快速模式,API 速度提升高达 2.5 倍,旨在提高客户的成本效益。
暂无内容
查看缓存全文
缓存时间: 2026/07/30 19:51
# 以GPT-5.6推动性价比新前沿
Source: https://openai.com/index/advancing-the-price-performance-frontier-with-gpt-5-6/
昨天,我们分享了GPT-5.6 (https://openai.com/index/gpt-5-6/) 如何帮助自身提高运行效率 (https://openai.com/index/gpt-5-6-frontier-intelligence-efficiency/)。今天,我们将这些成果传递给客户,降低GPT-5.6 Luna (opens in a new window) (https://developers.openai.com/api/docs/models/gpt-5.6-luna) 和 Terra (opens in a new window) (https://developers.openai.com/api/docs/models/gpt-5.6-terra) 的价格,并在API中为GPT-5.6 Sol (https://openai.com/index/gpt-5-6/) 提供更快的性能。这些更新共同帮助客户从投入到AI的每一美元中获得更多价值,并在时间紧迫时行动更快。
自今日起,我们最快且最实惠的模型GPT-5.6 Luna将降价80%,而适用于日常工作的平衡模型GPT-5.6 Terra将降价20%。Luna和Terra的降价也将体现在使用Codex和ChatGPT Work时如何从付费订阅中扣除使用量。Luna为企业提供了一种极具成本效益的方式,以极高的质量处理大量工作。它可以使用工具并完成多步骤工作流,使得更广泛的AI应用实现规模化运行成为现实。
让先进智能更充裕、更可负担是OpenAI确保AGI惠及全人类使命的核心。这些变化将这一承诺付诸实践,体现了我们在模型构建、服务和应用方面多年来的改进。
我们还在API中引入了**快速模式**,以取代原有的优先处理服务。对于GPT-5.6 Sol,快速模式现在的速度比标准处理快2.5倍,价格为两倍,但智能水平不变。快速模式向后兼容:标记为优先的请求将自动使用快速模式。
## 将智能匹配到结果
高效使用AI始于结果。风险、错误成本、紧迫性和规模决定了智能、速度、可靠性和成本之间的恰当平衡。这种平衡可能在工作流的每一步之间发生变化。
GPT-5.6为企业提供了更大的空间来优化这一等式。Luna的性能与一年前的前沿模型相当,但每任务成本约为其6%,速度接近九倍。在专业工作方面,根据Agent's Last Exam的评估,Luna的表现优于Fable 5,而每任务预估成本降低近99%。
在实践中,企业可以定义所需的结果和质量标准,然后通过评估来确定在哪些方面增加智能能显著改善结果,在哪些方面更快、更低成本的处理能达到相同质量。例如,编码工作流可能会使用Sol来解决不确定性并制定计划,然后使用Luna来实现明确定义的更改、编写和运行测试,并评估结果。另一个工作流可能需要不同的平衡。
GPT-5.6系列扩展了这些选择的范围。企业可以在每个阶段应用最大有用的智能,同时为它创造的价值支付合理的价格。
提供这种灵活性始于使模型背后的每一层都更高效。
## 我们如何推进效率前沿
我们的效率优势来自于改进模型、运行模型的推理系统,以及将模型连接到工具和上下文的代理框架。GPT-5.6模型通过更直接的路径完成工作。更好的路由保持硬件高效运转,优化的生产软件更高效地生成token,更智能的上下文管理帮助代理避免重复已完成的工作。这些改进共同使我们能用相同的算力完成更多有用工作,减少每个结果所需的时间、token和成本。
GPT-5.6 Sol正越来越多地帮助我们寻找并实现下一轮收益。在人工主导的流程中,Sol自主重写并优化了生产内核,设计并运行了数百个实验以改进token生成,并监控训练过程,在出现问题时进行干预。内核工作将模型的端到端服务成本降低了20%,而其实验将token生成效率提高了超过15%。这项工作仍在继续,形成了更紧密的反馈循环:随着我们的模型改进并能够更自主地工作,我们提高效率的能力也在加速。阅读更多 (https://openai.com/index/gpt-5-6-frontier-intelligence-efficiency/)关于GPT-5.6背后的工程细节。
## 为规模化构建的计算策略
满足对充裕智能的需求需要更多的算力以及更高效率的算力。我们正在构建弹性基础设施组合,并将每个工作负载匹配到最适合运行它的系统。这种方法支持性价比曲线的两端。在低成本端,新的Luna和Terra价格使得大量工作在经济上更具规模效益。在前沿端,当响应时间重要时,快速模式让API客户能够更快地访问Sol。
企业可以将更多AI融入日常运营,而无需牺牲最重要工作的速度。大规模文档分析、客户交互分类和常规实现可以以经济的方式广泛运行,而复杂的Sol工作负载也可以在需要时以溢价获得更快的速度。
收益可以叠加。在人工主导的流程中,能力更强的模型帮助我们的技术团队找到下一代改进,缩短了实现更好性能和更低成本的路径。我们的战略始终专注于推进能力和效率,以便每一代智能都能以更低的成本完成更多工作。
## 可用性与定价
GPT-5.6 Terra和Luna仍在ChatGPT Work、Codex和OpenAI API中可用。在ChatGPT Work和Codex中,Free和Go用户可以访问Terra,而Plus、Pro、Business和Enterprise用户可以选择Terra和Luna。
自7月30日起,API定价为:Terra每百万输入token 2美元,每百万输出token 12美元;Luna每百万输入token 0.20美元,每百万输出token 1.20美元。Sol定价保持不变。ChatGPT和Codex的订阅价格和配额预算保持不变,而Terra和Luna的使用现在消耗更少的积分。价格变更将于今日晚些时候在AWS中开始推出。
GPT-5.6 Sol的快速模式取代了API中的优先处理,并与Codex中的/fast保持一致。标记为优先的现有API请求将继续有效。查看完整API定价详情。 (https://openai.com/business/pricing/#api)
相似文章
@OpenAI:我们致力于在成本效率、能力和速度方面推动模型前沿。从今天开始,我们正…
OpenAI 已将 GPT-5.6 Luna 的价格降低 80%,GPT-5.6 Terra 的价格降低 20%,并在 API 中为 GPT-5.6 Sol 推出了更快的选项,同时还调整了 Codex 和 ChatGPT Work 中的使用量计算方式。
GPT‑5.6 Luna 价格降低80%,而 GPT‑5.6 Terra 价格降低20%。
GPT-5.6 Luna 和 Terra 模型已宣布,价格大幅降低:Luna 价格比之前版本降低80%,Terra 降低20%。
引用OpenAI
OpenAI宣布GPT‑5.6系列限量预览,包括Sol、Terra和Luna模型,并推出新的定价和缓存功能。
@vasuman:这有点像Citadel对Leopold Aschenbrenner,不过是针对氛围编码者的
Sam Altman宣布大幅下调GPT-5.6模型的价格:Luna降价80%,Terra降价20%,并在API中为Sol新增Fast模式。
新的GPT-5.6系列:Luna、Terra、Sol
OpenAI发布了GPT-5.6系列,提供三种规格(Luna、Terra、Sol),具有更强的智能体性能、新的API功能(如程序化工具调用和多智能体支持),以及相比Claude模型更具竞争力的定价。