预览Ultrafast模式:GPT-5.6 Sol速度提升高达14倍
摘要
OpenAI预览Ultrafast,这是GPT-5.6 Sol的一个新服务层级,通过Cerebras运行速度提升高达14倍,在OpenAI API中每秒可生成多达750个token。
预览Ultrafast,这是一个新的OpenAI API服务层级,运行GPT-5.6 Sol速度提升高达14倍。由Cerebras提供支持,每秒可输出多达750个token。
查看缓存全文
缓存时间: 2026/08/13 18:20
# 预览 Ultrafast 模式:GPT-5.6 Sol 速度提升至 14 倍
来源:https://openai.com/index/previewing-ultrafast/
今天,我们首次展示 Ultrafast——一种新的服务层级,以比 Standard 处理快 14 倍的速度运行 GPT-5.6 Sol,并率先在 OpenAI API 中推出。Ultrafast 由 Cerebras 提供支持,每秒可生成多达 750 个输出 token,将我们最智能的模型带入每一秒都至关重要的产品和工作中。
借助 [GPT-5.6](https://openai.com/index/gpt-5-6/),我们在模型能力上不断突破前沿,并在技术栈的每一层[提升效率](https://openai.com/index/gpt-5-6-frontier-intelligence-efficiency/)。这些改进使先进智能变得[更加经济实惠](https://openai.com/index/advancing-the-price-performance-frontier-with-gpt-5-6/),并且对[更多人更有用](https://openai.com/index/improving-gpt-5-6-sol-in-chatgpt/)。此前,要获得实时速度通常意味着选择更小或更专门的模型。Ultrafast 指向了一个新方向的进展:*每秒完成更多有用的工作*。
当速度不再需要以牺牲智能为代价时,AI 就能进入业务中最注重时效的环节,新形式的工作也随之成为可能。我们已经看到一些令人鼓舞的 Ultrafast 应用场景:
- **事件响应与可靠性:**当关键系统发生故障时,在故障仍在持续时分析应用程序日志、最近的代码变更和工程师报告,以识别可能的原因并帮助准备修复方案。
- **金融研究与安全:**在市场状况仍在变化时,分析市场信号、评估交易并识别可疑活动。
- **客户支持与语音:**实时解决复杂的客户问题,而不打断对话,即使需要多个步骤或系统才能找到答案。
- **商务:**在购物者仍在决策时回答产品问题、检查库存、个性化推荐并解决结账问题,防患于未然,避免犹豫变成弃购。
- **实时研究与实验:**将以往需要通宵运行的研究变成交互式工作会话,让团队可以在不打断工作流的情况下测试想法、检查结果、调整方法并运行下一个实验。
在预览期间,我们正与一组初始客户合作,以了解这种速度在哪些方面能带来最大改变,以及这些经验将如何长期指导我们的产品。如果您的业务需要最高速度的前沿智能,您可以[注册](https://openai.com/form/ultrafast/),以便在访问范围扩大时收到通知。
GPT-5.6 Sol Ultrafast 和 Standard 根据相同的文本提示并排构建可运行的 3D 仓库模拟器。
## 早期客户的实际体验
我们一直在与一组初始公司合作,在编码、商务、金融研究、支持及其他交互式应用中测试 Ultrafast 模式下的 GPT-5.6 Sol。从业务工作流入手,让我们能够在真实的生产环境中研究这些场景。他们的早期工作帮助我们了解速度的量级变化在哪些方面创造最大价值,以及当模型能够跟上使用者的节奏时,产品会发生怎样的变化。我们将利用这些发现来指导随着容量增长而进行的部署。
## OpenAI 如何使用 Ultrafast
在 OpenAI 内部,一组开发人员一直在 Ultrafast 模式下测试 GPT-5.6 Sol,以了解哪些工作流受益于能够实时回答的前沿智能。
事件响应是我们团队使用 Ultrafast 的一个示例。当警报触发时,工程师需要在系统和证据仍在变化的同时构建准确的全局视图。团队利用它快速读取日志、分析追踪、梳理对话、确定下一步检查项,并帮助准备或验证修复方案——所有这些都只需一小部分时间,同时具备 Sol 的智能。它缩短了观察信号、测试假设和选择下一步行动之间的延迟,而工程师仍然负责判断和部署。
在研究方面,我们的团队使用 Ultrafast 快速检索知识来源、查询数据,并跨关联工具快速收集、整理和汇总信息。一个常见的研究工作流是团队成员在夜间启动一批实验,然后在早上查看结果。借助 Ultrafast,我们看到这一循环正在缩短,转而支持在工作日内进行多次迭代。
## 由 Cerebras 提供支持
Ultrafast 标志着我们与 Cerebras 合作的下一个里程碑,旨在为 OpenAI 平台带来超低延迟推理。现在,借助 Ultrafast 模式下的 GPT-5.6 Sol,Cerebras 正为 OpenAI 最智能的模型提供支持,每秒可交付多达 750 个输出 token,使企业能够构建响应更迅速的产品、做出更快的决策,并将强大的 AI 直接引入其要求最高的工作流中。
## 可用性
Ultrafast 模式下的 GPT-5.6 Sol 今天以限量预览形式向特定客户群体开放。随着容量增长,我们将扩大访问范围。[注册获取更新](https://openai.com/form/ultrafast/)。
相似文章
@OpenAI:预览超快速模式:GPT-5.6 Sol,速度最高提升14倍。首先在OpenAI API中面向特定客户群…
OpenAI正在为GPT-5.6 Sol预览超快速模式,提供高达14倍的速度,最初在OpenAI API中面向特定客户提供,并随着时间推移扩大访问范围。
预览Ultrafast模式:GPT-5.6 Sol速度最高提升14倍
OpenAI的GPT-5.6 Sol在Ultrafast模式下提供最高14倍的速度提升,增强了事件管理和数据处理等复杂工作流,且不牺牲智能质量。
Previewing Ultrafast mode: GPT‑5.6 Sol at up to 14X the speed
OpenAI 预览了 GPT-5.6 Sol 的 Ultrafast 模式,速度最高提升 14 倍,同时保持与标准模式同等质量的智能,可在监控、数据处理、搜索和编码等场景中实现近乎实时的体验。
GPT-5.6 Sol 现在能以约每秒 750 tokens 的惊人速度运行
GPT-5.6 Sol 现以约每秒 750 tokens 的令人印象深刻的推理速度运行。
@OpenAI: 部署后,我们应用了 GPT-5.6 Sol,通过使其自身运行更高效来推进效率前沿。…
OpenAI 部署了 GPT-5.6 Sol,通过改进的 GPU 内核和推测解码,实现了 20% 的服务成本降低和 15% 以上的 token 生成效率提升。