GPT-5.6 Sol 的 Token 消耗量是 GPT-5.5 的两倍(2 分钟阅读)
摘要
在 Codex 工作流中,GPT-5.6 Sol 每个会话使用的 Token 量是 GPT-5.5 的两倍多,导致成本更高,订阅配额消耗更快。
在 Codex 工作流中,GPT-5.6 Sol xhigh 现在每个会话使用的 Token 量是 GPT-5.5 xhigh 的两倍多。这使基于 Token 的配额的有效价值降低了一半以上。在相同的 Token 价格下,2.25 倍的 Token 意味着类似 Token 组合的成本约为 2.25 倍。GPT-5.6 Sol 还增加了 GPT-5.5 没有的缓存写入费用。
查看缓存全文
缓存时间: 2026/08/04 13:30
# GPT-5.6 Sol 使用的 Token 量是 GPT-5.5 的两倍
来源:https://www.vincentschmalbach.com/gpt-5-6-sol-xhigh-uses-twice-tokens-gpt-5-5/
GPT-5.6 Sol xhigh 现在在我的 Codex 工作流中每次会话使用的 token 数是 GPT-5.5 xhigh 的两倍多。对于 Codex 用户来说,每次会话的 token 数等于总 token 数除以会话次数。我比较了来自去重本地日志的两个等长 14 天窗口。两次会话内容不同,但之前 1,667 次会话和之后 1,715 次会话足够相似,足以说明新模型为何会耗尽我的订阅。
在同等条件下,等长的 14 天窗口:
| 模型 / effort | 会话次数 | Token 数 | 每次会话的 Token 数 |
| --- | --- | --- | --- |
| GPT-5.5 xhigh | 1,667 | 12.17B | 7.30M |
| GPT-5.6 Sol xhigh | 1,715 | 28.22B | 16.45M |
会话次数仅增加了 2.9%。每次会话的 token 数增加了 125%。GPT-5.6 Sol xhigh 每次会话使用 16.45M token,而 GPT-5.5 xhigh 为 7.30M。也就是说,每次会话消耗的 token 数是原来的 2.25 倍。
总用量从 12.17B token 上升到 28.22B,增加了 2.32 倍。大致相同的会话次数现在消耗了超过两倍的用量配额。
这使得基于 token 的配额的实际价值降低了一半以上。我的三个订阅以前大约能支撑一周的高强度工作。自从 GPT-5.6 Sol 成为顶级的 xhigh 模型后,大约一天的中等强度工作就能将它们耗尽。我每个账户还积攒了三到四次用量重置机会。以前我很少需要它们,现在全都用完了。
OpenAI 对 GPT-5.5 和 GPT-5.6 Sol 列出了相同的首次输入(fresh-input)、缓存输入(cached-input)和输出 token 价格(https://platform.openai.com/docs/pricing)。在相同的 token 价格下,token 数增加到 2.25 倍,意味着相似 token 组合的成本大约也增加到 2.25 倍。此外,GPT-5.6 Sol 还增加了 GPT-5.5 没有的缓存写入(cache-write)费用。
Vroni — 我正在构建的产品
## 委派任务,交付软件。
把 GitHub issue、bug 报告、规格说明或粗略想法交给 Vroni。它会阅读仓库、规划修改、编写代码、运行检查,并推动生成一个可供审查的 pull request。看看 vroni.com(https://www.vroni.com/?utm_source=vincentschmalbach.com&utm_medium=blog&utm_campaign=blog_post_vroni&utm_content=after_post_card)
我尊重你的隐私。可随时取消订阅。
相似文章
@sama: GPT-5.6 sol 的价格是 fable 的一半,并且在许多情况下完成相同任务的 token 效率大约是 fable 的两倍。很高兴…
Sam Altman 宣布,GPT-5.6 sol 的价格是 fable 的一半,并且在许多任务中 token 效率大约是 fable 的两倍,计划以四分之一的价格交付。
OpenAI 暂时放宽了 GPT-5.6 Sol 的使用限制(2分钟阅读)
OpenAI 暂时取消了 Plus、Pro 和 Business 套餐中 GPT-5.6 Sol 的五小时使用限制,并推出了效率改进措施以减少使用消耗。
@OpenAI: 部署后,我们应用了 GPT-5.6 Sol,通过使其自身运行更高效来推进效率前沿。…
OpenAI 部署了 GPT-5.6 Sol,通过改进的 GPU 内核和推测解码,实现了 20% 的服务成本降低和 15% 以上的 token 生成效率提升。
GPT-5.5 或许消耗更少的 token,但它始终烧掉更多的钱
尽管 OpenAI 声称 GPT-5.5 在 token 效率上有所提升,但实际使用成本仍比 GPT-5.4 高出 49% 至 92%;与此同时,Anthropic 的 Claude Opus 4.7 对于较长提示词的实际成本也上涨了 12% 至 27%。这一现象反映出前沿模型价格普遍上涨的趋势,而两家公司均面临巨额预计亏损。
GPT 5.6 Sol 基准测试
GPT 5.6 Sol 在 AI 语言建模方面取得新的基准测试结果,展示了性能改进。