5.6 Sol 模型将于七月登陆 Cerebras,推理速度达每秒 750 token
摘要
5.6 Sol 模型将于七月在 Cerebras 硬件上运行,提供每秒 750 token 的推理速度。
https://preview.redd.it/8nbr61qjzn9h1.png?width=1853&format=png&auto=webp&s=a223073294a2498e7557061f8b3fc822eb677f96 实在是太疯狂了
相似文章
@sama: 哦对了……750 token/sec 将在七月以5.6 SOL 提供!
Sam Altman 宣布,一款每秒750个token的模型将在七月以5.6 SOL的价格提供。
GPT-5.6 Sol 现在能以约每秒 750 tokens 的惊人速度运行
GPT-5.6 Sol 现以约每秒 750 tokens 的令人印象深刻的推理速度运行。
预览Ultrafast模式:GPT-5.6 Sol速度提升高达14倍
OpenAI预览Ultrafast,这是GPT-5.6 Sol的一个新服务层级,通过Cerebras运行速度提升高达14倍,在OpenAI API中每秒可生成多达750个token。
Cerebras 首席财务官表示,他们正在其芯片上内部运行 GPT5.4 和 GPT5.5,并将很快向公众发布。(想象一下那种速度下的智能)
Cerebras 首席财务官宣布,公司正在其芯片上内部运行 GPT5.4 和 GPT5.5,并即将向公众发布这些模型,承诺提供高速 AI 推理。
AMD与Cerebras推出AI推理解决方案(10分钟阅读)
AMD与Cerebras宣布联合推出AI推理解决方案,该方案将AMD Helios机架级解决方案与Cerebras晶圆级引擎相结合,旨在实现超低延迟和高吞吐量。这种解耦式推理工作流预计每瓦每秒可处理的token数量提升高达5倍。