标签
Cerebras Systems 首席执行官 Andrew Feldman 将在 TechCrunch Disrupt 2026 上发表题为《AI 还能持续扩展吗?》的演讲,探讨算力需求、能源限制以及 Cerebras 以晶圆级方案应对 AI 硬件挑战的路径。
General Compute正与NVIDIA GPU一起部署Cerebras系统,提供20倍更快的AI推理,资金来自4亿美元债务,以解决开发者的计算可用性问题。
OpenAI 正在准备将其 Ultrafast API 模式扩展到更多用户,可能在 DevDay 期间更广泛地提供,该模式由 Cerebras 驱动以实现更快的推理速度。
Wafer 在 YC 的 AI Office Hours 中延迟表现优于 Cerebras,GLM-5.2 达到 379 毫秒,而 Gemma 4 为 674 毫秒,使得延迟降低 44%,并提升了用户参与度。
研究人员在Cerebras上使用Qwen 3.8 27B和Pi harness构建了一个更快的AI助手,通过优化并行检查和更快的推理,实现了相较现有助手19倍的速度提升。
Cerebras首席执行官Andrew Feldman讨论了大规模构建Cerebras如何让他对Jensen Huang在Nvidia的工作有了新的欣赏,强调了领导力中所需的毅力。
Andrew Feldman,Cerebras的CEO,强调了硅谷对人工智能的强烈兴奋,通过清晨会议的轶事展现了行业的狂热。
OpenAI 使用 Cerebras 进行快速推理,以在故障期间改善事件响应和关键研究,如 @seanlie 所述。
这篇文章分析了2026年人工智能焦点从训练转向推理的转变,这一转变由硬件创新以及Nvidia、Amazon和Cerebras等科技巨头之间的战略联盟推动,以满足日益增长的需求。
演示一个基于 Qwen 3.8 27B 的操作系统,在 Cerebras 硬件上以每秒 1950 令牌的速率运行,其中模型权重充当实时软件生成的运行时环境。
一篇社交媒体帖子,突出了Cerebras CTO关于GPU编程和AI硬件架构的演讲,并指出尽管内容信息量大,但观看次数很少。
Cerebras宣布在其推理平台上提供Qwen 3.8 27B模型,速度达1500 tokens每秒,并详细介绍了其模型压缩技术,如量化和剪枝。
这篇社交媒体帖子推测,来自 OpenAI 和 Cerebras 的极其快速的 AI 模型将通过实现并行代理和基于文本的计算机交互来改变工作方式。
Cerebras 在 Hot Chips 2026 上宣布了 CS-5 芯片,提供了相较于前几代的显著性能提升,最高可达每用户每秒 10,000 个令牌,适用于 Gemma 4 和 GPT 变体等 AI 模型。计划举办一场 AMA 会议来讨论这些公告。
Cerebras发布了CS-4,这是一款新型AI计算机,其速度比前代快数倍,声称在速度上优于Nvidia系统,并将在第三季度更广泛地上市。
文章探讨了AI中的‘期限红利’概念,即更快的推理速度能在时间限制内完成更多计算,重点介绍了OpenAI为GPT-5.6 Sol提供的Ultrafast API预览,并与Cerebras等提供商进行了比较。
OpenAI通过已行权的认股权证以约100美元收购了Cerebras 4.2%的股份,此举发生在预览Ultrafast服务数周之前。该服务使用Cerebras硬件,可将GPT-5.6 Sol的推理速度提升高达14倍。
OpenAI预览Ultrafast,这是GPT-5.6 Sol的一个新服务层级,通过Cerebras运行速度提升高达14倍,在OpenAI API中每秒可生成多达750个token。
Google Gemma宣布,借助Hugging Face和Cerebras实现超快推理,开发者现在可以将Gemma 4 31B模型用作语音AI的大脑,这是开源级联语音到语音堆栈的一部分。