AMD与Cerebras推出AI推理解决方案(10分钟阅读)
摘要
AMD与Cerebras宣布联合推出AI推理解决方案,该方案将AMD Helios机架级解决方案与Cerebras晶圆级引擎相结合,旨在实现超低延迟和高吞吐量。这种解耦式推理工作流预计每瓦每秒可处理的token数量提升高达5倍。
AMD与Cerebras发布了一款AI推理解决方案,该方案将AMD Helios与Cerebras晶圆级引擎相结合,提升了低延迟AI工作负载的性能。
查看缓存全文
缓存时间: 2026/07/24 17:02
# AMD 与 Cerebras 联合推出 AI 推理解决方案
来源:https://www.cerebras.ai/press-release/amd-and-cerebras-announce-industry-leading-ultra-low-latency-and-high-throughput-ai-inference
**新闻亮点**
- *AMD 与 Cerebras 合作,推动面向超低延迟 AI 推理基础设施的工作负载优化方案。*
- *AMD HeliosTM 与 Cerebras Wafer-Scale Engine 将作为单一解耦推理工作流运行,结合 AMD InstinctTM GPU 的超高吞吐量与 Cerebras Wafer-Scale Engine 的超快速 Token 生成能力。*
- *Cerebras 计划在其数据中心部署 AMD Helios,联合解决方案预计将于 2026 年下半年首先通过 Cerebras Cloud 提供。*
**旧金山与桑尼韦尔,2026 年 7 月 23 日——** AMD(纳斯达克:AMD)与 Cerebras Systems(纳斯达克:CBRS)宣布达成技术合作,推出一款全新的解耦式 AI 推理解决方案,该方案将 AMD HeliosTM 机架级解决方案与 Cerebras Wafer-Scale Engine 相结合。该解决方案在 Advancing AI 2026 上发布,旨在提供最先进 AI 应用所需的超低延迟,同时大幅提升吞吐量和效率。
AMD 与 Cerebras 的联合解决方案将部署 AMD Helios 与 Cerebras Wafer-Scale Engine 技术,集成到单一推理工作流中,以实现最佳性能和效率。AMD Helios 将提供高性能、可扩展的吞吐量引擎。Cerebras Wafer-Scale Engine 技术将提供超快速、超低延迟的解码与 Token 生成。两者结合,预计每瓦每秒 Token 数(T/s/W)可提升高达 5 倍\[i\]。
AI 推理工作负载在延迟、吞吐量、Token 容量、成本和规模方面的要求日益多样化。高吞吐工作负载优先考虑最大化 Token 生成,而编码、实时协处理器、实时代理和代理工作流则要求更快的响应时间。这些差异推动了对异构基础设施的需求,以匹配特定工作负载的计算技术。
AMD 与 Cerebras 的解决方案通过解耦推理解决了这一挑战,独立优化工作流的两个主要阶段。AMD Helios 提供超高吞吐量,处理提示(prompt)和大上下文窗口。Cerebras Wafer-Scale Engine 则加速内存带宽密集型的 Token 生成,实现超低延迟。通过将这两款同类最佳引擎集成到单一工作流中,两家公司打造了一个差异化平台,在不牺牲吞吐量或规模的前提下实现超低延迟推理。
> “AI 推理正在成为 AI 领域最大的基础设施机遇之一,其日益增长的多样性要求更灵活的方法,”AMD 董事会主席兼首席执行官苏姿丰博士表示。“AMD Helios 为最广泛的推理工作负载提供了领先的性能和规模。与 Cerebras 合作,我们将这一领先优势拓展到最敏感的延迟应用,并为实时代理 AI 创建一个强大的新平台。”
> “超快速推理的需求正以前所未有的速度增长。Cerebras 提供全球最快、超低延迟的推理,”Cerebras 首席执行官兼联合创始人 Andrew Feldman 表示。“与 AMD 合作使我们获得了绝佳机会,将这一性能带给更多客户。”
随着 AI 进入软件开发、自主代理、机器人技术、科学发现以及其他响应时间直接影响用户体验和系统实用性的应用领域,快速 Token 生成变得愈发重要。联合解决方案将专为这些需求而构建的互补架构结合在一起。
AMD Helios 提供高吞吐量提示引擎、机架级效率和部署规模,以处理大量复杂请求。Cerebras Wafer-Scale Engine 技术则提供实时返回 Token 所需的超低延迟和解码性能。最终形成的解决方案专为推理市场中超低延迟细分领域而设计,以 AMD Helios 作为数据中心高吞吐量和均衡推理工作负载的基础。
Cerebras 计划在其数据中心部署 AMD Helios 系统,联合解决方案预计将于 2026 年下半年首先通过 Cerebras Cloud 提供。
### **支持资源**
- 关注 AMD 在 Advancing AI 2026(新闻资料包)
- 了解更多关于 AMD HeliosTM 机架级解决方案
- 了解更多关于 AMD InstinctTM 加速器
- 在 LinkedIn 上联系 AMD
- 在 X 上关注 AMD
- 了解更多关于 Cerebras Wafer-Scale Engine
- 在 LinkedIn 上联系 Cerebras | 在 X 上关注 Cerebras
### **关于 AMD**
AMD(纳斯达克:AMD)致力于推动高性能和 AI 计算领域的创新,以解决世界上最重要的挑战。如今,AMD 技术为云和 AI 基础设施、嵌入式系统、AI PC 和游戏领域的数十亿体验提供动力。凭借广泛的 AI 优化 CPU、GPU、网络和软件产品组合,AMD 提供全栈 AI 解决方案,为智能计算新时代提供所需的性能和可扩展性。了解更多信息,请访问 www.amd.com。
### **关于 Cerebras Systems**
Cerebras Systems(纳斯达克:CBRS)构建全球最快的 AI 基础设施。Cerebras 团队由开创性的计算机架构师、计算机科学家、AI 研究员以及各类工程师组成,他们通过创新和发明使 AI 变得极快。我们相信,当 AI 足够快时,它将改变世界。全球领先的企业、研究机构和政府选择 Cerebras 来运行其 AI 工作负载。Cerebras 解决方案可在本地和云端部署。请访问 cerebras.ai 了解更多信息。
#### ***AMD 警示声明***
本新闻稿包含关于 Advanced Micro Devices, Inc.(AMD)的前瞻性声明,例如 AMD 与 Cerebras 合作及联合解决方案的功能、性能、可用性、可扩展性、部署、时间安排及预期收益,这些声明依据 1995 年《私人证券诉讼改革法案》的安全港条款作出。前瞻性声明通常由“将”、“可能”、“期望”、“相信”、“计划”、“打算”、“预计”等词语及其他类似含义的术语标识。投资者应注意,本新闻稿中的前瞻性声明基于当前的信念、假设和预期,仅在本新闻稿发布之日有效,并涉及可能导致实际结果与当前预期存在重大差异的风险和不确定性。此类声明受某些已知和未知风险与不确定性的影响,其中许多难以预测且通常超出 AMD 的控制范围,可能导致实际结果及其他未来事件与前瞻性信息及声明中明示、暗示或预计的内容存在重大差异。可能导致实际结果与当前预期存在重大差异的重要因素包括但不限于以下内容:政府行为及法规(如出口法规、进口关税、贸易保护措施和许可要求)的影响;AMD 产品销售所在的竞争市场;半导体行业的周期性;AMD 产品所售行业的市场状况;AMD 及时推出具备预期功能和性能水平产品的能力;重要客户的流失;经济及市场不确定性;季度和季节性销售模式;AMD 充分保护其技术或其他知识产权的能力;不利的汇率波动;第三方制造商及时以足够数量使用竞争技术制造 AMD 产品的能力;关键设备、材料、组件(如内存供应)、基板或制造工艺的可用性;实现 AMD 产品预期制造良率的能力;AMD 从其半定制 SoC 产品中创收的能力;潜在安全漏洞;潜在安全事件,包括 IT 中断、数据丢失、数据泄露和网络攻击;涉及 AMD 产品订购和发货的不确定性;AMD 依赖第三方知识产权设计和推出新产品;AMD 依赖第三方公司设计、制造和供应主板、软件、内存及其他计算机平台组件;AMD 依赖微软及其他软件供应商的支持,以设计和开发可在 AMD 产品上运行的软件;AMD 依赖第三方分销商和附加卡合作伙伴;修改或中断 AMD 内部业务流程和信息系统的影响;AMD 产品与部分或全部行业标准软件和硬件的兼容性;与缺陷产品相关的成本;在客户需求变化时未能维持高效供应链;AMD 依赖第三方供应链物流功能;AMD 有效控制其在灰色市场产品销售的能力;气候变化对 AMD 业务的影响;AMD 实现其递延所得税资产的能力;潜在税务负债;当前和未来的索赔及诉讼;环境法、冲突矿产相关条款及其他法律或法规的影响;政府、投资者、客户及其他利益相关者对企业责任事宜不断变化的期望;与 AI 负责任使用相关的问题;管理 AMD 票据、Xilinx 票据担保及循环信贷协议的协议所施加的限制;AMD 履行担保、租赁及其他商业承诺下财务义务的能力;收购、合资企业和/或投资对 AMD 业务的影响及 AMD 整合收购业务的能力;任何合并公司资产减值的影响;政治、法律和经济风险及自然灾害;未来技术许可购买减值;AMD 吸引和留用关键员工的能力;以及 AMD 股价的波动性。强烈建议投资者详细审查 AMD 向美国证券交易委员会提交的文件中的风险和不确定性,包括但不限于 AMD 最新的 10-K 和 10-Q 表格报告。
**CEREBRAS 信息披露信息**
Cerebras 使用其投资者关系页面(investors.cerebras.ai)、X 账户(@cerebras)和 LinkedIn 页面(linkedin.com/company/cerebras-systems/)披露重大非公开信息,并履行其根据 FD 法规下的披露义务。因此,投资者应关注这些渠道,以及 Cerebras 的新闻稿、美国证券交易委员会(SEC)文件、公开电话会议和公开网络广播。
***前瞻性声明***
本新闻稿包含适用证券法定义内的“前瞻性声明”。除历史事实陈述外的所有声明均可视为前瞻性声明,包括但不限于关于 Cerebras 与 AMD 合作及联合解决方案的功能、容量、可扩展性、性能、时间安排、数据中心部署和实施、成本及预期收益和机会的声明,以及任何相关假设。词语“可能”、“将”、“应”、“应当”、“期望”、“计划”、“预期”、“可能”、“打算”、“目标”、“预计”、“考虑”、“相信”、“估计”、“预测”、“潜在”、“目标”、“继续”,或这些词语的否定形式或其他类似术语或表达,涉及我们的预期、战略、计划或意图的,均旨在识别前瞻性声明,但并非所有前瞻性声明都包含这些识别词语。这些前瞻性声明受到许多风险和不确定性的影响,其中许多涉及 Cerebras 无法控制的因素或情况。这些风险和不确定性包括但不限于:Cerebras 维持和管理其增长、以可接受条款获得借款及其他资本来源、以及部署可用资本以支持增长的能力;其净亏损历史及实现和维持盈利能力的能力;其在当前规模的有限运营历史及准确预测收入、适当预算和管理费用的能力;其对少数重要客户的依赖,包括 OpenAI、Group 42 Holding Ltd、穆罕默德·本·扎耶德人工智能大学和 AWS,以及任何需求减少、与这些客户关系发生重大不利变化或未能履行对这些客户(包括与 OpenAI 的主关系协议项下)义务的潜在影响;其战略客户、合作伙伴和融资安排的时间安排、执行和预期收益;其对硬件系统销售的历史依赖及云端产品和 AI 基础设施的早期快速变化市场;其获得足够数据中心容量和资本以支持云端产品的能力;其推出新产品和增加新功能的能力;以及其在快速发展和竞争的 AI 计算解决方案市场中的有效竞争能力。
由于多种因素,Cerebras 的实际结果可能与前瞻性声明中明示或暗示的结果存在重大差异。因此,不应过度依赖此类声明。这些前瞻性声明仅在其首次发布之日作出,并基于截至该日 Cerebras 可获得的信息以及 Cerebras 的预期、估计、预测、计划、信念和假设。这些前瞻性声明不应被视为代表 Cerebras 在本新闻稿发布日期之后任何日期的观点。过往表现未必预示未来结果。除非法律要求,Cerebras 不承担任何更新或修订任何前瞻性声明的意图或义务,无论是因为新信息、未来事件还是其他原因。
可能影响实际结果的潜在风险进一步信息包含在 Cerebras 最近向美国证券交易委员会(SEC)提交的文件中,包括 Cerebras 最近的 10-Q 表格季度报告,可通过访问 Cerebras 投资者关系网站 investors.cerebras.ai 或 SEC 网站 www.sec.gov 获取。 ————————————-
\[i\] 基于 AMD 性能实验室和 Cerebras 在 2026 年 7 月的建模,以确定在 Kimi 2.6 1T 模型的可比交互点处,每千瓦每秒 Token 数(TPS/kW),比较 AMD Helios 机架级解决方案与 Cerebras WSE 的组合配置与仅使用 Cerebras WSE 的配置。系统制造商可能配置不同,产生不同结果。
相似文章
AMD与AI芯片初创公司Cerebras达成协议
AMD已与AI芯片初创公司Cerebras签署协议,标志着双方在AI硬件领域的战略合作。
OpenAI与Cerebras合作
OpenAI与Cerebras合作,将750MW超低延迟AI计算能力整合到其平台中,旨在加速推理,并在各种工作负载中实现更快的实时AI响应。
AMD的Helios(4分钟阅读)
AMD推出Helios,这是其首个机架级AI系统,旨在与Nvidia产品竞争,微软成为其客户之一。该系统定于今年晚些时候发货。
AMD的小型AI PC预示着模型推理向本地化未来的转变
AMD的Ryzen AI Max平台配备128GB统一内存,可本地推理高达2000亿参数的大模型,旨在将AI工作负载从云端转移到紧凑的个人硬件上。
推理的变革(阅读时长约 8 分钟)
本文分析了 Cerebras 即将进行的 IPO,将其视为 AI 硬件领域“推理变革”的信号。文章指出,尽管 Nvidia 在基于 GPU 的训练领域占据主导地位,但为了支持推理工作负载,AI 算力的未来正变得越来越异构。