据AMD、Arm和微软称,代理式AI可能将CPU与GPU的比例从1:4推至甚至1:1
摘要
在OCP APAC 2026上,AMD、Arm和微软的高管认为,代理式AI工作负载将显著增加CPU需求,可能将CPU与GPU的比例从1:4转变为1:2甚至1:1,而微软则将其Cobalt 200芯片定位为“代理原生CPU”。
在OCP APAC 2026上,AMD计算与企业AI高级副总裁Tai表示,代理并不会减少GPU需求,而是会额外增加一层运行在CPU上的编排、检索和工具调用工作。常见的1:4 CPU与GPU比例可能会转向1:2甚至1:1。Arm也给出了理由,其台湾/东南亚总裁表示,AI代理可以发出比人类多15倍的请求,因为它们不停运行,并且可以生成其他代理,这实际上使当前配置中的CPU不堪重负。微软的观点也与此一致。他们的新款Cobalt 200芯片基本上被宣传为“代理原生CPU”,可将代理调用延迟降低33%,并在代理式工作负载上将吞吐量提升23%,同时他们还在GPU上持续投入。因此,一旦AI不再是单次提示的聊天机器人,而是变成自主执行多步骤工作的代理,那么不仅GPU,CPU、内存、存储和网络可能都需要以同样的速度扩展。来源:https://www.digitimes.com/news/a20260812VL224/amd-apac-cpu-2026-infrastructure.html
相似文章
AMD呼吁IT领导者重新思考AI基础设施规划:代理型AI不仅仅是往GPU机箱里加更多CPU
AMD认为,代理型AI需要重新思考基础设施规划,需要专用的CPU机架来处理编排和控制工作负载,将CPU:GPU比例从1:8或1:4转变为1:1或更高,而不是简单地给GPU密集型服务器增加更多CPU。
@rohanpaul_ai: 代理型AI可能正在迫使将更多关注CPU的传统计算堆栈重新回到故事的中心。这里,A…
本文讨论了代理型AI如何可能将计算焦点从GPU转回CPU,引用了OpenAI的CFO和Ark Invest的CEO。它认为代理的推理涉及编排和通用任务,CPU处理这些任务更擅长。
@TechFlowPost: https://x.com/TechFlowPost/status/2067185245036659061
伯恩斯坦研报预测 Agentic AI 时代将推动 CPU 在数据中心角色逆转,服务器 CPU 可寻址市场2030年或达2230亿美元,看好海光信息、Arm等标的。
据报道,Google 与 AMD 合作设计下一代 TPU —— 混合 AI ASIC 可能集成片上 CPU 核心用于强化学习(3 分钟阅读)
据报道,Google 与 AMD 合作设计下一代 TPU,该 TPU 可能集成片上 CPU 核心以处理强化学习工作负载,有望推动 AI 硬件架构的发展。
AI 战争正从模型转向硬件,但我觉得讨论得远远不够
一篇评论文章认为,AI 竞争正从模型质量转向硬件部署与基础设施。文中指出,微软的 Project Solara、英伟达的 RTX Spark 以及字节跳动自研 CPU 等案例表明,智能体工作负载正推动着硅片与部署策略的革新。