Nvidia 的 Vera CPU、DGX Station、Windows PC 都指向同一个目标:本地运行的 AI 代理

Reddit r/ArtificialInteligence 新闻

摘要

Nvidia CEO Jensen Huang 宣布了 Vera CPU、适用于 Windows 的 DGX Station 以及其他 PC,旨在支持本地 AI 代理,强调本地推理以控制 token 成本。

暂无内容
查看原文
查看缓存全文

缓存时间: 2026/06/02 05:52

# 英伟达Vera CPU、DGX Station与Windows PC殊途同归:本地运行AI智能体 来源:https://www.constellationr.com/insights/news/nvidias-vera-cpu-dgx-station-windows-pcs-all-go-same-place-ai-agents-running-locally 英伟达CEO黄仁勋在Computex的主题演讲中展示了Nvidia RTX Spark、面向Windows的DGX Station、一系列PC,以及首次亮相的Vera CPU——这款处理器可能进一步扩展英伟达的影响力。 在多年听惯"GPU即一切"的说法后,英伟达如此热衷于CPU显得颇具讽刺意味。尽管如此,黄仁勋仍在为Microsoft Windows撒上一些智能体AI的魔法。 黄仁勋发布了常规的新闻轰炸(https://nvidianews.nvidia.com/online-press-kit/gtc-taipei-at-computex-2026-news),包括他反复提及的"Token转化为收入"的老调。然而,英伟达这个"PC狂欢日"揭示了对于试图规模化AI智能体的企业和开发者来说已经显而易见的事实——你必须在本地优化你的智能体AI,否则预算将不堪重负。 英伟达CEO指出,基于Vera的Windows CPU全面升级相当于"40年来首次完整的产品线PC革新",强调了一款被称为"个人智能体盒子"的桌面设备,并称Nvidia DGX Station for Windows是"桌面级AP超级计算机"。 黄仁勋表示,随着时间的推移,PC将意味着"你的家中真的有一台AI超级计算机",它"更像R2D2和C-3PO,而不像一台传统PC。" **英伟达PC** "这是旅程的起点,"黄仁勋补充说,每一代英伟达架构都将包括台式机、笔记本电脑和工作站。 从企业高管的角度来看,这一系统阵容可能等同于分布式本地部署。至少英伟达正在抢先应对AI推理成本可能带来的反弹。 - **BT150时代精神:寻找AI智能体投资回报率**(https://www.constellationr.com/insights/news/bt150-zeitgeist-search-ai-agent-roi) - **CIO视AI智能体为旅程,Token预算成隐忧——Box CEO Levie称**(https://www.constellationr.com/insights/news/cios-see-ai-agents-journey-token-budgets-concern-says-box-ceo-levie) - **AI推理成本将成重大关注:如何解决?**(https://www.constellationr.com/index%2Ephp/insights/news/ai-inference-costs-are-going-be-big-concern-whats-fix) - **AI论坛2026:AI没有简单按钮**(https://www.constellationr.com/insights/news/ai-forum-2026-there-isnt-easy-button-ai) - **Constellation Research的未来论坛:CEO在想什么**(https://www.constellationr.com/insights/news/constellation-researchs-futures-forum-what-ceos-are-thinking) - **其他人的Token经济学在哪里?**(https://www.constellationr.com/insights/news/wheres-tokenomics-rest-us) 谁会想到,所有那些AI工厂现在都需要大规模PC升级(https://www.constellationr.com/insights/news/pcs-and-workstations-get-their-ai-inference-moment)才能让Token经济学运转起来? 以下是英伟达在Computex上宣布的内容。 ## **Nvidia DGX Station for Windows 发布** 该系统将Windows带入开发者的智能体AI时代。DGX Station for Windows基于Nvidia GB300 Grace Blackwell Ultra Desktop Superchip,将于今年第四季度上市。 企业可以使用DGX Station构建AI智能体,无需承担云成本。DGX Station将支持Windows上的Nvidia OpenShell。该系统能够本地运行高达1万亿参数的前沿AI模型。 对于微软而言,英伟达的助力意义重大。英伟达指出(https://nvidianews.nvidia.com/news/nvidia-dgx-station-for-windows-puts-a-trillion-parameter-ai-supercomputer-on-every-enterprise-desk): > "历史上,重型企业AI工作负载——训练、微调、大规模推理和多智能体开发——需要在数据中心运行Linux的强大AI系统,而《财富》500强中的绝大多数公司使用Windows进行日常生产力、创意、设计和工程应用。" 英伟达的DGX Station可能会将Windows开发者及更多企业带入AI智能体的派对。 **DGX Station Windows** 简而言之,微软需要英伟达的帮助,才能使Windows成为AI智能体平台。 - **英伟达Q1财报亮眼,展望上调**(https://www.constellationr.com/insights/news/nvidia-q1-shines-outlook-raised) - **英伟达GTC 2026:黄仁勋分析师会议八大要点**(https://www.constellationr.com/insights/news/nvidia-gtc-2026-8-takeaways-huangs-analyst-meetings) ## **Vera CPU** 英伟达不会将CPU市场拱手让给那些老面孔——包括Intel、AMD以及近期凭借Arm处理器在Windows系统上取得先发优势的Qualcomm。 黄仁勋推崇Vera CPU(https://nvidianews.nvidia.com/news/nvidia-unveils-vera-the-cpu-for-agents)来为桌面上的AI智能体提供动力,但或许更大的布局是确保英伟达在数据中心拥有完整的技术栈。毕竟,企业在AI推理中使用了大量CPU,而最大的威胁来自超大规模厂商的定制芯片——比如Google TPU和AWS Graviton。 Vera将为英伟达独立服务器、现已全面投产的Nvidia Vera Rubin系统以及AI存储平台提供动力。英伟达特别提到,Vera正在被添加到Anthropic、OpenAI和SpaceX的AI工厂中,并且被字节跳动、CoreWeave和Oracle Cloud Infrastructure所采用。 Dell Technologies、HPE、联想以及其他众多厂商也将构建基于Vera CPU的系统。 英伟达表示,Vera比x86替代方案快1.8倍。但并未提及Vera在AI工厂中与Arm处理器的对比情况。 ## **Nvidia RTX Spark** 英伟达发布了RTX Spark,这是一款1-petaflop超级芯片,在轻薄笔记本中支持Nvidia AI技术栈。 该系统(https://nvidianews.nvidia.com/news/nvidia-microsoft-windows-pcs-agents-rtx-spark)旨在提供Windows体验,以吸引AI开发者、创意人士和游戏玩家。后一类受众覆盖了英伟达的侧翼,因为英伟达此前一直专注于AI基础设施。 华硕、戴尔、惠普、联想、微软Surface和微星将率先推出基于RTX Spark的PC,宏碁和技嘉的机型随后跟进。 黄仁勋表示,这些Windows笔记本电脑和台式机专为"个人智能体打造",为开发者提供了运行OpenClaw和Hermes Agent的紧凑型系统。RTX Spark将包含Nvidia OpenShell和Windows安全原语。 要点: - 预计这些系统厚度为14毫米,重量轻至3磅。 - RTX Spark笔记本电脑将有14英寸和16英寸版本。 - 微软将在Microsoft Build上推广RTX Spark系统并阐述Windows视角。 ## **本地AI智能体推动** 黄仁勋强调了本地构建个人智能体的能力,并反复提及开放权重模型。 英伟达的核心思路是:其基础设施可以从AI工厂一直延伸到桌面。智能体将本地与应用交互、生成内容并自动化流程。 这种方法还将缓解AI推理成本问题。 最终,英伟达的这款CPU和本地系统将扩展到机器人及其他形态。英伟达发布了Cosmos 3(https://nvidianews.nvidia.com/news/nvidia-launches-cosmos-3-the-open-frontier-foundation-model-for-physical-ai),这是一个新的物理AI基础模型,具备原生视觉推理能力。 英伟达一直倡导开放模型。Cosmos 3得到Agile Robots、Black Forest Labs、Generalist、LTX、Runway和Skild AI的支持。Cosmos 3包含三个版本: - Cosmos 3 Super:用于后训练机器人及自动驾驶车辆模型 - Cosmos 3 Nano:用于快速推理 - Cosmos 3 Edge:用于实时推理 英伟达还介绍了用于无人出租车的Alphamayo 2,以及开放的Nvidia-Groot人形机器人参考设计(https://nvidianews.nvidia.com/news/nvidia-open-humanoid-robot-reference-design)。

相似文章

NVIDIA刚刚发布了全新的Vera CPU——据称比x86快两倍

Reddit r/ArtificialInteligence

NVIDIA宣布了采用全新Vera架构的CPU,该架构从头开始为智能代理AI和强化学习而设计,声称性能达到x86替代方案的两倍。Vera Rubin NVL72平台集成了72个GPU和36个CPU,主要客户包括Meta、Oracle和Alibaba。