Nvidia 的 Vera CPU、DGX Station、Windows PC 都指向同一个目标:本地运行的 AI 代理
摘要
Nvidia CEO Jensen Huang 宣布了 Vera CPU、适用于 Windows 的 DGX Station 以及其他 PC,旨在支持本地 AI 代理,强调本地推理以控制 token 成本。
暂无内容
查看缓存全文
缓存时间: 2026/06/02 05:52
# 英伟达Vera CPU、DGX Station与Windows PC殊途同归:本地运行AI智能体
来源:https://www.constellationr.com/insights/news/nvidias-vera-cpu-dgx-station-windows-pcs-all-go-same-place-ai-agents-running-locally
英伟达CEO黄仁勋在Computex的主题演讲中展示了Nvidia RTX Spark、面向Windows的DGX Station、一系列PC,以及首次亮相的Vera CPU——这款处理器可能进一步扩展英伟达的影响力。
在多年听惯"GPU即一切"的说法后,英伟达如此热衷于CPU显得颇具讽刺意味。尽管如此,黄仁勋仍在为Microsoft Windows撒上一些智能体AI的魔法。
黄仁勋发布了常规的新闻轰炸(https://nvidianews.nvidia.com/online-press-kit/gtc-taipei-at-computex-2026-news),包括他反复提及的"Token转化为收入"的老调。然而,英伟达这个"PC狂欢日"揭示了对于试图规模化AI智能体的企业和开发者来说已经显而易见的事实——你必须在本地优化你的智能体AI,否则预算将不堪重负。
英伟达CEO指出,基于Vera的Windows CPU全面升级相当于"40年来首次完整的产品线PC革新",强调了一款被称为"个人智能体盒子"的桌面设备,并称Nvidia DGX Station for Windows是"桌面级AP超级计算机"。
黄仁勋表示,随着时间的推移,PC将意味着"你的家中真的有一台AI超级计算机",它"更像R2D2和C-3PO,而不像一台传统PC。"
**英伟达PC**
"这是旅程的起点,"黄仁勋补充说,每一代英伟达架构都将包括台式机、笔记本电脑和工作站。
从企业高管的角度来看,这一系统阵容可能等同于分布式本地部署。至少英伟达正在抢先应对AI推理成本可能带来的反弹。
- **BT150时代精神:寻找AI智能体投资回报率**(https://www.constellationr.com/insights/news/bt150-zeitgeist-search-ai-agent-roi)
- **CIO视AI智能体为旅程,Token预算成隐忧——Box CEO Levie称**(https://www.constellationr.com/insights/news/cios-see-ai-agents-journey-token-budgets-concern-says-box-ceo-levie)
- **AI推理成本将成重大关注:如何解决?**(https://www.constellationr.com/index%2Ephp/insights/news/ai-inference-costs-are-going-be-big-concern-whats-fix)
- **AI论坛2026:AI没有简单按钮**(https://www.constellationr.com/insights/news/ai-forum-2026-there-isnt-easy-button-ai)
- **Constellation Research的未来论坛:CEO在想什么**(https://www.constellationr.com/insights/news/constellation-researchs-futures-forum-what-ceos-are-thinking)
- **其他人的Token经济学在哪里?**(https://www.constellationr.com/insights/news/wheres-tokenomics-rest-us)
谁会想到,所有那些AI工厂现在都需要大规模PC升级(https://www.constellationr.com/insights/news/pcs-and-workstations-get-their-ai-inference-moment)才能让Token经济学运转起来?
以下是英伟达在Computex上宣布的内容。
## **Nvidia DGX Station for Windows 发布**
该系统将Windows带入开发者的智能体AI时代。DGX Station for Windows基于Nvidia GB300 Grace Blackwell Ultra Desktop Superchip,将于今年第四季度上市。
企业可以使用DGX Station构建AI智能体,无需承担云成本。DGX Station将支持Windows上的Nvidia OpenShell。该系统能够本地运行高达1万亿参数的前沿AI模型。
对于微软而言,英伟达的助力意义重大。英伟达指出(https://nvidianews.nvidia.com/news/nvidia-dgx-station-for-windows-puts-a-trillion-parameter-ai-supercomputer-on-every-enterprise-desk):
> "历史上,重型企业AI工作负载——训练、微调、大规模推理和多智能体开发——需要在数据中心运行Linux的强大AI系统,而《财富》500强中的绝大多数公司使用Windows进行日常生产力、创意、设计和工程应用。"
英伟达的DGX Station可能会将Windows开发者及更多企业带入AI智能体的派对。
**DGX Station Windows**
简而言之,微软需要英伟达的帮助,才能使Windows成为AI智能体平台。
- **英伟达Q1财报亮眼,展望上调**(https://www.constellationr.com/insights/news/nvidia-q1-shines-outlook-raised)
- **英伟达GTC 2026:黄仁勋分析师会议八大要点**(https://www.constellationr.com/insights/news/nvidia-gtc-2026-8-takeaways-huangs-analyst-meetings)
## **Vera CPU**
英伟达不会将CPU市场拱手让给那些老面孔——包括Intel、AMD以及近期凭借Arm处理器在Windows系统上取得先发优势的Qualcomm。
黄仁勋推崇Vera CPU(https://nvidianews.nvidia.com/news/nvidia-unveils-vera-the-cpu-for-agents)来为桌面上的AI智能体提供动力,但或许更大的布局是确保英伟达在数据中心拥有完整的技术栈。毕竟,企业在AI推理中使用了大量CPU,而最大的威胁来自超大规模厂商的定制芯片——比如Google TPU和AWS Graviton。
Vera将为英伟达独立服务器、现已全面投产的Nvidia Vera Rubin系统以及AI存储平台提供动力。英伟达特别提到,Vera正在被添加到Anthropic、OpenAI和SpaceX的AI工厂中,并且被字节跳动、CoreWeave和Oracle Cloud Infrastructure所采用。
Dell Technologies、HPE、联想以及其他众多厂商也将构建基于Vera CPU的系统。
英伟达表示,Vera比x86替代方案快1.8倍。但并未提及Vera在AI工厂中与Arm处理器的对比情况。
## **Nvidia RTX Spark**
英伟达发布了RTX Spark,这是一款1-petaflop超级芯片,在轻薄笔记本中支持Nvidia AI技术栈。
该系统(https://nvidianews.nvidia.com/news/nvidia-microsoft-windows-pcs-agents-rtx-spark)旨在提供Windows体验,以吸引AI开发者、创意人士和游戏玩家。后一类受众覆盖了英伟达的侧翼,因为英伟达此前一直专注于AI基础设施。
华硕、戴尔、惠普、联想、微软Surface和微星将率先推出基于RTX Spark的PC,宏碁和技嘉的机型随后跟进。
黄仁勋表示,这些Windows笔记本电脑和台式机专为"个人智能体打造",为开发者提供了运行OpenClaw和Hermes Agent的紧凑型系统。RTX Spark将包含Nvidia OpenShell和Windows安全原语。
要点:
- 预计这些系统厚度为14毫米,重量轻至3磅。
- RTX Spark笔记本电脑将有14英寸和16英寸版本。
- 微软将在Microsoft Build上推广RTX Spark系统并阐述Windows视角。
## **本地AI智能体推动**
黄仁勋强调了本地构建个人智能体的能力,并反复提及开放权重模型。
英伟达的核心思路是:其基础设施可以从AI工厂一直延伸到桌面。智能体将本地与应用交互、生成内容并自动化流程。
这种方法还将缓解AI推理成本问题。
最终,英伟达的这款CPU和本地系统将扩展到机器人及其他形态。英伟达发布了Cosmos 3(https://nvidianews.nvidia.com/news/nvidia-launches-cosmos-3-the-open-frontier-foundation-model-for-physical-ai),这是一个新的物理AI基础模型,具备原生视觉推理能力。
英伟达一直倡导开放模型。Cosmos 3得到Agile Robots、Black Forest Labs、Generalist、LTX、Runway和Skild AI的支持。Cosmos 3包含三个版本:
- Cosmos 3 Super:用于后训练机器人及自动驾驶车辆模型
- Cosmos 3 Nano:用于快速推理
- Cosmos 3 Edge:用于实时推理
英伟达还介绍了用于无人出租车的Alphamayo 2,以及开放的Nvidia-Groot人形机器人参考设计(https://nvidianews.nvidia.com/news/nvidia-open-humanoid-robot-reference-design)。
相似文章
Vera到来:英伟达首款为智能体打造的CPU抵达顶级AI实验室
英伟达亲手将首批Vera CPU交付给Anthropic、OpenAI、甲骨文云基础设施和SpaceXAI,标志着专为智能体AI工作负载设计的CPU到来。
AI创新者采用NVIDIA Vera — 大规模最高单线程CPU为何至关重要
NVIDIA推出Vera,一款专为智能AI时代设计的新型最高单线程CPU,通过优化每核性能来加速AI智能体循环,最大化AI工厂收入。
@CNET:Nvidia CEO 黄仁勋在 GTC 2026 详解 Vera Rubin 系统
在 Nvidia GTC 2026 上,CEO 黄仁勋发布了下一代 Vera Rubin 系统;Supermicro 也推出基于 Nvidia Blackwell GPU 的全栈 AI Factory 产品组合,实现企业级 AI 一站式部署。
NVIDIA Vera CPU 开启洛斯阿拉莫斯国家实验室代理科学 AI 之路
NVIDIA 宣布其 Vera CPU 将为洛斯阿拉莫斯国家实验室的新超级计算机提供动力,为代理型 AI 模拟和科学工作负载带来显著性能提升。
NVIDIA刚刚发布了全新的Vera CPU——据称比x86快两倍
NVIDIA宣布了采用全新Vera架构的CPU,该架构从头开始为智能代理AI和强化学习而设计,声称性能达到x86替代方案的两倍。Vera Rubin NVL72平台集成了72个GPU和36个CPU,主要客户包括Meta、Oracle和Alibaba。