@rohanpaul_ai: NVIDIA 刚刚发布了首个代理型 AI 基准测试结果,其中 GB300 NVL72 每兆瓦可运行多达 20 倍以上的编码代理…
摘要
NVIDIA 发布了首个代理型 AI 基准测试结果,显示 GB300 NVL72 每兆瓦可运行的编码代理数量比 H200 多出 20 倍,该测试基于 Artificial Analysis 的 AgentPerf 基准。
查看缓存全文
缓存时间: 2026/06/13 01:04
NVIDIA 刚刚发布了首个代理式 AI 基准测试结果,其中 GB300 NVL72 每兆瓦可运行的编码代理数量比 H200 高出最多 20 倍。
以往的推理基准测试大多询问系统在一次提示后能多快生成 token。
而来自 Artificial Analysis 的 AgentPerf 提出了一个更难的问题:在保持响应流畅的前提下,能同时运行多少个代理?
它测试的工作负载比常规 LLM 服务更重,因为一个代理并非一次请求加一次回答,而是一长串模型调用、代码编辑、命令执行、工具延迟以及不断增长的上下文。
该基准测试回放了来自公开仓库的、涉及 12 种以上编程语言的真实编码代理路径,请求长度从 5K 到 131K token 不等,平均约为 27K token。
NVIDIA 表示,GB300 NVL72 在最低服务层级上每兆瓦可达 61.4K 个并发代理,而 H200 仅为 2.6K 个。
这一提升源自 72 块 GPU 通过 NVLink 像一台机架级机器一样协同工作,再加上软件层将 MoE 专家工作分散、重叠通信与计算、并保持大批量处理。
@NVIDIAAIDev
相似文章
NVIDIA Blackwell 在首个自主AI基础设施基准测试中领先
NVIDIA Blackwell GB300 NVL72 平台在 Artificial Analysis 的首个自主AI基础设施基准测试 AgentPerf 中领先,每兆瓦可运行的智能体数量是上一代 Hopper 的 20 倍。
每瓦功耗工作量提升高达30倍:NVIDIA Vera Rubin NVL72为AI智能体树立新能效标准
NVIDIA Vera Rubin NVL72系统在智能体AI工作负载中,展现出每兆瓦吞吐量提升高达30倍的性能,为AI基础设施设定了新的效率标准。
NVIDIA的编码代理在ARC-AGI-3交互式推理基准测试中获得满分100%
NVIDIA的编码代理在ARC-AGI-3交互式推理基准测试中取得了100%的满分,展示了先进的AI推理能力。
@mr_r0b0t: 16个本地AI代理同时流式传输!MiniMax M2.7 NVFP4 — 2x GB10,没有云API。
演示展示了使用MiniMax M2.7 NVFP4在两个Nvidia GB10芯片上同时流式传输16个本地AI代理,无需云API。
AA-AgentPerf-Local:在笔记本和工作站上对本地 AI 智能体进行基准测试
Artificial Analysis 开源了 AA-AgentPerf-Local,这是一款推理基准测试工具,通过重放真实智能体轨迹来测量智能体式 AI 在笔记本和工作站上的运行速度,并给出了 NVIDIA DGX Spark、RTX 5090、AMD Ryzen AI Halo 和 MacBook Pro M5 Pro 的初步测试结果。