nvl72

标签

Cards List
#nvl72

NVIDIA Vera Rubin NVL72 在 MLPerf Inference v6.1 首秀中展现出领先性能

NVIDIA Blog · 6天前 缓存

NVIDIA 的 Vera Rubin NVL72 系统在 MLPerf Inference v6.1 中首次亮相,展现出领先性能。在 DeepSeek-R1 和 Qwen3-VL 等基准测试中,其吞吐量比 GB300 NVL72 最高提升达 3.7 倍。该系统强调系统性能、扩展效率以及软件优化。

0 人收藏 0 人点赞
#nvl72

Mixture-of-Kittens:我们为NVL72s提供的开源MoE巨型内核(25分钟阅读)

TLDR AI · 2026-08-05 缓存

Cursor正在开源Mixture-of-Kittens(MoK),这是一个用于NVL72s的生产级MoE训练巨型内核,它融合了通信与计算,为其Composer模型带来了1.41倍的端到端训练吞吐量提升。

0 人收藏 0 人点赞
#nvl72

@cursor_ai:我们正在开源 Mixture-of-Kittens (MoK),这是我们为 NVL72 打造的 MoE 训练巨型内核。它融合了所有 Mixture-of-Experts 的…

X AI KOLs Timeline · 2026-08-04 缓存

Cursor 正在开源 Mixture-of-Kittens (MoK),这是一个针对 NVIDIA NVL72 的融合式 MoE 训练巨型内核,其运行速度比最强的公开基线快达 2.37 倍。

0 人收藏 0 人点赞
#nvl72

SpaceX AI Sat V1的峰值功率规格已提升至约250千瓦(电池辅助),平均功率约160千瓦。将能够支持一个NVL72 Ruben机架。

Reddit r/singularity · 2026-07-16 缓存

SpaceX将其AI Sat V1的峰值功率规格提升至约250千瓦(电池辅助),平均功率约160千瓦,使其能够支持一个NVL72 Ruben机架。

0 人收藏 0 人点赞
#nvl72

@haoailab: 在最新的机架级 GPU 系统上,Attention-FFN 解聚还能胜出吗?我们构建了 FastAFD,一个开源的 AFD 运行时…

X AI KOLs Timeline · 2026-07-13 缓存

FastAFD 是一个开源的 serving 系统,用于在 Blackwell NVL72 上对 MoE 模型进行 Attention-FFN 解聚,相较于共置的 MoE 服务,其每 GPU 解码吞吐量提升了 1.35-1.45 倍。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈