@FinanceYF5: NVIDIA发布Nemotron 3.5 Lightning 30B 总参数,激活只有 3B,支持 100 万 token 上下文,可商用。 本地部署友好:BF16 和更小的 NVFP4 版本,单卡 H100 或 DGX Spark 就能…

X AI KOLs Following 模型

摘要

NVIDIA 发布 Nemotron 3.5 Lightning 30B 模型,总参数30B,激活仅3B,支持100万token上下文,可商用,本地部署友好,输出速度最高提升4倍。

NVIDIA发布Nemotron 3.5 Lightning 30B 总参数,激活只有 3B,支持 100 万 token 上下文,可商用。 本地部署友好:BF16 和更小的 NVFP4 版本,单卡 H100 或 DGX Spark 就能跑,RTX 5090 也在支持列表里。 官方称输出速度最高提升 4 倍,PinchBench 上准确率 86%,比同准确率的 Qwen3.6 35B 快 30%。 https://t.co/KbbCAWfuF5
查看原文
查看缓存全文

缓存时间: 2026/08/12 10:24

NVIDIA发布Nemotron 3.5 Lightning

30B 总参数,激活只有 3B,支持 100 万 token 上下文,可商用。

本地部署友好:BF16 和更小的 NVFP4 版本,单卡 H100 或 DGX Spark 就能跑,RTX 5090 也在支持列表里。

官方称输出速度最高提升 4 倍,PinchBench 上准确率 86%,比同准确率的 Qwen3.6 35B 快 30%。 https://t.co/KbbCAWfuF5

相似文章

nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4

Hugging Face Models Trending

NVIDIA released Nemotron 3.5 Lightning 30B-A3B-NVFP4, a hybrid MoE LLM with 3B active parameters, up to 1M context, and speculative decoding support for efficient single-GPU inference.

nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B-NVFP4

Hugging Face Models Trending

NVIDIA 发布 Nemotron-3-Ultra,一个拥有 5500 亿参数的开源权重模型,采用结合 Mamba-2、MoE 和注意力的混合架构,支持高达 100 万 token 的上下文长度和可配置的推理模式。