nemotron

标签

Cards List
#nemotron

@no_stp_on_snek: 所以我想测试一下Nvidia的TwoTowers,但它有点大,于是我对其进行了量化。但速度非常慢。看起来像是…

X AI KOLs Following · 2026-07-03 缓存

NVIDIA TwoTower块扩散语言模型(Nemotron-Labs-TwoTower-30B-A3B-Base)的4位量化,将两个塔压缩至约38 GB,使得在单GPU上推理速度缓慢(约2-4 tok/s)。

0 人收藏 0 人点赞
#nemotron

@LiorOnAI:现在你可以将任何LLM转换成更快的版本,而无需从头重新训练。NVIDIA刚刚在他们30B的模型上实现了这一点。她…

X AI KOLs Timeline · 2026-07-01 缓存

NVIDIA提出了一种方法,将任何LLM转换为更快的版本,方法是将模型拆分为两个副本:一个冻结用于上下文,另一个训练用于并行生成多个token,实现了2.4倍加速,且质量保留约99%,仅使用了8%的训练数据。

0 人收藏 0 人点赞
#nemotron

@NVIDIAAI:我们将一个300亿参数模型一分为二,并行生成token,而非逐个生成。推出Nemotron-Labs…

X AI KOLs Timeline · 2026-07-01 缓存

NVIDIA Research推出Nemotron-Labs-TwoTower,这是一种扩散语言模型,它将一个300亿参数的模型分成两半,实现并行token生成,生成速度提升2.42倍,同时保持了原始质量的98.7%。

0 人收藏 0 人点赞
#nemotron

NVIDIA 发布了 Nemotron-TwoTower-30B-A3B-Base-BF16,这是一种基于 Nemotron 3 Nano 30B-A3B 主干构建的异常扩散型语言模型。

Reddit r/LocalLLaMA · 2026-06-25 缓存

NVIDIA 发布了 Nemotron-TwoTower-30B-A3B-Base-BF16,这是一种基于扩散的语言模型,采用逐块自回归扩散方法,通过对令牌块进行迭代去噪来生成文本,实现了自回归基线 2.42 倍的生成吞吐量,同时保留了基准测试质量 98.7% 的水平。

0 人收藏 0 人点赞
#nemotron

nvidia/NVIDIA-Nemotron-Labs-3-Puzzle-75B-A9B-NVFP4

Hugging Face Models Trending · 2026-06-24 缓存

NVIDIA 发布了 Nemotron-Labs-3-Puzzle-75B-A9B,它是 Nemotron-3-Super 的压缩版本,推理效率更高,基准测试性能强劲。

0 人收藏 0 人点赞
#nemotron

@TheAhmadOsman: 不要忽视Nemotron 3 Ultra,有时它比GPT 5.5更智能

X AI KOLs Following · 2026-06-16 缓存

作者声称Nemotron 3 Ultra比GPT 5.5更智能。

0 人收藏 0 人点赞
#nemotron

@ziv_ravid: 1/我阅读了Nemotron 3 Ultra报告,将其后训练与DeepSeek V4的对比很有趣。两者现在都…

X AI KOLs Timeline · 2026-06-15 缓存

这条推文比较了Nemotron 3 Ultra和DeepSeek V4的后训练方法,指出两者都使用多个专长教师并通过在线策略蒸馏合并到一个学生模型,但在支持重叠方面存在差异。

0 人收藏 0 人点赞
#nemotron

Nemotron - 深度之王?4个≤120B模型的对比

Reddit r/LocalLLaMA · 2026-06-14

使用Strix Halo硬件对四个大型语言模型(≤120B参数)在深度上下文性能上的比较。与GPT-OSS和Qwen模型相比,Nemotron Super在深度上下文中的提示处理速度表现出色。

0 人收藏 0 人点赞
#nemotron

@PrajwalTomar_: Nous Research 和 NVIDIA 刚刚不谋而合。不是编码工具,不是副驾驶。一个驻留在你的……的代理。

X AI KOLs Timeline · 2026-06-10 缓存

Nous Research 和 NVIDIA 分别独立地走向了相同的架构——持久化 AI 代理,这些代理驻留在服务器上并每日进化,标志着从编码副驾驶向自主服务器端代理的转变。

0 人收藏 0 人点赞
#nemotron

@llm_wizard: 顺便说一下,我们直接发布了构建Nemotron模型所需的一切,包括配方和流水线。https://…

X AI KOLs Following · 2026-06-09 缓存

NVIDIA发布了Nemotron仓库,其中包含开放的训练配方、流水线和模型权重,用于他们的Nemotron模型,包括新的Nemotron 3 Ultra和Nemotron 3 Nano Omni,支持智能体AI和多模态能力。

0 人收藏 0 人点赞
#nemotron

@auroter: Frontier AI 简直脑死亡。GPT5.5 xHigh 在 Codex 中认为我应该使用张量并行来部署 Qwen 3.6 27B 在我的系统上…

X AI KOLs Following · 2026-06-08 缓存

作者批评 Frontier AI(GPT5.5 xHigh)错误地建议对一个能单 GPU 容纳的模型使用张量并行,并宣布计划进行一场对决,比较多个 AI 模型(GPT5.5、Opus 4.8、Qwen 系列、Nemotron)在真实问题上的表现。

0 人收藏 0 人点赞
#nemotron

OpenClaw 免费顶级模型

Reddit r/openclaw · 2026-06-08

一位用户分享道,NVIDIA 目前正在免费提供顶级 AI 模型,如 Nemotron Ultra、DS4flash、Kimi、GLM 和 Minimax3,但有速率限制,可能对个人用户有益。

0 人收藏 0 人点赞
#nemotron

@cyrilXBT: Nemotron 3 Ultra 对比 DeepSeek V4 对比 MiniMax M3 对比 Qwen 3.7 Max。相同两个提示词。四个前沿模型。一个…

X AI KOLs Following · 2026-06-06 缓存

四种前沿AI模型(Nemotron 3 Ultra、DeepSeek V4、MiniMax M3、Qwen 3.7 Max)在相同两个提示词上的对比,附完整结果链接。

0 人收藏 0 人点赞
#nemotron

Nvidia的Nemotron系列是最开源的一系列模型。我发现:- 基准测试要求 - 所有GitHub仓库 - 所有数据 - 权重 而且它们表现很好,实际上非常独特。他们发布NVFP4基准测试,结果仅差1% https://t.co/dQ2PwarUfO

X AI KOLs Following · 2026-06-04 缓存

Nvidia的Nemotron系列AI模型完全开源,包含基准测试、GitHub仓库、数据和权重,性能上与NVFP4基准测试仅差1%。

0 人收藏 0 人点赞
#nemotron

@rasbt:又一个开源权重发布。Nemotron 3 Ultra 拥有令人印象深刻的性能效率比!在设计上,它……

X AI KOLs Timeline · 2026-06-04 缓存

Nemotron 3 Ultra 是一个开源权重发布,具有令人印象深刻的性能效率比,采用 Mamba-2 与注意力机制的混合栈和 LatentMoE,并且比之前的 Super 变体更大。

0 人收藏 0 人点赞
#nemotron

NVIDIA Nemotron 3 Ultra 已发布。

Reddit r/LocalLLaMA · 2026-06-04

NVIDIA 发布了 Nemotron 3 Ultra,这是一款新模型,旨在为长期运行的 AI 智能体提供更快、更高效的推理能力。

0 人收藏 0 人点赞
#nemotron

@kwindla: https://x.com/kwindla/status/2062544580105359686

X AI KOLs Timeline · 2026-06-04 缓存

NVIDIA 发布了 Nemotron 3.5 ASR,这是一款开源的多语言语音转文字模型,在测试中延迟最低,提供多语言和纯英文两个版本,非常适合语音助手和自托管部署场景。

0 人收藏 0 人点赞
#nemotron

@mervenoyann: NVIDIA Nemotron Ultra 来了 > 55B/550B 混合MoE  百万上下文窗口 > 支持MTP推测解码 > da…

X AI KOLs Following · 2026-06-04 缓存

NVIDIA发布了Nemotron Ultra,这是一个拥有55B/550B参数的混合MoE模型,具有百万上下文窗口,支持MTP推测解码,并在transformers中提供day-0支持。

0 人收藏 0 人点赞
#nemotron

nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B-NVFP4

Hugging Face Models Trending · 2026-06-03 缓存

NVIDIA 发布 Nemotron-3-Ultra,一个拥有 5500 亿参数的开源权重模型,采用结合 Mamba-2、MoE 和注意力的混合架构,支持高达 100 万 token 的上下文长度和可配置的推理模式。

0 人收藏 0 人点赞
#nemotron

@FinanceYF5: 来源:

X AI KOLs Following · 2026-06-02 缓存

英伟达宣布将于本周发布Nemotron 3 Ultra。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈