@mr_r0b0t: 叫上兄弟们,新的 @UnslothAI NVFP4 刚刚发布

X AI KOLs Following 模型

摘要

Unsloth AI 发布了新的 NVFP4 量化 Qwen3.6 模型,在 GPU 上运行速度提升 2.5 倍,并提高了准确性和工具调用能力。

叫上兄弟们,新的 @UnslothAI NVFP4 刚刚发布 🔥 https://t.co/Y7RQKPiWhC
查看原文
查看缓存全文

缓存时间: 2026/07/10 22:16

叫上兄弟们,@UnslothAI 的 NVFP4 新版本刚上线了 🔥 https://t.co/Y7RQKPiWhC

Unsloth AI (@UnslothAI): 我们发布了全新的 Qwen3.6 量化版本,在 GPU 上运行速度提升 2.5 倍。

Qwen3.6-27B NVFP4 可在 24GB 显存下运行。 35B-A3B 可达 17,561 tok/s(B200)。

我们还提升了准确性、工具调用、智能体使用和循环性能。

指南:https://t.co/EEQIlFrR0c Qwen3.6 NVFP4:

相似文章

unsloth/Qwen3.8-27B-NVFP4

Hugging Face Models Trending

Unsloth 发布了 Qwen3.8-27B AI 模型的 NVFP4 量化版本,该模型在编码、专业工作、智能体任务和原生视觉语言理解方面提供了增强的能力。

unsloth/Qwen3.6-27B-NVFP4

Hugging Face Models Trending

Unsloth 发布了 Qwen3.6-27B 的 NVFP4 量化检查点,声称吞吐量提升 2.5 倍,精度与 FP8 和 BF16 相当,并提供了在 24GB GPU 上通过 vLLM 运行的说明。