2.5倍更快的Qwen3.6 NVFP4 Unsloth量化版本

Reddit r/LocalLLaMA 工具

摘要

Unsloth推出使用NVFP4格式的量化Qwen3.6模型,推理速度提升2.5倍。

暂无内容
查看原文

相似文章

unsloth/Qwen3.6-27B-NVFP4

Hugging Face Models Trending

Unsloth 发布了 Qwen3.6-27B 的 NVFP4 量化检查点,声称吞吐量提升 2.5 倍,精度与 FP8 和 BF16 相当,并提供了在 24GB GPU 上通过 vLLM 运行的说明。

unsloth/Qwen3.8-27B-NVFP4

Hugging Face Models Trending

Unsloth 发布了 Qwen3.8-27B AI 模型的 NVFP4 量化版本,该模型在编码、专业工作、智能体任务和原生视觉语言理解方面提供了增强的能力。