我想试试 qwen 3.8... 但大家用的是哪个 GGUF 版本?

Reddit r/LocalLLaMA 新闻

摘要

一位用户讨论为 Qwen 3.8 AI 模型选择合适的 GGUF 量化变体以在 32 GB 显存下获得良好性能的挑战,寻求社区推荐。

大家都很清楚 qwen 3.8 不是玩具。但对于像我这样偶尔参与的人来说,我搞不清楚到底该尝试什么才能达到期待的性能。我读到 q4_k_m 变体效果不会好。我想知道哪个才真正值得尝试。我有 32 GB 显存。
查看原文

相似文章

empero-ai/Qwen3.8-27B-Ridge-GGUF

Hugging Face Models Trending

本文介绍了Qwen3.8-27B AI模型的量化GGUF版本发布,该版本针对有限显存硬件上的高效本地推理进行了优化。

ISTA-DASLab/Qwen3.8-27B-GSQ-RCO-GGUF

Hugging Face Models Trending

该仓库提供了使用GSQ和RCO方法对Qwen3.8-27B AI模型进行GGUF量化的版本,以便在标准工具中高效部署。