我们会迎来 Qwen 3.8 35-A3B 吗?

Reddit r/LocalLLaMA 模型

摘要

围绕即将发布的 Qwen 3.8 的猜测,质疑它会是稠密 27B 模型还是类似此前 35B-A3B 的 MoE 变体,并讨论了对本地硬件性能的影响。

到目前为止,看起来 Qwen 3.8 可能会在今天以 27B 稠密模型的形式发布。如果是这样的话,这次就没有 MoE 卸载了。我以前在 RTX 3060 上运行 Qwen 3.6 35B-A3B 时大约有 70 tok/s,但卸载稠密模型则完全是另一回事,它可能会慢 100 倍甚至更慢。
查看原文

相似文章

等不及要看 Qwen3.8-27B

Reddit r/LocalLLaMA

Qwen 发布了 Qwen3.8,其中包括一个全新的 27B 模型,令人对本地部署充满期待。

还有人跟我一样对 Qwen 3.8 感到兴奋吗?

Reddit r/LocalLLaMA

作者表达了对即将推出的 Qwen 3.8 模型的期待,分享了他们使用 Qwen 3.6 27B 进行本地 LLM 的体验,并讨论了自托管 AI 取代基于订阅的前沿模型的潜力。