我们会迎来 Qwen 3.8 35-A3B 吗?
摘要
围绕即将发布的 Qwen 3.8 的猜测,质疑它会是稠密 27B 模型还是类似此前 35B-A3B 的 MoE 变体,并讨论了对本地硬件性能的影响。
到目前为止,看起来 Qwen 3.8 可能会在今天以 27B 稠密模型的形式发布。如果是这样的话,这次就没有 MoE 卸载了。我以前在 RTX 3060 上运行 Qwen 3.6 35B-A3B 时大约有 70 tok/s,但卸载稠密模型则完全是另一回事,它可能会慢 100 倍甚至更慢。
相似文章
等不及要看 Qwen3.8-27B
Qwen 发布了 Qwen3.8,其中包括一个全新的 27B 模型,令人对本地部署充满期待。
有没有关于Qwen 3.7 9B的消息?(同时也寻找Qwen 3.5的9B级别替代品)
讨论关于阿里巴巴潜在的开源权重发布Qwen 3.7 9B,以及寻找Qwen 3.5 9B的本地部署替代品。
Qwen 3.7 或 3.8 30B - 100B。何时发布?
用户询问Qwen模型在30B至100B参数范围内的发布时间表,猜测可能的版本为3.7或3.8。
还有人跟我一样对 Qwen 3.8 感到兴奋吗?
作者表达了对即将推出的 Qwen 3.8 模型的期待,分享了他们使用 Qwen 3.6 27B 进行本地 LLM 的体验,并讨论了自托管 AI 取代基于订阅的前沿模型的潜力。
关于用于本地编码的 Qwen-3.6 14B 和 9B 蒸馏模型有任何消息(或希望)吗?
作者询问是否有针对本地编码用途的 Qwen-3.6 模型 9B 和 14B 蒸馏变体,并提到了在有限硬件上使用 Qwen-3.5 9B 时遇到的具体工具调用和文件结构问题。