有人试过 Mach-1 Additive 吗?性能是 Qwen 3.6 35B 的95%,体积却小10倍

Reddit r/LocalLLaMA 模型

摘要

用户询问关于 Mach-1 Additive 的情况,据称该模型在体积小10倍的情况下,实现了 Qwen 3.6 35B 95% 的性能,并质疑为什么它没有得到更广泛的讨论。

为什么没人讨论这个?对社区来说似乎相当重要。
查看原文

相似文章

Qwen 3.6 35B A3B 的热度绝非虚名!

Reddit r/LocalLLaMA

作者对小型本地 LLM 进行了基准测试,重点突出了 Qwen 3.6 35B A3B,其将学术代码与研究论文进行映射的能力优于 Gemma 4 和 Nemotron 3 Nano 等模型。

我们会迎来 Qwen 3.8 35-A3B 吗?

Reddit r/LocalLLaMA

围绕即将发布的 Qwen 3.8 的猜测,质疑它会是稠密 27B 模型还是类似此前 35B-A3B 的 MoE 变体,并讨论了对本地硬件性能的影响。