使用一天后,我觉得可以这么说:Muse-Glimmer-30B 在部分使用场景下终于以同等规模击败了 3.6-27B
摘要
一位用户报告称,Muse-Glimmer-30B 在推理效率和常识知识方面优于 Qwen3.6-27B,但在编码方面稍弱,使其成为 24GB GPU 上的可行选择。
首先说几点:它的推理非常高效。像 Grok 4.5 级别的思维效率,而且量化效果很好。我用 iq3_xxs 进行的初步测试表现优于 Qwen/Gemma 在该规模下的表现,其知识深度令人惊叹。它在不使用工具的情况下击败了 Qwen3.6 27B 的常识问答。在 OpenCode 中,它是一个比 27B 高效得多的智能体。两个模型都能完成任务,但 Muse-Glimmer 每次都更快。我得说它在大多数编码任务上表现较差,可能更接近 Gemma4-31B 的水平……但天哪,现在有很多场景我会在 24GB GPU 上使用这个模型,而且除了 3.6-27B 之外,已经很久没有模型能填补这个位置了。
相似文章
@TheAhmadOsman: Qwen 3.8 27B 能否在与 Muse Glimmer 30B 的对抗中卷土重来?无论如何,对这次发布感到非常高兴
一位用户对新的AI模型发布表示兴奋,并推测 Qwen 3.8 27B 能否与 Muse Glimmer 30B 竞争。
Muse Glimmer 居然真的能装进单张 RTX 3090
用户报告称,30B 参数的 Muse Glimmer 使用 Q4_K_XL 量化和 DFlash,在单张 RTX 3090 上即可运行,并支持完整的 256k 上下文,速度达到 64-124 tok/s,且长上下文检索完美,与同类模型不同。
通俗版对比:Qwen3.6 35b-a3b 与 Gemma4-26b-a4b-it
Gemma 4-26b-a4b-it 基本是个基础扎实、能稳妥完成任务的 B 等生。Qwen3.6-35b-a3b 则是考出 A+ 的优等生,做完任务后还有余力搞点锦上添花的发挥。在我的 16GB 显存显卡上,两款模型运行速度相当。测试环境为 Windows 下的 LM Studio,采用推荐推理设置。使用的模型:unsloth/gemma-4-26B-A4B-it-UD-Q4_K_S 与 AesSedai/Qwen3.6-35B-A3B IQ4_XS。大家有不同意见吗?**更新:** 看来我之前用 Gemma 4 的方式不太对。[Sadman782 的评论](https://www.redd
Qwen 3.6 27B 简直是个猛兽
有开发者实测,新的 27B Qwen 3.6 模型在 24GB 显存笔记本上跑得飞起,所有 PySpark/Python 数据转换基准全部通过,再也不用买云算力订阅了。
在本地使用 OpenCode 测试 Muse Glimmer 的编码与智能体工作
一位用户分享了在 llama.cpp 上使用 OpenCode 对 Muse Glimmer(通过 Unsloth 的 Q4 量化)进行本地测试,指出其性能低于 Qwen3.6 27B,但工具调用可靠。