Qwen 35b a3b 令我惊喜
摘要
用户报告了使用 Qwen 35b a3b 进行代理编码任务的积极体验,指出在其使用场景中它优于 Gemma4 26b,并且在演示/数据分析方面表现出色,尤其是在代理模式而非聊天模式下。
只是想分享一下,我对 Qwen 35b a3b 的代理编码性能非常满意。我以 q80 量化运行该模型,kv cache 也设为 q8_0,上下文长度 262144,在 4090 + 5060 ti 上,通过 llama.cpp 后端,并使用指向 localhost 的 claude code。对于演示/数据分析用途,它表现相当不错。我还没有在大型代码库上使用它,但在我的使用场景中,它绝对比 Gemma4 26b 更好。有一件事让我惊讶:它在代理编码方面的表现似乎比聊天更好。当仅使用聊天 UI 时,我发现 Qwen35b 提供的代码有些笨重。我想知道其他人是否已经将其性能与开源测试框架(Pi / opencode)进行了比较。
相似文章
Qwen3.6 是当前本地代理使用的最佳模型吗?
有用户报告称,Qwen3.6 35B A3B 在代理任务上优于 Gemma4 和 GLM 4.7 Flash REAP 等其他本地模型,不过偶尔仍会出现循环。
Qwen 3.6 27B 太牛了
一位用户分享了在本地使用 Qwen 3.6 27B 进行复杂研究和编程的积极体验,发现它在职业建议和移民研究方面优于 Gemini Pro,同时也提到 Gemma 4 31B 存在性能问题。
Qwen3.8-27B Q6 在代理编码方面是性能怪兽
用户反馈显示,Qwen3.8-27B Q6 在代理编码任务中表现出高性能,在双 NVIDIA GPU 上持续运行 20 小时,保持 60-63 tokens/s 的速度。
Qwen 3.8 27b 即使在 Q3_xxs 下也很强大
用户发现 Qwen 3.8 27b 在 Q3 量化下对编码任务非常高效,推理速度快,超越了之前的模型,尽管在日常对话中存在一些小问题。
Gemma 4 31B 的能力让我惊讶
一位用户分享了轶事发现:Gemma 4 31B 在理解和重构杂乱的学术代码方面优于 Qwen 3.6 模型,并与 Opus 4.7 能力相当,还突出了一个 Gemma 擅长的基准测试(SciCode)。