我是不是哪里做错了?Qwen 3.8 27B 在代理式编程中似乎毫无用处
摘要
一位用户报告在使用 Qwen 3.8 27B 模型进行代理式编程任务时遇到困难,指出与其他模型相比效率低下和错误,并寻求关于潜在设置问题的建议。
我断断续续使用本地模型大约两年了,但从未真正广泛使用,因为封闭模型总是好得多。Qwen 3.8 27B 发布后,我决定再次认真尝试。我配置了 Cline 和 ZooCode 作为 VSCode 插件,安装了几个 MCP 服务器并添加了一项技能。当我使用 Deepseek V4 Flash 的这些工具时——它们做得相当好(主要是 Home Assistant 配置编辑等),但仍比我工作中使用的 Claude Code/GitHub copilot 差得多。使用 Qwen 时——运行来自 unsloth 的 Q6_K 量化——它运行大量令牌,最终要么完成任务(经常不正确),要么根本不完成,因为它进入循环或试图修复没有问题的东西。我在 Windows 11 上使用 LM Studio 运行模型。我拥有的硬件足够强大——2x3090Ti。我将其完全卸载到 GPU 并将上下文限制设置为大约 50k 令牌。此外——我知道过度思考的问题,所以我修改了提示模板以使用中等努力。尽管如此——我仍然难以完成大多数手头的任务。你能告诉我我做错了什么吗?我怀疑 Qwen 可能仍在使用高推理努力,但我无法检查。或者我不应该使用 LM Studio 而使用其他工具?
相似文章
Qwen 3.6 27B 在代理任务上完全失败
一位用户报告称,Qwen 3.6 27B 虽然在单次提示任务中表现强劲,但在代理任务中频繁出错,导致其不得不回退到 Qwen 3.5 122B。
我对Qwen 3.8在代理编码中的初步看法
对使用Qwen 3.8模型进行代理编码的个人评测,称赞其处理复杂任务(如将llama.cpp与Godot集成)的能力,同时指出存在循环问题。
我无法让Qwen3.6 27B超越Qwen-Coder-Next,不确定原因
用户报告称,Qwen-Coder-Next 在实际测试和合成基准测试中均优于 Qwen3.6 27B,尽管其他人称赞 27B,用户寻求关于可能设置问题的建议。
Qwen 35b a3b 令我惊喜
用户报告了使用 Qwen 35b a3b 进行代理编码任务的积极体验,指出在其使用场景中它优于 Gemma4 26b,并且在演示/数据分析方面表现出色,尤其是在代理模式而非聊天模式下。
Qwen3.8-27B Q6 在代理编码方面是性能怪兽
用户反馈显示,Qwen3.8-27B Q6 在代理编码任务中表现出高性能,在双 NVIDIA GPU 上持续运行 20 小时,保持 60-63 tokens/s 的速度。