我是不是哪里做错了?Qwen 3.8 27B 在代理式编程中似乎毫无用处

Reddit r/LocalLLaMA 新闻

摘要

一位用户报告在使用 Qwen 3.8 27B 模型进行代理式编程任务时遇到困难,指出与其他模型相比效率低下和错误,并寻求关于潜在设置问题的建议。

我断断续续使用本地模型大约两年了,但从未真正广泛使用,因为封闭模型总是好得多。Qwen 3.8 27B 发布后,我决定再次认真尝试。我配置了 Cline 和 ZooCode 作为 VSCode 插件,安装了几个 MCP 服务器并添加了一项技能。当我使用 Deepseek V4 Flash 的这些工具时——它们做得相当好(主要是 Home Assistant 配置编辑等),但仍比我工作中使用的 Claude Code/GitHub copilot 差得多。使用 Qwen 时——运行来自 unsloth 的 Q6_K 量化——它运行大量令牌,最终要么完成任务(经常不正确),要么根本不完成,因为它进入循环或试图修复没有问题的东西。我在 Windows 11 上使用 LM Studio 运行模型。我拥有的硬件足够强大——2x3090Ti。我将其完全卸载到 GPU 并将上下文限制设置为大约 50k 令牌。此外——我知道过度思考的问题,所以我修改了提示模板以使用中等努力。尽管如此——我仍然难以完成大多数手头的任务。你能告诉我我做错了什么吗?我怀疑 Qwen 可能仍在使用高推理努力,但我无法检查。或者我不应该使用 LM Studio 而使用其他工具?
查看原文

相似文章

Qwen 3.6 27B 在代理任务上完全失败

Reddit r/LocalLLaMA

一位用户报告称,Qwen 3.6 27B 虽然在单次提示任务中表现强劲,但在代理任务中频繁出错,导致其不得不回退到 Qwen 3.5 122B。

我对Qwen 3.8在代理编码中的初步看法

Reddit r/LocalLLaMA

对使用Qwen 3.8模型进行代理编码的个人评测,称赞其处理复杂任务(如将llama.cpp与Godot集成)的能力,同时指出存在循环问题。

Qwen 35b a3b 令我惊喜

Reddit r/LocalLLaMA

用户报告了使用 Qwen 35b a3b 进行代理编码任务的积极体验,指出在其使用场景中它优于 Gemma4 26b,并且在演示/数据分析方面表现出色,尤其是在代理模式而非聊天模式下。