Qwen3.8: 大量思考却无果

Reddit r/LocalLLaMA 模型

摘要

一位用户对Qwen3.8 27B模型表示不满,批评其过度思考和过度发挥的倾向,这在任务中浪费了时间和上下文,并征求社区对实际使用的反馈。

所以,和这里许多人一样,我正在尝试Qwen3.8 27B,但我不得不说,现在我不满意:大量的思考和大量的超越任务,这最终在开始真正处理分配任务之前消耗了时间和上下文。我听到你说:是工具的问题。嗯,可能是,但它在其他模型上效果好得多,而且我记得Qwen3.6仍有做未要求事情的意愿,但我或多或少驯服了它……但现在它真的失控了。你的印象是什么?不是基准测试,而是实际使用。
查看原文

相似文章

Qwen 3.8 27B 表现优异,但默认启用过度推理模式

Simon Willison's Blog

Qwen 3.8 27B 是阿里巴巴通义千问实验室推出的一款强大的开源270亿参数多模态大语言模型。它在基准测试中表现突出,但被批评默认启用过度推理模式,这在消费级硬件上拖慢了运行速度。

不流行观点:Qwen 3.8 27b 不是过度思考者

Reddit r/LocalLLaMA

文章认为,Qwen 3.8 27b 增加的推理令牌使用量与其他中国AI模型如 GLM 和 DeepSeek 相似,用户的挫败感源于硬件限制。它建议使用推理预算可以保持性能优于 Qwen 3.6。

Qwen 3.8 27B:你喜欢糖还是PCP?

Reddit r/LocalLLaMA

对 Qwen 3.8 模型的对话输出进行批评,指出其在针对编码和智能体使用进行优化的同时,生成无意义的句子。