Qwen 3.8 对比 3.6 27b:低推理模式下循环显著减少

Reddit r/LocalLLaMA 模型

摘要

这篇文章比较了 Qwen 3.8 和 3.6,指出 Qwen 3.8 在低设置下减少了推理循环,并包含一个 preserve_thinking 参数以避免冗余推理。

有人说过即使在推理设置为低时,Qwen 3.8 仍然过度思考。根据我的情况,它比 3.6 好很多,即使在 3 位量化下也是如此。我认为值得提一下默认设置实际上是 xhigh,所以如果不是已经设置,首先确保指定它。另外,Qwen 3.8 有一个额外的参数 preserve_thinking。它允许在每次交互后保留或丢弃推理过程。所以确保它被激活,否则模型可能会再次推理相同的内容。我的个人体验是低推理模式下的循环比 3.6 少得多,仍然不完美,但有显著改进。总结:Qwen 3.8 在“低”设置下循环比 3.6 少。检查“preserve_thinking”并确保你不是仍在默认的“xhigh”设置。
查看原文

相似文章

Qwen 3.8 27B 表现优异,但默认启用过度推理模式

Simon Willison's Blog

Qwen 3.8 27B 是阿里巴巴通义千问实验室推出的一款强大的开源270亿参数多模态大语言模型。它在基准测试中表现突出,但被批评默认启用过度推理模式,这在消费级硬件上拖慢了运行速度。

Qwen3.8-27B 不同思维层级

Reddit r/LocalLLaMA

Qwen3.8-27B 模型引入了不同的思维层级,与之前的版本如 Qwen 3.7 plus 和 Qwen3.6-27B 相比,显示出推理能力的提升。

不流行观点:Qwen 3.8 27b 不是过度思考者

Reddit r/LocalLLaMA

文章认为,Qwen 3.8 27b 增加的推理令牌使用量与其他中国AI模型如 GLM 和 DeepSeek 相似,用户的挫败感源于硬件限制。它建议使用推理预算可以保持性能优于 Qwen 3.6。