不流行观点:Qwen 3.8 27b 不是过度思考者

Reddit r/LocalLLaMA 新闻

摘要

文章认为,Qwen 3.8 27b 增加的推理令牌使用量与其他中国AI模型如 GLM 和 DeepSeek 相似,用户的挫败感源于硬件限制。它建议使用推理预算可以保持性能优于 Qwen 3.6。

是的,它比 3.6 使用了更多的推理令牌。但在相同任务上测试其他中国模型,如 glm 5.3、deepseek v4 flash 和 pro 等,它们真的很相似,而且这些是必要的。现实是,我们只是感到沮丧,因为我们的硬件不允许大多数人拥有 1M 上下文(我知道这还不支持)和 150 tps 解码。此外,如果你不介意质量下降,你可以添加推理预算,它仍然会比 3.6 更好。
查看原文

相似文章

Qwen 3.8 27B 表现优异,但默认启用过度推理模式

Simon Willison's Blog

Qwen 3.8 27B 是阿里巴巴通义千问实验室推出的一款强大的开源270亿参数多模态大语言模型。它在基准测试中表现突出,但被批评默认启用过度推理模式,这在消费级硬件上拖慢了运行速度。

Qwen3.8: 大量思考却无果

Reddit r/LocalLLaMA

一位用户对Qwen3.8 27B模型表示不满,批评其过度思考和过度发挥的倾向,这在任务中浪费了时间和上下文,并征求社区对实际使用的反馈。