Qwen 3.8 27B的存在提出了问题

Reddit r/singularity 新闻

摘要

文章质疑相对较小的Qwen 3.8 27B模型如何实现高智能,对当前的扩展定律和大型模型参数的效率提出疑问。

1) 扩展定律是否已经失效?如果如此小的模型如此智能,那么智能的关键是什么? 2) 当今大多数最大的前沿模型参数是否只是“无用的填充”,不能帮助模型推理或不持有知识,等待被压缩? 3) 他们是如何做到的?是从内部模型蒸馏而来,还是因为较小模型使用RL训练更快?
查看原文

相似文章

Qwen 3.8 27B 表现优异,但默认启用过度推理模式

Simon Willison's Blog

Qwen 3.8 27B 是阿里巴巴通义千问实验室推出的一款强大的开源270亿参数多模态大语言模型。它在基准测试中表现突出,但被批评默认启用过度推理模式,这在消费级硬件上拖慢了运行速度。

Qwen 3.8 27b 就像你的机器上的 Opus 4.6

Reddit r/LocalLLaMA

这篇文章讨论了 Qwen 3.8 27b 的发布,这是一个 270 亿参数的 AI 模型,据报道其性能可与更大的模型如 Opus 4.6 相媲美,引发了关于 AI 订阅未来和本地 AI 效率的问题。

不流行观点:Qwen 3.8 27b 不是过度思考者

Reddit r/LocalLLaMA

文章认为,Qwen 3.8 27b 增加的推理令牌使用量与其他中国AI模型如 GLM 和 DeepSeek 相似,用户的挫败感源于硬件限制。它建议使用推理预算可以保持性能优于 Qwen 3.6。