我们确实需要27B、35B、122B和397B规模的Qwen3.8

Reddit r/LocalLLaMA 新闻

摘要

作者认为,发布更小规模的Qwen模型(27B、35B、122B、397B)比专注于万亿参数的大模型更能服务本地AI社区,因为后者对大多数用户来说并不实用。

与其发布2T+参数的大模型,继续发布能力出色的小型和中型LLM才能真正帮助保持社区的活力。几乎没人能奢望运行最近那些1.5-2T+参数的巨兽,而标题中的这些模型(借助CPU专家卸载)可以在我们现有的大多数系统上流畅运行。中国实验室试图用万亿参数的开源权重模型去追赶Mythos级别前沿的趋势,并不利于本地模型社区的创新。它只是让那些有能力运行这些模型的大公司获得了一个比商业前沿更便宜的替代方案。
查看原文

相似文章

Qwen 3.8 27B的存在提出了问题

Reddit r/singularity

文章质疑相对较小的Qwen 3.8 27B模型如何实现高智能,对当前的扩展定律和大型模型参数的效率提出疑问。

Qwen3.8-27B

Hacker News Top

Qwen 发布了 Qwen3.8-27B 的开源权重,这是一个原生多模态稠密模型,拥有 27B 参数,整体性能超越 Qwen3.7-Plus,支持 262K 原生上下文并可扩展至 1M,采用 Apache 2.0 许可。

等不及要看 Qwen3.8-27B

Reddit r/LocalLLaMA

Qwen 发布了 Qwen3.8,其中包括一个全新的 27B 模型,令人对本地部署充满期待。