我们确实需要27B、35B、122B和397B规模的Qwen3.8

Reddit r/LocalLLaMA 新闻

摘要

作者认为,发布更小规模的Qwen模型(27B、35B、122B、397B)比专注于万亿参数的大模型更能服务本地AI社区,因为后者对大多数用户来说并不实用。

与其发布2T+参数的大模型,继续发布能力出色的小型和中型LLM才能真正帮助保持社区的活力。几乎没人能奢望运行最近那些1.5-2T+参数的巨兽,而标题中的这些模型(借助CPU专家卸载)可以在我们现有的大多数系统上流畅运行。中国实验室试图用万亿参数的开源权重模型去追赶Mythos级别前沿的趋势,并不利于本地模型社区的创新。它只是让那些有能力运行这些模型的大公司获得了一个比商业前沿更便宜的替代方案。
查看原文

相似文章

Qwen/Qwen3.6-35B-A3B-FP8

Hugging Face Models Trending

阿里巴巴发布了Qwen3.6-35B-A3B-FP8,这是Qwen3.6的开源权重量化变体,拥有35B参数,通过MoE激活3B,具有改进的智能编码能力和保持思维链的迭代开发特性。