我们是否暂时忘记了另一个Qwen模型?
摘要
本文讨论了Qwen3.8 27b的发布以及备受期待的Qwen3.8-next-flash模型,突出了Qwen系列中模型数量减少但规模增大的趋势。
所以当Qwen3.8 27b发布时,他们暗示了另一个模型,即Qwen3.8-next-flash。我原本希望有一个更轻量级的模型,比如Qwen 3.6 35b,但我们得到了一个大型模型。但自从Qwen 3和3.5以来,他们减少了发布的模型数量。我们过去常常得到从非常小的0.8b、2b、9b到非常大的模型,但现在每次只有两个,尽管发布新模型的时间也缩短了。
相似文章
@QwenDevs: Qwen的新一波浪潮即将来临
该公告预示着Qwen3.8-Flash-Next即将开源发布,该模型由Qwen4的新型下一代架构驱动。
Qwen/Qwen3.8-Flash-Next
发布 Qwen3.8-Flash-Next,一款开放权重的 AI 模型,引入混合注意力(Hybrid Attention)与 QSA 以及门控残差(Gated Residual)等架构创新,提升效率和可扩展性,预览未来的 Qwen4 架构。
更多 Qwen 3.8 尺寸即将推出
文章宣布 Qwen 3.8 模型系列将推出更多尺寸,为开发者提供更多部署选择。
Qwen3.8-Flash-Next
Qwen 发布了 Qwen3.8-Flash-Next,这是一款开放权重的多模态 MoE 模型,拥有 125B tokens,但只有 6B 活跃参数,提供了性能提升,并作为 Qwen4 架构的早期预览。
我们会迎来 Qwen 3.8 35-A3B 吗?
围绕即将发布的 Qwen 3.8 的猜测,质疑它会是稠密 27B 模型还是类似此前 35B-A3B 的 MoE 变体,并讨论了对本地硬件性能的影响。