开放模型未来走向之我见

Reddit r/LocalLLaMA 新闻

摘要

作者分析中国AI实验室分阶段发布开放权重模型以从前沿模型吸引用户的策略,并预测随着它们瞄准大型组织,中端模型将暂停发布。

当Qwen宣布将以超过2万亿参数的开放权重发布3.8时,我意识到这一点。我认为中国战略性地分多个阶段发布开放模型,现在正处于最后阶段。第一阶段:发布体积小但能力强的开放模型(特别是在Qwen 3.5时代),让高级用户停止使用前沿模型,转而使用本地模型。第二阶段:发布非常大的模型,如Kimi K3和GLM 5.2,让大型组织从美国前沿模型切换过来。这些组织有能力购买大型服务器硬件来托管这些模型。一旦某个组织安装了某个模型,前沿闭源实验室基本上就永远失去了这个客户。我认为在今年年底之前,我们不太可能看到中国发布9b-35b参数(可在32-64GB内存下运行)的开放模型。几乎每个想要切换到本地模型的人都已经这样做了,或者已经在计划这样做。现在他们瞄准的是那些当前是前沿实验室目标受众的组织。当Qwen 3.7没有迅速发布时,我就一直担心会发展到这一步。我真的希望我是错的!
查看原文

相似文章

开放与封闭AI模型:2025-2026年差距如何缩小及未来走向

Reddit r/artificial

本文探讨了从2025年初到2026年中,开放与封闭AI模型之间的性能差距如何急剧缩小,以DeepSeek开放模型的发布及其后续市场影响为例。文章还讨论了中国实验室在推动开放前沿方面的作用及其对行业的影响。