@rohanpaul_ai: 开放模型一直存在分发问题。将权重或 API 放到网上让它们可用,但这并不能让它们……

X AI KOLs Following 新闻

摘要

该推文讨论了开放 AI 模型的分发挑战,并强调了 Bolt Forge 如何整合多个模型,使用统计数据显示 GLM 5.3 Flash 因延迟和成本优势而领先。

开放模型一直存在分发问题。 将权重或 API 放到网上让它们可用,但这并不能将它们融入开发者的开发流程。 @boltdotnew Forge 就是当分发摩擦消失时会发生什么的一个例子。 4 个开放模型位于同一个选择器内,用于一个拥有超过 1100 万用户的产品,到目前为止,GLM 5.3 Flash 已占据了 Bolt Forge 54% 的提示。 而 DeepSeek V4 Pro、GLM 5.3 和 Kimi K3 分享了剩余的部分。 这告诉我们,在构建循环中,性能与延迟、成本以及产品提供的推理预算相互竞争。即使某个模型在理论上在某个基准测试中更强,如果每次迭代都更慢或更贵,它仍然可能不那么有吸引力。
查看原文
查看缓存全文

缓存时间: 2026/09/18 08:34

开源模型一直存在分发问题。
仅仅将模型权重或API上线使其可用,并不能真正融入开发者的工作流。

@boltdotnew Forge正是分发摩擦消失后的典型案例。
4个开源模型集中在一个选择器中,服务于超过1100万开发者,而GLM 5.3 Flash目前占据了Bolt Forge近54%的提示量。

DeepSeek V4 Pro、GLM 5.3和Kimi K3则平分其余份额。

这说明在构建循环中,模型能力需与延迟、成本以及产品提供的推理预算进行权衡。理论上基准测试更强的模型,若每次迭代更慢或成本更高,吸引力仍会降低。

bolt.new (@boltdotnew):
超过1100万用户在Bolt上构建应用。本周一,我们为他们提供了使用量提升高达50倍的开源模型。

目前哪个模型最受欢迎?速度最快、成本最低且支持最大两倍提示量的那个。

🥇 GLM 5.3 Flash 54%
🥈 DeepSeek V4 Pro 17%
🥉 GLM 5.3 15%
👏 Kimi K3 14%

相似文章

开源权重模型并非通过抄袭来追赶闭源模型,它们之所以胜出,是因为整个AI堆栈正在悄然模块化

Reddit r/singularity

本文认为,开源权重AI模型追赶闭源模型并非通过蒸馏技术,而是得益于AI堆栈的模块化——稳定的接口(Transformer架构、兼容OpenAI的推理API、智能体框架)使得创新能在整个生态系统中迅速扩散,在缩小能力差距的同时保持巨大的价格优势,最终可能导致前沿AI的商品化。