逐底竞争?
摘要
作者认为,对于大多数消费者来说,像Claude Code Sonnet 4.5这样的旧版AI模型已经足够且成本效益高,暗示追求更大模型可能对大多数用户来说没有必要。
就消费者使用和vibe coding而言,我使用旧版模型取得了很大的成功。Claude Code Sonnet 4.5生成的代码几乎没有错误。我在工作中尝试了Fable,并没有得到改进,只是增加了成本。我在这里说的是消费者。拥有大型代码库的企业可能需要更大的模型来容纳更大的上下文,但我认为一旦他们建立了合适的流程,可能也不需要。当然,有些任务需要更强的算力,比如蛋白质折叠、化学等。但对于绝大多数用户和大多数独立vibe coders来说,价值正在迅速趋于平稳。给我提供来自“昨天”的快速、低成本的模型,再加上良好的流程,你就可以为95%的用户节省电力和金钱,这些用户只是把AI当成更好的谷歌或可靠的方式用来构建自己的东西。
相似文章
模型在软件工程领域正遭遇收益递减
一位超大规模公司的杰出工程师认为,AI 模型在软件工程任务中正遭遇收益递减,他发现 Claude 的 Fable 5 与之前的 Opus 模型之间几乎没有差别,并预测本地模型很快将提供可媲美的价值。
科技公司能否学会青睐更便宜的AI模型?
TechCrunch报道称,随着成本不断攀升,企业开始考虑转向更便宜、更小的AI模型,而非始终使用最强大的模型,这可能引发行业转变。布赖恩·阿姆斯特朗等人的预测表明,12-18个月内,80%的工作负载可能运行在价格便宜99%的模型上,这将严重冲击OpenAI和Anthropic等主要AI实验室。
Claude Sonnet 5
Anthropic 发布了 Claude Sonnet 5,这是一款高度自主的 AI 模型,在推理、工具使用和编码能力上有所提升,以更低的价格缩小了与 Opus 级别模型的差距。该模型现已面向所有套餐提供,并采用首发优惠定价。
@rhythmrg: https://x.com/rhythmrg/status/2066561780495896785
文章认为,企业应该对自定义AI模型进行后训练,用于关键任务、高容量的用例,以实现差异化、节省成本并对权衡进行控制,而不是仅仅依赖通用前沿模型。
基准测试是一回事,实际感受是另一回事。
作者认为,最近发布的AI模型(如Claude Opus 4.8和GPT 5.5)只是渐进式改进,类似于iPhone的升级,真正的创新正在转向工具层,例如Claude Code和Codex。