中国的开放AI模型正在挑战硅谷的惯用策略

Wired 新闻

摘要

中国AI实验室发布具有竞争力的开源模型(GLM 5.2、Kimi K3、Qwen 3.8),挑战西方闭源主导地位,引发美国政治反弹,并凸显了中国与硅谷在开放与封闭AI路径上的分歧。

随着对Anthropic和OpenAI前沿模型的使用限制日益严格,中国实验室正在将它们的开源替代方案宣传为稳定、易用且性能日益强大。
查看原文
查看缓存全文

缓存时间: 2026/07/22 20:21

# 中国开源AI模型正在挑战硅谷的游戏规则 来源:https://www.wired.com/story/chinas-open-ai-models-are-challenging-silicon-valleys-playbook/ 人工智能行业尚未真正迎来DeepSeek 2.0时刻(https://www.wired.com/story/deepseek-china-model-ai/),但感觉已非常接近。中国领先的AI实验室(https://www.wired.com/story/china-ai-boom-algorithm-registry/)近来频频发力,接连发布了一系列几乎达到前沿水平的开源模型:Z.ai在6月发布了GLM 5.2,月之暗面上周推出了Kimi K3,阿里巴巴本周一发布了Qwen 3.8。 硅谷和华盛顿方面立刻开始讨论这些模型,尤其是K3——它被广泛认为是这批模型中的佼佼者。风险投资人、美国总统特朗普的AI顾问David Sacks称月之暗面模型的表现"令人担忧"(https://x.com/DavidSacks/status/2078092271296143593?s=20)。本周早些时候,商务部长Scott Bessent暗示美国可能(https://www.bloomberg.com/news/articles/2026-07-21/bessent-says-us-will-scrutinize-chinese-ai-models-for-ip-theft)对中国AI公司实施制裁。 周三,白宫科技政策办公室主任Michael Kratsios声称(https://x.com/mkratsios47/status/2079933645888880708?s=20),特朗普政府"掌握信息表明月之暗面AI在其K3模型开发中蒸馏了Anthropic的Fable",他称这相当于"窃取美国专有技术并削弱美国研究",是"不可接受的"。(月之暗面AI未立即回应置评请求。) 这些新模型有几个共同点:第三方基准测试显示它们的性能几乎与西方最佳模型相当;它们针对智能体编程任务(今年AI领域最热门的方向)进行了优化;并且它们已经或即将以开放权重发布,使其易于访问且透明。 但或许当前时刻与2025年1月(DeepSeek的R1模型震惊世界之时)之间最大的相似之处在于,它再次印证了中美AI实验室在开放与封闭路径上的分歧。 DeepSeek横空出世时,曾挑战了"只有通过数十亿美元计算基础设施和训练投资打造的闭源模型才能达到前沿性能"这一前提。但自那以后,西方AI实验室继续以同样的方式发展AI,而如今美国的前沿模型比一年前更加封闭。 Anthropic数月来一直声称其最新的Mythos模型在黑客攻击方面过于危险,仅限经过批准的协作者(https://www.wired.com/story/anthropic-mythos-preview-project-glasswing/)使用。当该模型最终更广泛地发布时,白宫随即发布了广泛的出口管制措施(https://www.wired.com/story/anthropic-says-us-government-ordered-it-to-shut-down-mythos-models/),迫使Anthropic暂时下线Mythos及其能力较弱的姐妹模型Fable 5。OpenAI在收到白宫请求(https://www.wired.com/story/openai-gpt-56-model-release-trump-admin-approval/)后也推迟了GPT 5.6的发布。 与此同时,在中国,情况则截然不同。中国初创企业和科技巨头纷纷加倍押注开源:任何拥有足够好计算机环境的人现在都可以下载开放权重的模型,在本地运行,添加自定义功能,总体享受比OpenAI和Anthropic所允许的大得多的自由度。从很多方面来看,开放与封闭的辩论比以往任何时候都更与美国与中国的辩论纠缠在一起。 中国AI实验室选择建立在开源模型之上的商业策略有很多原因。作为AI领域较新较小的参与者,使模型免费开放有助于中国公司吸引更多用户、合作者和媒体关注。这也使它们与OpenAI、Anthropic、Google、SpaceX及其他资金雄厚的巨头处于不同的竞争轨道上。 今年早些时候,有传闻称阿里巴巴在重组其AI模型开发团队后可能考虑加入闭源(https://www.scmp.com/tech/big-tech/article/3348844/chinese-ai-giants-pivot-toward-proprietary-models-drive-revenue-performance)竞赛。但这家科技巨头周一宣布,将再次以开放权重发布最新版本的Qwen——其深受全球技术社区喜爱的(https://www.wired.com/story/expired-tired-wired-gpt-5/)开源模型系列——向客户和公众表明它尚未转向。 中国方法最有力的验证或许正是模型本身。中国实验室已经生产出被广泛认为是全球最佳的开源AI模型,这表明美国公司不再独享构建最强大系统的能力。 众包模型评估平台Arena AI目前将K3评为网页开发任务的最佳模型,在智能体任务中排名第四,仅次于Anthropic的Fable和Opus 4.8,以及OpenAI的GPT 5.6。独立AI基准测试公司Artificial Analysis将K3在其智能指数中排名第三。 月之暗面AI于7月16日发布K3预览版后不久,世界各地的人们纷纷争相试用,消耗了大量推理计算资源,以至于该公司暂时限制新用户注册。 随着越来越多的人开始使用能力几乎与西方竞争对手相当的中国开源模型,一些人开始质疑付费使用OpenAI或Anthropic的产品是否真的值得。多家中国实验室能够创建出强大的智能体模型,并且不惧向公众发布,这戳破了普遍认为OpenAI和Anthropic遥遥领先的认知。 就像DeepSeek一样,K3的粉丝现在将其视为西方AI模型被过度炒作和过度保护的证据。独立研究公司Tech Buzz China的创始人Rui Ma在一篇社交媒体帖子(https://x.com/ruima/status/2079166567536115948?s=20)中表示:"Kimi获得如此多的喜爱,简直太疯狂了。"她指的是该公司宣布K3需求使其服务器不堪重负。"这只有在过去一年中[硅谷]实验室沟通不畅和决策失误的情况下才可能实现,"她补充道。 西雅图的独立AI研究员Nathan Lambert最近访问了月之暗面AI在中国的办公室。他说:"我认为Anthropic夸大了风险,或者描述的风险即将到来但尚未扩散。"但他也承认,就像普通大众一样,他对Mythos的真实表现几乎没有第一手信息。"我们依赖少数私营公司和能力已耗尽的联邦政府来做这个判断。" 除了挑战西方主流AI叙事外,中国开源模型还证明了自己是美国闭源模型的实用商业替代品。它们不仅在X上被讨论并与其他模型进行基准测试,而且已成为越来越多西方初创企业和个人用户受欢迎且易于使用的选择(https://www.nbcnews.com/tech/innovation/silicon-valley-building-free-chinese-ai-rcna242430)。 Lambert说:"从GLM 5.2开始,实际使用这些最新模型确实发生了转变。"他指的是Z.ai的模型。"即使在GLM 5.2发布几周后,我仍听到湾区的AI研究人员说他们还在将其用于工作流程的核心部分。Kimi作为更强的模型,只会做得更多,尤其是在网络安全等领域——Mythos、Fable和GPT 5.6基本上无法使用的地方。" 事实上,这已经发生了。周二,OpenAI披露了一起令人担忧的事件,其GPT-5.6 Sol模型入侵了开源AI平台Hugging Face的生产系统。Hugging Face表示,它最终使用开源模型GLM 5.2来分析这次网络攻击,因为其他前沿模型由于内置安全护栏而拒绝提供帮助。 中国AI模型通常也比西方替代品更便宜,但这不一定是最主要的卖点。虽然K3等模型对代币收费较低,但早期测试显示,它们解决相同问题可能比西方模型需要更多代币,从而使成本差距缩小。前白宫AI顾问、最近加入OpenAI担任战略未来主管的Dean Ball在一篇社交媒体帖子(https://x.com/deanwball/status/2078133895766114412?s=20)中写道:"在我相当有限的使用中,[K3]似乎也非常消耗代币。对我来说,这个模型运行起来是否真的这么便宜还不明显。"他在帖子中也称赞K3是"一个非常好的模型"。 即使相对消耗代币,像K3这样的模型最终确实挑战了多年来驱动OpenAI和Anthropic战略的一个基本假设:AI实验室需要无限的资金来扩大计算能力,仅仅是为了制造更好的模型。Ball写道:"最终,开放权重模型会抑制进一步的AI资本支出。"

相似文章