从硅谷到华盛顿,科技界突然痴迷于AI中的一个概念:蒸馏

Reddit r/artificial 新闻

摘要

AI蒸馏已经成为一个从硅谷到华盛顿的热门话题,因为人们越来越担心像Moonshot AI这样的中国实验室正在利用这项技术迅速追赶美国的前沿模型,引发了关于国家安全和知识产权的争论。

暂无内容
查看原文
查看缓存全文

缓存时间: 2026/07/25 18:17

# 从硅谷到华盛顿,科技界突然痴迷于AI中的同一个概念:蒸馏 来源:https://www.cnbc.com/2026/07/25/hat-is-distillation-and-why-is-everyone-so-obsessed-with-it-this-week.html 谷歌人工智能负责人杰夫·迪恩于2020年1月28日周二在美国加利福尼亚州旧金山的一场谷歌AI活动上讲话。 David Paul Morris | Bloomberg | Getty Images 今年早些时候,谷歌AI负责人杰夫·迪恩在一个播客(https://www.latent.space/p/jeffdean)中讨论了一个当时在技术圈外鲜有人谈论的概念:蒸馏。 在谈及谷歌AI模型的开发时,迪恩表示,他和同事们发现AI蒸馏技术是因为谷歌希望在不依赖单一大型图像识别模型的情况下提升系统性能。 “通过蒸馏——这是一种让更小模型具备更强能力的关键技术——你必须先拥有前沿模型,然后才能将其蒸馏到你的小模型中,”迪恩在2月份说。 五个月后,从硅谷到华盛顿,蒸馏突然成为一个热点话题,科技人士和立法者争论这种做法是否正在变成国家安全威胁,并让中国在高风险的AI竞赛中追上美国。担忧情绪在上周末开始升温,当时中国实验室Moonshot AI发布了Kimi K3(https://www.cnbc.com/2026/07/17/moonshot-ai-kimi-k3-model-openai-anthropic-china.html),用户很快发现它与Anthropic和OpenAI目前最好的商业AI模型具有竞争力(https://fireworks.ai/blog/kimik3-fable)。 与领先的美国AI公司(它们销售对专有模型的访问权限)不同,Moonshot和其他中国实验室提供所谓的开放权重模型,允许用户下载该技术、进行调整并在任何地方运行。 一些政府官员将Moonshot能够迅速追赶的能力归因于蒸馏,并将其描述为窃取美国知识产权,特别是通过整合Anthropic的前沿模型Fable。 “我们有信息表明,Moonshot AI为了开发其K3模型,对Anthropic的Fable进行了蒸馏,”白宫顾问迈克尔·克拉齐奥斯(Michael Kratsios)周三在X上发文(https://x.com/mkratsios47/status/2079933645888880708)称。“为此,他们开发了一个复杂的内部平台,用于对美国模型进行大规模蒸馏,从而能够在多种访问方式之间快速切换以逃避检测。” 中国初创公司Moonshot AI发布新模型,缩小了与美国竞争对手的性能差距。 在宏观层面,蒸馏指的是利用聊天机器人的回答或先进AI模型的工作产物来训练另一个模型。这种做法之所以有争议,是因为根据其使用方式,它可能允许模型开发者仅仅通过使用那些投入数百万或数十亿美元开发最先进训练技术的公司的输出,就创造出具有竞争力的产品。 “这几乎就像有人去听了讲座、读了教科书,并且完成了所有艰苦的作业,”AI安全公司SecurityPal的创始人普卡·哈马尔(Pukar Hamal)说。“然后另一个学生说,‘嘿,我没做作业。我可以抄你的吗?’” 无论是因为克拉齐奥斯的帖子还是其他原因,全球最大的科技巨头在周五以一种可能是前所未有的方式聚集在一起,明确表达了他们的立场。经过一周的一系列社交媒体帖子,科技巨头Nvidia(https://www.cnbc.com/quotes/NVDA/)、Microsoft(https://www.cnbc.com/quotes/MSFT/)、Meta(https://www.cnbc.com/quotes/META/)、Palantir(https://www.cnbc.com/quotes/PLTR/)与其他20多家公司联合发布了一封信,敦促政策制定者避免对开放权重AI模型实施“过早的限制”,以免“扼杀竞争或将创新推向海外”。 “蒸馏,即利用一个模型的输出来帮助训练或改进另一个模型的做法,是一种广泛使用的模型改进、演化和验证技术,”他们写道。 ## 让中国问题更加复杂 蒸馏的出现给美国政策制定者带来了一个难题,他们长期以来一直担心中国在知识产权窃取和国家安全方面的技术问题。 乔治城大学安全与新兴技术中心的研究员科林·谢伊-布莱米耶(Colin Shea-Blymyer)表示,美国政府正在试图明确其立场。 政府可能会辩称,中国和俄罗斯公司“利用辛勤工作的美国模型的输出来提升自身性能,因此它们在这方面拥有不公平的优势,”谢伊-布莱米耶说。 Box(https://www.cnbc.com/quotes/BOX/)首席执行官亚伦·利维(Aaron Levie)是周五信函的签署人之一。利维在接受采访时表示,为了保持竞争力,美国公司需要能够获得最好的技术,无论它是在哪里开发的。 “总体趋势是,创新越多——无论是来自美国、中国还是其他地方——你应该期待更多的AI进步,而且通常这会导致成本更低、效率更高,”利维说。 尽管当前讨论大多集中在Kimi K3等中国开放权重AI模型上,但许多公司在创建自己的模型时也采用了蒸馏技术,Info-Tech Research Group的研究总监沙希·贝拉姆康达(Shashi Bellamkonda)说。例如,Nvidia在其Llama Nemotron系列模型的训练过程中就使用了蒸馏,如随附的研究论文(https://arxiv.org/pdf/2505.00949)中所述。 “这是一种合法且非常有价值的技术,可以用较大模型的输出来训练较小、成本更低的模型,并且一直在实践中使用,”贝拉姆康达说。 Anthropic联合创始人兼首席执行官达里奥·阿莫迪(Dario Amodei)于2026年4月30日周四在美国加利福尼亚州旧金山的Anthropic总部接受“与Emily Chang的电路”节目采访。 Jason Henry | Bloomberg | Getty Images 然而,Anthropic持有不同观点,因为该公司看到了自己的模型是如何被使用的,并且需要保护其快速发展的业务。2月份,该公司表示(https://www.anthropic.com/news/detecting-and-preventing-distillation-attacks),其Claude能力正被中国的DeepSeek、Moonshot和MiniMax以“工业规模”进行蒸馏,这些公司使用了约24000个虚假账户,产生了1600万次交互。 估值接近1万亿美元并计划在不久的将来上市(https://www.cnbc.com/2026/07/15/anthropic-ipo-banks-investor-meetings.html)的Anthropic表示,阻止非法蒸馏事关国家安全。 “Anthropic和其他美国公司建立了系统,以防止国家和非国家行为者利用AI进行例如开发生物武器或实施恶意网络活动等行为,”该公司在2月份的帖子中表示。而阻止这种行为需要“行业参与者、政策制定者和全球AI社区之间迅速、协调的行动”。 OpenAI和Anthropic在其服务条款中禁止蒸馏。贝拉姆康达表示,他们实质上是在暗示,未经授权使用他们的大型模型可能构成知识产权窃取。 但随着AI成本飙升,公司将不惜一切代价提高效率。 哈马尔表示,他在SecurityPal使用像Kimi K3这样的中国开放权重模型完全没有问题,该公司利用AI自动化安全评估。他说这可以为公司节省大量资金。 “我们会确保代码中没有恶意的后门,”哈马尔说。“但在经过评估后将其托管在我们自己的基础设施上,为什么不呢?” 对于Anthropic和OpenAI来说,在试图证明知识产权窃取时面临的一个大问题是,两家公司都依赖其他来源的内容来构建自己的模型,并因此被起诉(https://www.reuters.com/world/us-judge-approves-anthropics-15-billion-settlement-copyright-lawsuit-2026-07-20/)。 代表书籍作者在针对AI公司的版权诉讼中的Boies Schiller Flexner律师事务所律师马克斯·普里特(Max Pritt)表示,政府也处于同样的境地。 “政府,至少在公开场合,将重点放在保护科技公司的知识产权上,而在很大程度上对被未经授权使用的创作者和个人的知识产权保持沉默,”普里特说。 **观看:**中国的AI公司即使在模型保持开放的情况下也在寻找变现方式(https://www.cnbc.com/video/2026/07/20/how-chinas-ai-firms-plans-to-monetize-its-free-ai-llms.html) 高盛:中国的AI公司即使在模型保持开放的情况下也在寻找变现方式

相似文章

硅谷在对待中国AI问题上完全分裂

Wired

Wired报道称,硅谷在对待中国开放权重AI模型方面存在严重分歧:一些初创公司反对禁令,而Anthropic等AI巨头则因担忧知识产权盗窃和缺乏安全护栏而推动监管。

“蒸馏”的说法本质上就是荒谬的

Reddit r/LocalLLaMA

认为指责中国从美国AI模型中进行知识蒸馏在法律上是没有根据的,这不过是保护估值过高的美国AI公司的一种宣传手段。

@rabois: 很好的提炼。

X AI KOLs Following

一位评论员强调了美国政府在限制中国AI模型方面的选项分析,其中包括FUD策略。

蒸馏护城河(6分钟阅读)

TLDR AI

文章认为,AI公司建立在昂贵模型训练之上的竞争护城河很容易被蒸馏(distillation)所削弱——即通过重复API查询来复制模型,行业实践如xAI在OpenAI模型上训练Grok、Anthropic指控中国实验室挖掘Claude等行为都印证了这一点。