@AnthropicAI: 关于我们对开放权重模型的立场,外界有很多猜测。我们在此全面阐述了我们的观点:

X AI KOLs 新闻

摘要

Anthropic CEO Dario Amodei 澄清公司从未主张禁止开放权重模型,称其在不具备危险能力时是一种公共产品,同时表达了他对威权国家滥用和误用强大AI的担忧。

外界对我们在开放权重模型上的立场有很多猜测。我们在此全面阐述了我们的观点:https://t.co/NtXQuWm2g5
查看原文
查看缓存全文

缓存时间: 2026/07/28 06:25

关于我们对开放权重模型的立场,外界一直猜测颇多。我们已在此处完整阐述观点:https://t.co/NtXQuWm2g5


我们对开放权重模型的立场

来源:https://www.anthropic.com/news/position-open-weights-models 作者:Dario Amodei,Anthropic 首席执行官

过去几天,围绕开放权重模型,尤其是来自中国的开放权重模型,讨论很多。有报道称,一些美国官员正在考虑禁止(https://www.axios.com/2026/07/20/ai-us-china-open-source-kimi)美国公司使用中国的开放权重模型。作为回应,许多科技公司签署了一封信(https://x.com/JensenHuang/status/2080643682408321103)支持开放权重模型,甚至有人指责 Anthropic 想通过禁止开放权重模型来保护自身业务。任何读过我过往文章的人都应明白,我并不认为此类禁令是有效措施,但在此我明确表态,以免存疑:Anthropic 从未主张禁止开放权重模型。

不具备危险能力的开放权重模型是一种公共产品:除了运行所需的算力之外,它们不产生任何成本,并且为企业、开发者和研究人员提供了价值。

保护主义禁令无法解决我最关切的国家安全问题。具体来说,我担心两种噩梦场景。这些场景我在六个月前的文章《技术的青春期》(https://darioamodei.com/essay/the-adolescence-of-technology)¹ 中已有阐述,并且多年来我一直坚持这一立场:

  1. 我主要的担忧是,威权政府——不仅仅是中国(CCP),尽管 CCP 显然是最有能力的威胁——构建出比美国更强大的 AI 模型,并利用这些模型实现永久军事优势或对其人民进行极其深度的压制。美国政府内部普遍认同这一担忧:副总统万斯去年在巴黎警告(https://www.presidency.ucsb.edu/documents/remarks-the-vice-president-the-artificial-intelligence-action-summit-paris-france)说,“威权政权窃取并利用 AI 来加强其军事、情报和监控能力。”情报界的《2026 年度威胁评估》(https://www.dni.gov/files/ODNI/documents/assessments/ATA-2026-Unclassified-Report.pdf)指出,“其他全球大国在 AI 方面的强劲进展正在挑战美国的经济竞争力和国家安全优势。”这些模型是否以开放权重发布并不重要,它们是否被美国企业使用当然也不重要。事实上,最危险的模型可能是秘密训练、仅交给解放军用于无人机、交给国家安全部用于监控和镇压的模型。
  2. 我次要的担忧是,强大的 AI 模型可能被滥用于发动网络攻击或生物攻击,并且可能存在严重的对齐问题(https://time.com/article/2026/07/24/openai-hugging-face-attack/)。开放权重模型——无论来自中国还是其他地方——确实可能比封闭模型带来更高风险,因为很难对其施加防护措施或监控其使用,且权重一旦发布就无法收回²。但禁止美国企业使用这些模型对解决这一风险毫无帮助,因为恶意行为者不太可能是合法的美国企业。这确实会保护美国 AI 公司免受竞争,但这从来不是我的目标。

为解决这些担忧,我确实支持以下三项措施,我本人及 Anthropic 一直倡导这些措施:

  • 我们不应向中国出售强大芯片或芯片制造设备,并且应严厉打击猖獗的走私(https://www.justice.gov/opa/pr/three-charged-conspiring-unlawfully-divert-cutting-edge-us-artificial-intelligence)³ 和获取此类芯片的变通手段。中国本土生产能力有限,因此,根据缩放定律(https://arxiv.org/abs/2001.08361),没有美国芯片,中国就无法构建比美国更强大的模型。这是阻止威胁 #1 最高效、最直接的方式,同时通过阻碍训练超出美国法律管辖范围的模型,也间接有助于应对威胁 #2。
  • **我们应打击工业规模的蒸馏操作(https://www.anthropic.com/news/detecting-and-preventing-distillation-attacks)。**蒸馏比从头训练模型要高效得多。它使中国能够构建出远超其芯片数量通常所能支撑的更好模型,从而部分规避芯片禁令。蒸馏无法让中国获得与美国相当或更优的 AI 能力,但可以使中国的前沿水平接近美国前沿(https://www.anthropic.com/research/2028-ai-leadership)数月之内。诚然,许多进行这些操作的公司会发布开放权重模型——但开放权重远不如这些操作背后有试图在前沿超越美国的威权国家支持这一事实重要。我们应制定政策干预措施来阻止这种行为。全面禁止开放权重模型既不是正确的补救措施,也不是我们所呼吁的⁴。
  • **所有具备足够能力的模型,无论开放还是封闭,都应接受强制性安全测试。**解决威胁 #2 的最佳方式就是直接测试模型在发布前的网络、生物和对齐风险。我认为这个想法实际上近乎共识:令我感到欣慰的是,特朗普政府在最近几个月已朝这个方向迈进,而且最近的行业提案(https://demishassabis.substack.com/p/a-framework-for-frontier-ai-and-the-dawning-of-a-new-age)主张将此类测试应用于最有能力的模型,无论其原产国或开放/封闭状态如何(同时完全豁免能力较弱的模型,例如来自初创公司和学术界的模型)。开放模型是否构成更高风险,以及这些风险能否被缓解,应通过测试得出结论,而非预先决定——并且可能存在有前景的方法来提升开放权重模型的安全性,包括 Anthropic 最近关于模块化训练策略(https://alignment.anthropic.com/2026/modular-pretraining/)的研究。请注意,为有效起见,测试需要全球化,这意味着即使是 也需要参与其中。我认为这或许是可能的:正如我在《技术的青春期》中所写,围绕防止 AI 生物武器的有限合作可能是可行的,因为这同样符合中国的利益。

这引出了那封公开信(https://images.nvidia.com/pdf/Open-Weights-and-American-AI-Leadership.pdf)。我认同其大部分内容:开放权重扩大了 AI 经济的参与度,至少在某些用例中增强了竞争,并给予客户更大的控制权。对蒸馏的担忧应通过有针对性的法律和商业框架来解决——也就是我上面描述的措施。但我不同意信中关于开放权重模型必然使开发安全保障更容易的说法,也不同意广泛的能力获取必然对防御者比对攻击者更有帮助的说法。在我看来,相反的情况至少同样可能发生。例如,我担心生物学将存在强烈的攻击者-防御者不对称性,具备足够能力的模型可能能够利用广泛可用的材料快速将大流行级别的病毒武器化,而针对这些制剂的防御即使在最佳情况下也是一项多年的操作任务(正如我们在“曲速行动”中所见)⁵。此类问题应通过发布前严格的经验测试来回答,而非预先假设。

总而言之,我和 Anthropic 的立场是:我们未曾也不会主张全面禁止开放权重模型。相反,我们应该聚焦于防止强大芯片落入威权之手、打击工业规模的蒸馏,以及要求对所有具备足够能力的模型(无论开放还是封闭)进行安全测试。

相关内容

Cognizant 与 Anthropic 扩大合作,为企业客户带来 Claude

阅读更多(https://www.anthropic.com/news/cognizant-anthropic)

推出 Claude Opus 5

Opus 5 是 Opus 级别的阶梯式改进,为长时间运行的智能体提供支持,同时在编程和专业工作方面带来提升。

阅读更多(https://www.anthropic.com/news/claude-opus-5)

经济未来研究基金的研究议程

我们正在分享 Anthropic 经济未来研究基金的研究议程。

阅读更多(https://www.anthropic.com/news/economic-futures-research-fund-agenda)

相似文章

开放权重模型的权衡(9分钟阅读)

TLDR AI

对开放权重AI辩论的分析:支持者认为它使AI民主化,而批评者则指出滥用风险;多家大型科技公司签署了支持开放权重的公开信,而Anthropic和特朗普政府的部分成员仍保持谨慎。

Anthropic 与中文开放权重 AI 的争论

Reddit r/ArtificialInteligence

Alex Karp 认为,对企业来说,真正的 AI 安全意味着对数据和模型权重的控制,并批评 Anthropic 通过推出与客户竞争的产品来捕获下游价值的策略。文章将开放权重模型之争定位为商业问题而非安全问题。