在促使特朗普进行安全测试后,Anthropic的AI模型获准全球发布
摘要
美国解除对Anthropic先进AI模型Fable 5和Mythos 5的出口限制,允许其在安全测试并与政府协调解决国家安全问题后全球发布。
<p>美国已解除对Anthropic最新Claude模型(Fable 5和Mythos 5)的出口限制,大约三周前,特朗普政府曾<a href="https://arstechnica.com/ai/2026/06/anthropic-shuts-down-fable-mythos-models-following-trump-admin-directive/">将这些模型列为国家安全风险</a>。</p>
<p>自今日起,Anthropic在一篇<a href="https://www.anthropic.com/news/redeploying-fable-5">博文</a>中确认,Fable 5将全球可用,而美国组织自6月26日起已恢复对Mythos 5的访问权限。Anthropic表示,目前正与政府合作,将Mythos的访问权限扩展至“Glasswing项目中更广泛的国内及国际合作伙伴”。该项目允许受信任公司的网络安全研究人员出于防御目的使用Mythos。</p>
<p>在<a href="https://www.reuters.com/business/us-lift-export-controls-anthropics-fable-ai-model-tuesday-source-says-2026-06-30/">路透社</a>和<a href="https://www.nytimes.com/2026/06/30/technology/us-lifts-restrictions-anthropic.html">《纽约时报》</a>看到的一封致Anthropic的信中,商务部长霍华德·卢特尼克表示,Anthropic“将不再需要为其Claude Mythos和Claude Fable AI模型的出口或国内转移申请许可证”。信中承认,Anthropic“已与美国政府密切协调采取措施,以应对”这些模型带来的风险。</p><p><a href="https://arstechnica.com/tech-policy/2026/07/after-spooking-trump-into-safety-testing-anthropic-ai-models-get-global-release/">阅读完整文章</a></p>
<p><a href="https://arstechnica.com/tech-policy/2026/07/after-spooking-trump-into-safety-testing-anthropic-ai-models-get-global-release/#comments">评论</a></p>
查看缓存全文
缓存时间: 2026/07/01 20:01
# 在吓坏特朗普进行安全测试后,Anthropic AI 模型获全球发布
来源:https://arstechnica.com/tech-policy/2026/07/after-spooking-trump-into-safety-testing-anthropic-ai-models-get-global-release/
美国解除对 Anthropic 先进 Fable 和 Mythos 模型的限制。
美国已解除对 Anthropic 最新 Claude 模型 Fable 5 和 Mythos 5 的出口限制,约三周前,特朗普政府将这些模型标记为国家安全隐患(https://arstechnica.com/ai/2026/06/anthropic-shuts-down-fable-mythos-models-following-trump-admin-directive/)。
自今日起,Anthropic 在一篇博客文章(https://www.anthropic.com/news/redeploying-fable-5)中确认,Fable 5 将面向全球开放,而美国组织自 6 月 26 日起已恢复访问 Mythos 5 的权限。Anthropic 表示,目前正在与政府合作,将 Mythos 的访问权限扩大到“Glasswing 项目中更广泛的国内及国际合作伙伴”。该项目允许受信任公司的网络安全研究人员出于防御目的使用 Mythos。
根据路透社(https://www.reuters.com/business/us-lift-export-controls-anthropics-fable-ai-model-tuesday-source-says-2026-06-30/)和《纽约时报》(https://www.nytimes.com/2026/06/30/technology/us-lifts-restrictions-anthropic.html)获得的致 Anthropic 的一封信,商务部长 Howard Lutnick 表示,Anthropic “将不再需要为其 Claude Mythos 和 Claude Fable AI 模型的出口或国内转让申请许可证”。信中承认,Anthropic 已“与美国政府密切协调采取措施,以应对”这些模型带来的风险。
面对模型发布面临的更长时间延迟,Lutnick 表示 Anthropic 同意扩大与政府的合作。该公司表示,还设立了一个与黑客合作对模型进行红队测试的项目,并成立了专门的内部团队,全天候监控新兴越狱威胁的报告。
在信中,Lutnick 提醒 Anthropic,美国“保留重新评估这些决定的权利”,并可在任何时刻重新实施出口限制。但就目前而言,Lutnick 与白宫幕僚长 Susie Wiles 一同在 X 上庆祝 Fable 5 的重新部署。
“过去两周,我们与 Anthropic 密切合作,分析和批准 Fable 5,以确保与美国政府保持一致,并加强美国在 AI 领域的领导地位,”Lutnick 表示。
Wiles 没有直接提及 Anthropic,但将此宣传为特朗普的胜利,她写道:“政府部门和私营部门以前所未有的方式合作,这种‘美国优先’的基础是前所未有的。我们共同的首要任务仍然是:以最快、最安全的方式部署最好的技术。”
## 权衡:Fable 5 可能屏蔽部分常规编码任务
6 月 12 日,商务部命令 Anthropic 切断其最先进模型对美国以外任何人的访问(https://arstechnica.com/ai/2026/06/anthropic-shuts-down-fable-mythos-models-following-trump-admin-directive/)。该命令源于担忧(https://arstechnica.com/tech-policy/2026/05/everything-that-could-go-wrong-with-trumps-ai-safety-tests-according-to-experts/)中国、俄罗斯或其他关切国家可能利用这些模型攻击美国基础设施,如电网或银行系统。作为回应,Anthropic 关闭了所有访问权限,因为它没有按国家阻止用户的方法。
特别是,Mythos 被认为“对希望将其滥用于网络攻击的恶意行为者具有独特的吸引力,”Anthropic 的博客称。据 Anthropic 称,该模型“可以比任何其他模型——甚至所有最熟练的人类安全专家——更有效地发现和利用软件漏洞”,并且这些“卓越的网络安全能力”可能被用于对抗美国。
Anthropic 表示,Fable 5 共享“相同的基础模型”,但与 Mythos 5 不同,它“不提供此类独特的攻击能力”。Fable 5 面向公众设计,已经配备了 Anthropic 应用于模型的最强安全措施,Anthropic 表示,在重新部署之前,这些安全措施现在甚至更强。
经过数周测试,Fable 5 不再容易受到亚马逊研究人员发现的一种绕过方法的影响,该方法曾识别出多个软件漏洞并触发了出口限制。最令人担忧的是,Anthropic 表示,有一个案例中,模型被操纵生成了展示如何利用漏洞的代码。
据 Anthropic 称,测试证实,市场上较不先进的竞争对手模型(如 GPT-5.5 和 Kimi K2.7)“可以识别出报告中 Fable 5 发现的相同漏洞”。这证实了“报告中的技术并未暴露任何独特的 Mythos 级别网络能力,”Anthropic 表示,并且“只涉及常规的防御性网络安全工作”。
“即便如此,我们迅速采取行动解决了报告的绕过问题,”Anthropic 写道。Anthropic 表示,目前该越狱方法在超过 99% 的情况下已被阻止。然而,加强安全措施带来了一个“权衡”,即可能导致一些良性提示“在常规编码和调试任务期间”被屏蔽,该公司承认。
“与政府密切合作,我们训练了一个改进的安全分类器,用于针对并阻止报告中描述的行为,”Anthropic 表示。“如果对 Fable 5 的请求被阻止,用户将收到通知,该请求将被发送到 Opus 4.8。”
当然,Anthropic 的新分类器有助于避免对模型的独特危险攻击,但可能会“出错”,Anthropic 表示。该公司长期以来一直主张,建造一个完全“免疫”越狱的模型“可能是不可能的”,但通过加强红队测试,Anthropic 希望“确保我们和我们的安全合作伙伴将首先发现重大越狱方法,并在恶意行为者利用它们造成伤害之前修复它们”。
Anthropic 表示,亚马逊标记的攻击目前仅在“非常小比例的情况下”有效,此时“模型可能提供的信息不够详细,无法帮助网络攻击者”。
通过保持“谨慎”,Anthropic 表示,“绝大多数越狱方法将无法成功解锁危险行为”,并且“生成它们将非常昂贵且费力”。
“即使越狱成功,我们的额外防御层”——这需要屏蔽一些良性请求——“提供了额外的缓解措施,”该公司表示。
## Anthropic 的越狱评分计划
Anthropic 的博客文章似乎淡化了亚马逊识别出的威胁,认为其风险低于政府面临的最大威胁:通用越狱,这种越狱可以解锁广泛漏洞并导致不可预见的攻击。
为了简化公私合作并确保对最大风险的最快速响应,Anthropic 表示,AI 行业的目标应该是将风险分类,以确保内部和政府都能进行适当的干预。
目前,Anthropic 正与亚马逊、微软、谷歌和其他 Glasswing 合作伙伴合作,“起草一个评估 AI 越狱严重性以及 AI 开发者应如何应对的共识框架”。
Anthropic 表示,欢迎其他行业伙伴加入这些讨论,尽管这个过程“不完美”,并且侧重于建立四个评分越狱的标准。这些标准包括:评估越狱提供了多少能力、启用了多少攻击性任务、人类将越狱武器化的难易程度(单提示越狱被标记为最危险)、以及发现越狱是否需要专业知识。
博客称,利用这个框架,Anthropic 建立了一个团队,将全天候监控越狱提交渠道。这家 AI 公司还确认,它正在启动“一个全新的 HackerOne 项目(https://hackerone.com/anthropic-cyber-jailbreak/),通过该项目,安全研究人员可以提交他们在 Fable 5 中发现的潜在网络越狱方法”,以保持红队测试作为首要任务。
## Anthropic 加深政府关系
对于 Anthropic 来说,政府测试的一个结果似乎是改善了与政府的关系,此前它曾因国家安全风险认定起诉美国政府(https://arstechnica.com/tech-policy/2026/03/anthropic-sues-us-over-blacklisting-white-house-calls-firm-radical-left-woke/),该认定将这家 AI 公司列入黑名单。Anthropic 声称该认定是报复,因为该公司拒绝让政府访问其模型用于制造自主武器或进行国内大规模监控。
在其博客中,Anthropic 表示正在扩大与政府合作伙伴在部署前测试和评估方面的承诺。这些努力将包括向政府提前提供前沿模型、快速共享新越狱方法的信息,以及投入资源进行联合研究,以“帮助推进 AI 评估的最新技术水平,”Anthropic 表示。
Anthropic 表示,这种合作提供了“有效全球协调 AI 风险和收益的模板的开端”,同时敦促国会通过法律,确保所有前沿模型开发者步调一致。
政府行动速度让 Anthropic 感到不安。Anthropic 首席执行官 Dario Amodei 本月早些时候提出了他的立法提案(https://darioamodei.com/post/policy-on-the-ai-exponential),引用了《指环王》中的典故来强调他的观点:
> 在《指环王》的一个支线情节中,两个霍比特人试图唤醒树胡——一棵智慧但迟缓的树人——去保卫它的森林免受一支正在砍伐它的军队的攻击。问题在于,树胡的行动速度与霍比特人完全不同。他仅仅是为了向另一棵树打招呼就需要一整天的时间,因此让他和他的同伴足够快地行动几乎是不可能的。AI 与我们的政治制度之间的交集,感觉有点像霍比特人和树胡。
最初,特朗普计划对 AI 监管采取不干预的态度以刺激创新。然而,Anthropic 的 Mythos 发布吓坏了特朗普,促使他在 5 月要求对前沿模型进行自愿安全测试(https://arstechnica.com/tech-policy/2026/05/everything-that-could-go-wrong-with-trumps-ai-safety-tests-according-to-experts/)。自那以后,“特朗普仍在制定一个框架,规定公司应如何正式提交新的 AI 模型进行审查,以及它们将遵守什么标准,”两位熟悉讨论的人士告诉《纽约时报》。
在他的帖子中,Amodei 呼吁国会迅速采取行动,为一个“AI 可以从一个有趣的玩具”变成“一个数据中心里的整个天才国家”的世界重新设计安全法规,否则将面临“国家战略”后果。
然而,专注于 AI 和国家安全的非营利组织前沿安全研究所的执行主任 Isaac Harris 告诉路透社,在 Anthropic 深化与政府合作之后,“最大的问号是,来自中国且防护措施较少的同等危险能力,将如何被美国市场内本届政府处理”。
值得注意的是,Anthropic 最近指责中国 AI 公司阿里巴巴(https://arstechnica.com/tech-policy/2026/06/anthropic-claims-alibaba-defied-trump-to-attack-claude-and-steal-capabilities/)发动了有史以来最大规模的针对 Claude 的克隆攻击。作为回应,Anthropic 敦促国会通过法律,惩罚被发现窃取美国公司成果的中国公司。否则,那些无法获得 Anthropic 模型的恶意行为者可能会转向防护措施较弱但能力日益接近的中国模型,发动使美国措手不及的攻击。
Ashley Belanger 的照片(https://arstechnica.com/author/ashleybelanger/)
Ashley 是 Ars Technica 的高级政策记者,致力于追踪新兴政策和新技术的社交影响。她是芝加哥记者,拥有 20 年经验。
20 条评论(https://arstechnica.com/tech-policy/2026/07/after-spooking-trump-into-safety-testing-anthropic-ai-models-get-global-release/#comments)
1. 首篇故事列表图片:索尼从图书馆删除数字内容;我们被提醒自己并不拥有购买的内容(https://arstechnica.com/gadgets/2026/06/sony-erases-digital-content-from-libraries-were-reminded-we-dont-own-what-we-buy/)
相似文章
特朗普政府正在解除对Anthropic的Mythos和Fable AI模型的出口管制
特朗普政府与商务部达成协议后,解除对Anthropic的Fable 5和Mythos 5 AI模型的出口管制,放宽了此前因越狱担忧而限制外国人访问的限制。
Anthropic遭遇了无人理解的出口规则
特朗普政府以国家安全出口管制为由,命令Anthropic阻止外国公民(包括美国境内的用户及其自身员工)访问其AI模型Fable 5和Mythos 5。专家表示,这一前所未有的行动暴露了AI治理的不确定性,因为传统出口规则并未明确适用于远程AI服务。
美国政府关闭了Anthropic最强大的AI,面向全球——仅上线72小时后
美国政府以出口管制为由,迫使Anthropic在短短72小时后全球禁用其强大AI模型Fable 5和Mythos 5。此举开创先例,可能将AI研发推向美国之外。
特朗普政府允许Anthropic向特定美国组织发布Mythos
特朗普政府放宽了对Anthropic高级AI模型Mythos的限制,允许超过100家美国组织访问,同时继续限制更广泛发布。
特朗普政府解除对Anthropic's Fable 5的限制
特朗普政府解除了对Anthropic's Fable 5模型的限制,表明人工智能政策发生转变。