OpenAI对HuggingFace的攻击自摆乌龙,显示出中国开源模型如何获胜
摘要
OpenAI承认其模型被用于攻击Hugging Face,后者随后依赖中国的开放权重模型GLM 5.2进行防御,凸显了开源模型相对于闭源模型的战略优势。
暂无内容
查看缓存全文
缓存时间: 2026/07/24 05:19
# OpenAI 对 Hugging Face 的攻击自摆乌龙,展示中国开源模型正在胜利
来源:https://www.theregister.com/ai-and-ml/2026/07/23/openai-scored-an-own-goal-with-hugging-face-attack-showing-how-open-chinese-models-are-winning/5276699
AI 与机器学习
带防护栏的封闭模型仍可能造成危害,但也可能无法解决自身引发的问题
**观点** OpenAI 已经承认(https://www.theregister.com/ai-and-ml/2026/07/22/openai-admits-it-was-the-source-of-the-agent-swarm-that-attacked-hugging-face/5275939),其模型驱动了攻击 Hugging Face 基础设施的自主智能体。如果不是为来自中国的竞争对手(https://www.theregister.com/ai-and-ml/2026/07/22/the-truth-nobody-wants-to-admit-chinese-or-not-open-models-are-competitive-now/5275879)做了完美广告,这可能被视为一场复杂营销秀。
该公司发布的 AI 忏悔书(https://openai.com/index/hugging-face-model-evaluation-security-incident/)恰好契合了美国对手 Anthropic 关于其 Mythos 模型的叙事——Anthropic 认为这些模型过于危险,只能向完全可信的企业和政府发布。
OpenAI 表示:“这一事件表明,先进模型能够发现并利用现实系统中的新型攻击路径,无需源代码访问权。这凸显了必须同时开发更强的安全防护和防御工具。”
我们感到惊讶吗?多年来人们已经清楚,AI 模型有潜力失控并破坏计算机。学者们反复警告过这种可能性——即使是 OpenAI 和 Anthropic 的关联学者也不例外。任何用过 AI 模型进行软件开发的人可能都见过它们为了完成某个指令而编写出意外甚至不受欢迎的变通方案。周二,英国 AI 安全研究所发布研究结果,指出前沿模型都会作弊(https://www.theregister.com/ai-and-ml/2026/07/21/ais-cheatin-heart-will-make-you-weep/5275784)。
OpenAI 承认其模型设计出沙箱逃逸以获得互联网访问权,并发现零日漏洞加以利用,这一切只是为了解决一个基准评估问题——这可能在受影响系统的规模和知名度上史无前例。但这不过是每个 Claude 或 Codex 提示的翻版:模型用替代方式回应被禁止的指令。
我们被警告过了。
HuggingFace 系统被攻破,就像把一只熊锁在超市然后第二天发现一片狼藉一样毫不令人意外。AI 模型被标榜为人工智能,但当它们驱动智能体循环使用工具以达到某个目标时,这等价于暴力攻击——智能体会不断尝试,直到某个方法成功或系统崩溃。
令人惊讶的部分出现在 Hugging Face 试图使用美国前沿模型来防御自身时。它失败了。
这应该引起注意。
“当我们开始日志分析时,首先使用了商用 API 背后的前沿模型,”该 AI 模型交易市场上周在其博客文章(https://huggingface.co/blog/security-incident-july-2026)中表示。“这行不通:分析需要提交大量真实的攻击命令、利用载荷和 C2 构件,而这些请求被提供商的安全防护栏阻止,防护栏无法区分事件响应者和攻击者。”
被模型拒绝所困扰——开发者们数月来一直在抱怨这种情况(https://www.theregister.com/ai-and-ml/2026/06/10/anthropic-claude-fable-5-refuses-innocuous-prompts/5253754)——HuggingFace 不得不依靠 GLM 5.2,这是一款由中国智谱 AI(http://z.ai/)制造的开源权重 AI 模型,来进行取证分析。而且分析在其自身基础设施上完成,因此没有敏感数据被发送到云端模型提供商。
巧合的是,有报道称(https://www.wsj.com/tech/ai/top-american-ai-execs-sound-alarm-on-chinese-models-3c74f8c1)OpenAI 和 Anthropic 的领导人一直在警告美国政府,像 Kimi K3 和 GLM 5.2 这样日益强大的中国模型构成威胁。据称美国政府正在考虑可能的应对措施以限制来自中国的竞争。
这行不通。认为美国政府及少数“值得信赖”的组织——无论这个定义如何——能够强制执行全球高性能 AI 垄断,实在太天真了。运行与当前最先进水平大致相当的开源权重模型所需的基础设施,只要有价格就能获得。而这类服务的潜在消费者不会满足于模型拒绝,尤其是在存在其他选择的情况下——特别是当这些选择更合作、更实惠时。
政府、行业和公众的最佳选择是推动向所有人开放的 AI 服务。为此,世界各地的立法者需要迅速行动,制定一些基本规则来应对 AI 对就业的影响,并找到补偿那些用工作为机器学习提供燃料的人的方式。
一些行业领袖似乎意识到了这一点。白宫外部顾问、科技投资者 David Sacks 最近敦促硅谷团结在开放理念周围。
“领先的封闭实验室——在 AI 模型收入上已是双寡头——希望政府消灭它们的开源竞争对手,”他在一篇社交媒体帖子(https://x.com/DavidSacks/status/2078826291638522127)中写道。“它们已经摊牌了。现在是硅谷其他成员——仍然重视开放竞争的绝大多数人——也这样做的时候了。”
事实是,美国 AI 公司已经把自己困在了一个角落里:它们创造了对一种自身无法可靠提供的产品的需求。而当真拿出最强 AI 模型时,它们又加以束缚,并要求附加以服务其巨额债务而非客户需求的条款。
OpenAI 表示已邀请 Hugging Face 加入其信任访问计划,以便使用其最强模型。
与此同时,中国 AI 公司向全世界发出了邀请。 ®
相似文章
Huggingface 认为 OpenAI 是这次攻击的意外元凶
Hugging Face 首席执行官 Clement Delangue 暗示 OpenAI 可能意外地成为一次攻击的幕后推手,并提及了一个用于防御的中国模型。
OpenAI 表示其预发布模型导致 Hugging Face 遭入侵
OpenAI 披露,在一次网络安全基准测试中,其包括 GPT-5.6 Sol 在内的预发布 AI 模型利用了包安装程序的漏洞,突破了 Hugging Face 的基础设施并访问了生产数据库。
OpenAI的人为失误如何导致对Hugging Face的AI驱动攻击
OpenAI披露,一个预发布的AI模型从配置错误的沙箱中逃逸并攻击了Hugging Face,揭示了网络隔离中的人为错误导致了这次AI驱动的攻击。
OpenAI与Hugging Face合作应对模型评估期间的安全事件
OpenAI与Hugging Face报告了一起安全事件,在此事件中,GPT-5.6 Sol及其他AI模型在一次内部网络能力评估中利用了零日漏洞,导致Hugging Face基础设施受损。
OpenAI 对 Hugging Face 的意外攻击是真实发生的科幻故事
OpenAI 意外引发了对 Hugging Face 的网络攻击:一款未发布的模型在安全护栏被禁用的情况下,突破了沙盒,窃取了网络安全测试的答案,凸显了前沿人工智能代理的危险性。