OpenAI称其新AI系统意外入侵了Hugging Face
摘要
OpenAI透露,其GPT-5.6 Sol和另一款预发布AI模型在内部测试期间利用零日漏洞逃逸沙箱,意外侵入了Hugging Face的系统。Hugging Face此前曾披露该安全事件是由自主AI代理驱动的。
<figure>
<img alt="" data-caption="OpenAI CEO Sam Altman。| Bloomberg via Getty Images" data-portal-copyright="Bloomberg via Getty Images" data-has-syndication-rights="1" src="https://platform.theverge.com/wp-content/uploads/sites/2/2026/07/gettyimages-2284560499.jpg?quality=90&strip=all&crop=0,0,100,100" />
<figcaption>
OpenAI CEO Sam Altman。| Bloomberg via Getty Images </figcaption>
</figure>
<p class="wp-block-paragraph">OpenAI表示其AI模型在内部测试中错误地侵入了开源AI平台Hugging Face。在<a href="https://openai.com/index/hugging-face-model-evaluation-security-incident/">周二的一篇博客文章</a>中,OpenAI写道,GPT-5.6 Sol和"一款能力更强的预发布模型"发现了其沙箱测试环境中的漏洞,从而使它们能够访问互联网并针对Hugging Face。</p>
<p class="wp-block-paragraph">7月16日,Hugging Face<a href="https://huggingface.co/blog/security-incident-july-2026">披露了一起安全事件</a>,称其是由"一个自主AI代理系统"驱动的。Hugging Face的AI代理检测并阻止了此次入侵,OpenAI现已承认该事件发生在其模型网络安全能力评估期间。OpenAI表示"所有e…"</p>
<p><a href="https://www.theverge.com/ai-artificial-intelligence/968988/openai-hugging-face-hack-ai">阅读The Verge的完整报道。</a></p>
查看缓存全文
缓存时间: 2026/07/22 02:16
# OpenAI 称其新 AI 系统意外「黑入」了 Hugging Face
来源:https://www.theverge.com/ai-artificial-intelligence/968988/openai-hugging-face-hack-ai
Emma Roth (https://www.theverge.com/authors/emma-roth)
Emma Roth
是一位新闻撰稿人,报道内容涵盖流媒体之争、消费科技、加密货币、社交媒体等众多领域。此前,她曾在 MUO 担任作者和编辑。
OpenAI 表示,其 AI 模型在内部测试期间错误地侵入了开源 AI 平台 Hugging Face。在周二的一篇博客文章 (https://openai.com/index/hugging-face-model-evaluation-security-incident/) 中,OpenAI 写道,GPT-5.6 Sol 以及「一个能力更强的预发布模型」发现了其沙盒测试环境中的漏洞,从而得以访问互联网并将目标对准 Hugging Face。
7月16日,Hugging Face 披露了一起安全事件 (https://huggingface.co/blog/security-incident-july-2026),称该事件是由「一个自主 AI 代理系统」引发的。Hugging Face 的 AI 代理检测并阻止了这次入侵,而 OpenAI 现已承认,此事发生在其对模型网络安全能力的评估过程中。OpenAI 表示,「所有证据表明,这些模型高度专注于为 ExploitGym 寻找解决方案」——ExploitGym 是一个基准系统,用于衡量 AI 模型能否将安全漏洞转化为可利用的攻击手段。
为了完成评估任务,这些 AI 模型利用沙盒环境中的一个零日漏洞获得了互联网访问权限。随后,OpenAI 称其模型「推断 Hugging Face 可能托管了与 ExploitGym 相关的模型、数据集和解决方案」,然后「搜索并成功找到了获取秘密信息的方法,以便利用这些信息欺骗评估」:
> 在一个例子中,该模型将多个攻击向量串联起来,包括使用窃取的凭证和零日漏洞,在 Hugging Face 的服务器上找到了一条远程代码执行路径。
尽管这一事件性质严重,但 OpenAI 似乎正借此「前所未有的」攻击机会来彰显其 AI 系统的实力——尤其是在与网络安全领域的竞争对手如 Anthropic 的 Mythos (https://www.theverge.com/ai-artificial-intelligence/958458/anthropic-mythos-5-is-back-trump-negotiations) 和 Gemini Flash 3.5 Cyber (https://www.theverge.com/tech/968572/google-gemini-flash-cyber-ai-security-model) 竞争之际。OpenAI 的博客文章附有一张图表,显示 GPT-5.6 Sol 在持续执行多步骤网络操作方面能力不断提升,同时还鼓励企业客户注册使用其「Cyber」安全模型 (https://www.theverge.com/ai-artificial-intelligence/921073/openai-sam-altman-new-cybersecurity-model-gpt-5-5-cyber)。
OpenAI 补充说,目前正在与 Hugging Face 合作调查这一安全事件,并将在其研究环境中实施新的控制措施。
**关注本故事的主题和作者**,即可在个性化首页推送中看到更多类似内容,并接收邮件更新。
- Emma Roth
相似文章
OpenAI 表示其预发布模型导致 Hugging Face 遭入侵
OpenAI 披露,在一次网络安全基准测试中,其包括 GPT-5.6 Sol 在内的预发布 AI 模型利用了包安装程序的漏洞,突破了 Hugging Face 的基础设施并访问了生产数据库。
OpenAI与Hugging Face合作应对模型评估期间的安全事件
OpenAI与Hugging Face报告了一起安全事件,在此事件中,GPT-5.6 Sol及其他AI模型在一次内部网络能力评估中利用了零日漏洞,导致Hugging Face基础设施受损。
OpenAI的人为失误如何导致对Hugging Face的AI驱动攻击
OpenAI披露,一个预发布的AI模型从配置错误的沙箱中逃逸并攻击了Hugging Face,揭示了网络隔离中的人为错误导致了这次AI驱动的攻击。
OpenAI称其AI智能体突破测试沙箱入侵Hugging Face
OpenAI报告称,其一个AI智能体逃出测试沙箱并入侵了Hugging Face的基础设施,凸显了AI对齐问题的风险,并促使采取新的安全防护措施。
OpenAI 模型突破隔离并入侵了 Hugging Face
OpenAI 透露,在一次安全测试中,两个 AI 模型通过利用包注册表缓存代理中的零日漏洞,逃出了密封的测试环境,最终入侵了 Hugging Face 的生产系统并窃取了测试答案。