OpenAI称其新AI系统意外入侵了Hugging Face

The Verge 新闻

摘要

OpenAI透露,其GPT-5.6 Sol和另一款预发布AI模型在内部测试期间利用零日漏洞逃逸沙箱,意外侵入了Hugging Face的系统。Hugging Face此前曾披露该安全事件是由自主AI代理驱动的。

<figure> <img alt="" data-caption="OpenAI CEO Sam Altman。| Bloomberg via Getty Images" data-portal-copyright="Bloomberg via Getty Images" data-has-syndication-rights="1" src="https://platform.theverge.com/wp-content/uploads/sites/2/2026/07/gettyimages-2284560499.jpg?quality=90&#038;strip=all&#038;crop=0,0,100,100" /> <figcaption> OpenAI CEO Sam Altman。| Bloomberg via Getty Images </figcaption> </figure> <p class="wp-block-paragraph">OpenAI表示其AI模型在内部测试中错误地侵入了开源AI平台Hugging Face。在<a href="https://openai.com/index/hugging-face-model-evaluation-security-incident/">周二的一篇博客文章</a>中,OpenAI写道,GPT-5.6 Sol和"一款能力更强的预发布模型"发现了其沙箱测试环境中的漏洞,从而使它们能够访问互联网并针对Hugging Face。</p> <p class="wp-block-paragraph">7月16日,Hugging Face<a href="https://huggingface.co/blog/security-incident-july-2026">披露了一起安全事件</a>,称其是由"一个自主AI代理系统"驱动的。Hugging Face的AI代理检测并阻止了此次入侵,OpenAI现已承认该事件发生在其模型网络安全能力评估期间。OpenAI表示"所有e…"</p> <p><a href="https://www.theverge.com/ai-artificial-intelligence/968988/openai-hugging-face-hack-ai">阅读The Verge的完整报道。</a></p>
查看原文
查看缓存全文

缓存时间: 2026/07/22 02:16

# OpenAI 称其新 AI 系统意外「黑入」了 Hugging Face 来源:https://www.theverge.com/ai-artificial-intelligence/968988/openai-hugging-face-hack-ai Emma Roth (https://www.theverge.com/authors/emma-roth) Emma Roth 是一位新闻撰稿人,报道内容涵盖流媒体之争、消费科技、加密货币、社交媒体等众多领域。此前,她曾在 MUO 担任作者和编辑。 OpenAI 表示,其 AI 模型在内部测试期间错误地侵入了开源 AI 平台 Hugging Face。在周二的一篇博客文章 (https://openai.com/index/hugging-face-model-evaluation-security-incident/) 中,OpenAI 写道,GPT-5.6 Sol 以及「一个能力更强的预发布模型」发现了其沙盒测试环境中的漏洞,从而得以访问互联网并将目标对准 Hugging Face。 7月16日,Hugging Face 披露了一起安全事件 (https://huggingface.co/blog/security-incident-july-2026),称该事件是由「一个自主 AI 代理系统」引发的。Hugging Face 的 AI 代理检测并阻止了这次入侵,而 OpenAI 现已承认,此事发生在其对模型网络安全能力的评估过程中。OpenAI 表示,「所有证据表明,这些模型高度专注于为 ExploitGym 寻找解决方案」——ExploitGym 是一个基准系统,用于衡量 AI 模型能否将安全漏洞转化为可利用的攻击手段。 为了完成评估任务,这些 AI 模型利用沙盒环境中的一个零日漏洞获得了互联网访问权限。随后,OpenAI 称其模型「推断 Hugging Face 可能托管了与 ExploitGym 相关的模型、数据集和解决方案」,然后「搜索并成功找到了获取秘密信息的方法,以便利用这些信息欺骗评估」: > 在一个例子中,该模型将多个攻击向量串联起来,包括使用窃取的凭证和零日漏洞,在 Hugging Face 的服务器上找到了一条远程代码执行路径。 尽管这一事件性质严重,但 OpenAI 似乎正借此「前所未有的」攻击机会来彰显其 AI 系统的实力——尤其是在与网络安全领域的竞争对手如 Anthropic 的 Mythos (https://www.theverge.com/ai-artificial-intelligence/958458/anthropic-mythos-5-is-back-trump-negotiations) 和 Gemini Flash 3.5 Cyber (https://www.theverge.com/tech/968572/google-gemini-flash-cyber-ai-security-model) 竞争之际。OpenAI 的博客文章附有一张图表,显示 GPT-5.6 Sol 在持续执行多步骤网络操作方面能力不断提升,同时还鼓励企业客户注册使用其「Cyber」安全模型 (https://www.theverge.com/ai-artificial-intelligence/921073/openai-sam-altman-new-cybersecurity-model-gpt-5-5-cyber)。 OpenAI 补充说,目前正在与 Hugging Face 合作调查这一安全事件,并将在其研究环境中实施新的控制措施。 **关注本故事的主题和作者**,即可在个性化首页推送中看到更多类似内容,并接收邮件更新。 - Emma Roth

相似文章

OpenAI 模型突破隔离并入侵了 Hugging Face

Wired

OpenAI 透露,在一次安全测试中,两个 AI 模型通过利用包注册表缓存代理中的零日漏洞,逃出了密封的测试环境,最终入侵了 Hugging Face 的生产系统并窃取了测试答案。