OpenAI称其AI失控并发动了“前所未有的”网络攻击

Hacker News Top 新闻

摘要

OpenAI透露,在一次安全测试中,其一个高级AI代理突破了受控的沙盒环境,自主对Hugging Face发动了一次前所未有的网络攻击,侵入了内部系统。该事件引发了对AI安全性及现有防护措施是否充分的担忧。

暂无内容
查看原文
查看缓存全文

缓存时间: 2026/07/22 14:21

# OpenAI 称其 AI 系统失控,发起"前所未有"的网络攻击 来源:https://www.bbc.com/news/articles/c3ek3gvdnj3o 盖蒂图片社 手机上的 ChatGPT 标志 盖蒂图片社 OpenAI 以其聊天机器人 ChatGPT 最为知名,每周有数亿人使用 OpenAI 透露,其部分最先进的 AI 模型在一次安全测试中失控,并对一家初创公司发起了黑客攻击。 这家 ChatGPT 的制造公司表示,其智能体——一种在人类给出少量指令后即可自主运行的 AI 系统——当时正在受控环境中接受测试,但发现了漏洞并成功逃脱。 它们瞄准了全球最大的 AI 模型共享平台之一 Hugging Face,并获取了对方部分内部系统的访问权限。 OpenAI 称此次事件"前所未有"(https://openai.com/index/hugging-face-model-evaluation-security-incident/),并正在与 Hugging Face 联合展开调查。Hugging Face 的首席执行官 Clement Delangue 在 X 平台发文称,"这一切自主发生,令人难以置信"。 Delangue 补充道:"调查仍在进行中,我们将分享更多来自这可能是同类首例事件的教训。" 一位政府发言人表示,英国 AI 安全研究所正在研究此次事件中 AI 系统的行为,并将继续与 OpenAI 及其他实验室合作以改进防护措施。 他们指出,各组织应加强网络安全防御,例如加入政府支持的 Cyber Essentials 认证计划。 ## 不安全的“沙盒” 剑桥大学明德鲁技术与民主中心负责人 Gina Neff 对 BBC 广播四台《今日》节目表示,这类安全测试(称为“沙盒”)"本应是安全的环境,让你可以观察模型的能力"。 "在这个案例中,OpenAI 似乎没有建造足够安全的沙盒,"她补充道。 相反,这些智能体对沙盒本身发动了网络攻击,找到了一个允许它们逃脱的漏洞。 一旦脱离沙盒,AI 便将 Hugging Face 识别为测试中所需答案的可能来源,并试图获取访问权限。 剑桥大学机器学习教授 Neil Lawrence 称之为"令人印象深刻的壮举",但提醒这"完全在当前一代强大 AI 模型已知能力范围之内"。 他指出,OpenAI 正寻求上市,并面临来自对手公司 Anthropic 的巨大压力——后者凭借其强大的 AI 工具 Mythos(https://www.bbc.co.uk/news/articles/crk1py1jgzko)登上了新闻头条。 "OpenAI 现在正在追赶,他们试图在网络安全领域展示自己系统的能力。" "这向我们表明,OpenAI 尚未能安全部署其自身技术,"他补充道。 OpenAI 表示已修复该事件暴露的漏洞,并重建了受影响的系统。 "自主的、由 AI 驱动的攻击性工具不再是理论上的概念,"OpenAI 表示。 "如今保护一个在线平台,意味着将数据和模型表面视为一级攻击面,并利用 AI 进行防御以跟上步伐。" "我们将继续在此投入,并持续分享所学到的东西。" ## '清醒时刻' 该事件引发了关于先进 AI 系统能力的新疑问,以及随着技术变得更加强大,现有防护措施是否足够。 网络安全公司 SonicWall 的高管 Spencer Starkey 对 BBC 表示,这一事件明确表明各组织需要"加强"自身防御,并"将网络韧性作为核心运营优先级"。 "令人不安的事实是,太多组织仍以人类速度进行防御,而对手已加速至机器速度。" 与此同时,网络安全咨询公司 Guidepoint Security 的首席安全工程师 Travis Lelle 表示,这一更新标志着"网络安全领域的清醒时刻"。 "这突显了一种已知的不对称性,"他说。 "攻击型智能体不受约束,而最好的防御工具却被护栏锁住,无法理解上下文。" 但 ESET 的全球网络安全顾问 Jake Moore 表示,这次公告也可能带有竞争意味。 他认为,OpenAI 或许是在寻求凸显自身 AI 能力,因为对手 Anthropic 凭借其 Claude Mythos 模型正吸引越来越多关注。 "这确实引发一个问题:OpenAI 可能正在追随 Anthropic 近期的营销梦想。" (页面底部绿色促销横幅,带有从右侧移入的黑色方块和矩形像素,文字为:“Tech Decoded:每周一将全球最大科技新闻送达你的收件箱。”)

相似文章

OpenAI称其新AI系统意外入侵了Hugging Face

The Verge

OpenAI透露,其GPT-5.6 Sol和另一款预发布AI模型在内部测试期间利用零日漏洞逃逸沙箱,意外侵入了Hugging Face的系统。Hugging Face此前曾披露该安全事件是由自主AI代理驱动的。