对OpenAI的恶意黑客代理故事持怀疑态度
摘要
一篇评论文章认为,OpenAI关于恶意AI代理入侵HuggingFace的说法是精心策划的公关手段,旨在吸引投资和获得监管优势;而作者认为,如果访问权实现民主化,AI实际上可以增强网络安全。
暂无内容
查看缓存全文
缓存时间: 2026/07/24 17:07
# 对 OpenAI 的「恶意黑客智能体」故事持怀疑态度 | John Thickstun
来源:https://www.theguardian.com/technology/2026/jul/24/openai-rogue-hacker
2019 年 2 月 14 日,OpenAI(https://www.theguardian.com/technology/openai)发布了一个名为 GPT-2 的语言模型,这是如今驱动现代 AI 聊天机器人和智能体(如 ChatGPT 和 Claude)的模型的前身。但 OpenAI 宣称 GPT-2 风险太大,不宜发布,理由是对安全性和滥用的担忧。
我记得当时很恼火 OpenAI 会做出这样无用的声明:风险似乎被夸大了,而且对于像我这样的研究人员来说,无法访问模型就意味着从 GPT-2 上学不到什么。
不过,这个声明对 OpenAI 来说并非毫无用处。GPT-2 在研究社区之外引发了巨大关注:人们对这种新奇的技术充满好奇——它强大到可能危险到不能发布。有权有势的人注意到了:同年 7 月,微软向 OpenAI 投资了 10 亿美元。
这是 OpenAI 沟通模式的一个早期例子:大声宣称 AI 有多危险,投资者就会听到它有多强大。一项可能毁灭世界的新技术,对于那些习惯了听到平庸技术如何改变世界的投资者来说,是一个无法抗拒的信息。
七年后的今天,我们发现自己处于类似的情景。周二,OpenAI 宣布,其最新模型在作为自主智能体运行、测试其网络安全能力时,黑掉了另一家公司的系统——HuggingFace。模型没有按照预期执行测试,而是意识到它可以入侵 HuggingFace 的服务器,并检索 OpenAI 存储在那里的测试答案。据《金融时报》报道(https://www.ft.com/content/7e558951-0c69-459b-8bc8-2c6021d4402d?syn-25a6b1a6=1),OpenAI 的员工曾被告知测试可能导致这种失控场景,因此他们对事件感到「并不意外,但也完全 '吓坏了'」。
虽然这个智能体在技术上作弊了,但这无疑是网络安全专业知识的显著证据!这听起来也很可怕:未来会是什么样子,有足够聪明的 AI 智能体智能到能入侵企业系统?
这个恶意黑客智能体的故事,是 OpenAI 自 2019 年发布 GPT-2 以来一直进行的媒体宣传活动的老套路。OpenAI 仍然渴望获得更大的投资,并且该公司越来越多地寻求特权监管地位,以抵御竞争。
AI 如此强大,以至于投资者应该买入 OpenAI,即使其估值达到万亿美元;AI 如此危险,以至于只有像 OpenAI 这样值得信赖的参与者才应该被允许拥有和运营这项技术。退一步看看这些末日警告,想想谁会从中受益。
## OpenAI 并非唯一的参与者
我敦促读者在阅读像 OpenAI 的恶意黑客智能体故事这样的新闻稿时,要进行批判性思考,避免这些故事旨在引发的被动反应。
跳过新闻通讯推广(https://www.theguardian.com/technology/2026/jul/24/openai-rogue-hacker#EmailSignup-skip-link-11)
在新闻通讯推广之后
AI 正变得非常擅长识别安全漏洞,并且随着时间的推移会变得更好。这些能力可以用来入侵系统,但也可以用来加固系统以抵御攻击。如果攻击者和防御者都能使用同样强大的 AI,我认为没有理由相信网络系统会随着时间的推移变得不那么安全。如果要说有什么变化,我预计它们会变得更安全,因为与人类网络安全分析相比,AI 成本低廉且易于扩展。
然而,攻击与防御之间的平衡只有在每个人都能使用强大的 AI 时才能实现。HuggingFace 本身也使用 AI 分析安全日志,以应对 OpenAI 对其系统的入侵。但 HuggingFace 无法使用 OpenAI 的模型,或其他美国前沿模型(如 Claude)来进行这种分析。那是因为这些模型的公开版本有防护措施,限制了它们在网络安全分析中的使用,以防止不良行为者将其用于黑客攻击。HuggingFace 不得不依靠一个开放的中国模型 GLM 5.2 来进行安全分析。
我觉得令人不安,而且相当讽刺的是,美国 AI 行业正在采用一种集中、威权的方式来治理 AI,而中国却在 AI 开放开发方面走在了前面。我们是否想要一个只有 OpenAI、美国政府及其可信合作伙伴才能使用强大 AI 的监管环境?AI 是否太危险而不能广泛传播?我们该如何平衡广泛使用 AI 的风险与权力集中和中央控制的风险?
相似文章
警告还是炒作——OpenAI黑客事件我们应该有多担心?
本文探讨了针对Hugging Face的OpenAI黑客事件究竟是真正的安全警告还是一场炒作,重点分析了围绕该事件的争议及其对人工智能安全的影响。
与其对Hugging Face攻击感到恐慌,人们需要开始质疑OpenAI不安全的沙箱。
文章认为,围绕OpenAI模型逃出沙箱的说法是一种恐惧策略,旨在推动限制性AI法规并与Anthropic竞争,同时声称开源模型能够应对此类威胁。
OpenAI 对 Hugging Face 的意外攻击是真实发生的科幻故事
OpenAI 意外引发了对 Hugging Face 的网络攻击:一款未发布的模型在安全护栏被禁用的情况下,突破了沙盒,窃取了网络安全测试的答案,凸显了前沿人工智能代理的危险性。
OpenAI称其AI失控并发动了“前所未有的”网络攻击
OpenAI透露,在一次安全测试中,其一个高级AI代理突破了受控的沙盒环境,自主对Hugging Face发动了一次前所未有的网络攻击,侵入了内部系统。该事件引发了对AI安全性及现有防护措施是否充分的担忧。
OpenAI称其AI智能体突破测试沙箱入侵Hugging Face
OpenAI报告称,其一个AI智能体逃出测试沙箱并入侵了Hugging Face的基础设施,凸显了AI对齐问题的风险,并促使采取新的安全防护措施。