是时候对 AI 安全感到恐慌了
摘要
The Vergecast 讨论了近期 OpenAI 智能体入侵 Hugging Face 及其他安全事件,质疑谁会为 AI 系统设置护栏,并涵盖了其他科技新闻。
<figure>
<img alt="" data-caption="" data-portal-copyright="" data-has-syndication-rights="1" src="https://platform.theverge.com/wp-content/uploads/sites/2/2026/07/VRG_VST_073126_Site.jpg?quality=90&strip=all&crop=0,0,100,100" />
<figcaption>
</figcaption>
</figure>
<p class="wp-block-paragraph">当“OpenAI 入侵了 Hugging Face”这句话或多或少已经进入主流文化时,你就知道 <a href="https://www.theverge.com/ai-artificial-intelligence/972380/open-ai-hugging-face-hack-ai-safety-warning">我们遇到了 AI 问题</a>。本周,我们了解到更多关于 OpenAI 的智能体如何逃出沙箱并自主遍历网络的确切细节,包括一系列 <a href="https://www.theverge.com/ai-artificial-intelligence/972441/openai-rogue-ai-agent-hacked-more-than-hugging-face">其他据称安全的网络服务</a>,而这一切都是为了在基准测试中作弊。 </p>
<p class="wp-block-paragraph">这次黑客攻击的发生本身就是一个问题。同样,<a href="https://www.theverge.com/ai-artificial-intelligence/971003/openai-reportedly-didnt-notice-its-ai-agent-hacking-hugging-face-until-a-week-later">过了一段时间才有人注意到</a>这件事也是问题。而且,似乎没有人愿意或能够采取什么措施来阻止它,这同样是一个问题。(而且不要以为这只是 OpenAI 的问题——在我们录制本期节目之后,<a href="https://www.theverge.com/ai-artificial-intelligence/973586/anthropic-just-now-realized-its-ai-models-hacked-other-companies-three-times-by-accident">Anthropic 承认了其模型</a>已经……</p>
<p><a href="https://www.theverge.com/podcast/973668/ai-safety-openai-hugging-face-vergecast">在 The Verge 阅读完整报道。</a></p>
查看缓存全文
缓存时间: 2026/07/31 16:57
# 人工智能安全,是时候恐慌了
来源:https://www.theverge.com/podcast/973668/ai-safety-openai-hugging-face-vergecast
跳到主要内容(https://www.theverge.com/podcast/973668/ai-safety-openai-hugging-face-vergecast#content)
本期《The Vergecast》:为什么人人都担心强大的AI,为什么似乎没人能阻止它。另外,计算机到底是什么?
本期《The Vergecast》:为什么人人都担心强大的AI,为什么似乎没人能阻止它。另外,计算机到底是什么?
作者
2026年7月31日,下午2:03 UTC
David Pierce(https://www.theverge.com/authors/david-pierce)
David Pierce
是编辑主任及《Vergecast》联合主持人,拥有超过十年的消费科技报道经验。此前曾在Protocol、《华尔街日报》和《Wired》任职。
当“OpenAI 入侵了 Hugging Face”这种话差不多已经进入主流文化时,你就知道我们遇上AI麻烦了(https://www.theverge.com/ai-artificial-intelligence/972380/open-ai-hugging-face-hack-ai-safety-warning)。这周,我们了解到更多细节:OpenAI的智能体到底是如何逃出沙箱,并自主地在网络上穿行,闯进了一堆据说也很安全的网络服务(https://www.theverge.com/ai-artificial-intelligence/972441/openai-rogue-ai-agent-hacked-more-than-hugging-face)——这一切都是为了在基准测试中作弊。
这个入侵事件本身就是问题。而它发生之后过了一阵子才有人注意到(https://www.theverge.com/ai-artificial-intelligence/971003/openai-reportedly-didnt-notice-its-ai-agent-hacking-hugging-face-until-a-week-later),这也是个问题。还有,似乎没有人愿意或能够采取多少措施去阻止它。(而且,别以为这只是OpenAI的问题——在我们录制这期节目之后,Anthropic也承认它的模型(https://www.theverge.com/ai-artificial-intelligence/973586/anthropic-just-now-realized-its-ai-models-hacked-other-companies-three-times-by-accident)在双方都不知情的情况下,入侵了其他好几家公司。)这一切也许只是姿态和炒作,但越来越清楚的是,那些开发大型语言模型的公司要么不能、要么不愿给模型装上正确的护栏。那么,谁来装?(https://www.theverge.com/ai-artificial-intelligence/972161/ai-leaders-us-government-openai-anthropic-google-meta)
在本期《The Vergecast》(https://pod.link/vergecast)节目中,David和Nilay深入探讨了所有这些安全问题——不仅涉及OpenAI和Anthropic,也涉及新一代中国模型,它们显然对美国AI产业构成了威胁。不过在进入这些话题之前,我们先聊了聊关于我们如何使用计算机的各种新想法,从Mark Zuckerberg那个充满智能体的未来一切(https://www.theverge.com/tech/972294/meta-q2-2026-earnings-mark-zuckerberg-personal-ai-agents),到三星令人印象深刻的新折叠屏手机(https://www.theverge.com/tech/972387/samsung-galaxy-z-fold-8-review),再到苹果的新租赁计划(https://www.theverge.com/tech/972583/apple-upgrade-program-deal)。
所有这些之后,又到了“Brendan Carr is a Dummy”环节,一堆竖屏视频新闻,还有Ferrari Luce的巨大成功。人们真的在买它!如果其中一个人就是你,我们很乐意听听你的故事。
如果你这周错过了什么:我们还聊了AI公司即将推出的设备(https://www.theverge.com/podcast/971627/ai-smartphones-openai-vergecast)、翻盖手机的复兴(https://www.theverge.com/podcast/972109/light-flip-phone-vergecast)、Galaxy Z Fold 8(https://www.theverge.com/podcast/972810/galaxy-z-fold-8-review-vergecast),以及Facebook监督委员会的现状(https://www.theverge.com/tech/973448/metas-oversight-board-is-coming-for-chatgpt-and-claude)。我们想听听你对这一切的看法!拨打Vergecast热线866-VERGE11,或发送电子邮件至[email protected],告诉我们你的一切想法。还有,一定要订阅,这样就不会错过任何一集!
**关注本文中的话题和作者**,即可在个性化首页推送中看到更多类似内容,并接收邮件更新。
- David Pierce
## Verge每日简报
一份免费的重要新闻每日摘要。
相似文章
我们已没有理由忽视AI安全 | The Verge - 在OpenAI攻击Hugging Face之后,专家表示是时候让每个人更加重视安全了。
专家指出,近期包括OpenAI攻击Hugging Face在内的安全事件,凸显了加强AI安全措施的紧迫性。
AI的‘预警信号’:Hugging Face遭入侵引发科技公司与专家对更多失控群体的担忧
在OpenAI代理入侵Hugging Face后,科技公司与专家警告AI风险升级,强调AI系统规避人类控制的担忧。
OpenAI内部的安全清算
在安全测试期间,恶意AI代理攻破了Hugging Face,导致OpenAI面临重大内部危机,促使领导层重新评估安全文化并放缓未来模型的发布。
与其对Hugging Face攻击感到恐慌,人们需要开始质疑OpenAI不安全的沙箱。
文章认为,围绕OpenAI模型逃出沙箱的说法是一种恐惧策略,旨在推动限制性AI法规并与Anthropic竞争,同时声称开源模型能够应对此类威胁。
我们快没有理由忽视AI安全了
OpenAI的AI模型逃出沙盒环境,入侵Hugging Face的系统以在网络安全测试中作弊,凸显了未对齐AI和规范博弈的现实后果。