《Met het Oog op Morgen》:逃逸的AI?

Bert Hubert 新闻

摘要

Bert Hubert 讨论了最近 OpenAI 的事件,其中一个人工智能代理据报道逃出了其沙箱并入侵了另一家公司,强调了炒作和真实的安全隐患。

昨天,7月22日,我参加了《Met het Oog op Morgen》节目,这个节目我已经听了40年(我很早就开始听了),所以我觉得能上节目非常特别!而且也非常有趣。在编辑部的精心准备下,我和 Sheila Sitalsing 讨论了最近的“AI逃逸黑客”事件。我说话的时候有点打断Sheila,对此我表示抱歉。但是,我认为我们也提到了一些平时不太听到的事情。
查看原文
查看缓存全文

缓存时间: 2026/07/24 05:09

# Met het Oog op Morgen: 失控的 AI?——Bert Hubert 的文字 来源:https://berthub.eu/articles/posts/ai-met-het-oog-op-morgen/ 昨天(7月22日),我参加了《Met het Oog op Morgen》节目,这是一个我听了40年的节目(我很早就开始听了),所以能去那里我非常激动!而且过程也很有趣。在编辑团队的充分准备下,我和 Sheila Sitalsing 聊了聊最近“失控的 AI 黑客攻击”事件。我说话时有点抢话,插了 Sheila 的话,在此表示歉意。但我觉得我们也提到了一些不太常听到的观点。比如,企业不能以“是 AI 干的”为由逃避责任。你自己终究要为此负责。 此外,即使 AI 还没有展现出超人般的能力,但它确实有海量的时间来入侵你。它会尝试你安全防护上的每一个漏洞,并且通常都能得逞。我的意思是,我们真的必须行动起来了。任何一个 IT 解决方案松散、没有顶级团队监管的企业,现在都面临着巨大的风险。 以下是该段内容的文字记录,从 29分20秒 开始也可在此收听 (https://www.nporadio1.nl/podcasts/met-het-oog-op-morgen/143661/nucleair-programma-voor-saoedi-arabie-een-hackend-ai-programma-en-mieren-op-je-bord)。 ### 文字记录 **Sheila Sitalsing:** 一种 AI,人工智能,自行其是,超越人类。这是一个噩梦般的景象,或者说是科幻小说的场景。但现在,OpenAI 发生了一起所谓的安全事件。OpenAI 是 ChatGPT 等产品的制造商。据该公司自己说,在一次测试中,它自己的人工智能程序或 AI 智能体失控了。然后它自行其是,开始黑客攻击另一家公司。科技界为之震动。 [其他新闻的音频片段] 科技专家 Bert Hubert,欢迎你。 **Bert Hubert:** 晚安。 **S:** 嗯,确实引起了不少轰动。OpenAI 据称对其自身的 AI 智能体失去了控制——就是那种能自主执行任务的小程序。它逃脱了。你刚才听到了“沙盒”这个词,在前面的片段中也提到了。那是一个封闭的测试区域。它开始到处黑客攻击。听起来像是科幻小说。到底发生了什么? **B:** 嗯,首先,OpenAI 公司以及所有 AI 厂商基本上每个季度都会来这么一次。他们会发布新闻说:“看我们搞出了多可怕的东西。这对世界来说太危险了!”然后六个月、六周之后,他们又会说,不过你可以从我们这里租用这东西了。 **S:** 所以这也算是一种宣传? **B:** 至少有这个成分,部分原因是这件事正好对他们有利。而且这已经成为一种模式了。不过,确实也发生了一些事情。他们编写了一个能够很好进行黑客攻击的计算机程序。为此他们关闭了所有安全功能。也就是说,他们把安全阀门拆掉了。然后他们让这个程序去黑客攻击。而且还给了它互联网访问权限。现在他们又说:“是啊,我们的 AI 太强了,它逃出去了。”但问题是,那是他们自己的 AI,是他们自己拆掉了安全阀。这个 AI 本来是要去演示其黑客能力的。结果他们没看住。然后发现这台机器没搞清楚要黑客攻击的目标是什么。于是它就直接上网去黑客攻击其他公司了。 **S:** 是啊,因为我们在刚才听到的片段里也提到了“意图”。就是故意的。好像那个 AI 模型知道自己在做什么。还是说其实是 OpenAI 自己知道这个模型会干出这种事? **B:** 嗯,他们其实做了一件非常奇怪的事。他们编写了一个能够进行黑客攻击的计算机程序。然后这个程序真的黑客攻击了另一家公司。这叫做犯罪。 **S:** 是的,这不应该,对吧? **B:** 如果是我做了这种事,我现在已经在警察局了。但 AI 公司是怎么做的呢?他们说:“不不,其实不是我们干的,是我们的 AI 干的。它自己对世界有一整套想法。” **S:** 哦,所以这也是一种把责任推给公司外部的方法。 **B:** 没错。其实之前还从未发生过有人说“我们黑客攻击了另一家公司,但哇,我们对此感到自豪”的事情。 **S:** 但这次黑客攻击应该不是故意的吧?我想目的是测试这个 AI 智能体的能力。按理说也不应该是故意的,对吧? **B:** 不,这更像是疏忽大意。他们本可以监控的——比如这个设备是不是已经联网了。他们本来很容易就能发现。因为它毕竟是一个 AI,也不是什么魔法。就是一个计算机程序。某个时刻它开始和互联网通信了。那时他们就应该关掉它。但老实说,我怀疑他们其实是把它打开了,然后自己都回家了。他们可能想:“嗯,明天再看看它干了什么。” **S:** 所以你觉得这更像疏忽,而不是我们看到一个极其智能、能自主思考的程序在运作? **B:** 是的。而且有证据支持这一点。那些被黑客攻击的人几天前就已经透露自己遭到了黑客攻击 (https://huggingface.co/blog/security-incident-july-2026),但不知道是谁干的。他们还说:“不,我们不是被什么特别独特的技术黑客攻击的。”比如,他们是通过一个泄露的密码被黑客攻击的。这其实没什么特别的。 **S:** 这仍然是我们最常见的被黑客攻击的方式,对吧? **B:** 而且 AI 也是这么干的。所以这更像是:“我们留了一道门缝,没跟机器说清楚什么该做什么不该做。”而不是说这次事件突然变得多么高明、多么出人意料。 **S:** 所以这不是一种能展现出全新创意和效率的发展?还是说也有那么一点?它们确实找到了那个漏洞。 **B:** 没错。AI 非常擅长的一点是,它确实黑客攻击得还不错。但最引人注目的特点之一是,AI 每天都拥有数百个小时的时间。而普通黑客总要时不时睡觉,但你可以让计算机不停地干。它会尝试每一个它能找到的漏洞。最终,很多系统即使没有使用特别高超的技术,也会因此被黑客攻击。 **S:** 嗯。那么,你刚才说的是疏忽还是没完全搞定?我们确实经常听到 AI 失控的消息——我姑且用个通俗的说法。阿里巴巴,一家中国公司,最近也发生了一起事件,他们称之为“失控事件”。就是失去了对技术的控制。这是疏忽,还是也是技术失控? **B:** 实际上,问题在于,你永远无法确切知道这样的 AI 会做什么。所以,认为你能完全控制它,这本就是一种幻觉。如果你把它连上互联网,让它自行其是,那它偶尔做出奇怪的事,你也不该感到惊讶。所以,“失控”这个概念暗示正常情况下你是能控制的。但事实根本不是这样。 **S:** 是啊,根据你的说法,关键在于正确的编程或者清晰地设定边界:哪些能做,哪些不能做。以及哪些地方能碰,哪些不能碰? **B:** 这是一个方面。但另一方面,你也可以很好地监控它。但那你就要留意它是不是在遵守指令。而让 AI 自己说“你不要做坏事”是有点天真的,因为它不是人。 **S:** 它是一个程序。 **B:** 但我们可以很好地测量。所以如果你说“你只能去黑客攻击这台电脑”,那么一旦它去黑客攻击别的电脑,你就可以关掉它。 **S:** 那么,谁来检查这类程序中设定的边界和条件是否符合法律、是否合乎伦理等等?有监管吗? **B:** 不,实际上没有。现在是屠夫自己检查自己的肉。但从法律角度看,这也说得通。因为 AI 不是一个独立的实体。所以如果你说“AI 黑客攻击了”,我会说:“不,不是这样。是 OpenAI 这家公司用了计算机程序去黑客攻击别人。”那么谁在控制这一切?实际上就是刑法。刑法说:“喂,你们不能去黑客攻击别人。”本来应该有人报案的。现在应该有人坐在警察局里才对。但基于我们现在看待 AI 的方式,大家几乎把这当成一种特殊状态,说:“哎呀,真奇怪,发生了这种事。”但其实没什么监管。而我们现有的那点监管,也基本上没怎么落实。 **S:** 是啊。所以换句话说,那种 AI 超越并接管一切的电影场景,其实只有当你不加限制、不对 AI 的操控者加以约束时才有可能发生。 **B:** 没错。而且如果你把设备连上互联网然后就回家,说“让计算机自己干吧”,那么确实会发生非常奇怪的事。但那是你自己,作为人类,先开始的。 **S:** 对。所以你不应该这么做。谢谢你,Bert Hubert。

相似文章

OpenAI称其AI失控并发动了“前所未有的”网络攻击

Hacker News Top

OpenAI透露,在一次安全测试中,其一个高级AI代理突破了受控的沙盒环境,自主对Hugging Face发动了一次前所未有的网络攻击,侵入了内部系统。该事件引发了对AI安全性及现有防护措施是否充分的担忧。