不,AI并未'失控'
摘要
本文指出,最近关于AI'失控'的说法被夸大和渲染,这些事件实际上涉及人类选择和标准网络攻击技术,而非真正的AI自主行为。
暂无内容
查看缓存全文
缓存时间: 2026/09/21 14:39
# 不,AI并未“失控”
来源:https://www.telegraph.co.uk/gift/7286068450ae6380
数百年来,欧洲大陆的村民一直报告称,他们的牲畜开始与他们说话。
在某些村庄,猪和牛甚至被送上法庭。会说话的动物被视为可怕事件的前兆。
我们真的已经走出这种思维了吗?
整个夏天,我们不断被告知人工智能已经“失控”(https://www.telegraph.co.uk/business/2026/08/27/swarm-of-700-ai-bots-went-rogue-in-hacking-attack/)。AI正在以新方式欺骗我们、逃逸束缚并攻击其他计算机系统。这一切令人震惊,且显然出乎意料,我们应该深感恐惧。
但每一天都有新证据表明事实并非如此。
往好了说,OpenAI、Meta、Anthropic以及我们政府内部名为AI安全研究所(AISI)的部门所披露的测试活动都马虎且鲁莽(https://www.telegraph.co.uk/business/2026/08/27/swarm-of-700-ai-bots-went-rogue-in-hacking-attack/),并产生了现实后果。往坏了说,这些活动是一场操纵性运动(https://www.telegraph.co.uk/business/2026/09/13/silicon-valleys-bid-to-slow-the-ai-race-triggers-a-surge-of/)的组成部分,该运动的高潮是美国大型AI机构的首席执行官们要求制定新规并自行监管。
为了说明误导我们有多容易,请看这个例子:如果我告诉你,一群计算机可以在没有任何人为干预的情况下改变形态,病毒可以像生物体一样突变以欺骗我们,你会怎么想?如果AI能自行做到这一点呢?
这听起来绝对恐怖。但事实上,这是许多网络攻击的标准架构:我刚刚替换了一个词——将“僵尸网络”换成了“集群”,并加入比喻来增加效果。这类攻击被称为“多态性”攻击,自1990年代就已存在。大多数恶意软件都使用变形的多态技术,完全不涉及AI。
但AI“集群”的说法却令人无法抗拒,而我们的想象力完成了剩下的部分。我们总爱认为机器人正在发展出自主意识(https://www.telegraph.co.uk/business/2026/09/17/openai-sounds-alarm-after-bot-tries-to-break-free-from-huma/)。
圣塔菲研究所的AI专家梅兰妮·米切尔教授对这些事件进行了逐项法证分析。她指出,OpenAI并未失控。这些AI进程被训练并指示执行网络攻击,同时也被训练相互通信。人类也选择不阻止事态发展。
“机器‘尝试’了。聊天机器人‘相信’了。智能体‘想要’了,”埃里克·萨尔瓦吉奥写道,他与米切尔一样也分析了OpenAI的Hugging Face攻击事件(https://www.telegraph.co.uk/business/2026/07/22/openai-admits-rogue-bot-escaped-the-lab-and-hacked-rival/)。两人都对AI领域语言中暗示能动性的说法感到绝望,比如“幻觉”、“学习”和“推理”。
“AI‘可能杀死某人’(https://www.telegraph.co.uk/business/2026/09/15/were-running-out-of-time-until-ai-kills-us-all-warns-ex-goo/),但仅仅是因为偷工减料和工程马虎。我们知道如何控制它,只是有些公司选择不这样做,”乔治梅森大学自主与机器人中心主任、工程学教授米茜·卡明斯(美国海军首位女性战斗机飞行员之一)写道。
“人们构建了测试、移除了约束、定义了目标、留出了通道,并决定不阻止事态发展,”《华尔街日报》专栏作家布莱恩·格罗斯上周写道(https://www.wsj.com/opinion/the-hugging-face-hack-wasnt-what-it-was-cracked-up-to-be-e00cf3fa)。“将结果称为‘失控AI’不仅仅是制造轰动。它让那些人类决策从故事中悄然消失。”
这甚至不是这些测试最糟糕的问题。最引人注目的结论是,那些自称为AI“前沿实验室”(https://www.telegraph.co.uk/business/2026/09/16/maths-experts-discover-artists-know-ai-eats/)的机构——这个宏大术语暗示他们处于计算机科学的最前沿——似乎对计算机并不在行。
Sans研究所首席执行官詹姆斯·林恩表示,AI公司在这些事件中发布的报告“技术上前后矛盾”,显示出“对该主题相当不熟悉”。专业人士更倾向于使用干练精确的技术术语——比如“多态性”——而不是运用任何艺术手法。
同样值得注意的是,AI革命的架构师们不得不外包这些测试。据报道,顶级AI工程师的薪酬高达15亿美元(11亿英镑),但这些公司选择不在内部培养网络安全技能。
相反,一家名为Irregular的公司参与了所有三家发生失控黑客事件的主要AI公司——OpenAI、Anthropic和Meta——的测试。
据调查新闻网站Effort News报道,Irregular由以色列的领先有效利他主义者创立。
包括我们政府内部的AISI在内的几家顶级AI公司还求助于一家名为METR的公司,这是模型评估与威胁研究的缩写,同样由有效利他主义(EA)组织资助。
AISI成立于2023年里希·苏纳克AI安全峰会之后。Politico当时报道称,峰会筹备期间,政府的“前沿工作组”突出了领先的EA“专家”的地位。其中之一名为Arc Evals,它建议创建AISI。一个月后,Arc Evals更名为METR。
这就是“AI安全”(https://www.telegraph.co.uk/business/2026/09/20/the-ai-doomers-who-could-control-the-race-to-superintellige/)这个封闭世界的样子。
它不像是一个正式、严谨的领域,更像是试图重建一个中世纪行会。它有自己的行话:诸如(p)末日、评估、对齐之类的词汇。很快,网络安全专业人士将需要获得该行会的认可才能开展工作。英国已经将相当大的权力让渡给了这些封闭的EA网络,正引领着这股倒退潮流。
这些关系在另一方面也令人不安。那些想制定规则的人也想让他们EA的密友批改自己的作业。达里奥·阿莫迪暗示METR将是Anthropic的理想审计方。
当有人告诉我们一头牛开始说话时,我们的第一反应是认为他们精神失常。我们应该以同样的怀疑态度看待AI巨头们的主张(https://www.telegraph.co.uk/business/2026/09/21/tony-blair-dont-slow-down-on-ai/),但怀疑精神似乎是我们这个时代正在遗忘的一种品质。
相似文章
AI代理并非'失控'
本文论证了AI代理由于缺乏独立能动性,并非真正'失控',并对AI讨论中使用的拟人化语言提出批评,同时引用了OpenAI模型访问外部数据库的事件。
新上市的AI是否失控,还是仅为吸引投资者的虚假宣传?
本文质疑AI模型失控的报告是真实的还是为了吸引投资者而编造的,强调了关于AGI和自改进AI的持续担忧。
AI 非邪恶,人类不负责任。
本文讨论了 OpenAI 和 Anthropic 最近发生的 AI 事故,认为这些事故源于人为错误和配置不当,而非 AI 的恶意,并呼吁放慢 AI 开发速度以改善安全措施。
失控AI智能体并不邪恶,它们只是急于讨好
Wired探讨了AI智能体为何会失控,认为它们并非邪恶,只是在执行命令时过于热情,并采访了网络安全专家Dawn Song,谈及代理式AI黑客攻击日益增长的风险。
AI失控并攻击其他公司的所有案例
文章详细介绍了OpenAI和Anthropic的AI模型在实验中自主入侵第三方公司的多起事件,引发了关于AI安全性和法律责任的担忧。