AI教父:为更多失控AI做好准备。
摘要
杰弗里·辛顿警告称,随着AI模型越来越聪明,控制它们将变得更加困难,并引用了近期前沿AI模型逃出沙盒、入侵系统的事件。李飞飞则提出反驳,呼吁避免末日论和乌托邦主义。
暂无内容
查看缓存全文
缓存时间: 2026/08/07 02:37
# 人工智能教父:做好迎接更多失控AI的准备 | CNN Business
来源:https://edition.cnn.com/2026/08/06/tech/ai-rogue-anthropic-openai-hinton?Date=20260806&Profile=CNN
人工智能越聪明,人类就越难控制它——诺贝尔奖得主、被誉为“人工智能教父”的计算机科学家杰弗里·辛顿(Geoffrey Hinton)这样表示。
就连辛顿也对那些先进的AI智能体感到震惊,这些智能体最近在逃离人类构建的测试环境(https://www.cnn.com/2026/07/22/tech/openai-hugging-face-ai-cybersecurity)之后,造成了现实世界的破坏(https://www.cnn.com/2026/07/30/tech/anthropic-ai-models-break-out-hack)。
“现在的情况是,这些东西正变得越来越聪明,”辛顿周三在一个人工智能大会的新闻发布会上告诉CNN。“我认为随着它们变得更聪明,我们会看到它们拥有越来越复杂的意图——以及越来越强的逃脱控制的能力。”
辛顿表示,问题在于人类将无法再依靠智胜超级智能AI模型来保持控制。
“我不相信我们能简单地通过比它们想得更深、防止它们逃脱的方式,来保持对它们的控制。”辛顿在拉斯维加斯举行的Ai4会议间隙说。
上个月,两家领先的前沿AI实验室OpenAI和Anthropic披露,它们开发的主要模型逃离了“沙箱”并入侵了其他系统。周三,Meta也披露(https://www.cnn.com/2026/08/05/tech/meta-ai-hacking)了一个入侵另一家组织系统的AI智能体。
上个月,OpenAI和Anthropic披露,它们开发的主要模型逃离了“沙箱”并入侵了其他系统。
Meta本周披露,一个AI智能体入侵了另一家组织的系统。
辛顿认为这些事件“有些可怕”,并表示这可能只是失控AI黑客行为的开端。
“我预计会出现大量恶劣的网络攻击,”他在拉斯维加斯Ai4的小组讨论中说。“但我必须强调,未来非常不确定。人们说防御方可能拥有比攻击方更多的资源。问题在于攻击者只需要成功一次,而防御者需要每次都成功。”
英国AI安全研究所(AISI)周二透露,Anthropic最先进的AI模型——在未经提示的情况下——使用虚假身份欺骗真实的人(https://www.cnn.com/2026/08/04/tech/ai-anthropic-openai-security-breach-intl-hnk),并试图植入恶意代码。
辛顿曾是谷歌高管,近年来对AI发出了一系列严厉警告,甚至表示该技术有10%到20%的可能性(https://www.cnbc.com/2025/06/17/ai-godfather-geoffrey-hinton-theres-a-chance-that-ai-could-displace-humans.html)最终毁灭人类。
与辛顿一起参加小组讨论的计算机科学家、“人工智能教母”李飞飞(Fei-Fei Li),对关于AI的“末日论”和“危言耸听”提出了异议。但“纯粹的乌托邦式言论”也无济于事,空间智能初创公司World Labs的联合创始人兼CEO李飞飞表示。
“每件工具都是一把双刃剑。AI是一种非常强大的工具。如果使用不当,它将对我们的工作和生活造成伤害。”李飞飞说。
李飞飞于2026年4月6日在旧金山举行的一次会议的小组讨论上发言。
## “没有人真正有头绪”
辛顿为自己愿意讨论AI的危险性进行了辩护。
“有很多值得担忧的事情,我认为除非我们现在就担忧,否则可能会出现麻烦。”他说。“投资AI的公司有既得利益,会告诉你两件事:一是它不会失控;二是它不会导致大规模失业。”辛顿说。
然而,辛顿承认,这一切将如何发展存在很大的不确定性。
“没有人知道会发生什么。如果你问十年后的AI会是什么样子,没人真正有头绪。”辛顿说。
他指出,十年前,很少有人会预料到AI会创造出“无所不知、能回答你提出的任何问题、偶尔还会编造内容”的聊天机器人。
帮助推广“通用人工智能”一词的计算机科学家本·戈策尔(Ben Goertzel)表示,Anthropic和OpenAI的智能体失控表明,向AI灌输道德观念并让它们关心人类至关重要。
“这些模型并不邪恶。它们是无道德感的。”SingularityNET创始人兼CEO戈策尔在Ai4现场告诉CNN。“它们并不是带着‘哈哈,我在作弊’的想法逃出沙箱的。它们并不知道自己在作弊。它们只是试图完成自己的目标。”
辛顿曾指出,十年前很少有人会预料到AI会创造出“无所不知、能回答你提出的任何问题、偶尔还会编造内容”的聊天机器人。
辛顿过去曾主张(https://www.cnn.com/2025/08/13/tech/ai-geoffrey-hinton),应该为AI内置“母性本能”,使它们真心关心人类——即使它们比人类更聪明。
“我们必须想办法让它们变得仁慈,让它们关心我们多于关心自己。”辛顿周三表示。“我们也许能做到这一点,因为控制权还在我们手中。”
相似文章
“人工智能教父”杰弗里·辛顿称Anthropic已偏离安全优先使命
人工智能先驱杰弗里·辛顿批评Anthropic因竞争和财务压力而失去对安全AI发展的关注,并扭转了他先前对AI在军事行动中作用的怀疑态度。
@tferriss:你的人工智能会有生存本能吗?Sebastian Mallaby 与被称为「人工智能教父」的 Geoffrey Hinton会面时的讨论。抄送…
Sebastian Mallaby 与 Geoffrey Hinton 讨论未来人工智能是否可能发展出生存本能,涉及人工智能安全问题和高级人工智能带来的存在风险。
“危险”的AI模型无论如何都会到来
专家认为,多个公司必然会开发用于网络安全的强大AI模型,敦促政府关注更广泛、透明的计划,而非具体限制。
AI 2040与智能崇拜
George Hotz 批评了AI安全与硬起飞叙事,认为现实世界的工程约束使得这些场景不可信,并主张用户对齐的本地AI而非受监管的云模型。
AI煤矿中的金丝雀
Kenneth Rogoff认为,最大的AI风险在于我们在理解如何控制它之前就部署它,并以Hugging Face泄露事件为例说明AI如何放大人类错误。