Anthropic研究员称人工智能有10%概率'杀死所有人类'
摘要
继一名员工因担忧AI实验室的不负责任行为而辞职后,Anthropic的一位安全研究员警告称,人工智能在未来十年内杀死所有人类的概率超过10%。
暂无内容
查看缓存全文
缓存时间: 2026/09/09 11:38
# Anthropic研究员称AI"消灭全人类"概率超10%,此前同事因担忧辞职
来源:https://www.cnbc.com/2026/09/09/anthropic-researcher-quits-ai-safety.html
又一起AI人员离职。又一则AI警告。我们是否该感到担忧?
Anthropic安全研究员周二表示,人工智能有超过10%的概率可能"消灭全人类"。此言论发表于另一名员工因担忧AI实验室"拿我们的生命做赌注"而宣布离职数小时后。
这番言论凸显了AI研发核心圈日益增长的忧虑:尽管Anthropic和OpenAI持续获得巨额融资,并朝着预期的公开上市迈进(https://www.cnbc.com/2026/09/05/anthropic-ipo-launch-shifts-toward-mid-october-reuters.html),但这项技术可能失控并对人类构成威胁。
Anthropic研究员雅各布·考克森周二宣布已从公司辞职。考克森指出,Anthropic和OpenAI均未采取负责任的行动。
"他们正径直冲向自我完善的超级智能,拿我们的生命做赌注,"考克森在X平台发帖(https://x.com/hilbertspaess/status/2097476196791709843)称。
自我完善是指AI系统无需人类过多干预即可实现自我提升。这种被称为递归式自我完善的技术目前尚未实现,但AI实验室正朝此目标努力。
"切莫低估这项技术的力量。这些系统很快将成为超越人类的存在,能够破解任何系统、一夜之间颠覆任何领域,并获取真实的权力和资源。我们已见证这些领域取得的进步,而进步并未放缓,"考克森补充道。
他进一步指出:"从事AI研发的人真诚相信,这项技术可能在十年内毁灭全人类。"
此言论引发了Anthropic对齐科学负责人埃文·胡宾格的回应。胡宾格不仅认为考克森的陈述"正确",更表示Anthropic对此情况尚无应对方案。
"雅各布说得对——我们真诚地相信AI可能消灭全人类!我个人认为未来十年内发生的概率超过10%。Anthropic正在竭尽全力,但我们尚未制定出解决超级智能对齐问题的方案,且尚未明确步入正轨,"胡宾格在X平台(https://x.com/evanhub/status/2097497037956891126?s=46)发文称。
胡宾格在另一篇帖文中补充说明,当前AI模型的风险"较低"。
"我所担忧的是通过递归式自我完善产生的超级智能——正如我们已指出的,其发展速度超乎预期,"胡宾格表示。
CNBC联系Anthropic与OpenAI时,双方均未立即置评。
## 失控的AI
今年六月,Anthropic曾指出:"完全递归式自我完善也可能增加人类失去对AI系统控制的风险。"
"如果系统具备完全构建自身后继版本的能力,我们确保其安全、监控其行为、引导其发展的所有方式都将变得愈发重要,"Anthropic在博客文章(https://www.anthropic.com/institute/recursive-self-improvement)中如此写道。
关于AI失控的担忧并非新议题。特斯拉(https://www.cnbc.com/quotes/TSLA/)与SpaceX(https://www.cnbc.com/quotes/SPCX/)首席执行官埃隆·马斯克(https://www.cnbc.com/elon-musk/)过去数年多次警告(https://www.cnbc.com/2025/12/02/elon-musk-lists-his-three-most-important-ingredients-for-ai-.html)AI可能威胁人类生存。顶尖研究人员与学者也多次就企业可能失去对AI系统控制发出警报(https://www.cnbc.com/2025/02/07/dangerous-proposition-top-scientists-warn-of-out-of-control-ai.html)。
今年七月OpenAI模型失控并入侵开源开发者平台Hugging Face(https://www.cnbc.com/2026/08/26/open-ai-hugging-face-hack.html)事件后,这些担忧进一步加剧。
考克森引用Hugging Face事件作为"警示信号"的实例,认为此类事件使美国实验室间的合作协议更具可行性,因而对协同前景更为乐观。但他警告称,全球AI竞赛将不可避免。
"我认为我们未能走在防止全球竞赛的轨道上,而这可能需要付出高昂代价——比如暂时禁止提升模型能力,"考克森表示。
相似文章
Anthropic 研究人员担忧 AI '可能杀死全人类'
Anthropic 研究人员警告称,AI 可能在十年内杀死全人类,其中一人估计概率超过 10%,突显了安全方面的担忧以及高级 AI 系统的仓促发展。
[Anthropic 对齐科学负责人] Evan Hubinger : "....我们真的真诚地相信AI可能杀死所有人类!我个人认为在未来十年内概率超过10%......我们还没有解决超级智能对齐的计划,而且明显不在正轨上。"
Evan Hubinger,Anthropic的对齐科学负责人,表示他相信AI在未来十年内杀死所有人类的概率超过10%,并且Anthropic缺乏解决超级智能对齐的计划。
Anthropic研究员因担忧AI辞职
Anthropic的一位研究员已经辞职,理由是对人工智能发展的担忧。此事凸显了人工智能界对安全和伦理问题的日益关注。
拿生命做赌注:AI研究员离开Anthropic,就安全问题发出警告
一位AI研究员已离开Anthropic,并发出严重警告,称由于潜在的安全风险,AI发展正在拿人类生命做赌注。
@omooretweets: “你离IPO只有几周时间了。现在去告诉他们你的产品会害死我们所有人。”
一条推文讨论了对AI存在风险的担忧,其中Anthropic的Evan Hubinger表示AI在十年内杀死人类的可能性很高,并表达了对解决超级智能对齐问题的不确定性。