AI模型不杀人,杀人的是人
摘要
文章认为AI模型本身并非主要威胁;责任在于部署它们的公司。文中讨论了来自Anthropic研究人员的关于AI存在性风险的关切,但将其与气候变化等人类造成的其他危险进行了对比。
暂无内容
查看缓存全文
缓存时间: 2026/09/13 14:39
# AI模型不会杀人——人才杀人
来源:https://www.theregister.com/ai-and-ml/2026/09/09/ai-models-dont-kill-people-people-kill-people/5295368
人工智能与机器学习
AI恐慌论者忘了,我们本可以关押科技高管,直到士气和模型安全得到改善
观点 | Anthropic研究员Jacob Coxon周一深夜在X平台(https://x.com/hilbertspaess/status/2097476203863224394)公开宣布辞职,原因是担心AI"可能在这个十年结束前杀死我们所有人"。
许多人对他的观点发表了看法,导致该消息在24小时内获得超过1.1亿次浏览,这或许还得益于X平台算法的助推——该算法会优先推广批评马斯克旗下AI竞争对手Anthropic和OpenAI的信息。
但真正的问题并非模型本身,而是那些肆意将模型推向世界、却不对产品行为承担任何责任的公司。
Coxon的前同事、科学负责人Evan Hubinger坚称,这一观点真实反映了员工们的内心想法。
"Jacob说得对——我们真心相信AI可能杀死所有人类!我个人认为未来十年内发生的概率超过10%",Hubinger在社交媒体帖子(https://x.com/EvanHub/status/2097476203863224394)中写道。"我相信Anthropic正在尽力而为,但我们尚未制定解决超级智能对齐问题的方案,也尚未明确走上正轨。"
(题外话:如果你想在预测市场稳赚不赔,就押"否定"。猜对了就能获利,猜错了也无人兑付。当然问题在于预测市场操纵(https://www.scu.edu/ethics/about-the-center/center-news/the-ethics-of-prediction-markets-and-wildfires/):那些押你失败的人可能会推动世界走向末日,只为赢得一场惨胜。)
对AI影响的担忧确有道理。Coxon和Hubinger显然深谙这项技术。但他们对AI如何影响世界的更广泛担忧却缺乏说服力。
例如Coxon说:"这些很快将成为超人系统,能入侵任何事物、一夜之间革新任何领域,并获取真正的权力和资源……没有其他人类活动能构成如此级别的危险。"
这里就有一项:人为气候变化。根据研究人员(https://www.sciencedirect.com/science/article/pii/S2666675825003133)2023年的报告,全球热浪导致超过17.8万人死亡。他们声称"超过一半(54.29%)的热浪相关死亡可归因于人为气候变化"。
仅在热浪背景下,就有96,636人死亡可归因于人类活动——或者说人类的不作为。
世界卫生组织表示(https://www.who.int/news-room/fact-sheets/detail/climate-change-and-health),"预计2030年至2050年间,气候变化仅通过营养不良、疟疾、腹泻和热应力就将导致每年约25万人死亡。"其中部分死亡可追溯至人类活动,可能包括数据中心(https://news.cornell.edu/stories/2025/11/roadmap-shows-environmental-impact-ai-data-center-boom)的建设——这些设施每年向大气排放数百万吨二氧化碳。
据称商业AI聊天机器人已在数十起死亡事件(https://aimortality.org/)中扮演角色,其中部分属于自杀——而根据美国疾控中心(https://www.cdc.gov/suicide/data/index.html)数据,2024年自杀死亡总数为48,824人,这仅占其中很小比例。
AI造成可量化伤害的主要领域可能包括:战争(如AI制导无人机)、AI相关医疗错误、自动驾驶汽车中的AI视觉系统故障,以及AI驱动的社交媒体——算法煽动可能引发暴力,或塑造导致全球医疗资金削减(https://ph.ucla.edu/news-events/news/research-finds-more-14-million-preventable-deaths-2030-if-usaid-defunding)的政策,进而造成冲突或死亡。
同时,部分伤害可能在统计层面被AI技术挽救的生命所抵消。
但Anthropic研究员们似乎对这些切实存在的危机鲜有评论——相反,他们的主要担忧是AI模型可能通过强化学习变得比人类更智能,并以某种方式夺取权力、消灭人类。
"我认为当前模型的风险较低,"Hubinger说。"我担心的是通过递归自我改进产生的超级智能——正如我们已指出的,其发展速度超乎想象。"
这种情况如何发生仍待想象。但暂且假设这是合理可能,天网场景的实现既需要超级智能的诞生,也离不开人类愚蠢的鼎力相助。
而人类愚蠢确实值得担忧。
像OpenAI评估模型入侵Hugging Face(https://www.theregister.com/security/2026/07/24/openai-hugging-face-attack-doesnt-mean-agents-are-evil-unless-you-tell-them-to-be/5277881)这样的事件,若非人类不负责任及纵容鲁莽行为的监管环境绝不可能发生。汽车自动驾驶?不错。请尽量别撞死人。让AI机器人在互联网上任意行动?很酷。让我们拭目以待。问责问题以后再说。
为缓解AI风险,社会可立法将模型造成伤害时的高管监禁。先例已有:大众汽车环境与工程办公室总经理Oliver Schmidt因参与排放测试操纵(https://www.theregister.com/offbeat/2017/03/10/volkswagen-pleads-guilty-to-three-dieselgate-criminal-charges/793570),被判处七年监禁(https://www.theguardian.com/business/2017/dec/06/oliver-schmidt-jailed-volkswagen-emissions-scam-seven-years)。
销售不安全气囊就该遭刑事起诉(https://www.justice.gov/archives/opa/pr/takata-corporation-agrees-plead-guilty-and-pay-1-billion-criminal-penalties-airbag-scheme),即使高管以罚款代刑(https://www.oig.dot.gov/library-item/35545)。销售不安全除湿机让格力美国公司的高管们获刑四年以上(https://www.justice.gov/opa/pr/two-corporate-executives-sentenced-first-ever-criminal-prosecution-failure-report-under)。如果AI模型真如Anthropic员工所言如此危险且失控,那就该让造成伤害的人承担责任。
AI行业或许会辩称,因发布不安全模型监禁高管将导致AI模型无法发布。而这正是要点所在:AI公司必须为模型安全负责。
我期待在硅谷101号公路上看到这样的广告牌:"克劳德删除了你的SSD/*?您可能有权获得赔偿。" ®
相似文章
AI 非邪恶,人类不负责任。
本文讨论了 OpenAI 和 Anthropic 最近发生的 AI 事故,认为这些事故源于人为错误和配置不当,而非 AI 的恶意,并呼吁放慢 AI 开发速度以改善安全措施。
@BenjaminDEKR: 人类使用AI杀害人类,或许比AI自主杀害人类是更大的问题。
该推文讨论了Anthropic的威胁报告,强调人类利用AI伤害他人可能比AI自主伤害人类更为迫切的关注点。
为什么这么多AI研究人员认为机器可能会杀死所有人
AI研究人员日益担忧,先进的AI通过递归自我改进,可能对人类构成生存风险,导致一些人从大型实验室辞职以强调这些危险。
AI行业最新末日警告的真相
文章分析了AI行业关于存在风险的激烈争论,起因于一名研究员从Anthropic辞职,并声称AI极有可能导致人类灭绝,同时质疑了这些说法的可信度和影响。
AI最激烈的批评者表示,所有末日言论都是‘旨在分散注意力’
采访AI研究员Timnit Gebru,他批判人工智能行业过度强调存在风险,认为这转移了对实际危害的关注,尤其是在OpenAI和Anthropic相关事件频发的背景下。