AI安全社区的作为恐怕弊大于利(7分钟阅读)
摘要
作者认为,Palisade Research 采访前沿AI实验室员工,称人类灭绝只是"抛硬币",这正在损害AI行业,尤其在 Jacob Coxon 高调离开 Anthropic 以及《Pacing the Frontier》公开信发布之后,这种说法助长了国会和公众的反AI情绪。
公开宣扬AI末日论,可能让业界的反对声更加坚定,而非改善安全领域的讨论。实验室员工和研究人员反复发出灭绝警告,会将AI问题政治化,加剧公众的不信任,并加大推行限制性监管的压力。
查看缓存全文
缓存时间: 2026/10/01 14:55
# knower (@knowerofmarkets) on X
来源:https://x.com/knowerofmarkets/status/2105330652732125602?utm_source=tldrai
就在昨天,Palisade Research 发布了对 22 位前沿 AI 实验室在职或前员工的系列访谈,询问他们对 AI 末日论、人类灭绝这类相关场景,或一台计算机究竟要怎样做才能把我们全部杀光等话题的看法。
这些现任与前任员工在这些高质量的访谈片段中表达了各自的观点,声称**"人类灭绝就是抛硬币"**,或者**"挡路的是这些模型面前的人类"**,我猜,目的是想借此引发人们对 AI 持续发展的担忧——他们认为这种发展正威胁着人类。
这原本足以让人震惊,甚至可能在**9 月 8 日之前**就引爆互联网——那正是 Jacob Coxon 打破沉默、解释自己为何选择离开 Anthropic 那一职位的日子。自这一**文化事件**之后,关于实验室可能想要被国有化的讨论甚嚣尘上(我认为这不实),围绕 OAI–HuggingFace 事件与智能体文明的讨论相互交织,此外还有持续不断的关于美国政府在超级智能乃至最终的人工感知智能发展中应当扮演何种角色的争论。
说得更直白一些:Palisade 近期的宣传,出现在一个我们并不需要更多"应当放慢 AI 发展"论调的时刻,尤其考虑到这些观点对整个行业而言看起来是相当有害的。
---
Coxon 表示他离开 Anthropic,是因为他们奔向自我改进的超级智能的速度太快,并声称他们"拿我们的生命在赌博"。Coxon 的帖子突破了圈层壁垒,获得超过 1.5 亿次浏览,甚至跨入了 TikTok、YouTube 这类更贴近大众的平台,并在这一过程中为 Jacob Coxon 带来了一连串的媒体露面。
Coxon 的警告,是在 2026 年 7 月那份由 1386 名前沿 AI 实验室在职员工共同签署的《Pacing the Frontier》公开信之后发出的,签署者共同呼吁这些实验室放慢脚步,并在前沿 AI 系统的开发上协调一致,以免它们变得过于强大、最终把我们全部杀死。
Coxon 的帖子和 Pacing 信确实在很大程度上把 AI 安全与对齐这些议题带入了 X 之外的公共讨论,但它们同样也把 AI 的发展变成了一种党派之争,划出了阵营:一边是希望继续发展 AI 的人,一边是希望暂停 AI、直到我们对这些"外星智能"有更好理解的人。
后者的出发点(我假设)是善意的,但他们没有意识到,他们放慢甚至暂停 AI 开发的呼吁,无意中正落入国会与参议院中 AI 末日论者,以及数千万厌恶一切与 AI 相关事物的普通美国人的手中。
当普通人看到"前沿 AI 实验室在职员工"发出人类灭绝不过是抛硬币的说法时,这不会把他们导向 **LessWrong** 这样的网站——在那里,他们本可以阅读关于 AI 对齐的内容,或者围绕 **AI 2040: Plan A** 这样一篇深度长文展开有建设性的讨论。
相反,他们看到的是这些 AI 研究者——正是那些被告诉"年薪数百万美元、IPO 之后有望赚到数千万甚至更多"的人——在高呼 AI 的危险,却仍在 Palisade 这样的网站上以自己当前雇主的名义和 logo 自居。他们看到这一幕,心中涌起的是鄙夷,甚至是愤怒,指向的是一个对国家安全与美国 GDP 持续增长日益重要的行业——这个行业如此重要,以至于昨天有十几位行业领袖与我们国家的领导人会面,就签署一份**《超级智能协议》**达成了共识。
[](https://x.com/knowerofmarkets/article/2105330652732125602/media/2105330391003402241)
考虑到我目前就在科技行业工作,在他们眼中或许仍会被归为"与 AI 沾边的人",我有资格代表这些普通人发言吗?有可能,但我每天也会和那些不上 X、不在科技行业工作、也不去读 OpenAI 或 Anthropic 最新模型发布说明的人聊天。
那些并不知道 Project Glasswing 这类项目、不知道 AI 领域新兴实验室正在获得 2.5 亿美元种子轮融资这类现象、也不知道存在 METR 这样一个可以在模型发布前提供评估的组织的人。大多数人使用 ChatGPT 并非为了工作或其他重要事务,而是把它当作朋友或熟人。
那些讨厌 AI、希望禁掉它的人,其出发点并非基于知情的判断,更可能只是受够了那些想在他们社区附近建设数据中心的政客和产业大亨——他们被告知这种技术是坏的,于是他们就相信它是坏的。他们中甚至有人相信数据中心并非用于 AI,而是用于大规模监控,却不知道 2014 年耗资 15 亿美元建成的犹他数据中心——一座已经存在了十二年、专供 NSA 及其他情报机构使用的数据中心。
[](https://x.com/knowerofmarkets/article/2105330652732125602/media/2105330525036593152)
即便有像 Andy Masley 这样的人会写出 5000 字的文章、逐条驳斥他们的错误指控,也无济于事,因为在我们的圈子之外,根本没有人读这些批评。因此,当你听到又一批 AI 实验室员工联合起来、公开谴责人工智能危险的时候,这在我们当前的人类进程叙事中并不像一个积极的进展,而更像是又一件将在 2028 年被用来对付科技行业、从而彻底封禁 AI 的证据。
我认为 Palisade Research 昨天发布的内容是有害的,它对当前推进 AI 安全的对话没有起到任何作用。不存在一种情况,是 AI 加速主义者看到这些后会改变立场;也不存在一种情况,是普通人看到这些后不立刻想要把它转发到群里、继续大骂 AI 和那些危险的科技 bro。
我知道今天的模型已经很强大,而明天的模型只会更强。我理解,人们希望在发布新模型方面拥有更多保障或更严格的内部政策,这一点很重要。但把末日论宣传塞到数百万美国人脸上的做法,就以为能把他们拉到你们这一边,这种想法幼稚到让人几乎要怀疑当初是谁批准的,以及是否考虑过任何潜在的负面影响。
如果我们不更加小心,我们在不久的将来**会**看到人工智能被禁用,因为人们已经受够了。我喜欢 AI,也相信它能为人类带来很多好处,甚至可能是难以想象的巨大好处,但我们如果继续彼此争斗、继续为那些认为拥有 75% P(doom) 是"基于"或"道德"的人提供发声平台,就永远走不到那一天。
相似文章
AI行业最新末日警告的真相
文章分析了AI行业关于存在风险的激烈争论,起因于一名研究员从Anthropic辞职,并声称AI极有可能导致人类灭绝,同时质疑了这些说法的可信度和影响。
AI对人类的最大风险?不是机器人失控。
这篇文章批判了来自Anthropic和OpenAI等公司的AI风险叙事,暗示他们可能利用安全担忧来抑制竞争并支持殖民主义议程。
AI最激烈的批评者表示,所有末日言论都是‘旨在分散注意力’
采访AI研究员Timnit Gebru,他批判人工智能行业过度强调存在风险,认为这转移了对实际危害的关注,尤其是在OpenAI和Anthropic相关事件频发的背景下。
AI 非邪恶,人类不负责任。
本文讨论了 OpenAI 和 Anthropic 最近发生的 AI 事故,认为这些事故源于人为错误和配置不当,而非 AI 的恶意,并呼吁放慢 AI 开发速度以改善安全措施。
性、AI与末日
这篇文章探讨了一位AI研究员的辞职,他曾警告AI可能带来的存在风险,并分析了影响AI安全辩论的理性主义亚文化。