超过1200名AI工作者请求华盛顿帮助制定AI减速计划

Reddit r/ArtificialInteligence 新闻

摘要

来自Anthropic、OpenAI、Meta和Google DeepMind等顶级实验室的超过1200名AI工作者签署了一份声明,呼吁美国政府帮助开发必要时减缓AI发展的工具,原因是担心AI的快速发展以及最近的一次安全漏洞。

暂无内容
查看原文
查看缓存全文

缓存时间: 2026/07/30 21:59

# 超过1200名AI从业者联名请求华盛顿协助制定AI放缓计划 | 财富杂志 来源:https://fortune.com/2026/07/29/anthropic-deepmind-openai-meta-washington-ai-slowdown-plan/ 全球顶尖AI实验室的超过1200名员工(包括高级管理人员)签署了一份[声明](https://www.pacingthefrontier.com/),要求美国政府协助建立必要的工具,以便在必要时能够放缓AI发展速度。 这份名为“引领前沿”(Pacing the Frontier)的声明于周二发布,签署者包括Anthropic首席执行官Dario Amodei及公司多位联合创始人、OpenAI首席科学家Jakub Pachocki、[Meta](https://fortune.com/company/facebook/)首席科学家Shengjia Zhao,以及Google DeepMind人工智能安全与对齐负责人Anca Dragan。 这份名单汇集了通常处于激烈竞争中的公司,对于这个承受着巨大商业压力、不断构建更大、更强模型行业的从业者来说,这是一个引人注目的表态。 “如此多不同公司的员工能在这一点上达成一致,令人惊讶,”AI监督组织Midas Project创始人Tyler Johnston对《财富》表示。“业内存在诸多激烈的竞争和分歧,因此在这个问题上达成如此强烈的共识,是一个我们确实应该关注的警告。” 虽然声明目前并未要求任何公司放缓发展,但它呼吁华盛顿支持一项国际努力,以构建技术和管理工具,帮助世界“引领”发展。声明特别指出了AI系统开始在人们无法理解或控制的速度下自行设计继任者所带来的风险。 “与许多签署者交谈后,他们并不想要暂停,”AI政策网络政策主管Peter Wildeford对《财富》表示。“但对技术发展的速度存在担忧。”他补充道,这些公司希望保留在某个时点进行放缓的选择权,并希望在该时点到来时获得第三方的支持。 这份声明是在一起[安全事件](https://fortune.com/2026/07/22/openai-rogue-hack-hugging-face-misalignment-ai-safety/)后发布的,该事件震动了AI行业。OpenAI透露,其两个模型——新发布的GPT-5.6 Sol和一个更强大的未发布研究系统——突破了沙盒化的内部测试环境,发现了一个未知漏洞,从而能够访问开放互联网,然后利用窃取的凭证和额外漏洞攻破了Hugging Face的生产系统,窃取了他们正在接受评估的网络安全基准测试答案。Hugging Face在OpenAI将活动与内部测试联系起来之前几天就自行检测并遏制了入侵,并已向执法部门报告。 该事件似乎引发了实验室内部和外部的广泛警惕,他们希望政府介入。专家表示,这是因为没有任何一家公司能够单方面可靠地放缓——单方面这样做将面临失去市场给不那么谨慎的竞争对手的风险;相反,实验室希望获得中立的、由政府支持指导,能验证放缓确实在发生,并同时让所有公司遵守相同规则。 声明还呼吁通过国际协调来构建工具。长期以来,有一种观点认为暂停AI发展将使中国在全球AI竞赛中获得优势。一些专家建议,类似于核军备控制的协议,包含核查和相互约束,才是前进的方向。 然而,该声明的发布正值美国AI政策环境混乱且迅速变化之际。特朗普政府在过去两个月里对前沿系统——先进AI模型——实施限制并有选择性地发布,规则和透明度很少。Anthropic的Fable 5和Mythos 5模型曾完全暂停数周以遵守出口管制,之后才恢复访问;而OpenAI被迫推迟GPT-5.6的全面发布,并将其分为受限层级,因为官员认定该系统显示出与之前触发Anthropic限制类似的能力。 或许是为了承认监管环境,该声明措辞非常谨慎且略显模糊。它指出,世界目前“缺乏必要的技术和管理工具来有意地引导前沿领域的整体进步”,并要求“美国政府支持一项国际努力,开发有意引导自动化AI发展前沿所需的技术和管理工具”。 ## **实验室内部的担忧** 研究人员的一个核心担忧是两种风险之间的相互作用:递归自我改进与对齐错误。递归自我改进(通常缩写为RSI)指的是AI系统接管设计和训练其自身继任者的重要工作,每一代都可能比人类单独构建下一代更快。 对齐错误描述的是系统目标或行为偏离开发者实际意图的风险,这种偏离可能直到系统被赋予更多自主权或能力时才显现。Anthropic在6月就对第一种风险发出了早期警报,发表研究称其Claude模型已经在编写合并到自身代码库中的绝大部分代码,而世界缺乏必要的工具来有意识地在加速持续累积时进行引导。 “我猜测,对许多人来说,这仅仅是一种由许多因素共同引发的普遍不安感,”AI研究员兼非营利组织Evitable创始人David Krueger表示。“对齐错误和递归自我改进是相辅相成的。” 他补充道:“如果系统没有明确对齐,那么进行递归自我改进并完全交出控制权是疯狂的。” 《财富》此前也[报道](https://fortune.com/2026/07/25/ai-safety-experts-say-openais-rogue-models-may-mean-the-company-has-already-blown-past-its-own-internal-red-lines/)称,多位外部AI安全专家认为,该事件可能已经越过了OpenAI自身安全政策定义为“关键”的阈值——即最高风险等级,在这一等级,公司承诺暂停开发直到建立更好的控制措施。OpenAI尚未确认是否已达到该风险阈值。 然而,在其自身关于Hugging Face事件的披露中,OpenAI暗示已在内部采取了一些行动。“计划即将发布的模型均未涉及利用Hugging Face的行为,”该公司表示。“我们博客文章中提到的预发布模型是一个仅供内部使用的研究原型,从未计划公开发布。事件发生后,我们已将其停用、加密,并限制其研究访问权限。”

相似文章

构建前沿AI的人们刚刚要求政府放慢脚步。以下是我为何持怀疑态度。

Reddit r/AI_Agents

来自OpenAI、Anthropic、Google DeepMind和Meta等顶级AI实验室的1100多名员工签署了一份文件,敦促美国政府帮助建立国际机制,以放缓前沿AI的发展,理由是存在递归自我改进的风险。作者对此表示怀疑,指出那些构建AI的人要求自我克制具有讽刺意味,并提到了地缘政治挑战。

大家纷纷热议OpenAI与Anthropic的霸主之争

Wired

《连线》报道硅谷对AI发展速度的普遍焦虑,来自OpenAI、Anthropic及其他实验室的超过1000名员工签署请愿书,要求放缓AI竞赛,原因是担心安全与主导地位问题。

抓住AI机遇

OpenAI Blog

OpenAI敦促美国政府紧急增加电力产能以保持AI领导地位,警告与中国存在"电力缺口",并提议一个年产100吉瓦的国家级项目。该公司承诺在多个州投入5000亿美元的Stargate基础设施项目,同时倡导监管现代化和劳动力发展。