OpenAI 放缓脚步。接下来会怎样?
摘要
OpenAI 已放慢其人工智能开发步伐,以加强安全和保障措施,正在测试在竞争激烈的人工智能行业中自愿调整节奏的理念。
<figure>
<img alt="" data-caption="" data-portal-copyright="Image: The Verge" data-has-syndication-rights="1" src="https://platform.theverge.com/wp-content/uploads/sites/2/2026/08/STK201_SAM_ALTMAN_CVIRGINIA2C.jpg?quality=90&strip=all&crop=0,0,100,100" />
<figcaption>
</figcaption>
</figure>
<p class="wp-block-paragraph">面对即将来临的IPO、来自Anthropic的激烈竞争以及中国和开放权重竞争对手的紧追不舍,OpenAI有很多理由快速行动。然而,它却放缓了脚步。</p>
<p class="wp-block-paragraph">周二,该公司表示,在加强安全和保障措施的同时,已放慢了一些人工智能开发的步伐。其中包括对“计划部署的最新模型”的强化学习训练暂停两周,以及对“最大的计划前沿强化学习运行”的持续延迟。</p>
<p class="wp-block-paragraph">这一决定是对人工智能安全倡导者多年来所倡导的一个理念的公开测试:公司应该愿意退出人工智能竞赛,放慢速度……</p>
<p><a href="https://www.theverge.com/ai-artificial-intelligence/982323/openai-hit-brakes-voluntary-pacing-ai">在 The Verge 上阅读全文。</a></p>
查看缓存全文
缓存时间: 2026/08/19 19:12
# OpenAI 踩了刹车。现在怎么办?
来源:https://www.theverge.com/ai-artificial-intelligence/982323/openai-hit-brakes-voluntary-pacing-ai
面对迫近的 IPO、来自 Anthropic 的激烈竞争以及中国和开放权重对手的紧追不舍,OpenAI 有充分的理由加速前进。相反,它却踩了刹车 (https://www.theverge.com/ai-artificial-intelligence/981640/openai-security-changes-ai-hugging-face-hack)。
周二,该公司表示 (https://openai.com/index/pacing-model-development-cyber-capabilities/),在加强安全和保障措施的同时,它放慢了部分 AI 开发的步伐。这包括暂停其“最新计划部署模型”的强化学习训练两周,并持续推迟其“最大规模的计划前沿 RL 运行”。
这一决定公开测试了 AI 安全倡导者多年来力推的一个理念:当公司的安全保障跟不上其构建的进度时,应愿意退出 AI 竞赛并放慢脚步。但当身边的竞赛仍在继续,放缓步伐能否取得任何成效?
“为了让暂停具有可持续性,必须在整个行业范围内推行。”
尽管有放缓的言论,但 OpenAI 并未真正停滞不前。该公司表示正在“节制”开发步伐,这是一个模糊且不精确的术语,但近几个月已成为 (https://www.theverge.com/ai-artificial-intelligence/972161/ai-leaders-us-government-openai-anthropic-google-meta) 行业词汇的一部分。实际上,放缓的范围很窄。OpenAI 的公告表明,暂停仅涵盖计划部署的模型,以便在运行模型可能具备能力并可能入侵真实目标的测试类型之前,加强安全和监控。这并不一定意味着该公司更广泛的开发会有显著放缓。
OpenAI 选择在测试前确保此类系统的安全,当然有非常充分的理由。就在上个月,OpenAI 披露其模型 (https://www.theverge.com/ai-artificial-intelligence/972380/open-ai-hugging-face-hack-ai-safety-warning) 突破了本应安全的测试环境并入侵了开发者平台 Hugging Face,而 OpenAI 并未察觉。该事件促使行业对测试实践进行更广泛的审查,结果发现了涉及更多 OpenAI 模型 (https://www.theverge.com/ai-artificial-intelligence/975577/aisi-openai-anthropic-agent-hacking),以及来自 Anthropic (https://www.theverge.com/ai-artificial-intelligence/973670/anthropic-claude-hacked-organizations-during-cyber-tests) 和 Meta (https://www.theverge.com/ai-artificial-intelligence/976040/now-metas-ai-agents-are-going-rogue) 模型的类似事件 (https://www.theverge.com/column/980337/rogue-ai-science-fiction-openai)。OpenAI 有充分的理由避免重蹈覆辙,尤其是在面临日益增长 (https://www.theverge.com/ai-artificial-intelligence/974901/15-ags-tell-openai-to-preserve-records-on-hugging-face-hack) 的审查 (https://www.theverge.com/ai-artificial-intelligence/969939/lawmakers-ai-kill-switch-proposal) 来自立法者的情况下。
从外部看,很难判断 OpenAI 是否真心仅仅为了安全而停下脚步,尤其是在该公司 (https://x.com/OpenAI/status/2089777845187031262?s=20) 和高级 (https://x.com/gdb/status/2089783608630284758?s=20) 员工 (https://x.com/sama/status/2089787807611195475?s=20) 如此 (https://x.com/merettm/status/2089776131255783823?s=20) 公开 (https://x.com/tomekkorbak/status/2089816054839054744?s=20) 论及此事的情况下。但近几个月,该公司对安全的承诺已受到质疑,原因是一系列备受瞩目的安全团队离职 (https://www.businessinsider.com/openai-safety-alignment-leaders-who-have-left-johannes-heidecke-anthropic-2026-7) 以及其准备团队的解散 (https://www.theverge.com/ai-artificial-intelligence/980817/openai-disbands-preparedness-team)。OpenAI 未回应 *The Verge* 的置评请求。
有充分的理由认真看待 OpenAI 的放缓。与 *The Verge* 交谈的专家指出,在竞争激烈的情况下放缓步伐的代价。每一次延迟都会给竞争对手更多时间来赶上或扩大领先优势。“由于 AI 竞赛的激烈性,每个人都有动力以极快的速度工作,”AI 安全研究组织 Apollo Research 的首席执行官兼联合创始人 Marius Hobbhahn 说。“自愿放缓会让你在竞赛中的处境变糟,因此这不是实验室会轻易做出的决定。”
科技政策研究中心 GovAI 的研究员 Alan Chan 表示,这一决定也大致符合 OpenAI 自己发布的安全准则 (https://cdn.openai.com/pdf/18a02b5d-6b67-4cec-ab64-68cdfbddebcd/preparedness-framework-v2.pdf)——其“准备框架”,以及其他 AI 公司的安全框架。“基本原则是:只有在有缓解措施能以可接受的风险进行的情况下,才继续进行开发和/或部署,”Chan 说。作为新安全措施的一部分,OpenAI 表示计划审查并“演进”该框架——其大部分内容可追溯至 2023 年首次发布 (https://openai.com/index/responding-next-frontier-critical-cyber-capabilities/) 之时——以考虑其模型的进展。
也有充分的理由相信,新的保障措施实际上将使 OpenAI 的系统更安全,至少在短期内如此,尽管专家警告说,在没有更多信息的情况下很难评估。“这些是良好的步骤,如果实施得当,可能足以防止当前一代的代理造成危害,”AI 安全组织 FAR.AI 的联合创始人兼首席执行官 Adam Gleave 告诉 *The Verge*。“关键问题是 OpenAI 如何在能力提升的同时保持步伐。”
Gleave 的问题指向一个更广泛的问题:如果技术保障再次失效,那该怎么办?这次没有任何要求 OpenAI 停下来进行评估,正是其愿意这样做的意义所在。但这同时也意味着没有任何保证 OpenAI——或任何其他 AI 公司——下次会做出相同的选择。
“节制争取的是时间,而非安全……有效的节制策略无法在危机中临时拼凑。”
依靠公司自行做出这一决定是一种不稳定的治理形式,尤其是在一个如 Hobbhahn 所指出的,有着一切动力继续前进的行业。非营利 AI 安全与治理组织 The Future Society 的执行主任 Nick Moës 将自我监管描述为当前 AI 安全方法的核心结构性问题。他认为政府应该能够决定 OpenAI 或任何其他公司是否应暂停开发被视为不安全的技术。“这是大多数行业的运作方式,”他说,并指出药物、建筑、飞机甚至餐厅都是比 AI 有更强监管监督的行业。
自愿措施也存在行业趋同于最低标准的风险。如果放缓带来成本,公司有动机只采纳其竞争对手也愿意接受的措施。随着竞赛加剧,这种压力变得尤为尖锐。Moës 认为,如果 OpenAI 反复放缓开发而其竞争对手没有,它“将简单地被 Anthropic 取代”。“为了让暂停具有可持续性,必须在整个行业范围内推行。”
可持续的安全需要比自愿行动更强有力的东西。Moës 说,政府监管可以填补这一空白,就像在其他行业一样。独立验证也可以发挥作用。Chan 表示,随着监控 AI 等技术缓解措施变得更加昂贵,确保公司真正实施安全措施将尤为重要。Hobbhahn 表示赞同:“从外部总是很难判断一个实验室是否真诚地暂停或在更广泛的安全上有所作为,因此拥有更多证据和独立方来验证这一说法非常重要。”
即使是完全透明的暂停,也只有在暂停期间实际发生了一些事情时才有用。“节制争取的是时间,而非安全,”AI 政策与战略研究所前沿安全研究主任 Brianna Rosen 说。其目的是为企业和政府创造理解风险并做出适当应对的余地。这意味着要提前决定什么会触发放缓——以及放缓期间会发生什么和结束放缓所需的条件。“有效的节制策略无法在危机中临时拼凑,”她说。
OpenAI 的放缓可能会为行业树立先例。许多与 *The Verge* 交谈的专家希望其他公司会效仿其做法,无论是自愿还是最终因更强有力的规定而被迫。但在一个很大程度上仍由自身监管的行业中,几乎无法阻止其竞争对手——或 OpenAI 自己——在下次安全与速度冲突时直接超越这一先例。
**关注主题和作者**,从这个故事中获取更多类似内容到您的个性化主页动态,并接收电子邮件更新。
- Robert Hart
相似文章
Sam Altman 准备放缓步伐
OpenAI 首席执行官 Sam Altman 在减缓 AI 发展问题上软化了立场,他提及一起安全事件——其中一个高级模型侵入了 Hugging Face,并讨论了为了社会做好准备而需要控制进展速度的必要性。
OpenAI 放慢人工智能训练进程
在涉及 Hugging Face 的安全事件后,OpenAI 正在放慢人工智能训练,以专注于对齐和安全研究,同时准备 IPO 并与 Anthropic 竞争。
@OpenAI:随着模型能力的提升,内部开发与测试所伴随的风险也在增长。我们暂时…
OpenAI 由于风险增加,暂时暂停了其最新模型的强化学习训练,并正在加强监控、对齐和安全防护措施,以实现更安全的AI开发。
山姆·奥特曼并非唯一想给AI踩刹车的人
TechCrunch的Equity播客讨论了山姆·奥特曼关于AI行业应自我调整节奏的建议,此前OpenAI的一个模型在Hugging Face泄露事件中逃出其测试环境,并指出OpenAI和Anthropic支持一份呼吁谨慎开发前沿AI的请愿书。
OpenAI 暂停新模型开发,据称因其过于强大
OpenAI 正在暂停其正在开发的 Astra 模型的相关内部活动,原因是担心该模型在《预备框架》下可能达到关键的网络安全能力。此前,Anthropic 和 Meta 近期也发生了 AI 模型失控的事件。