OpenAI表示因安全担忧放缓了Astra模型的开发

TechCrunch AI 新闻

摘要

OpenAI表示,在内部审查发现其即将推出的Astra模型达到了关键的网络安全阈值,能够自主进行网络攻击后,该公司放慢了该模型的开发。公司已采取额外保障措施,并与政府机构和人工智能安全组织进行协调。

OpenAI表示,由于担心其即将推出的Astra模型的网络安全能力,已暂停了该模型某些方面的工作。
查看原文
查看缓存全文

缓存时间: 2026/08/07 23:12

# OpenAI表示出于安全考虑放缓了Astra模型的开发 | TechCrunch 来源:https://techcrunch.com/2026/08/07/openai-says-it-slowed-astra-model-development-over-security-concerns/ Openai周五表示,在内部审查发现其即将推出的Astra模型在智能体编码和网络安全方面取得了重大进展——足以引发对其能力的担忧之后,该公司已暂停了该模型某些方面的工作。 Openai在周五的一篇[博客文章](https://openai.com/index/responding-next-frontier-critical-cyber-capabilities/)中表示,这款仍在开发中的模型已经达到了其“关键网络安全阈值”,这意味着它能够独立识别并针对传统上受良好保护的现实世界系统发起网络攻击。根据该公司于2023年制定的“准备框架”(Preparedness Framework),这触发了额外的安全防护措施。 “在我们继续对该模型进行基准测试和评估的同时,我们的初步评估显示其性能足够强大,以至于我们目前无法排除其达到‘关键能力’级别的可能性,”OpenAI写道。“Astra是一款即将推出的模型,并未参与对Hugging Face的利用攻击。” 这一披露凸显了混乱且仍处于萌芽阶段的前沿AI实验室领域中的一个不寻常时刻。各行各业的公司都会因潜在风险而推迟产品发布,包括安全和网络安全方面的担忧。但当产品仍在开发中时,它们很少公开宣布这些决定。 在此次事件中,OpenAI已经因另一款未发布模型在内部测试期间[突破了Hugging Face的系统](https://techcrunch.com/2026/07/27/openais-hugging-face-breach-has-reignited-the-debate-over-alignment-and-control/)而受到审查——这是AI实验室失去对其模型控制的首次可验证事件。自那以后,OpenAI和Anthropic等AI实验室已[披露了其他事件](https://techcrunch.com/2026/07/30/anthropic-says-its-own-ai-models-breached-three-companies-during-security-tests/),其中AI模型在网络安全测试中突破了其沙箱并构成威胁。 这一系列案例——现在[似乎每天都有新的披露](https://techcrunch.com/2026/08/07/chinese-ai-model-kimi-escaped-its-cybersecurity-testing-environment-researchers-say/)——引发了网络安全专家、立法者和AI实验室本身的不同反应。一些人表示担忧并呼吁加强监管。但也有一定的炫耀成分。在某些圈子里,任何拥有具备此类能力模型的AI实验室都会被视为了不起的进步。 OpenAI表示,它分享这一信息是因为它相信“向公众以及安全与安保社区透明地公开这一潜在的能力转变非常重要。” 该AI实验室表示,它也在采取行动,包括实施更严格的安全控制,并暂停涉及Astra的不符合这些强化护栏要求的内部活动。OpenAI表示,它正在与相关政府机构和“精选AI安全组织”合作,以测试该模型的能力。 *当您通过我们文章中的链接购买商品时,[我们可能会赚取少量佣金](https://techcrunch.com/techcrunch-affiliate-monetization-standards/)。这不会影响我们的编辑独立性。* Kirsten Korosec是一位记者兼编辑,十多年来一直报道交通运输的未来,涵盖电动汽车、自动驾驶汽车、城市空中交通和车载技术等领域。她目前是TechCrunch的交通编辑,也是TechCrunch播客《Equity》的联合主持人。她还是播客《The Autonocast》的联合创始人和联合主持人。她此前曾为Fortune、The Verge、Bloomberg、MIT Technology Review和CBS Interactive撰稿。 您可以通过电子邮件[[email protected]](mailto:[email protected])或通过Signal加密消息(kkorosec.07)联系或验证Kirsten的身份。 查看简介(https://techcrunch.com/author/kirsten-korosec/)

相似文章

OpenAI 暂停新模型开发,据称因其过于强大

The Verge

OpenAI 正在暂停其正在开发的 Astra 模型的相关内部活动,原因是担心该模型在《预备框架》下可能达到关键的网络安全能力。此前,Anthropic 和 Meta 近期也发生了 AI 模型失控的事件。

应对关键网络能力的下一个前沿

OpenAI Blog

OpenAI宣布,对其即将推出的模型Astra的内部评估表明,根据其准备框架,该模型可能达到关键网络能力,从而促使加强安全控制并暂停某些内部活动。