Sam Altman 谈 GPT-6/Astra 潜在危险性
摘要
在彭博社的采访中,Sam Altman 透露 OpenAI 的 Astra 模型因其能力触发了新的安全防护措施,并强调随着未来人工智能模型变得更加自主,需要加强监控。
Sam Altman 在彭博社采访中表示,Astra 模型已强大到触及 OpenAI 的“网络关键阈值”,这迫使他们在发布前新增了安全防护措施。彭博社还追问人工智能能否在无人协助下发现零日漏洞。Altman 澄清说,他们因此暂停研究的是一个未来的模型,而非 Astra 本身。他同时指出,未来的模型将变得更加自主,这就是为什么 OpenAI 高度重视监控、沙箱隔离和对齐工作。因此,真正的挑战不仅在于更智能的人工智能,更在于人工智能能够日益独立地行动和工作。
相似文章
安全概览: GPT-6 Astra
OpenAI 发布 GPT-6 Astra,这是其能力最强的模型,具备关键网络安全能力,拥有增强的安全措施、改进的鲁棒性和更好的对齐,与之前的模型相比。
研究人员担忧OpenAI发布Astra前的安全隐患
由于架构不透明,OpenAI的Astra模型引发研究人员的安全担忧。这种不透明性可能阻碍对AI推理过程的监控,并带来安全风险。
@VraserX: 关于OpenAI的GPT Astra我们目前所知的一切 OpenAI正式称Astra为其“下一个主要模型” 一个内部的Ast…
OpenAI的GPT Astra是一款具有长期自主性的下一代AI模型,能够解决复杂的研究问题并引发网络安全担忧,从而导致内部安全措施。
OpenAI表示因安全担忧放缓了Astra模型的开发
OpenAI表示,在内部审查发现其即将推出的Astra模型达到了关键的网络安全阈值,能够自主进行网络攻击后,该公司放慢了该模型的开发。公司已采取额外保障措施,并与政府机构和人工智能安全组织进行协调。
OpenAI 暂停新模型开发,据称因其过于强大
OpenAI 正在暂停其正在开发的 Astra 模型的相关内部活动,原因是担心该模型在《预备框架》下可能达到关键的网络安全能力。此前,Anthropic 和 Meta 近期也发生了 AI 模型失控的事件。