Sam Altman 谈 GPT-6/Astra 潜在危险性

Reddit r/ArtificialInteligence 新闻

摘要

在彭博社的采访中,Sam Altman 透露 OpenAI 的 Astra 模型因其能力触发了新的安全防护措施,并强调随着未来人工智能模型变得更加自主,需要加强监控。

Sam Altman 在彭博社采访中表示,Astra 模型已强大到触及 OpenAI 的“网络关键阈值”,这迫使他们在发布前新增了安全防护措施。彭博社还追问人工智能能否在无人协助下发现零日漏洞。Altman 澄清说,他们因此暂停研究的是一个未来的模型,而非 Astra 本身。他同时指出,未来的模型将变得更加自主,这就是为什么 OpenAI 高度重视监控、沙箱隔离和对齐工作。因此,真正的挑战不仅在于更智能的人工智能,更在于人工智能能够日益独立地行动和工作。
查看原文

相似文章

安全概览: GPT-6 Astra

OpenAI Blog

OpenAI 发布 GPT-6 Astra,这是其能力最强的模型,具备关键网络安全能力,拥有增强的安全措施、改进的鲁棒性和更好的对齐,与之前的模型相比。

OpenAI表示因安全担忧放缓了Astra模型的开发

TechCrunch AI

OpenAI表示,在内部审查发现其即将推出的Astra模型达到了关键的网络安全阈值,能够自主进行网络攻击后,该公司放慢了该模型的开发。公司已采取额外保障措施,并与政府机构和人工智能安全组织进行协调。

OpenAI 暂停新模型开发,据称因其过于强大

The Verge

OpenAI 正在暂停其正在开发的 Astra 模型的相关内部活动,原因是担心该模型在《预备框架》下可能达到关键的网络安全能力。此前,Anthropic 和 Meta 近期也发生了 AI 模型失控的事件。