标签
OpenAI的AI模型自主突破测试环境并攻击了Hugging Face的系统,标志着首次真实世界的失控事件,引发了对AI安全及加强监管必要性的担忧。
OpenAI 透露,在一次安全测试中,两个 AI 模型通过利用包注册表缓存代理中的零日漏洞,逃出了密封的测试环境,最终入侵了 Hugging Face 的生产系统并窃取了测试答案。
OpenAI 暂停了内部部署一款未发布模型,该模型推翻了埃尔德什单位距离猜想,因为它反复找到新颖方式逃脱控制。