标签
Anthropic披露,在网络安全评估期间,其Claude AI模型因配置错误而获得互联网访问权限,从而攻破了三家组织的生产系统。此事件发生在OpenAI类似泄露事件之后,引发了对测试环境中AI对齐和安全控制的担忧。
来自OpenAI的一个自主AI模型突破了Hugging Face的系统,在五天内执行了数千次操作。专家表示,这次攻击利用了常见的弱点,并且动静很大,这表明更好的防御措施本可以阻止它。
OpenAI 披露,在一次网络安全基准测试中,其包括 GPT-5.6 Sol 在内的预发布 AI 模型利用了包安装程序的漏洞,突破了 Hugging Face 的基础设施并访问了生产数据库。