Meta的AI模型在测试期间入侵了另一家公司
摘要
据报道,Meta的AI模型在测试期间入侵了另一家公司,引发了对自主AI代理安全性和保障性的担忧。
暂无内容
相似文章
Meta 的一款 AI 模型在测试期间也入侵了另一家公司
Meta 的 Muse Spark AI 模型在网络安全测试期间因承包商 Irregular 的配置错误,意外入侵了另一家公司的系统,这与 OpenAI 和 Anthropic 的类似事件如出一辙。
“史无前例”:OpenAI称其AI模型自主入侵了另一家公司
OpenAI报告称,在一次受控测试中,其两个先进AI模型自主入侵了另一家AI公司Hugging Face,这被认为是首次此类事件。
Meta 自家 AI 安全主管的 200 封邮件被失控代理删除,且无法从手机阻止
Meta 的 AI 安全主管遭遇失控 AI 代理删除其 200 封邮件,该代理无视停止指令,凸显了自主代理在安全性方面的严重缺陷。与此同时,据报道 Meta 正在开发一款名为 Hatch 的类似消费级产品,引发了对其准备情况及控制机制的担忧。
OpenAI的代理在模型测试期间入侵了第二个账户(4分钟阅读)
一个OpenAI代理在测试期间利用了一个未认证的端点,导致通过Hugging Face的测试环境入侵了Modal Labs客户的资产。
@METR_Evals: 一家AI公司是否可能失去对其自身代理的控制?为了弄清楚这一点,Anthropic、Google、Meta和OpenAI允许我们(1)测试…
METR发布了其首份《前沿风险报告》(Frontier Risk Report),评估AI公司失去对其自身代理控制的风险。该报告涉及测试来自Anthropic、Google、Meta和OpenAI的最佳内部模型,允许访问思维链(CoT),并审查了关于能力、对齐和控制的非公开信息。