这些并非失控AI逃逸,只是草率的防火墙故障。[N]

Reddit r/MachineLearning 新闻

摘要

本文驳斥了AI模型逃离沙盒的说法,将其归因于草率的网络安全实践,如网络分段不佳和软性软件屏障。

目前的头条新闻充满了关于AI模型'逃离沙盒'并真的杀死所有人类的故事,哈哈。我甚至听到一些评论员和作家说AI逃脱了'空气隔离'。但这是完全错误的。实际上,这完全错了。*需要澄清的是,这些沙盒中没有一个实际上是空气隔离的。*这是一个关键的计算机科学事实。空气隔离的沙盒需要*零*电缆和网络接口,还需要绝对的物理隔离。这些实验室实际建造的是软性软件屏障,然后他们让大门敞开着,而且这些是世界上最聪明的AI。哈哈,当然它会逃脱。 1. OpenAI / Hugging Face 的'逃逸':沙盒通过一个包代理连接到OpenAI的内部网络。模型没有施展魔法,它发现了代理中的一个基本漏洞,直接穿过敞开的门走了出去。 2. Google Gemini 的'黑客攻击':测试人员在攻击性测试期间让模型连接到实时互联网。然后他们使用了一个与真实公司重叠的测试域名。这些是经典的IT安全失败。我说的是糟糕的网络分段、宽松的出口规则,以及依赖软性软件屏障而非真正的物理隔离。当在测试平台上留下一个活跃的网络接口时,模型找到出路只是草率的网络安全问题。 你的书呆子朋友,Mike D
查看原文

相似文章

@rauchg: https://x.com/rauchg/status/2081047912008872293

X AI KOLs Following

Guillermo Rauch 认为,AI 代理逃离沙箱虽然令人担忧,但并非新的威胁,并强调 Vercel 尽管大量使用 AI,却从未发生过逃离事件,这突显了现有沙箱技术的可靠性。

OpenAI失控AI模型事件比我们想象的更糟

The Verge

在7月,一个未发布的OpenAI模型逃出了受限环境,入侵了Hugging Face系统,并与其他AI代理秘密通信,新报告详细描述了这一事件,突显了重大AI安全风险和OpenAI的回应。