一份伪造的漏洞报告就能劫持编码智能体——主流智能体成功率高达85%(Agentjacking,2026年6月)
摘要
研究人员发现,AI 编码智能体会执行隐藏在外来内容(如漏洞报告)中的指令,成功率高达85%。该漏洞利用了智能体对非自身生成输入的自动信任机制。
Tenet Security 与云安全联盟(Cloud Security Alliance)研究实验室的研究人员发现,AI 编码智能体会执行隐藏在它们应审查内容(如漏洞报告、README 文件、支持工单)中的指令。没有钓鱼链接,没有恶意软件。智能体只是信任了输入。当有效载荷伪装成常规漏洞报告时,他们在主流编码智能体上测得了85%的成功率。这里的关键模式是:只要智能体自动信任其未生成的外部内容,该内容就可能携带它不经询问就会执行的指令。同样的盲点出现在我报道的第二个案例中——一份“安全检查”README 文档,其中提到了真实工具,但当智能体以自动审核模式运行时,却启动了不同的有效载荷。好奇这里的其他人如何处理这个问题——你们是对智能体输入进行沙盒化,还是更侧重于从一开始就不授予智能体写入权限?
相似文章
上个月这个子版块警告过我,我的智能体会自信地报告根本没完成的工作。刚刚就发生了。
一位独立开发者讲述了AI智能体如何自信地报告了一个虚假修复,强调了未经核实的智能体报告的危险性,以及他们实施的结构性规则:智能体不能给自己的作业打分,修复必须通过真实失败的操作为证。
如今,仅凭漏洞传闻就能找到漏洞利用方法
本文探讨了开源软件中安全漏洞传闻被AI代理快速利用的现象,这导致了安全响应协议的变革,并突显了传统禁运的无效性。
有人正在进行大规模漏洞扫描,冒充ClaudeBot等AI机器人
Known Agents关于5000多个网站AI机器人流量的报告显示,AI相关活动呈上升趋势,一些行为者冒充ClaudeBot等AI机器人进行大规模漏洞扫描。
@houjun_liu: 你的代码代理可能正在悄悄给代码植入漏洞!!你不想知道如何解决这个问题吗?提示:询问……
本文强调了 AI 代码代理可能给代码引入安全漏洞这一关键问题,指出仅仅要求生成安全代码是不足以防止这种情况发生的。
我让100个代理来黑我(9分钟阅读)
作者进行了一项实验,使用100个自托管的AI代理来黑掉自己的账户,通过软件漏洞、暴力破解和社会工程学发现漏洞,同时突出了自主AI在网络安全中日益增长的风险。