Meta的Muse拥有独立的Sentinel用于出站动作,你会首先测试什么?

Reddit r/AI_Agents 产品

摘要

Meta宣布了Muse,一个个人AI代理,配备独立的Sentinel来批准出站操作和处理敏感任务的用户权限。文章建议测试哪个安全层会拒绝恶意指令以评估系统。

Meta在9月8日发布的Muse公告描述了一个运行在专用云虚拟机中的个人代理,由独立的Sentinel批准出站活动。Meta还表示,发送邮件或进行购买等敏感操作需要用户许可。值得关注的是,AI审查员认为操作可接受与代理无法覆盖的权限之间的区别。一个有用的测试是让页面指示助手将私有信息发送到新目的地:哪个层会拒绝它,以及什么证据会到达用户?还有一个推出边界:Muse正在美国通过iOS、Android和网络推出。计划在今年晚些时候推出的Confidential VM,密钥仅由用户持有,与当前提供的VM不同。这些是Meta的设计声明,而非独立的安全测试。对于浏览器代理,你会首先测试什么:恶意页面指令、批准负载更改,还是撤销访问权限?来源在评论中。
查看原文

相似文章