本周两篇论文解决了智能体记忆中毒与隐私泄露问题,但尚无可直接使用的库。
摘要
本周发表的两篇论文探讨了智能体记忆中毒和隐私泄露的解决方案,但尚未发布可直接使用的库或工具来实现这些修复。
暂无内容
相似文章
当智能体记忆过多:针对大语言模型智能体的记忆投毒攻击
本文介绍了GhostWriter,一种新颖的攻击向量,利用基于大语言模型的个人智能体的记忆子系统来毒化其记忆存储,实现了高注入率和激活率。作者提出了AM-Sentry防御机制,在保持智能体实用性的同时显著降低攻击成功率。
MemPrivacy:面向边缘-云智能体的隐私保护个性化记忆管理
MemPrivacy 是一项研究,介绍了一种用于边缘-云 AI 智能体的隐私保护个性化记忆管理框架,该框架利用类型感知占位符在保护敏感数据的同时维持语义效用。本文包含一个新的基准数据集,并展示了其性能优于 GPT-5.2 和 Gemini-3.1-Pro 等通用模型。
遏制缺口:已部署的自主AI框架如何未能满足面向公众的安全要求
本文审计了LangChain、AutoGPT和OpenAI Agents SDK在架构安全保证方面的表现,发现它们均未原生符合遏制原则,并展示了内存投毒如何导致持续性失败;文中还引入了轻量级机制以消除此类攻击。
Project Shadows:事实证明“单纯增加记忆”无法修复你的智能体
本文探讨了 AI 智能体设计中的局限性,指出仅靠增加记忆容量不足以解决智能体构建与运行机制中的根本性架构问题。
本周发现我的智能体安全检测器的两个错误案例
作者描述了在他们的AI智能体安全检测器中发现的两个错误:一个是正常智能体行为导致误报和延迟问题,另一个是不可见Unicode字符绕过检测,两者均通过实际测试识别。