智能体的记忆尚未成熟
摘要
对当前AI智能体记忆解决方案的批评,认为RAG包装器及类似方法未能解决模型偏见和上下文膨胀的核心问题。
每天我在Reddit、Twitter等平台上刷,几乎每个人都在推销RAG包装器,好像是什么上天赐予的记忆工具。它们都遵循同样的套路:没错,我们有向量搜索,但我们的重新排序器或图结构提高了准确性。我们用了MCP,因为模型应该主动向我们索要信息。更好的Markdown文件管理。一切都在本地。或者用某种新的更大的嵌入器、重新排序器、RRF等等。但为什么还没有大规模采用呢?我认为构建者们只是在拼凑拼图的不同部分,希望记忆层能返回你想要的东西。没有人退一步去真正理解问题所在。我相信要让一个真正的系统工作,你不能依赖模型主动询问(MCP),因为模型是通过RLHF训练的,这产生了一种偏差,使模型更追求认可而非准确性。也不能依赖多个技能文件,因为那只是更多的上下文膨胀,让模型去推理,反而分散了对实际问题的注意力。我认为也不能依赖事后提取,因为想想当你被要求回忆某事时,根据提问方式的不同,你可能会记起从未发生过的事情。那么,理想系统到底应该是什么样子?
相似文章
智能体记忆不仅仅是基于用户事实的RAG
文章认为,简单的基于RAG的智能体记忆系统在生产中会失败,原因包括过时的偏好、遗漏的关键词和提示注入等问题,并主张采用分层记忆架构,具备主动选择、确定性回退、治理和测试等功能。
智能体真的需要记忆吗?还是我们用它来弥补架构不佳?
本文探讨了AI智能体中的记忆是必不可少的,还是对不良架构的变通方案,并询问从业者在生产系统中需要持久化哪些内容。
Project Shadows:事实证明“单纯增加记忆”无法修复你的智能体
本文探讨了 AI 智能体设计中的局限性,指出仅靠增加记忆容量不足以解决智能体构建与运行机制中的根本性架构问题。
关于智能体、RAG 和记忆的一些笔记与经验教训
作者分享了在大规模构建 AI 智能体过程中积累的笔记与经验教训,重点探讨 RAG 和记忆管理,以帮助他人。
理解智能体记忆(38分钟阅读)
本文比较了三种常见的智能体记忆系统形态——基于文件的、结构化存储和基于经验的,并通过一个使用常见智能体循环和开源模型的基准测试评估了它们的有效性。