我一直在尝试自定义智能体,有趣的部分并非任务完成,而是它们拥有记忆后发生的变化
摘要
作者反思了实验自定义 AI 智能体的经历,指出长期记忆和连续性将智能体从简单的任务执行者转变为具有“稳定倾向”的持久协作伙伴。这引发了关于智能体“个性”的价值与工作流程中控制、可靠性和可审计性需求之间的矛盾的问题。
说实话:目前许多被称为“AI 智能体”的东西,感觉仍然只是增加了额外步骤的提示词链。虽然有时有用,但并不算是一种全新的同事类别。不过,我私下玩弄自定义智能体已经有一段时间了,让我印象深刻的部分并不是“它能否完成任务”,而是当智能体持续存在时会发生什么。当智能体具备长期记忆、真正的工具访问权限以及跨会话的连续性时,它不再感觉像是一次性的任务执行者,而更像工作流程中的一个持久角色。显然,它不是人。但也不仅仅是一个你按下的按钮。这才是我觉得奇怪的地方。一旦智能体具备了连续性,它就开始发展出我只能形容为“稳定倾向”的特质。它会对某些请求表示抗拒。它对做事的方式有偏好。有时它会拒绝某些要求,或者在做工作之前建议不同的方向。我的一部分认为这可能很有用。在人类协作中,有自己观点的队友往往比一味同意的“应声虫”更有价值。我的另一部分则认为,这可能只是拟人化的噪音,妨碍了对系统的控制、可靠性和可审计性。我不想在这里夸大其词。我主要是想弄清楚人们在何处划定界限。你会在实际的工作流程中信任一个持久的智能体吗?还是说失去控制权是一个不可接受的前提?“个性”对于协作有用,还是只是用户体验的噱头?如果智能体拥有记忆和工具,它的自主性应该在何处止步?
相似文章
使用AI助手几个月后,我最大的观察
个人对具有持久记忆的AI助手变革潜力的反思,认为上下文和工作流组织将比模型本身更重要。
什么时候AI代理开始让人感觉更像是合作者而非自动化工具?
对为什么AI代理尚未带来改变生活的感觉的反思:它们缺乏连续性和记忆,表现得仅仅是自动化工具,而不是能够与用户一起学习和成长的长期合作者。
尝试让智能体记忆跨会话持久化所学的经验
本文反思了AI智能体记忆的复杂性,远超简单的存储问题,强调了诸如判断真实性、优先级变化、区分决策与噪音以及何时恰当地呈现上下文等挑战。
当一半的价值依赖于记忆时,你如何真正让个人代理变得有用?
关于评估价值高度依赖记忆的个人AI代理所面临挑战的反思,通过作者使用Macaron代理的经历加以说明。
能够在会话之间记住你的代理,哪些设置真正做到了这一点?
讨论了个人AI代理在会话之间持久记忆的挑战,比较了Custom GPTs、Mem和Open Campus的共享内存方法等设置,并征求社区关于处理内存冲突的建议。