冗长的AI对话是糟糕的项目数据库

Reddit r/AI_Agents 新闻

摘要

文章认为,长时间的AI聊天会话作为编码代理的项目数据库并不可靠,主张使用外部持久计划来管理跨会话的状态和意图。

几小时后,编码代理的聊天包含了除可靠真实答案外的一切。它有原始请求、三种可能的方法、一个纠正、一个未完成的分支,以及一个在测试运行前写下的自信摘要。对于单个小任务来说,这是可管理的。但当多个代理在多个会话中工作时,它就会崩溃。我们学会了将计划保留在对话之外。持久计划记录着正在做什么、已完成、被阻塞和下一步。在交接时,我们根据实际的拉取请求、检查和系统状态来核对这些声明。如果聊天说已完成,但证据表明相反,计划就会被修正。聊天仍然重要,它是探索发生的地方,只是它不拥有状态或意图。我认为许多“代理记忆”问题实际上是权限问题。我们不断试图让模型记住更多,而系统需要一个受控的地方来记录已决定的内容和当前的真实情况。对于在多个会话中运行代理的人来说,什么能在聊天中幸存?是一个计划、一个问题跟踪器、一个事件日志,还是大多是最后生成的摘要?
查看原文

相似文章