AI代理的未来可能不在于更大的上下文窗口
摘要
这篇文章认为,AI代理架构应从持有全部上下文的单体代理转向一种路由模型,即代理将任务委托给专业化服务,类似于软件从单体架构演进到微服务的方式。
所以,我一直在想,我们是否基于错误的假设来构建代理。大多数代理架构假设一个代理应该完成所有的思考。这个代理持有内存、上下文、推理、规划、工具定义、历史记录和领域专业知识。随着能力的增长,上下文也在增长。随着上下文的增长,成本增加,推理质量下降。如果代理不需要知道一切呢?如果代理的工作仅仅是路由工作给专家呢?想象每个专家作为一个可调用的服务,拥有自己的:
• 模型
• 上下文窗口
• 知识
• 内存
• 执行环境
不是将专业知识加载到代理中,而是代理调用专业知识。代理成为一个路由器。专家负责思考。这感觉类似于软件从单体架构演进到微服务的方式。不确定这种模式是否会在生产代理系统中出现。但我相信,朝着专业化推理服务的网络发展似乎是正确的路径。
相似文章
更大的上下文窗口对智能体来说其实是错误的方向吗?
作者质疑将注意力集中在扩大AI智能体的上下文窗口上是否适得其反,认为积累的垃圾信息会拖慢长时间会话,并建议保持工作上下文小巧、使用外部记忆。
@ZhihuFrontier: Long-Horizon Agents Need More Than Bigger Context Windows AI Agents are moving from short conversations into software e…
A new survey from Renmin University reviews nearly 1,000 studies on long-horizon AI agents, arguing that reliable long-horizon intelligence depends on the whole model-harness system, not just larger context windows or stronger models.
单体AI是未来吗?
讨论单体AI系统是否可持续,将其与软件单体进行类比,并提出由专业化的微服务式智能体协同工作可能是未来的方向。
上下文至关重要,但上下文腐烂才是AI智能体的真正上限,更大的上下文窗口只会让情况更糟而非更好
文章认为,上下文腐烂(即随着上下文填充导致推理质量下降)是AI智能体的真正上限,而非上下文窗口大小。它提倡采用架构方法分解任务并使用独立验证来超越限制。
@N01ennn: 更大的上下文窗口是死路一条。这篇论文证明了这一点。一项新的CS调查悄然重新定义了整个游戏:事情…
一条推文重点介绍了一篇CS调查论文,该论文认为更大的上下文窗口是死路一条,而记忆工程——将智能体的记忆视为操作系统——才是将真正的AI智能体与自动补全区分开来的关键,使无状态模型能够自我进化。