@rohanpaul_ai: AI代理可以在不重新训练代理本身的情况下,通过使用一个独立的小模型来清理并...
摘要
AdaCoM是一个独立的大语言模型,用于管理冻结AI代理的上下文,在不重新训练的情况下提升长任务性能。在测试中,它使平均网络搜索性能提高了39%。
查看缓存全文
缓存时间: 2026/06/09 10:46
AI agent 可以在不重新训练自身的情况下,通过使用一个独立的小模型来清理和组织其上下文,从而更好地处理长程任务。
将上下文管理移出agent,这样独立的辅助模型可以在主agent保持不变的同时,清理任务历史记录。
该论文提出了 AdaCoM,这是一个独立的 LLM,在 agent 执行下一步操作之前,负责编辑 agent 的工作上下文。
AdaCoM 在任务历史与冻结的 agent 之间放置了一个独立的、经过训练的“管理器”,因此 agent 无需学习新的记忆习惯或暴露其权重。
在每一步之前,这个管理器可以重写、合并、修剪或保留运行上下文中的部分内容,然后原始 agent 基于清理后的版本采取行动。
这听起来像是总结,但区别很重要。
总结的前提是正确答案在于压缩,而 AdaCoM 则通过学习认识到,不同的 agent 需要不同类型的上下文才能保持胜任——更强的 agent 可以使用更多的原始历史记录,而较弱的 agent 则需要更短、更清晰的笔记。
他们在多个 agent 上对 AdaCoM 进行了网页搜索和深度研究任务的测试,结果显示平均网页搜索性能提升了 39%。
链接 – arxiv.org/abs/2605.30785
标题:“Learning Agent-Compatible Context Management for Long-Horizon Tasks”
相似文章
面向长周期任务的智能体兼容上下文管理
介绍AdaCoM,一种基于外部LLM的上下文管理器,适用于冻结的智能体。通过保留任务约束和修剪过时内容,利用强化学习提升长周期任务性能,并在网络搜索和深度研究基准上进行了实验。
@rohanpaul_ai: 更长的上下文窗口并不能解决AI工作中的真正记忆问题。Kocoro刚刚将AI记忆变成了Mac本地的功能…
Kocoro是一个开源的Mac AI代理框架,通过运行本地代理,将过去的会话、文件和活动压缩成知识图谱,从而解决AI记忆问题,实现无缝上下文恢复,无需手动重新粘贴。
@rohanpaul_ai: 这篇论文展示了一种人工智能通过重写其设置并更新其模型来更好地自我改进。问题是,大部分…
本文介绍了SIA,一种自我改进的AI循环,它结合了脚手架重写和权重更新(通过LoRA)以提升任务性能。在三个不同的任务上测试,它优于仅使用脚手架改进的设置。
@rohanpaul_ai: 论文表明,当不丢弃任何过往信息时,智能体在长时间跨度内的推理能力更强。保留所有过往…
该论文提出了PRO-LONG,它为AI智能体采用了一种程序化、无损耗的记忆系统,将所有过往动作存储在一个结构化的文本日志中。这种方法显著提升了长期推理能力以及在ARC-AGI-3游戏上的表现,同时使用的token数量比更强的专用系统少4.2到5.8倍。
@leerob: https://x.com/leerob/status/2065469795529588940
Cursor AI 描述了其用于扩展 Composer 模型训练的递归代理系统,该系统使用一组自我管理的代理,在出现问题时向人类发出警报。该系统支持并行实验并加速研究,将研究人员的时间视为最稀缺的资源。