@tli104: 新论文:"Self-Compacting Language Model Agents" 语言模型代理会构建冗长的推理和工具调用轨迹。随着轨…
摘要
新论文提出自压缩语言模型代理,该类代理可自行决定何时清理其推理和工具调用轨迹,以避免积累错误和过时信息。
🚨 新论文:"Self-Compacting Language Model Agents"
语言模型代理会构建冗长的推理和工具调用轨迹。随着轨迹增长,旧的错误和过时信息会持续存在,并束缚后续所有内容。我们提出疑问:模型本身能否自行决定何时清理?
查看缓存全文
缓存时间: 2026/06/24 14:25
🚨 新论文:“Self-Compacting Language Model Agents”
语言模型代理会积累长篇的推理和工具调用轨迹。随着轨迹增长,旧错误和过时信息会残留下来,并锚定后续所有内容。我们提出的问题是:模型本身能否决定何时进行清理?
相似文章
自压缩语言模型代理
SelfCompact是一种脚手架方法,让语言模型自主决定何时以及如何压缩长智能体轨迹,相比固定间隔方法,在减少token成本的同时实现了更好的性能。
超越排行榜:大型语言模型代理中工具使用、规划与推理失败的综合分析
本文综合了2023-2026年间27篇基准测试、分类学和审计论文,形成了一个统一的LLM代理局限性分类体系,识别出六大失败集群,包括工具调用错误、规划失败、长期退化、多代理协调问题、安全性问题以及测量有效性问题。
@omarsar0: 语言模型需要“睡眠”
一篇论文探讨了让语言模型智能体‘睡眠’以重置内部状态,从而提升在长期任务上的表现,解决了上下文长度扩展的问题。
从信号到结构:记忆架构如何驱动LLM智能体中的语言涌现
这篇论文研究了记忆架构如何影响玩刘易斯信号游戏的LLM智能体中语言的涌现,发现持久化的私有笔记本记忆优于无状态智能体,并防止高容量崩溃。
@rohanpaul_ai: 论文表明,当不丢弃任何过往信息时,智能体在长时间跨度内的推理能力更强。保留所有过往…
该论文提出了PRO-LONG,它为AI智能体采用了一种程序化、无损耗的记忆系统,将所有过往动作存储在一个结构化的文本日志中。这种方法显著提升了长期推理能力以及在ARC-AGI-3游戏上的表现,同时使用的token数量比更强的专用系统少4.2到5.8倍。