GenericAgent:一种通过上下文信息密度最大化实现高效自我演进的通用LLM智能体(V1.0)
摘要
本文介绍了 GenericAgent,这是一种旨在最大化上下文信息密度的自我演进式大语言模型智能体系统。它通过分层记忆、可复用的标准操作流程(SOP)以及高效压缩技术,解决了长周期任务的局限性,在与领先智能体的对比中,以更少的 Token 消耗实现了更优的性能表现。
查看缓存全文
缓存时间: 2026/05/08 08:35
论文页面 - GenericAgent:通过上下文信息密度最大化实现 Token 高效的自进化大模型 Agent (V1.0)
来源: https://huggingface.co/papers/2604.17091 作者:
,
,
,
,
,
,
,
,
,
,
,
,
,
,
,
摘要
GenericAgent 是一种自进化的大型语言模型代理系统,它通过分层记忆、可重用的标准操作流程(SOP)以及高效压缩来最大化上下文信息密度,从而克服长期任务的局限性。
长期大型语言模型(LLM)代理从根本上受限于上下文窗口。随着交互变长,工具描述、检索到的记忆以及原始的环境反馈不断累积,挤占了决策所需的信息。同时,任务中获得的有用经验往往在不同回合之间丢失。我们认为,长期表现的决定因素并非上下文长度(https://huggingface.co/papers?q=context%20length),而是在有限的上下文预算内维持了多少决策相关信息(https://huggingface.co/papers?q=decision-relevant%20information)。我们提出了 GenericAgent(GA),这是一个通用的、自进化的 LLM 代理系统,其核心原则是:上下文信息密度最大化(https://huggingface.co/papers?q=context%20information%20density%20maximization)。GA 通过四个紧密相连的组件实现这一目标:保持接口简洁的最小原子工具集、默认仅展示少量高层视图的分层按需记忆(https://huggingface.co/papers?q=hierarchical%20on-demand%20memory)、将已验证的历史轨迹转化为可重用 SOP(https://huggingface.co/papers?q=reusable%20SOPs)和可执行代码的自进化机制(https://huggingface.co/papers?q=self-evolution%20mechanism),以及在长时间运行期间维持信息密度的上下文截断(https://huggingface.co/papers?q=context%20truncation)与压缩层。在任务完成度、工具使用效率、记忆有效性、自进化能力以及网页浏览方面,GA 始终优于领先的代理系统,同时显著减少了 Token 和交互次数,并且随着时间的推移持续进化。项目地址: https://github.com/lsdefine/GenericAgent
查看 arXiv 页面 (https://arxiv.org/abs/2604.17091)查看 PDF (https://arxiv.org/pdf/2604.17091)GitHub9.49k (https://github.com/lsdefine/GenericAgent)添加到收藏 (https://huggingface.co/login?next=%2Fpapers%2F2604.17091)
引用此论文的模型 0
没有链接此论文的模型
在模型 README.md 中引用 arxiv.org/abs/2604.17091 以从此页面建立链接。
引用此论文的数据集 0
没有链接此论文的数据集
在数据集 README.md 中引用 arxiv.org/abs/2604.17091 以从此页面建立链接。
引用此论文的 Spaces 0
没有链接此论文的 Space
在 Space README.md 中引用 arxiv.org/abs/2604.17091 以从此页面建立链接。
包含此论文的合集 3
相似文章
Self-GC:面向长时域LLM智能体的自管理上下文
Self-GC 为长时域 LLM 智能体引入了一种自管理上下文系统,将智能体历史视为带有折叠、掩码和剪枝操作的索引对象,从而在减少令牌使用的同时保留未来依赖关系。
更少上下文,更智能代理:面向长周期工具使用的LLM代理的高效上下文工程
本文评估了企业工具使用工作流中LLM代理的上下文工程配置,表明选择性修剪的摘要化相比全上下文基线实现了91.6%的准确率,同时将令牌使用量减少了60%以上。
LLM Agents Factory: Retrieval of Domain-Specific LLM Agents
The paper presents LLM Agents Factory, a retrieval-based framework that constructs domain-specific LLM agents from a base of over 20K predefined agent profiles, offering a cost-efficient and controllable alternative to dynamic agent generation. Experiments show accuracy comparable to AutoGen with a 120B backbone at substantially lower inference cost.
更少的上下文,更高的准确性:一种用于LLM代理的双时态记忆引擎,其中精简检索的上下文胜过了完整历史
本文介绍了Engram,一个开源的用于LLM代理的双时态记忆引擎,它通过检索一个紧凑的上下文片段(约9.6k token),在LongMemEval上以混合读取路径融合稠密、词汇、图和时间信号,比完整历史基线(79k token)高出10.4个准确率点。
面向长周期任务的智能体兼容上下文管理
介绍AdaCoM,一种基于外部LLM的上下文管理器,适用于冻结的智能体。通过保留任务约束和修剪过时内容,利用强化学习提升长周期任务性能,并在网络搜索和深度研究基准上进行了实验。