@apurvasgandhi: 子代理是一个有前景的推理时间缩放原语:• 扩展智能体的工作记忆• 分而治之解决难题• 通过并行执行更快地解决问题…
摘要
RAO(递归智能体优化)是一种端到端强化学习方法,用于训练大语言模型智能体生成、协调并委托给自身的递归副本(这些副本本身也可以生成其他智能体),将递归推理转化为可学习的能力。
子代理是一个有前景的推理时间缩放原语:• 扩展智能体的工作记忆• 分而治之解决难题• 通过并行执行更快地解决问题但是,我们如何训练模型以充分利用子代理,并确保获得这些收益?我们非常兴奋地发布 RAO:递归智能体优化。RAO 是一种端到端强化学习方法,用于训练大语言模型智能体生成、协调并委托给自身的递归副本(这些副本本身也可以生成其他智能体)—— 将递归推理转化为可学习的能力。1/10
相似文章
Prime Agent:一个自我改进的RLM智能体
Prime Intellect 推出 Prime Agent,这是一个完全开源、自我改进的编码工具(harness),围绕递归语言模型(RLM)和 Continual Harness 抽象构建,通过基于 REPL 的接口实现持久子智能体和动态工具。
递归多智能体系统
本文提出RecursiveMAS,一种将递归扩展原则应用于多智能体系统的框架,以提升协作推理的效率和准确性。与标准基线相比,该框架在多个基准测试中实现了显著的加速和token缩减。
@h100envy: 这篇论文彻底改变了我对智能体集群的看法:将智能体描述为图 -> 节点是操作…
一篇论文提出了一个框架,将LLM智能体表示为计算图,节点是操作,边是信息流,通过强化学习自动优化节点提示和边连接,将分散的智能体集群转变为单个可优化的图。
@ashpreetbedi:推出 Pro Agent Builders 系列。揭秘专家如何构建智能体。第一篇文章:自动化…
介绍 Pro Agent Builders 系列,聚焦递归自动改进(RAI)——编码智能体在夜间运行数百个探针,自动提升另一个智能体的性能。
@rseroter:"在本文中,我想带你回顾过去12个月里我观察到的子代理范式的演变过程…
在文章中,作者追溯了过去一年AI编程助手中子代理范式的演变,并介绍了'Swarm Coding'作为一种整合的代理技能,它将子代理管理委托给代理本身。