@Teknium: 听起来有点像Hermes的自我改进
摘要
Google的一篇论文讨论了将技能进化系统分离为组件,如原始执行轨迹和为AI代理持久化的知识维基,涉及自我改进概念。
听起来有点像Hermes的自我改进 👀
查看缓存全文
缓存时间: 2026/08/31 02:27
听起来有点像赫尔墨斯的自我改进 👀
DAIR.AI (@dair_ai): 谷歌这篇重磅论文。
如果你为智能体维护了一个技能库,或许该看看这篇。
(建议收藏)
这项研究将技能进化系统通常混为一谈的三个要素明确区分:原始执行轨迹、持续积累的知识库
相似文章
@omarsar0: Google关于通过持久化知识维护智能体技能的一篇优秀论文。
一篇Google论文讨论了通过在类似维基的结构中分离原始执行痕迹与持久化知识来维护智能体技能。
@dair_ai: // MetaSkill-Evolve // 关于自我改进代理的优秀论文。大多数自我改进代理重写代理所做的并……
MetaSkill-Evolve 引入了一个递归的双时间尺度框架,用于LLM代理,使其能够同时进化任务技能和改进过程本身,在OfficeQA、SealQA和ALFWorld基准测试上取得了显著的准确性提升。
@HuggingPapers: 现代智能体系统中的自我改进——一项涵盖239篇论文的调研,关于AI智能体如何通过更新模型…
一项涵盖239篇论文的调研,分析AI智能体如何通过更新模型本身或框架(提示、记忆、工具)来自我提升。
@qinzytech: https://x.com/qinzytech/status/2066585405479371092
对构建自我进化AI代理的两种方法的技术分析:基于模型的方法(通过像SSMs或具有快速权重更新的transformer等架构,以及训练方法)和基于工具的方法(通过内存或能够自我重写的元工具)。作者为不同受众提供了实用建议。
@AlphaSignalAI: https://x.com/AlphaSignalAI/status/2069064122218717387
本文探讨了AI代理如何利用微软研究院的SkillOpt等技术自动编写和优化其技能文件,该技术将技能文档视为可训练状态,并带来显著的性能提升。文章还解决了手动技能调优的挑战,并介绍了GEPA和EvoSkill等进化方法的框架。