MUSE-Autoskill:通过技能创建、记忆、管理和评估实现自我进化的智能体

Hugging Face Daily Papers 论文

摘要

MUSE-Autoskill提出了一个以技能为中心的智能体框架,使LLM智能体能够通过创建、记忆、管理、评估和优化的统一生命周期,持续创建、复用和精炼技能。在SkillsBench上的实验表明,生命周期管理的技能能够提升任务成功率、效率、复用率以及跨智能体迁移能力。

大型语言模型(LLM)智能体依赖可复用的技能来解决复杂任务。然而,现有的技能创建方法将技能视为孤立且静态的工件,限制了其复用性、可靠性和长期改进能力。我们提出了MUSE-Autoskill Agent (Memory-Utilizing Skill Evolution),一个以技能为中心的智能体框架,使智能体能够通过统一生命周期(创建、记忆、管理、评估和优化)来持续创建、复用和精炼技能,从而不断提升任务解决能力。我们的框架使智能体能够按需创建技能,跨任务存储和复用,高效组织和选择,并通过单元测试和运行时反馈进行评估以实现持续优化。我们还引入了技能级记忆,为每个技能跨任务积累经验,从而实现更有效的复用和随时间适应。在SkillsBench上的实验初步证明,生命周期管理的技能可以提升任务成功率、效率、复用率和跨智能体迁移能力,凸显了将技能视为长期持久、经验感知且可测试资产的重要性。
查看原文
查看缓存全文

缓存时间: 2026/05/27 02:47

论文页面 - MUSE-Autoskill: 通过技能创建、记忆、管理和评估实现自我演进的智能体

来源: https://huggingface.co/papers/2605.27366

摘要

以技能为核心的智能体框架通过技能创建、记忆、管理、评估和优化的统一生命周期,实现任务解决能力的持续提升。

大型语言模型(LLM)智能体依赖可复用的技能来解决复杂任务。然而,现有的技能创建 (https://huggingface.co/papers?q=skill%20creation) 方法将技能视为孤立且静态的工件,限制了其可复用性、可靠性和长期改进。我们提出 MUSE-Autoskill Agent(Memory-Utilizing Skill Evolution,利用记忆的技能演进),这是一个以技能为中心的智能体框架,让智能体能够通过创建、复用和优化技能,在统一的生命周期(创建、记忆、管理、评估和优化)下持续提升其任务解决能力 (https://huggingface.co/papers?q=task-solving%20capability)。我们的框架使智能体能够按需创建技能,跨任务存储和复用技能,高效组织与选择技能,并通过单元测试和运行时反馈来评估技能以实现持续优化。我们进一步引入了技能级记忆 (https://huggingface.co/papers?q=skill-level%20memory),为每个技能积累跨任务的经验,从而随时间实现更有效的复用和适应。在 SkillsBench (https://huggingface.co/papers?q=SkillsBench) 上的实验初步证明,生命周期管理的技能能够提升任务成功率、效率、复用率和跨智能体迁移 (https://huggingface.co/papers?q=cross-agent%20transfer) 能力,凸显了将技能视为长期存在、有经验感知且可测试资产的重要性。

查看 arXiv 页面 (https://arxiv.org/abs/2605.27366) 查看 PDF (https://arxiv.org/pdf/2605.27366) 添加到收藏 (https://huggingface.co/login?next=%2Fpapers%2F2605.27366)

在您的智能体中获取此论文:

hf papers read 2605\.27366

没有最新 CLI?curl \-LsSf https://hf\.co/cli/install\.sh \| bash

引用此论文的模型0

尚无模型链接此论文

在模型 README.md 中引用 arxiv.org/abs/2605.27366 即可从此页面链接。

引用此论文的数据集0

尚无数据集链接此论文

在数据集 README.md 中引用 arxiv.org/abs/2605.27366 即可从此页面链接。

Spaces 引用此论文0

尚无 Space 链接此论文

在 Space README.md 中引用 arxiv.org/abs/2605.27366 即可从此页面链接。

包含此论文的收藏0

尚无收藏包含此论文

将此论文添加到收藏 (https://huggingface.co/new-collection) 即可从此页面链接。

相似文章

Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents

arXiv cs.AI

This paper introduces SkillMisevo-Gym and SkillMisevo-Bench to study how self-improving LLM agents can evolve unsafe skills from compromised experience, plus SafeEvolve as a mitigation wrapper. Experiments across 25 agent-method configurations show skill misevolution is widespread and can persist across sessions, though SafeEvolve reduces fresh-session harm significantly.