self-evolution

标签

Cards List
#self-evolution

Google's SkillOS:面向自进化 AI 智能体(阅读需22分钟)

TLDR AI ↗ · 2026-05-11 缓存

Google Cloud AI Research 推出 SkillOS,这是一种强化学习框架,使基于 LLM 的智能体能够通过从过往经验中提炼可复用技能来实现自我进化。

0 人收藏 0 人点赞
#self-evolution

SEIF:用于指令遵循的自我演化强化学习

Hugging Face Daily Papers ↗ · 2026-05-08 缓存

本文介绍了 SEIF,这是一个自我演化的强化学习框架,通过迭代难度自适应以及教官和跟随者组件的协同训练,增强大语言模型(LLM)的指令遵循能力。

0 人收藏 0 人点赞
#self-evolution

FlashEvolve:通过异步阶段编排加速智能体自我进化

Hugging Face Daily Papers ↗ · 2026-05-08 缓存

FlashEvolve 是一个框架,它利用异步阶段编排和工件版本追踪来加速基于大语言模型(LLM)的智能体自我进化。与同步执行方法相比,它显著提高了吞吐量和 token 效率。

0 人收藏 0 人点赞
#self-evolution

@FinanceYF5: 智能体现在可以"做梦"了——Dreaming 功能回顾历史会话、提炼规律、持续自我优化。 配合多智能体并行编排和 Outcomes 质量评估,Claude 智能体正式进入自我进化阶段。

X AI KOLs Following ↗ · 2026-05-07 缓存

Claude智能体新增"Dreaming"功能,通过回顾历史会话与提炼规律实现自我优化,配合多智能体并行编排与质量评估,标志着AI智能体进入自我进化阶段。

0 人收藏 0 人点赞
#self-evolution

SafeHarbor:面向LLM代理安全的分层记忆增强护栏

Hugging Face Daily Papers ↗ · 2026-05-07 缓存

SafeHarbor是一个用于LLM代理安全的新型框架,它利用分层记忆和自进化机制来平衡安全性与实用性,在良性任务和恶意任务上均实现了最先进的性能。

0 人收藏 0 人点赞
#self-evolution

RemoteZero:实现零人工标注的地理空间推理

Hugging Face Daily Papers ↗ · 2026-05-06 缓存

RemoteZero 是一个框架,通过利用多模态大语言模型(MLLMs)的语义验证能力,消除了地理空间推理中对人工标注框监督的需求,从而实现了从未经标注的遥感数据中进行自我演进的定位能力。

0 人收藏 0 人点赞
#self-evolution

通过世界知识探索训练LLM智能体实现自发、无奖励的自我进化

Hugging Face Daily Papers ↗ · 2026-04-20 缓存

# 论文页面 - 通过世界知识探索训练LLM智能体实现自发、无奖励的自我进化 来源:[https://huggingface.co/papers/2604.18131](https://huggingface.co/papers/2604.18131) ## 摘要 具备内在元进化能力的智能体通过在没有外部监督的情况下自主生成的世界知识,在网页导航任务中展现出更优的性能。如今大多数智能体通过遵循人类定义的奖励和规则来``自我进化''。然而,

0 人收藏 0 人点赞
#self-evolution

MiniMaxAI/MiniMax-M2.7

Hugging Face Models Trending ↗ · 2026-04-09 缓存

MiniMaxAI发布了MiniMax-M2.7,这是一个开放权重模型,具备自我进化能力、先进的智能体团队支持,并在软件工程基准测试中表现出色(SWE-Pro上56.22%,MLE Bench Lite上66.6%奖牌率),在生产事故恢复和专业工作任务中有显著应用。

0 人收藏 0 人点赞
#self-evolution

EvoScientist:面向端到端科学发现的多智能体进化AI科学家

Papers with Code Trending ↗ · 2026-03-09 缓存

EvoScientist 是一个用于端到端科学发现的自适应多智能体框架,通过持久化记忆模块持续改进,由三个专业智能体组成,分别负责创意生成、实验执行和知识提炼。它在科学创意生成方面超越了7个当前最先进的系统,并通过多智能体进化提升了代码执行成功率。

0 人收藏 0 人点赞
← Previous
← 返回首页

提交意见反馈