skill-overfitting

标签

Cards List
#skill-overfitting

重新思考自我进化:一种受约束的探索-利用过程以缓解技能过拟合

arXiv cs.AI ↗ · 2026-07-31 缓存

本文提出SkillBoost,一种三阶段的受约束探索-利用框架,用于缓解LLM智能体自我进化中的技能过拟合。它在23个模型-基准配置上达到了最先进的性能,并证明了优化后的技能可以迁移到其他智能体。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈