reasoning-agent

标签

Cards List
#reasoning-agent

RACL:用于连续元启发式学习的推理智能体控制层

arXiv cs.AI · 2026-06-20 缓存

介绍了RACL,一种推理智能体控制层,通过学习从操作内存控制内部搜索行为来改进元启发式优化,在车辆路径测试中显示出成本改善。

0 人收藏 0 人点赞
#reasoning-agent

Critic-R: 使用指令调优检索器与自然语言内省反馈改进Agentic Search

Hugging Face Daily Papers · 2026-05-30 缓存

Critic-R引入了一个框架,使用评判模型在推理智能体和检索器之间提供内省反馈,在推理和训练时间同时提升智能体搜索性能,且无需重新训练智能体。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈