research-preprint

标签

Cards List
#research-preprint

固定评估器仍可能成为代理循环的目标

Reddit r/artificial ↗ · 2026-08-21

本文基于AQuA预印本,讨论了代理循环中的固定评估器如何仍可能被代理适应所针对,并对验证反馈的隔离性提出疑问。

0 人收藏 0 人点赞
#research-preprint

AHD Agent:用于自动启发式设计的代理强化学习

arXiv cs.AI ↗ · 2026-05-12 缓存

本文介绍了 AHD Agent,这是一个利用代理强化学习(Agentic Reinforcement Learning)的框架,使大型语言模型(LLMs)能够通过动态交互求解环境,自主地为组合优化问题设计启发式方法。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈