balrog-benchmark

标签

Cards List
#balrog-benchmark

基于环境的LLM游戏智能体自动提示优化

arXiv cs.CL · 2026-06-17 缓存

介绍了一个针对LLM游戏智能体的自动提示优化框架,该框架将观察-行动流水线分解为两个智能体,并通过环境回报引导的进化循环迭代优化提示。在BabyAI任务上评估,显著提高了成功率(例如,在PutNext上从0%提升到72.5%),且无需更新模型权重。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈