标签
本文提出SIGMA,一个用于协作多智能体强化学习的层次化协作框架,通过基于密度的分组和聚合方法,利用协作结构在噪声观测下学习鲁棒表示。
本文介绍了 EpicStar 框架,该框架利用情景记忆和动态检索帮助 LLM 代理在星际争霸 II 等长时程任务中保持战略连贯性,以显著更少的 token 实现更高的胜率。
介绍了一个名为Latent Maps of Performance的框架,用于在星际争霸II中生成反事实反馈,该框架使用在职业玩家对局回放上训练的引导变分自编码器,为业余玩家提供改进轨迹。