标签
本文提出SIGMA,一个用于协作多智能体强化学习的层次化协作框架,通过基于密度的分组和聚合方法,利用协作结构在噪声观测下学习鲁棒表示。
OpenAI 和牛津大学研究人员提出了 LOLA(Learning with Opponent-Learning Awareness),这是一种强化学习方法,使智能体能够建模并考虑其他智能体的学习,在迭代囚徒困境和硬币游戏等多智能体博弈中发现合作策略。