equilibrium-learning

标签

Cards List
#equilibrium-learning

自适应对手重复博弈中的遗憾最小化

Hugging Face Daily Papers ↗ · 2026-06-04 缓存

本文介绍了重复策略遗憾(RP-Regret),一种用于自适应对手重复博弈中遗憾最小化的博弈论度量,并提出了三种算法来最小化它,表明这样做可以导致如猎鹿博弈中的合作均衡。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈