标签
来自 CMU、MIT、NYU 和斯坦福的研究团队开发了 Ataraxos,仅用 16 块 GPU 训练就在 Stratego 中以 15 比 1 战胜了史上最顶尖的 Stratego 选手,克服了这一游戏海量隐藏信息和长时序决策的难题——这些问题曾让 DeepMind 的 DeepNash 都束手无策。
来自MIT、卡内基梅隆大学、纽约大学和斯坦福大学的研究人员开发出一款AI,它以压倒性优势击败了顶级人类Stratego玩家,采用的高效训练方法比DeepMind等先前方案便宜得多。该系统发表于《自然》杂志,可推广到其他策略类游戏,有望辅助现实世界中不确定性下的决策,如商业谈判和网络安全。