无人机集群通过自我对弈学习近战与远程战斗战术

Reddit r/ArtificialInteligence 论文

摘要

本研究探索使用自我对弈强化学习,使无人机集群能够在无需人工干预的情况下自主开发近战和远程战斗战术。

暂无内容
查看原文

相似文章

竞争性自我对弈

OpenAI Blog

OpenAI 证明在模拟 3D 机器人环境中进行竞争性自我对弈,能够使 AI 智能体在没有明确指导的情况下发现复杂的物理行为,如铲球、躲闪和虚晃等,表明自我对弈将成为未来强大 AI 系统的基础。

OpenAI Five

OpenAI Blog

OpenAI Five 是一个强化学习智能体,通过自我对抗训练、课程学习和策略随机化来掌握 Dota 2,从随机行为逐步演进到执行复杂的人类级策略。

从单个演示中学习蒙特祖玛的复仇

OpenAI Blog

OpenAI 展示了一种通过单个人类演示来训练强化学习智能体玩蒙特祖玛的复仇的方法,通过课程学习和仔细的超参数调优来解决稀疏奖励的挑战。该方法在这款臭名昭著的 Atari 游戏上取得了强劲表现,但在其他游戏上的泛化能力有限。