无人机集群通过自我对弈学习近战与远程战斗战术
摘要
本研究探索使用自我对弈强化学习,使无人机集群能够在无需人工干预的情况下自主开发近战和远程战斗战术。
暂无内容
相似文章
竞争性自我对弈
OpenAI 证明在模拟 3D 机器人环境中进行竞争性自我对弈,能够使 AI 智能体在没有明确指导的情况下发现复杂的物理行为,如铲球、躲闪和虚晃等,表明自我对弈将成为未来强大 AI 系统的基础。
小型AI模型使无人机能够自主识别并攻击战场目标
一家北约支持的初创公司Scaleout Systems正在使用小型AI模型和联邦学习,使无人机能够在战场环境中自主识别和攻击目标,并利用边缘计算实现实时更新。
逆向自触发控制:针对稀疏拒绝服务攻击的对抗强化学习
本文提出了一种对抗强化学习代理,该代理学习通过稀疏拒绝服务攻击来干扰自触发控制器,在诸如 Pendulum 和 Quadrotor2D 等控制系统上超越了基线方法。
@dair_ai: // 自对弈加上一点人类数据 // 结合人类演示和自对弈强化学习的超酷论文。30分钟…
一篇研究论文,将少量人类演示作为正则化目标与自对弈强化学习相结合,从而使用极少的人类数据(30分钟对比数千小时)并在单个消费级GPU上训练15小时,实现与人类兼容的驾驶策略。
ASGARD:基于强化学习的无人机动作空间防护
ASGARD提出了一种两阶段的教师-学生流程,利用强化学习来增强无人机对动作空间攻击的韧性,通过纠正命令确保任务完成,并具备对未见攻击的泛化能力。