deep-reinforcement-learning

标签

Cards List
#deep-reinforcement-learning

基于概率鲁棒性的可解释通用对抗性扰动针对基于深度强化学习的入侵检测系统

arXiv cs.LG ↗ · 2天前 缓存

论文提出PX-UAP方法,该方法结合概率鲁棒性与可解释人工智能,生成针对基于深度强化学习的入侵检测系统的通用对抗性扰动,并在实验中展示了攻击有效性的提升。

0 人收藏 0 人点赞
#deep-reinforcement-learning

一维装箱问题中物品兼容性图的深度强化学习

arXiv cs.LG ↗ · 2026-09-23 缓存

本文提出了一种用于一维装箱问题的基于图的深度强化学习框架,与现有方法相比减少了最优性差距,并实现了跨实例规模的零样本泛化。

0 人收藏 0 人点赞
#deep-reinforcement-learning

REFINEPPO: 通过迭代动作细化学习连续控制策略

arXiv cs.LG ↗ · 2026-09-21 缓存

RefinePPO 引入迭代动作细化以改进连续控制策略,在基准任务中达到与标准PPO相当或更优的性能,并且收敛更快。

0 人收藏 0 人点赞
#deep-reinforcement-learning

用于深度强化学习与模型预测控制之间共享控制权限的Composite-Gradient Learning

arXiv cs.LG ↗ · 2026-09-17 缓存

本文提出了一种复合梯度学习方法,该方法整合了深度强化学习和模型预测控制,用于自主系统中的共享控制权限,并在交通网络上进行评估,显示在强交互下有适度效益。

0 人收藏 0 人点赞
#deep-reinforcement-learning

基于Decision Transformer的无人机搭载RIS辅助动态D2D通信

arXiv cs.AI ↗ · 2026-09-11 缓存

本文提出了一种基于Decision Transformer的方法,用于优化无人机搭载RIS辅助的动态D2D通信,展示了跨场景泛化能力和高效的零样本迁移学习。

0 人收藏 0 人点赞
#deep-reinforcement-learning

数据中心能源优化的AI应用

arXiv cs.AI ↗ · 2026-09-04 缓存

本文系统回顾了用于数据中心能源优化的AI研究,识别了现有研究空白,并提出了CLEAR-DC框架——通过整合能源、碳排放与水资源指标来打通优化器-负载的闭环。

0 人收藏 0 人点赞
#deep-reinforcement-learning

网络拓扑和对手信息在塑造多智能体强化学习系统合作中的作用

arXiv cs.AI ↗ · 2026-09-01 缓存

本文探讨了网络拓扑和对手信息对多智能体强化学习系统中合作涌现的影响,特别是在重复囚徒困境(IPD)中,发现图结构和信息可用性对合作策略有显著影响。

0 人收藏 0 人点赞
#deep-reinforcement-learning

混合交通中基于强化学习的联网自动驾驶车辆车队汇入机动控制

arXiv cs.LG ↗ · 2026-08-28 缓存

本研究论文提出了一种使用深度强化学习的模拟框架,用于控制混合交通中联网自动驾驶车辆的车队汇入,表明PPO实现了高成功率,同时强调了安全与效率之间的权衡。

0 人收藏 0 人点赞
#deep-reinforcement-learning

带时间窗与容量约束的取货配送路径问题深度强化学习解决方案

arXiv cs.LG ↗ · 2026-08-17 缓存

本文提出了一种改进的JAMPR深度强化学习模型,用于求解带容量与时间窗约束的取货配送问题(CPDPTW)。该模型可为中小规模实例提供快速最优解,并为大规模实例提供次优解。

0 人收藏 0 人点赞
#deep-reinforcement-learning

驾驶、打包、飞行:带无人机的旅行小偷问题 (TTP-D)

Hugging Face Daily Papers ↗ · 2026-08-17 缓存

本文介绍了带无人机的旅行小偷问题 (TTP-D),该问题使用混合整数规划、元启发式算法和基于注意力的深度强化学习联合优化地面路径规划、无人机同步和物品选择。

0 人收藏 0 人点赞
#deep-reinforcement-learning

@Meer_AIIT: 感谢 Sergey Levine!Berkeley 的深度强化学习课程现在完全在 YouTube 上线了。这个周末或下一个周末抽出时间…

X AI KOLs Following ↗ · 2026-08-16 缓存

正如 Sergey Levine 所宣布的,Berkeley 的深度强化学习课程现已在 YouTube 上免费全面提供。

0 人收藏 0 人点赞
#deep-reinforcement-learning

@svlevine:最新的深度强化学习课程讲座现已上线!https://youtube.com/playlist?list=PLKq1TCpsv3Y4&si=Z1_akUN4J2yz4qU1… 更多…

X AI KOLs Timeline ↗ · 2026-08-15 缓存

UC伯克利的深度强化学习课程CS185/285的讲座现已在网上公开观看。

0 人收藏 0 人点赞
#deep-reinforcement-learning

基于近体学奖励建模的深度强化学习社交合规导航

arXiv cs.LG ↗ · 2026-08-14 缓存

本文提出了一种基于近体学的奖励公式,用于深度强化学习社交导航,将人类个人空间建模为高斯混合场,以提高社交合规性,同时保持导航效率。

0 人收藏 0 人点赞
#deep-reinforcement-learning

基于深度强化学习的车辆路径问题:工业卡车规划案例研究

arXiv cs.AI ↗ · 2026-08-10 缓存

本文提出了一种基于深度强化学习的车辆路径问题求解方法,并通过三个工业卡车规划案例进行了演示。与基线结果相比,该方法实现了超过10%的成本降低,并讨论了对更多VRP变体的泛化。

0 人收藏 0 人点赞
#deep-reinforcement-learning

PLAN:面向柔性作业车间调度高效表示学习的并行类液体近似网络

arXiv cs.LG ↗ · 2026-08-05 缓存

本文提出PLAN,一种轻量级并行类液体近似网络,用于柔性作业车间调度中的高效表示学习,与最先进的基线相比,以更少的参数实现了更优的完工时间和更低的推理延迟。

0 人收藏 0 人点赞
#deep-reinforcement-learning

深度强化学习中冻结随机CNN特征提取器的涌现稀疏性

arXiv cs.LG ↗ · 2026-07-30 缓存

本文报告发现:使用冻结的随机初始化CNN特征提取器的深度强化学习智能体,在没有任何稀疏性诱导目标的情况下,自发地产生极端稀疏的全连接表示,通过极少数神经元压缩任务相关信息。

0 人收藏 0 人点赞
#deep-reinforcement-learning

面向机器人学习的进度奖励建模:综合综述

arXiv cs.CL ↗ · 2026-07-27 缓存

本综述为机器人学习的进度奖励建模提供了统一视角,将领域组织为三个步骤:接口、方法和数据/基准。

0 人收藏 0 人点赞
#deep-reinforcement-learning

通过相对位置编码对距离进行编码以增强基于Transformer的路由

arXiv cs.AI ↗ · 2026-07-22 缓存

本文探讨了在Transformer架构中使用相对位置编码(RPE)作为加性偏置来解决团队定向问题,与原始Transformer架构相比,在收集奖励和最优性差距方面展示了一致的改进。

0 人收藏 0 人点赞
#deep-reinforcement-learning

深度强化学习掌握Baghchal的不对称策略

arXiv cs.AI ↗ · 2026-07-22 缓存

本文系统地探索了四种深度强化学习解决方案(DQN、REINFORCE、PPO和MuZero)用于尼泊尔不对称棋盘游戏Baghchal,发现MuZero由于通过蒙特卡洛树搜索进行基于模型的规划,获得了最佳胜率。

0 人收藏 0 人点赞
#deep-reinforcement-learning

多时间尺度隐式动作深度强化学习在边缘-云网络中的联合优化

arXiv cs.LG ↗ · 2026-07-22 缓存

提出了一种具有隐式动作空间的双时间尺度多层深度强化学习框架,用于分层边缘-云计算中的联合服务放置、计算委托和功率控制,实现高达20.8%的延迟降低和13%的资源利用率提升。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈