goal-conditioned-learning

标签

Cards List
#goal-conditioned-learning

从连接性到奖励:基于有向状态图的密集奖励学习

arXiv cs.LG · 2026-09-11 缓存

本文介绍了G2QDR框架,该框架利用有向状态图为目标条件分层强化学习生成密集奖励,提升在稀疏奖励环境中的性能。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈