d4rl

标签

Cards List
#d4rl

CODS: Iterative Bellman-Residual Data Selection for Reusable Offline Reinforcement Learning

arXiv cs.LG ↗ · 2026-08-11 缓存

Introduces CODS, an iterative critic-guided data selection method for offline reinforcement learning that retains task performance at low data budgets by selecting high-residual transitions over multiple rounds.

0 人收藏 0 人点赞
#d4rl

神经启发的逆学习用于规划与控制

arXiv cs.AI ↗ · 2026-05-26 缓存

本文介绍了一种名为Inverter的神经启发式框架,该框架利用逆学习(Inverse Learning, IL)实现快速高效的规划与控制,在D4RL基准测试和量子门合成上取得了显著改进,推理计算量降低了数个数量级。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈