hierarchical-policies

Tag

Cards List
#hierarchical-policies

Learning Hierarchical Skill Policies with Offline Quality-Diversity Reinforcement Learning

arXiv cs.AI · 6d ago Cached

Introduces QDOS, a unified pipeline for offline-to-online reinforcement learning that uses advantage-weighted quality-diversity pretraining to extract diverse and high-value skills, significantly improving performance in manipulation and locomotion tasks.

0 favorites 0 likes
← Back to home

Submit Feedback