mode-averaging

Tag

Cards List
#mode-averaging

NFTR: From Provable Mode-Averaging to Geodesic Subgoal Selection in Offline Goal-Conditioned RL

arXiv cs.LG ↗ · 2026-07-10 Cached

This paper proposes NFTR, a method for offline goal-conditioned reinforcement learning that uses normalizing flows for subgoal policies and a triangle-slack reweighting to address optimistic bias and mode collapse in hierarchical implicit Q-learning.

0 favorites 0 likes
← Back to home

Submit Feedback