tail-likelihood

标签

Cards List
#tail-likelihood

Tail-Likelihood Reinforcement Learning

arXiv cs.LG ↗ · 2026-09-04 缓存

该论文提出了一种名为 Tail-Likelihood Reinforcement Learning (TailRL) 的优化方法,该方法专注于奖励分布的上尾部分,以改善生成任务中的策略性能,并在多种应用中进行了演示。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈