test-time-reward-alignment

标签

Cards List
#test-time-reward-alignment

TILT:利用模型内在奖励提升扩散模型中的组合生成

Hugging Face Daily Papers · 2026-05-16 缓存

TILT是一种无需训练的框架,通过使用模型内在奖励在测试时对齐采样轨迹,从而改善扩散模型中的组合生成,无需外部监督即可增强对复杂提示的忠实度。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈