self-reward

标签

Cards List
#self-reward

通过分阶段自奖励缓解多模态幻觉

Hugging Face Daily Papers · 2026-04-20 缓存

PSRD 框架通过分阶段自奖励解码和蒸馏轻量奖励模型,无需额外监督即可将 LVLM 的多模态幻觉降低一半。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈