prefix-gain

标签

Cards List
#prefix-gain

从正确性到效用:基于增益的LLM推理前缀评估

arXiv cs.CL · 2026-06-08 缓存

本文介绍了前缀效用模型(PUM),该模型基于前缀的效用(解题率的提升)而非局部正确性来评估LLM推理前缀。PUM在数学推理任务中的选择、搜索和强化学习方面表现出色。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈