decoding-time-intervention

标签

Cards List
#decoding-time-intervention

通过Logit偏置实现语言模型的出奇简单的黑盒适配

arXiv cs.LG · 2026-07-28 缓存

本文提出了一种黑盒方法,通过学习一个上下文无关的logit偏置向量,在每个解码步骤中添加该向量,从而在不修改模型权重或需要梯度的情况下提升数学和推理任务的性能。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈