steering-probes

标签

Cards List
#steering-probes

一次通过:在冻结语言模型的单次前向传递中同时进行回答与拒绝

arXiv cs.CL · 2026-08-17 缓存

本文介绍了YOPO方法,该方法在冻结语言模型的单次前向传递中结合了引导探针和充分性方向,以提高推理准确性,并在信息不足时实现拒绝,展示了在各种基准和模型规模上的改进。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈