selection

标签

Cards List
#selection

MILES:用于自我提升大型语言模型推理的可学习选择模块化指令记忆

arXiv cs.CL · 2026-07-09 缓存

MILES是一个通过动态扩展逐步记忆并使用可学习选择头来提升LLM推理能力的框架,实现了更好的准确性-效率权衡。

0 人收藏 0 人点赞
#selection

当更多采样有害时:测试时缩放的模态上限与相关上限

arXiv cs.LG · 2026-06-30 缓存

本文识别了推理模型测试时缩放中的“模态上限”和“相关上限”,表明在数十个样本之后,额外采样不会提高选择准确性,甚至可能有害,突显了生成正确回答与识别正确回答之间的可识别性差距。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈