confidence-calibration

标签

Cards List
#confidence-calibration

置信度感知对齐让推理型大语言模型更加可靠

arXiv cs.AI · 2026-05-11 缓存

本文介绍了CASPO框架,该框架通过迭代直接偏好优化(DPO),将token级别的置信度与大型推理模型中的逐步逻辑正确性进行对齐。文章还提出了置信度感知思考(CaT),用于在推理过程中动态剪枝不确定的推理分支,以提高可靠性和效率。

0 人收藏 0 人点赞
#confidence-calibration

前沿大语言模型中的领域级元认知监控:一份33个模型图谱

arXiv cs.CL · 2026-05-11 缓存

本研究提出了一份涵盖33个模型的图谱,利用MMLU基准分析了前沿大语言模型中的领域级元认知监控,揭示了聚合指标所掩盖的不同知识领域中置信度校准的显著差异。

0 人收藏 0 人点赞
#confidence-calibration

首个Token已知:用于幻觉检测的单次解码置信度

Hugging Face Daily Papers · 2026-05-06 缓存

本文介绍了一种利用大语言模型生成首Token的置信度来检测幻觉的方法,该方法仅需执行单次解码步骤。

0 人收藏 0 人点赞
← Previous
← 返回首页

提交意见反馈