black-box-llms

标签

Cards List
#black-box-llms

从令牌到语义:利用互补信号在黑盒LLMs中检测幻觉

arXiv cs.CL · 2天前 缓存

本文提出通过结合语义熵和令牌级不确定性信号来检测黑盒LLMs中的幻觉的方法,评估了TopK、CoCoA、Gated和Stacked等技术在多个基准测试中的表现,发现没有单一方法普遍最强,但Stacked通常表现最佳。

0 人收藏 0 人点赞
#black-box-llms

通过逐步置信归因诊断黑盒大语言模型中的多步推理失败

arXiv cs.CL · 2026-05-20 缓存

提出逐步置信归因(SCA),一个无需内部访问即可为黑盒大语言模型的推理轨迹分配逐步置信度的框架,利用信息瓶颈原理区分合法变异性与错误。实验表明,SCA能可靠地识别低置信度步骤,并将自纠正成功率相比答案级别反馈提升高达13.5%。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈