whitebox-methods

标签

Cards List
#whitebox-methods

LLM置信度估计的不同方法基准测试

Reddit r/artificial · 6天前

本文对LLM置信度估计的各种黑盒与白盒方法进行了基准测试,包括口头化置信度、语言不确定性、推理长度、P(Answer)、P(True)和自我一致性,比较它们在主动学习和安全分类等任务中的有效性。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈