priors

标签

Cards List
#priors

理解语言模型为何产生幻觉:测试推理与先验知识之间的对抗

arXiv cs.CL · 2026-07-02 缓存

本文研究语言模型产生幻觉的原因,提出幻觉通常源于有偏的潜在推理(推理失配),而非知识缺失。它引入了TrapQA,一个受控的诊断测试平台,用于测试推理与先验知识之间的对抗,并证明幻觉可能源于误导性的潜在关联。

0 人收藏 0 人点赞
#priors

安全是情境性的,LLM评判者则不然:驾驭评估者的刚性先验

arXiv cs.AI · 2026-06-09 缓存

本文研究了用于安全评估的LLM-as-judge适应情境信息及不同安全定义的能力,发现它们基本是刚性的,当情境与其内部先验相矛盾时无法调整。

0 人收藏 0 人点赞
#priors

论大语言模型适应性的局限:模型内化先验对标注任务性能的影响

arXiv cs.CL · 2026-06-02 缓存

本文研究了LLM的内化先验如何影响零样本标注性能,发现近三分之二的错误抵抗基于提示的修正,并引入了定义特定熟悉度(DSF)作为比记忆化指标更好的预测因子。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈