dataset-bias

标签

Cards List
#dataset-bias

从架构到输出:大型语言模型中幻觉的结构根源及数据的放大作用

arXiv cs.AI · 2026-06-11 缓存

本文分析了大型语言模型中的幻觉,将其视为三个架构决策的结构性后果:自注意力的共现学习、最大似然估计训练目标以及自回归解码的左到右承诺。它将每种机制映射到特定的幻觉类型,并论证了数据集病态会放大但不会导致这些脆弱性。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈