MLLMs 在信息分布偏离协同头时产生幻觉
摘要
本文提出了HEAL,一种通过因果干预和反事实分析来分析和校准协同头中信息分布的方法,以减轻多模态大型语言模型中的幻觉。
查看缓存全文
缓存时间: 2026/09/21 07:20
论文页面 - 多模态大语言模型在协同注意力头信息分布偏移时产生幻觉
来源: https://huggingface.co/papers/2609.09206
摘要
多模态大语言模型(MLLMs)常受幻觉问题困扰,这阻碍了其在实际应用中的可靠性。现有的基于注意力机制的缓解方法主要依赖间接信号(例如注意力权重),这些信号无法准确反映幻觉产生背后真实的信息偏移。本文提出HEAL——一种面向注意力头级别的信息解耦与校准方法,用于识别和缓解幻觉。HEAL首先通过因果噪声干预多头输出,筛选出因果冗余的注意力头。随后,利用反事实双重差分法解耦剩余注意力头中的信息分布,将注意力头分为四类。分析发现:当信息分布在协同注意力头中偏离健康的平衡状态时就会产生幻觉,而与模态特定注意力头的数量或强度无强相关性。基于此发现,HEAL向协同注意力头的值向量注入动态信息校准因子,主动调控视觉-语言依赖关系,引导输出分布趋向事实依据。大量实验表明,HEAL能有效降低多种MLLM的幻觉,为增强模型可信度提供了一条简单且可解释的途径。
查看 arXiv 页面 (https://arxiv.org/abs/2609.09206)查看 PDF (https://arxiv.org/pdf/2609.09206)GitHub0 (https://github.com/mason-ching/HEAL)添加到收藏 (https://huggingface.co/login?next=%2Fpapers%2F2609.09206)
在你的智能体中获取此论文:
hf papers read 2609.09206
没有最新 CLI?curl -LsSf https://hf.co/cli/install.sh | bash
引用此论文的模型0
无模型链接此论文
在模型 README.md 中引用 arxiv.org/abs/2609.09206 以从本页面链接。
引用此论文的数据集0
无数据集链接此论文
在数据集 README.md 中引用 arxiv.org/abs/2609.09206 以从本页面链接。
引用此论文的 Space0
无 Space 链接此论文
在 Space README.md 中引用 arxiv.org/abs/2609.09206 以从本页面链接。
包含此论文的收藏0
无收藏包含此论文
将此论文添加到收藏 (https://huggingface.co/new-collection)以从本页面链接。
相似文章
HalluSAE:利用稀疏自编码器检测大型语言模型中的幻觉
北京航空航天大学等机构的研究人员提出了HalluSAE,这是一个结合稀疏自编码器与相变理论的框架。该框架通过将生成过程建模为穿越势能地形的轨迹,来检测大型语言模型(LLM)中的幻觉,并精准定位发生事实性错误的关键过渡区域。
LLMs中的幻觉:基于生命周期的成因、检测、缓解与预防综述
这篇综述论文提出了一种基于生命周期的框架,用于理解LLMs中的幻觉现象,涵盖数据、训练和推理阶段的成因、检测、缓解与预防。
检测LLMs中的幻觉:追踪受损上下文共享的拓扑特征
本文提出了一种通过分析注意力图中的拓扑特征来检测LLMs中幻觉的方法,在多个基准测试中显示出相对于现有基线的改进。
从架构到输出:大型语言模型中幻觉的结构根源及数据的放大作用
本文分析了大型语言模型中的幻觉,将其视为三个架构决策的结构性后果:自注意力的共现学习、最大似然估计训练目标以及自回归解码的左到右承诺。它将每种机制映射到特定的幻觉类型,并论证了数据集病态会放大但不会导致这些脆弱性。
注意力分散作为大型语言模型中幻觉的诊断信号
本文提出了一种基于注意力分散的无监督指标,用于检测大型语言模型中的幻觉,在使用Qwen2.5模型家族的数学推理基准测试中显示出显著的AUC提升。