一致性存在可计算的盲点:视觉语言图表读取中无标签可靠性的交换理论
摘要
本文提出了一种用于视觉语言图表读取中无标签可靠性的交换理论,表明基于一致性的方法存在可计算的盲点,并引入了一种通过循环重标记增强的等变一致性评分。
查看缓存全文
缓存时间: 2026/08/07 07:51
# 一致性具有可计算的盲点:视觉-语言图表读取的无标签可靠性交换理论 来源:https://arxiv.org/abs/2608.05675 查看PDF(https://arxiv.org/pdf/2608.05675) > 摘要:视觉-语言模型的无标签可靠性依赖于不变性:扰动输入,忠实读者的答案不应改变。这有一个已知的盲点:系统性的误读能在扰动后存活,并被错误地认证为正确。我们证明这个盲点不仅是真实存在的,而且是可计算的:当且仅当误差与编辑可交换时,该误差对编辑不可见,因此测试套件无法触及的误差构成其联合中心化子——这一集合随编辑的增多而收缩,并且可以被明确写出而非猜测。我们转而利用互补关系——等变性:编辑图表数据后,正确答案必须按可计算量改变。两个匹配的编辑被证明对仿射读取误差是完备的;没有一组交换编辑对标签置换是完备的,而循环重标记填补了大部分差距。我们将理论实例化为等变性-一致性分数(Equivariance-Consistency Score),一种无标签、无需训练检测器,并发布REND-EQUIV,在相同数据上配对匹配的不变性与等变性集合。预测的排序在三个模型以及一个手工标注、避免了选择过程中的单一循环性的人群上成立;第二个基于不变性家族的方法确认该盲点属于关系本身,而非任何实现;循环重标记在匹配的真实样本上带来了预测的增益。同样的刻画解释了分类器蜕变测试文献中报道的该排序的逆向现象:可检测性是关系与故障类别的联合属性,绝不只是关系本身的属性。 ## 提交历史 来自:Rasul Khanbayov \[查看电子邮件](https://arxiv.org/show-email/0cfff27e/2608.05675)\] **\[v1\]** 2026年8月6日星期四 07:14:58 UTC(266 KB)
相似文章
视觉-语言模型中可靠性的所在:注意力、隐藏状态与因果电路的机制研究
本文通过证明注意力图的尖锐度并非视觉-语言模型正确性的良好预测指标,挑战了“注意力-置信度假设”。相反,研究表明,隐藏状态的几何特征和自一致性更能反映模型的可靠性,并揭示了晚期融合模型与早期融合模型在架构上的显著差异。
Vision-Language Models are Fragile Multilingual Associators
This paper introduces M2BIND, a benchmark to evaluate whether vision-language models maintain stable visual-linguistic associations across languages. It finds that binding is not language-invariant, with cross-family and cross-script settings causing significant performance collapse and weaker internal causal binding.
看不清还是想不对?面向视觉语言推理的感知奖励
本文提出一种强化学习框架,通过显式奖励感知保真度来改善视觉语言模型中的感知-推理协同,利用“蒙眼推理”代理和结构化言语验证来解决模态信用分配中的模糊性。
VLMs 是阅读还是改写?关于视觉语言模型转录忠实性的研究
本文揭示了视觉语言模型在面对错别字或视觉伪影等扰动时,往往会改写文本而非忠实转录,并引入了 FaithC4 基准来评估多种模型和语言中的这种行为。
小型视觉-语言模型知道自己错了但说不出来:一项关于在现实图像退化下陈述信心与内部信心的双模型研究
本文评估了小型开源视觉-语言模型(Qwen2-VL-2B和SmolVLM)如何处理现实图像退化,发现它们口头表达的信心不可靠,而内部令牌概率提供了更好的错误检测能力,尽管两者在严重低光条件下均失败。