预测瓶颈无法发现因果结构(但它们实际上能做什么)
摘要
本文质疑了诸如 Mamba 等模型中的预测瓶颈能够恢复因果结构的说法,并通过一个新的基准测试证明,其性能提升主要归因于混杂因素和鲁棒性伪影,而非真正的因果发现。
查看缓存全文
缓存时间: 2026/05/13 04:13
论文页面 - 预测瓶颈无法发现因果结构(但它们实际上做了什么)
来源:https://huggingface.co/papers/2605.09169
本文证伪了“下一步预测瓶颈——尤其是 Mamba/SSM 的权重投影——能够恢复因果结构”的主张,指出其表现出的增益主要源于低秩回归、样本量混淆、干预语义伪影以及对目标破坏的鲁棒性,其主要持久贡献在于提供了一个可复用的证伪基准。
➡️ 他们针对“预测即因果发现”的证伪框架的关键亮点:
🧪 可复用的五阶段证伪基准:引入了一个以控制变量为核心的基准,涵盖 VAR、Lorenz-96、CauseMe 风格生成器、带有边溯源卡片(edge-provenance cards)的真实数据集、容量匹配的网络架构、大小匹配的观测对照,以及多种干预语义,用以严格测试“预测模型隐式恢复因果图”的主张。
🧩 权重投影因果性无法经受控制测试:测试了瓶颈预测器的提取规则(S = \|W_{out}W_{in}\|),结果显示线性瓶颈的表现与 Mamba SSM 相当甚至更优,在合成图恢复任务中经过调优的 Lasso 占据主导,而在干净的 Lorenz-96 真值上,经典的 PCMCI/Granger 类方法优于瓶颈模型。
🧠 干预增益是混淆因素,而非因果提取:表明所报告的干预优势主要来自额外的样本量以及非标准的每步随机强迫干预;在适当的 do(X_i=c) 干预下,该效应几乎消失,而剩余效应在经典的双变量 Granger 因果检验中甚至更为显著,这表明这是一种与方法无关的目标破坏鲁棒性,而非习得的因果发现能力。
相似文章
贝叶斯因果发现如何失败?潜在混杂下线性高斯网络中结构后果的刻画
本文分析了在潜在混杂下线性高斯网络中贝叶斯因果发现如何失败,推导出一个导致评分函数偏好虚假边的相关性阈值,并刻画了两种不同的后验失败模式。
基于因果效应约束的可解释因果发现
本文提出了一种用于条件因果发现的贝叶斯方法,其中因果图和参数的后验以用户指定的因果效应约束(例如,较大的因果效应)为条件。他们采用稀有事件估计技术来处理后验质量较小的事件,并在合成数据和Sachs蛋白质数据集上验证了该方法。
当预测误差不足时:评估因果估计中的干扰函数预测
本文评估了干扰函数的预测误差与因果估计器性能之间的关系,发现预测误差在诸如XGBoost和Double Machine Learning等方法中,并非因果偏差或置信区间覆盖范围的一致性度量。
From Prediction to Incrementality: Causal Optimization for Large-Scale Targeting and Recommendation
This paper presents a decision-centric causal optimization framework for large-scale targeting and recommendation, combining a causal Transformer, Bayesian bandit layer, and dual-based linear programming. It reports a statistically significant +7.20% lift in LinkedIn Feed marketing traffic via online A/B testing.
可观测模式并非解释:隐式推理模型的因果几何分析
本文分析了隐式推理模型(LRM),并论证隐状态中的可观测模式并非推理的因果解释;它倡导在可解释性研究中采用匹配对照和因果测试。