Causal Foundation Models

Hugging Face Daily Papers 论文

摘要

本文介绍了Causal Foundation Models,该模型利用预训练神经网络,通过上下文学习在不进行微调的情况下估计新数据集上的因果效应,为这一新兴领域提供了实用指南。

因果推断是从数据中估计处理或干预效果的实践。传统上,它需要为每个新问题定制一个流程:首先提出因果机制,选择一个兼容的估计器,最后进行训练。与此同时,在各种设置和模式下,机器学习已转向基础模型的范式:网络一次大规模预训练,无需微调即可应用于新任务。Causal Foundation Models (CFMs) 将这一范式引入因果推断。CFMs是预训练神经网络,使用上下文学习在全新数据集上估计因果量,如平均处理效应,无需模型更新。本文为这一新兴领域提供了实用介绍。在讨论CFMs之前,我们总结了因果推断和机器学习的必要背景。全文中,我们包含了示例代码和Jupyter notebooks。
查看原文
查看缓存全文

缓存时间: 2026/09/08 16:25

论文页面 - 因果基础模型

来源:https://huggingface.co/papers/2609.03003

摘要

因果基础模型应用预训练神经网络,通过上下文学习在新数据集上估计因果效应,无需微调。

因果推断(https://huggingface.co/papers?q=Causal%20inference)是从数据中估计处理或干预效果的实践。传统方法需要为每个新问题定制专属流程:首先提出因果机制,选择兼容的估计器,最后进行训练。与此同时,跨不同场景和模态,机器学习已大量转向基础模型范式:一次性大规模预训练网络,无需微调即可应用于新任务。因果基础模型(https://huggingface.co/papers?q=Causal%20foundation%20models)(CFMs)将这一范式引入因果推断(https://huggingface.co/papers?q=causal%20inference)。CFMs是预训练神经网络(https://huggingface.co/papers?q=pretrained%20neural%20networks),能利用上下文学习(https://huggingface.co/papers?q=in-context%20learning)在全新数据集上估计因果量(如平均处理效应(https://huggingface.co/papers?q=average%20treatment%20effect)),无需模型更新。本文为这一新兴领域提供实用入门介绍。在讨论CFMs之前,我们总结了因果推断(https://huggingface.co/papers?q=Causal%20inference)和机器学习的必要背景知识。全文包含示例代码和Jupyter笔记本。

查看arXiv页面(https://arxiv.org/abs/2609.03003)查看PDF(https://arxiv.org/pdf/2609.03003)GitHub仓库(https://github.com/layer6ai-labs/cfms)添加至收藏(https://huggingface.co/login?next=%2Fpapers%2F2609.03003)

在您的代理中获取此论文:

hf papers read 2609\.03003

没有最新CLI?请运行:curl \-LsSf https://hf\.co/cli/install\.sh \| bash

引用此论文的模型0

暂无模型链接此论文

在模型README.md中引用arxiv.org/abs/2609.03003即可从本页面链接。

引用此论文的数据集0

暂无数据集链接此论文

在数据集README.md中引用arxiv.org/abs/2609.03003即可从本页面链接。

引用此论文的Space0

暂无Space链接此论文

在Space README.md中引用arxiv.org/abs/2609.03003即可从本页面链接。

包含此论文的收藏0

暂无收藏包含此论文

将此论文添加至收藏(https://huggingface.co/new-collection)即可从本页面链接。

相似文章

因果基础模型

arXiv cs.LG

本文介绍了因果基础模型(CFMs),这是一种预训练的神经网络,能够使用上下文学习在新的数据集上估计因果量,而无需进行微调。

用于结构和结果预测的因果基础模型

arXiv cs.LG

TabPFN-CFM是一个因果基础模型,可从观测数据中预测因果结构和因果结果,支持Pearl因果层次的所有三个层级,并实现了优于基线的性能。

通用多模态基础模型

arXiv cs.LG

本文介绍了一种通用多模态基础模型,能够处理任意模态组合与预测任务,通过在具有多样化因果结构的大规模合成数据集上训练,实现了具有竞争力的性能。

迈向连续时间因果基础模型

arXiv cs.LG

提出了一个连续性准则,用于将离散时间因果先验数据拟合网络扩展到连续时间,利用随机微分方程(SDE)。引入了分类体系和细网格积分方法,在不规则观测时间表上优于朴素积分方法。

代理时代的因果发现

Hugging Face Daily Papers

本文认为,语言模型代理应通过提供上下文支持和解释来辅助因果发现工作流程,而非生成因果结论,并介绍了causal-learn+平台以演示这一原则。