心电图基础模型能否迁移至罕见心脏病?来自Brugada综合征检测的证据
摘要
本研究评估了九种心电图基础模型在Brugada综合征检测中的表现,发现预训练提供了优化稳定性,但未提供可迁移的临床知识,这对大规模预训练对罕见疾病有益这一假设提出了挑战。
arXiv:2607.03009v1 公告类型:新
摘要:背景:在大规模无标签生理数据上训练的基础模型(FMs)已成为医学人工智能的一种有前景的范式。它们为罕见疾病捕捉具有临床意义且可迁移的表征的能力在很大程度上尚未得到验证。本研究旨在探讨FM预训练是否能为罕见心电图(ECG)表型提供超越优化改进的真正临床泛化益处。方法:我们系统评估了九种公开可用的ECG FM在BrSwiss队列(294名患者,87例阳性)和独立外部HUCA队列(363名患者,76例阳性)上的Brugada综合征检测性能,采用三种策略(从头训练、线性探测、全微调)及多种配置,包括3%数据消融实验和零样本跨站点迁移。结果:对于无法从头收敛的高容量架构,预训练是必要的(AUC增益高达0.411,p < 0.05),但对于仅靠标签数据就已收敛的紧凑架构,并未带来显著增益。在完整BrSwiss数据上,最佳微调FM(ECG-CPC,AUC = 0.962)仅略微超过最强监督基线(从头训练的ECG-CPC,AUC = 0.932;p = 0.091)。在匹配训练集大小的情况下,BrSwiss-3%上的数据效率优势(AUC增益 = 0.055,p < 0.01)未能在HUCA上复现。在零样本跨站点迁移下,基于FM的流水线并未比监督基线泛化得更好,所有方法均接近随机水平。结论:对于Brugada综合征检测,FM预训练是机械性的而非语义性的,提供的是优化稳定性而非可迁移的临床知识。这些发现对大规模预训练本身就能编码具有临床意义的表征这一假设提出了挑战,凸显了模型架构和数据领域对齐的核心作用。
查看缓存全文
缓存时间: 2026/07/07 04:40
# Do ECG Foundation Models Transfer to Rare Cardiac Diseases? Evidence from Brugada Syndrome Detection 来源:https://arxiv.org/abs/2607.03009 查看 PDF(https://arxiv.org/pdf/2607.03009) > **摘要:** 背景:在大规模无标签生理数据上训练的基础模型已成为医学人工智能的一种有前景的范式。它们能否捕获具有临床意义、可迁移的罕见病表示,目前仍缺乏充分证据。本研究旨在探究基础模型预训练是否能带来超越优化改进的、针对罕见心电图表型的真正临床泛化优势。方法:我们在 BrSwiss 队列(294 名患者,87 例病例)和独立外部 HUCA 队列(363 名患者,76 例病例)上,系统评估了九种公开可用的心电图基础模型用于 Brugada 综合征检测的效果。评估采用三种策略(从头训练、线性探测、全微调),并在多种配置下进行,包括 3% 数据消融实验和零样本跨站点迁移。结果:对于无法从零开始训练收敛的高容量架构,预训练是必要的(AUC 提升高达 0.411,p < 0.05),但对于仅靠标记数据已能收敛的紧凑架构,预训练未带来显著增益。在完整的 BrSwiss 数据上,最佳微调基础模型(ECG-CPC,AUC = 0.962)仅略微超过最强监督基线(ECG-CPC 从头训练,AUC = 0.932;p = 0.091)。在匹配的训练集大小下,BrSwiss-3% 上的数据效率优势(AUC 增益 = 0.055,p < 0.01)未在 HUCA 上复现。在零样本跨站点迁移中,基于基础模型的方法并未比监督基线泛化得更好,所有方法均接近随机水平。结论:对于 Brugada 综合征检测,基础模型预训练是机械性的而非语义性的,提供的是优化稳定性而非可迁移的临床知识。这些发现挑战了“大规模预训练天然编码具有临床意义的表示”这一假设,凸显了模型架构与数据域对齐的核心作用。 ## 提交历史 来自:Beatrice Zanchi [查看邮件(https://arxiv.org/show-email/08a7435a/2607.03009)] **\[v1\]**2026 年 7 月 3 日,星期五,06:43:53 UTC(13,684 KB)
相似文章
ECG-InterpBench:使用匹配尺度稀疏自编码器对ECG基础模型可解释性进行基准测试
ECG-InterpBench 是一个新基准,利用匹配尺度稀疏自编码器系统评估 ECG 基础模型表示的可解释性,涵盖重建保真度、临床概念可访问性以及跨 450 个单元的可重复性。
CADENCE:一种用于从心电图基础模型中可解释性神经概念提取的心脏原子词典
CADENCE 使用稀疏自编码器将心电图基础模型表示分解为可解释的生理概念,显著改善了与临床表型和波形形态的一致性。
基于数十万份心电图训练的AI模型,更准确地预测心脏性猝死风险
加州大学伯克利分校的研究人员利用数十万份心电图训练了一个AI模型,该模型能够检测到一种此前未被识别的信号,相比现有方法更准确地预测心脏性猝死风险,每年有望挽救数千人的生命。
ECG与血管造影表征的跨模态对比学习用于重度狭窄分类
本文介绍了StenCE,一个预训练框架,利用ECG与X射线血管造影表征之间的跨模态对比学习,从ECG中检测重度冠状动脉狭窄,实现了高性能,并能够在无症状患者中实现早期诊断。
基于患者感知采样的电子健康记录基础模型预训练
提出了患者采样方法,这是一种用于电子健康记录基础模型的预训练序列构建方法,在MIMIC-IV数据集上相比标准全局流基线提升了下游任务性能,强调了序列构建在自回归健康模型中的重要性。