UniH3:统一层级同质性与异质性用于一体化医学图像恢复
摘要
UniH3 提出了一种统一框架,用于一体化医学图像恢复,通过利用层级同质性和异质性,在基准测试中实现了最先进的性能。
查看缓存全文
缓存时间: 2026/09/11 10:17
论文页面 - UniH³:统一层级同质性与异质性以实现全能医学图像恢复
来源:https://huggingface.co/papers/2609.11156
摘要
UniH³ 通过基于记忆的同质性先验和异质性平衡器,统一了层级同质性与异质性,实现了全能医学图像恢复。
全能医学图像恢复 (https://huggingface.co/papers?q=All-in-One%20medical%20image%20restoration) (MedIR (https://huggingface.co/papers?q=MedIR)) 旨在使用单个通用模型解决跨模态和退化类型的多样化任务。现有方法通常优先建模任务间异质性(例如,不同的数据分布和退化类型)。然而,它们很大程度上忽视了医学图像中固有的同质性,例如模态内和模态间广泛共享的解剖结构,这些可以被用来简化模型训练并提高泛化能力。为此,我们提出了 UniH³,一个新颖的框架,统一了层级同质性与异质性以实现全能医学图像恢复 (https://huggingface.co/papers?q=all-in-one%20medical%20image%20restoration)。具体来说,为了全面利用同质性,我们引入了一个层级同质性记忆 (https://huggingface.co/papers?q=Hierarchical%20Homogeneity%20Memory) (H²M (https://huggingface.co/papers?q=H²M)) 模块,该模块在训练期间从高质量图像中逐步蒸馏任务内和任务间的同质性先验,并自适应地检索最相关的先验以适配输入,用于引导恢复。然后,这些检索到的先验通过一个高效的同质性引导注意力 (https://huggingface.co/papers?q=Homogeneity-Guided%20Attention) (HGA (https://huggingface.co/papers?q=HGA)) 机制注入到恢复流程中。此外,为了全面解决异质性,我们设计了一个层级异质性平衡器 (https://huggingface.co/papers?q=Hierarchical%20Heterogeneity%20Balancer) (H²B (https://huggingface.co/papers?q=H²B)),用于缓解优化过程中的任务间和任务内冲突,促进平衡且有效的多任务学习。在两个大规模基准测试集 MedIR (https://huggingface.co/papers?q=MedIR)-2D-500K 和 MedIR (https://huggingface.co/papers?q=MedIR)-3D-3K 上的大量实验表明,UniH³ 在全能和单任务医学图像恢复方面均实现了最先进的性能。我们希望这项工作能建立一个强大的基准,并推动通用医学图像恢复模型的发展。代码可在 https://github.com/Yaziwel/UniH3 获取。
查看 arXiv 页面 (https://arxiv.org/abs/2609.11156) 查看 PDF (https://arxiv.org/pdf/2609.11156) 项目页面 (https://github.com/Yaziwel/UniH3) GitHub5 (https://github.com/Yaziwel/UniH3) 添加到收藏 (https://huggingface.co/login?next=%2Fpapers%2F2609.11156)
引用此论文的模型 0
没有模型链接此论文
在模型的 README.md 中引用 arxiv.org/abs/2609.11156 以从此页面链接它。
引用此论文的数据集 0
没有数据集链接此论文
在数据集的 README.md 中引用 arxiv.org/abs/2609.11156 以从此页面链接它。
引用此论文的 Space 0
没有 Space 链接此论文
在 Space 的 README.md 中引用 arxiv.org/abs/2609.11156 以从此页面链接它。
包含此论文的收藏 0
没有收藏包含此论文
将此论文添加到收藏 (https://huggingface.co/new-collection) 以从此页面链接它。
相似文章
UniPET:一种适用于不同剂量降低因子的高质量PET图像去噪通用网络
UniPET是一种用于PET图像去噪的通用网络,通过域泛化和区域感知学习处理变化的剂量降低因子,达到了最先进的性能。
Hulu-Med:面向全面医学视觉语言理解的透明通用模型
Hulu-Med 是一个透明的医学视觉语言模型,统一了对文本、2D/3D图像和视频的理解,在30个基准测试中取得了最先进的性能,并且完全开源。
UniCorn:通过自生成监督走向自我改进的统一多模态模型
UniCorn 是一个框架,通过使用多智能体系统进行提示生成、图像创建和质量评估,使统一多模态模型能够自我改进,在 TIIF、WISE 和 OneIG-EN 等文本到图像基准上取得了最先进的结果。
UniSpace:统一的视觉表示与可扩展的多模态建模
UniSpace引入了一种统一的视觉表示,通过使用重新参数化的ViT,在单一空间中统一了语义理解、高保真重建和图像生成,消除了对独立VAE的需求。
Hunyuan3D-Buffalo 1.0:面向可扩展3D生成、理解与编辑的统一多模态模型
Hunyuan3D-Buffalo 1.0 是一个用于3D生成、理解与编辑的统一多模态模型,基于87M规模的3D多模态语料库进行训练。它结合了Hunyuan3D-VLM和Hunyuan3D-DiT,在文本到3D生成和3D编辑基准上取得了最先进的性能。