迈向暗光环境下鲁棒且三维感知的RGB-NIR成像
摘要
本文提出了一种用于RGB-NIR低光成像的三维感知神经方法,该方法在三维空间中将极度含噪的RGB观测与NIR线索融合,无需干净RGB监督,并提高了跨不同噪声水平的鲁棒性。
查看缓存全文
缓存时间: 2026/08/03 09:31
论文页面 - 面向暗光下鲁棒且三维感知的RGB-NIR成像
来源:https://huggingface.co/papers/2607.29684
摘要
鲁棒的暗光成像对该领域来说仍然具有挑战性。近期研究探索了将近红外(NIR)与含噪RGB融合以实现更好的增强效果,但大多数方法依赖精心整理的训练数据对,在不同场景下的鲁棒性有限。本文通过引入三维感知的神经建模,为RGB-NIR暗光成像提供了新视角。在无需干净RGB监督的情况下,一个强大的模型可以被优化,在三维空间中隐式融合极度含噪的RGB观测与NIR线索,从而有效恢复干净的RGB图像。所提出的模型无需收集干净的RGB数据,并能泛化到不同的噪声水平。在合成数据和真实数据上的大量评估证明了其优越性。代码见:https://github.com/MyNiuuu/3DarkFusion
查看 arXiv 页面 (https://arxiv.org/abs/2607.29684)
查看 PDF (https://arxiv.org/pdf/2607.29684)
GitHub1 (https://github.com/MyNiuuu/3DarkFusion)
添加到收藏 (https://huggingface.co/login?next=%2Fpapers%2F2607.29684)
在您的 agent 中获取此论文:
hf papers read 2607\.29684
没有最新 CLI?curl \-LsSf https://hf\.co/cli/install\.sh \| bash
引用此论文的模型 0
没有模型链接此论文
在模型 README.md 中引用 arxiv.org/abs/2607.29684,即可从本页链接到该模型。
引用此论文的数据集 0
没有数据集链接此论文
在数据集 README.md 中引用 arxiv.org/abs/2607.29684,即可从本页链接到该数据集。
引用此论文的 Spaces 0
没有 Space 链接此论文
在 Space README.md 中引用 arxiv.org/abs/2607.29684,即可从本页链接到该 Space。
包含此论文的合集 0
没有包含此论文的合集
将此论文添加到合集 (https://huggingface.co/new-collection) 中,即可从本页链接到该合集。
相似文章
让RGB成为视觉的语言
本文介绍了RINO(RGB In and RGB Out),一个统一框架,将各种视觉信息(如掩码、深度图等)表示为RGB图像,并将视觉任务转换为RGB到RGB的图像编辑,从而让单一模型能够在任务间进行零样本迁移。
FusionSense: 三阶段近传感器学习实现运行时自适应多模态边缘智能
FusionSense提出了一种面向多模态边缘智能的三阶段近传感器学习框架,通过融合感知滤波同时降低计算与通信开销,在RGB-深度/激光雷达任务上实现高达33倍的能耗节省和显著的数据缩减收益。
RGBD20K:一个用于RGB-D语义分割的大规模基准
本文介绍了RGBD20K,这是一个用于RGB-D语义分割的大规模基准数据集,包含160个细粒度类别和20,000对图像,具有高质量注释和一种新颖的分数净化融合方法。
鲁棒对抗性输入
研究人员展示了对抗性图像,这些图像能够在多个尺度和视角下可靠地欺骗神经网络分类器,这对自动驾驶汽车所使用的多尺度图像捕捉系统的鲁棒性假设提出了挑战。
CamoNAS:面向增强伪装目标检测的神经架构搜索
介绍了CamoNAS,一种用于伪装目标检测的频率感知多分辨率神经架构搜索框架,在四个基准测试上取得了最先进的结果。