BRDFusion: 物理与生成相结合的城市场景逆渲染
摘要
BRDFusion 将物理建模与生成先验相结合,实现了高质量的城市场景逆渲染和正向渲染,支持新颖视角重光照和动态物体插入等应用。
查看缓存全文
缓存时间: 2026/06/16 11:34
论文页 - BRDFusion:物理与生成融合的城市场景逆渲染
来源:https://huggingface.co/papers/2606.17049
摘要
BRDFusion 结合物理建模与生成先验,实现了城市场景的高质量逆渲染与正向渲染,具备精确控制和伪影减少能力。
从拍摄视频中逆渲染城市场景可实现众多应用,包括内容创作和自动驾驶仿真。基于物理的渲染方法遵循并控制光照物理特性,但存在重建和渲染伪影问题。生成模型能产生逼真的视频,但一致性和可控性有限。我们提出 BRDFusion,一个统一框架,将两种互补模型结合用于逆渲染和正向渲染。具体而言,BRDFusion 通过物理建模恢复显式一致的场景属性,并利用生成先验缓解优化歧义。在正向渲染过程中,物理模型提供基于场景配置的可控渲染,生成模型则进行去噪并修复伪影。因此,我们的方法能够生成高质量视频,同时允许精确控制,在真实和合成场景中均优于基线方法。此外,BRDFusion 支持新视角重光照、夜间模拟以及动态物体插入/编辑。项目页面:https://shigon255.github.io/brdfusion-page/
查看 arXiv 页面 (https://arxiv.org/abs/2606.17049) 查看 PDF (https://arxiv.org/pdf/2606.17049) 项目页面 (https://shigon255.github.io/brdfusion-page/) GitHub10 (https://github.com/shigon255/BRDFusion) 添加至收藏 (https://huggingface.co/login?next=%2Fpapers%2F2606.17049)
引用本文的模型1
Shigon/BRDFusion_checkpoints 更新于约8小时前 (https://huggingface.co/Shigon/BRDFusion_checkpoints)
引用本文的数据集2
Shigon/BRDFusion_data 查看器 • 更新于约8小时前 • 112k • 83 (https://huggingface.co/datasets/Shigon/BRDFusion_data)
Shigon/BRDFusion_videos 查看器 • 更新于约8小时前 • 495 • 24 (https://huggingface.co/datasets/Shigon/BRDFusion_videos)
引用本文的 Spaces0
没有关联此论文的 Space
在 Space 的 README.md 中引用 arxiv.org/abs/2606.17049 以从本页链接到它。
包含本文的收藏0
没有包含此论文的收藏
将此论文添加至一个收藏 (https://huggingface.co/new-collection) 以从本页链接到它。
相似文章
SynCity 3000: 自举场景级3D扩散
SynCity 3000 提出了一种框架,用于生成大规模、全局一致的3D场景,该框架通过将图像到3D生成器适配为卷积算子,并在来自新数据引擎的合成场景数据上进行微调来实现。
InfiniteDiffusion:桥接学习保真度与程序化实用性,用于开放世界地形生成
介绍 InfiniteDiffusion,一种无需训练的算法,使扩散模型能够生成无边界、种子一致的地形,并具有恒定时间的随机访问能力,弥合了学习保真度与程序化实用性之间的差距。Terrain Diffusion 框架展示了具有地球尺度动态范围的交互式速率真实地形生成。
GenRecon:结合生成先验的多视图3D场景重建
GenRecon提出了一种3D场景重建方法,将生成式3D先验与多视图图像条件相结合,实现了室内环境的高保真、可编辑网格重建,性能比现有方法提升16%。
从合成到去除:基于物理的反射模拟与基于扩散的视频去反射
本文提出了一个闭环框架,结合了基于物理的反射模拟、基于扩散的视频去反射模型(S2R-Removal)以及一个新的基准(S2R-Bench),实现了最先进的视频反射去除和快速推理。
PhysiFormer: 在世界空间中学习模拟力学
PhysiFormer 使用坐标空间扩散生成物理上合理的3D物体运动,无需显式归纳偏置,实现了高效的多物体推理以及对复杂材料和几何形状的泛化。