InfiniteDiffusion:桥接学习保真度与程序化实用性,用于开放世界地形生成
摘要
介绍 InfiniteDiffusion,一种无需训练的算法,使扩散模型能够生成无边界、种子一致的地形,并具有恒定时间的随机访问能力,弥合了学习保真度与程序化实用性之间的差距。Terrain Diffusion 框架展示了具有地球尺度动态范围的交互式速率真实地形生成。
<p><a href="https://lobste.rs/s/ncsslp/infinitediffusion_bridging_learned">评论</a></p>
查看缓存全文
缓存时间: 2026/07/12 20:53
# InfiniteDiffusion
来源:https://xandergos.github.io/terrain-diffusion/
地形扩散世界可视化
## InfiniteDiffusion:弥合学习逼真度与程序化实用性之间的鸿沟,实现开放世界地形生成
SIGGRAPH 2026
## 摘要
几十年来,程序化世界一直建立在诸如 Perlin 噪声等程序化噪声函数之上。这些函数快速且无限,但在真实感和大规模连贯性方面存在根本性局限。相反,扩散模型提供了前所未有的逼真度,但通常仍局限于有界画布。我们提出了 InfiniteDiffusion,这是一种无需训练的算法,它将扩散采样重构为惰性且无界的生成方式,从而弥合了扩散模型的逼真度与程序化噪声不可或缺的特性(无缝无限范围、种子一致性以及常数时间随机访问)之间的鸿沟。为了展示这种方法的实用性,我们提出了 Terrain Diffusion,这是一个用于学习驱动程序化地形生成的框架,具有类似程序化噪声的接口。我们的框架在消费级 GPU 上比轨道速度快 9 倍,能够以交互速率生成逼真的地形。我们集成了一个分层堆叠的扩散模型,以将行星尺度的上下文与局部细节耦合起来;一个紧凑的拉普拉斯编码,以在地球尺度动态范围内稳定输出;以及一个开源无限张量框架,用于对无界张量进行常量内存操作。这些组件共同将扩散模型定位为下一代无限虚拟世界的实用基础。
在此之前,内容生成面临一个根本性的**三难困境:无限范围、无状态生成和学习驱动的逼真度——三者只能选其二**。扩散模型实现了逼真度,但受限于有界范围。经典的程序化噪声是无限且无状态的,但无法学习。自回归外推允许学习驱动的无界生成,但需要共享的全局状态,这排除了确定性和随机访问。
**InfiniteDiffusion打破了这个三难困境**,它将任何扩散模型转化为一个无限、逻辑上无状态的数组,仅通过种子和坐标索引,支持 O(1) 随机访问、完全确定性和易并行计算。它在内部仅使用一个有界的 LRU 缓存作为性能优化,无需持久或外部状态。
InfiniteDiffusion 通过将 MultiDiffusion 推广到无限或大于内存的领域来实现这一目标,它作为一个即插即用的替代方案,将扩散过程重构为一种惰性计算:仅在请求时生成您所请求的区域。
下面的每张图片都对比了**MultiDiffusion**(上方)和**InfiniteDiffusion**(下方)。MultiDiffusion 在预定义、急切生成且有界的画布上运行,而 InfiniteDiffusion 没有此类限制。与 MultiDiffusion 相比,InfiniteDiffusion 几乎没有质量下降,同时提供了无限、无状态和惰性生成的优势。
### 与自回归对比
对于无界或惰性生成,唯一的竞争范式是自回归,但它存在根本性的局限性,InfiniteDiffusion 完全避免了这些局限性:
| 特性 | 自回归 | InfiniteDiffusion |
| :--- | :--- | :--- |
| 随机访问 | O(n) | O(1) |
| 确定性 | 否;顺序依赖 | 是;顺序无关 |
| 误差 | 累积误差 | 无累积 |
| 并行化 | 顺序执行 | 易并行计算 |
| 状态 | 全局有状态 | 功能性无状态 |
| 无需训练 | 否 | 是 |
## Terrain Diffusion
**Terrain Diffusion 是首个学习驱动的程序化地形生成器。** 我引入了一种技术,使扩散模型能够生成跨越巨大动态范围的输出,从马里亚纳海沟的 -10000 米到珠穆朗玛峰的近 9000 米,全部在一个世界中实现。但仅有垂直尺度还不够。通过利用级联的扩散模型,Terrain Diffusion **生成跨越数百公里真实世界的特征**,大陆面积达数百万平方公里。下面的每张 1024x1024 地形高程图宽度覆盖 100 公里。而且它**在消费级硬件上本地运行**。
**基于 InfiniteDiffusion,Terrain Diffusion继承了其所有特性:** 它在功能上是无状态的,可以轻松集成到任何游戏引擎中,几乎没有实际限制。为了证明这一点,它被作为一个开源 **Minecraft 模组**(https://github.com/xandergos/terrain-diffusion-mc)发布,无外部依赖。世界可以通过种子共享,玩家可以瞬间传送数百万英里,并且支持多人游戏。同时也在 Unity 中进行了演示,玩家能够在消费级硬件上以轨道速度的 3 倍舒适地飞越世界。
技术演示(Unity + Minecraft)
(电影级)模组展示由 AsianHalfSquat (https://www.youtube.com/@AsianHalfSquat) 提供
## BibTeX
```
@inproceedings{goslin2026infinitediffusion,
author = {Goslin, Alexander},
title = {InfiniteDiffusion: Bridging Learned Fidelity and Procedural Utility for Open-World Terrain Generation},
booktitle = {Special Interest Group on Computer Graphics and Interactive Techniques Conference Conference Papers},
year = {2026},
pages = {10 pages},
publisher = {ACM},
address = {New York, NY, USA},
doi = {10.1145/3799902.3811080},
url = {https://doi.org/10.1145/3799902.3811080},
series = {SIGGRAPH Conference Papers '26}
}
```
相似文章
地形扩散:一种基于扩散的Perlin噪声继任者,用于无限、实时地形生成
地形扩散引入了基于扩散的Perlin噪声继任者,采用新颖的InfiniteDiffusion算法,以常数时间随机访问生成逼真、无缝且无限的程序化世界。
物理信息生成的自增强扩散指导
本文提出一种自增强扩散指导方法,将物理定律融入扩散模型,减少与真实动态的偏差,并实现更快的生成。
DiffusionBench:迈向生成式扩散变换器的全面评估
介绍了DiffusionBench,这是一个统一的基准,用于全面评估生成式扩散变换器,支持多种生成任务,并提供标准化的训练与评估。
TILT:利用模型内在奖励提升扩散模型中的组合生成
TILT是一种无需训练的框架,通过使用模型内在奖励在测试时对齐采样轨迹,从而改善扩散模型中的组合生成,无需外部监督即可增强对复杂提示的忠实度。
城市系统轨迹生成的粗细结合多分辨率扩散模型
本文提出了一种名为MR-Traj的多分辨率扩散框架,用于城市系统的合成轨迹生成。该框架能够在多个分辨率上捕获复杂的时空依赖关系,并提升下游任务中细粒度移动性建模的性能。