ODEWorld:通过物理时间流的连续预测架构
摘要
本文介绍了 ODEWorld,一种使用物理时间流(PT-Flow)的连续时间潜在世界模型,该模型学习由常微分方程参数化的潜在速度场,能够实现任意时间分辨率、回溯预测,并改进视频生成和机器人控制的规划。
查看缓存全文
缓存时间: 2026/08/03 09:31
论文页面 - ODEWorld:基于 Physical-Time Flow 的连续预测架构
来源:https://huggingface.co/papers/2607.27924 发布于 7 月 30 日
·
提交者 https://huggingface.co/ldxxx
Dstate (https://huggingface.co/ldxxx) 于 8 月 3 日
摘要
在我们所处的物理世界中,空间和时间本质上是连续的。然而,现有的用于世界建模的机器学习范式大多局限于离散时间预测,因此在捕捉物理世界动态方面效率显著不足。我们提出了 Physical-Time Flow(PT-Flow),一种在物理时间内学习连续潜在速度场的新方法。关键在于,序列数据的底层动态由一个嵌入在结构良好的表征空间中的常微分方程(ODE)参数化。在该范式下,未来预测可以被重新表述为在压缩潜在空间中通过 ODE 求解器进行时间积分。基于 PT-Flow,我们构建了 ODEWorld,一个既高效又通用的连续时间潜在世界模型。通过提取时变特征,并在动态表征空间和潜在速度场上均施加 ODE 属性,ODEWorld 有效解决了潜在世界模型文献中长期存在的表征坍缩问题。这也使得即使经过长时程预测,仍能实现高质量的图像重建。此外,其连续特性允许任意的时间分辨率,甚至支持反向预测,而这对于大多数离散时间模型来说是不可能的。最后,ODEWorld 可以提供丰富的规划导向信息,以促进下游策略学习。综合实验表明,ODEWorld 成功调和了有利于规划的动态抽象与视觉真实感,在视频生成和机器人控制方面均表现出色。项目网站.
查看 arXiv 页面 (https://arxiv.org/abs/2607.27924) 查看 PDF (https://arxiv.org/pdf/2607.27924) 项目页面 (https://dstate.github.io/odeworld_website/) GitHub 11 (https://github.com/Dstate/ODEWorld) 添加到收藏 (https://huggingface.co/login?next=%2Fpapers%2F2607.27924)
让您的智能体获取这篇论文:
hf papers read 2607.27924
还没有最新的 CLI?curl -LsSf https://hf.co/cli/install.sh | bash
引用该论文的模型 0
尚无模型关联此论文
请在模型 README.md 中引用 arxiv.org/abs/2607.27924,即可从此页面链接到该模型。
引用该论文的数据集 0
尚无数据集关联此论文
请在数据集 README.md 中引用 arxiv.org/abs/2607.27924,即可从此页面链接到该数据集。
引用该论文的 Space 0
尚无 Space 关联此论文
请在 Space 的 README.md 中引用 arxiv.org/abs/2607.27924,即可从此页面链接到该 Space。
包含该论文的收藏集 0
尚无收藏集包含此论文
将此论文添加到收藏集 (https://huggingface.co/new-collection),即可从此页面链接到该论文。
相似文章
流经状态:用于强化学习的神经ODE正则化
本文提出了一种基于神经ODE的正则化方法,该方法强制强化学习智能体中的潜在嵌入遵循一致的ODE流,使表示学习与环境动态对齐,并在Atari和网格世界基准上取得了性能提升。
Modeling Unknown Nonlocal PDE Systems via Flow Map Learning
This paper presents a flow-map learning framework for modeling unknown nonlocal PDEs directly from solution data, avoiding explicit nonlocal operator evaluation. The method learns finite-time evolution operators in modal or nodal space and demonstrates accurate long-time prediction for fractional diffusion and wave equations.
Learning How the World Evolves: Extrapolative Video World Models via Latent Dynamics Reasoning
Introduces Latent Dynamics Reasoning (LDR), a video world model that integrates kinematic dynamics in a structured latent space, enabling extrapolation of learned dynamics far beyond training distributions while using far fewer parameters and running much faster than video diffusion baselines.
一种基于Latent ODE的电影心脏磁共振时空建模方法
本文提出了一种潜在动态模型,使用心率感知的神经ODE和基于图的网格自编码器,对电影心脏磁共振中的全周期心室运动进行建模。该模型应用于72,386名英国生物样本库参与者,在心衰风险预测方面优于传统心脏标志物。
VisualPatchWorld:作为规划潜在结构化表示的代码世界模型
VisualPatchWorld 提出了一种将世界动力学学习为代码的方法,能够从数据中构建可检查和可编辑的模拟器。在导航和操作任务中,它实现了强大的规划成功率。