@thesupermanmx: 中国开源了一个模型,可从普通视频实时重建任意场景的3D模型。只需一个摄像头,无需LiDAR。…
摘要
中国开源了一个实时3D场景重建模型,无需LiDAR,仅需普通单摄像头视频,在单GPU上实现20 FPS,并在10,000+帧中保持稳定。
中国开源了一个模型,可以从普通视频实时重建任意场景的3D。一个摄像头,无需LiDAR。超过10,000帧不会崩溃。只需拿着摄像头走动,就能看到整个世界以20 FPS的速度重建为3D。
→ 在单GPU上运行速度约20 FPS
→ 在10,000+帧上保持稳定
→ 在基准测试中击败基于优化的方法
→ 可用于无人机航拍、行车记录视频、室内漫游
100%开源。
相似文章
@FinanceYF5: 国内开源了一个模型,随便拍段视频,就能实时重建出3D场景。 一个摄像头,不用LiDAR,1万多帧都不会崩,单卡就能跑到20fps。跑分比传统优化类方法更强,无人机航拍、行车记录、室内漫游都测过。 而且完全开源。
国内开源了一个模型,仅用单摄像头拍摄的视频即可实时重建3D场景,无需LiDAR,单卡运行达20fps,性能优于传统优化方法,并完全开源。
@IlirAliu_: 忘掉激光雷达吧。仅需一个摄像头。实时运行且开源:一个流式3D模型,实时重建场景…
LingBot-Map 是一个开源、实时流式3D重建模型,使用单个摄像头,通过前馈几何上下文转换器以约20 FPS运行,性能优于流式和离线方法。
@vincieye: 单目视频实时转3D?MAGiSt3R使用多个代理和合并模型(MAGMA)从……重建场景
MAGiSt3R是一个多代理前馈框架,能够以10 FPS的速度从单目RGB视频实现实时3D重建,使用合并模型(MAGMA)结合局部点地图和姿态图优化来减少漂移。
AnyRecon:基于视频扩散模型的任意视角 3D 重建
AnyRecon 提出了一种可扩展框架,利用具备持久场景记忆与几何感知条件的视频扩散模型,从任意稀疏输入进行 3D 重建。
@ModelScope2022: AMAP CV Lab 推出 ABot-Recon,可将长视频流实时转换为相机路径和3D点云。 https…
AMAP CV Lab 推出了 ABot-Recon,这是一个实时AI系统,可处理长视频流以生成3D点云和相机路径,具有稳定的性能,并在Apache 2.0许可下发布了开源代码。