@ModelScope2022: AMAP CV Lab 推出 ABot-Recon,可将长视频流实时转换为相机路径和3D点云。 https…
摘要
AMAP CV Lab 推出了 ABot-Recon,这是一个实时AI系统,可处理长视频流以生成3D点云和相机路径,具有稳定的性能,并在Apache 2.0许可下发布了开源代码。
查看缓存全文
缓存时间: 2026/08/28 05:45
高德地图CV实验室推出ABot-Recon,可将长视频流实时转化为相机轨迹与三维点云。 https://modelscope.ai/models/amap_cvlab/ABot-Recon…
在Oxford Spires测试集上实现4.35米平均轨迹误差与91.81%的F1分数,无需闭环检测。 官方测试中达到24.45 FPS,内存占用仅6.71 GiB。 仅处理最近12帧数据,确保视频时长增加时仍保持稳定的处理速度与内存占用。 支持最长22,000帧的视频流,可构建连续完整的三维重建结果。 已发布检查点、推理与评估代码。代码采用Apache 2.0协议;模型权重适用单独条款。
相似文章
@IlirAliu_: 忘掉激光雷达吧。仅需一个摄像头。实时运行且开源:一个流式3D模型,实时重建场景…
LingBot-Map 是一个开源、实时流式3D重建模型,使用单个摄像头,通过前馈几何上下文转换器以约20 FPS运行,性能优于流式和离线方法。
robbyant/lingbot-map
LingBot-Map 是一个前馈式 3D 基础模型,用于流式 3D 重建,采用几何上下文转换器架构,在超过 10,000 帧的长序列上实现最先进的性能,并具有高效的 ~20 FPS 推理速度。
SAM 3.1:通过多路复用和全局推理实现更快、更易用的实时视频检测与跟踪
Meta AI 发布了 SAM 3.1,这是 Segment Anything Model(分割一切模型)的一次更新,通过引入多路复用和全局推理能力,增强了实时视频检测与跟踪性能。
@skalskip92: 没有陷阱;SAM3是开源的,真的很棒,它在物体追踪方面表现出色,即便在……
SAM3(Segment Anything Model 3)是开源的,在物体追踪方面表现异常出色,即使在像篮球这样复杂的场景中也是如此,使其成为一款杰出的计算机视觉模型。
@thesupermanmx: 中国开源了一个模型,可从普通视频实时重建任意场景的3D模型。只需一个摄像头,无需LiDAR。…
中国开源了一个实时3D场景重建模型,无需LiDAR,仅需普通单摄像头视频,在单GPU上实现20 FPS,并在10,000+帧中保持稳定。