展示:仅凭行车记录仪画面进行地理位置定位,无需GPS [P]
摘要
一个名为Third Eye的项目,无需GPS即可对行车记录仪视频进行视觉地理定位,通过基于街景图像索引的地点识别、轨迹拼接和几何验证,在地图上还原行驶路线。
分享一个我正在开发的项目,名为Third Eye。它能实现视觉地理定位:给定一段视频,仅凭图像内容就能确定拍摄地点,并在地图上绘制出行驶路线。流程简要:逐帧进行地点识别(基于街景图像索引)、轨迹搜索(将各帧拼接成连贯路径)、几何验证步骤(检测误匹配)、每帧置信度(弱帧被标记而非伪造)。我在真实的行车记录仪视频上运行了该项目,路线还原效果相当不错。跨域匹配本就极具挑战性,因此该项目在诚实表达不确定性方面做了大量工作。非常期待大家对匹配和轨迹方面的反馈。视频演示:https://youtu.be/U3sItFlvq6E?si=-KJrwb0gSlk-GxVH 该索引覆盖纽约市周边12平方公里的区域。
相似文章
面向序列观测的轨迹感知跨视角地理定位
提出了SeqGeo-VL数据集和TrajLoc框架,用于基于序列观测(视频片段或路径描述)的轨迹感知跨视角地理定位,在性能上显著优于现有方法。
Geo-Align: 基于度量几何奖励的视频生成对齐
Geo-Align 提出了一个用于相机可控视频重新渲染的强化学习框架,通过尺度感知的感知奖励和用于相机轨迹提取的度量三维估计来提高泛化能力。
CityRAG:基于空间锚定的视频生成,步入真实城市
CityRAG 提出一种视频生成模型,利用地理注册数据生成长时、物理一致、3D 连贯的真实城市视频,为机器人与自动驾驶提供可导航、可仿真的逼真环境。
detectly
将车队行车记录仪视频转化为驾驶员安全评分,一款实用的AI驱动型车队管理产品。
利用几何和CUDA编程对随机岛屿进行地理定位
一篇详细文章,介绍如何通过几何分析、CUDA编程和OpenStreetMap数据过滤,从照片中解决OSINT挑战来定位岛屿。