展示:仅凭行车记录仪画面进行地理位置定位,无需GPS [P]

Reddit r/MachineLearning 工具

摘要

一个名为Third Eye的项目,无需GPS即可对行车记录仪视频进行视觉地理定位,通过基于街景图像索引的地点识别、轨迹拼接和几何验证,在地图上还原行驶路线。

分享一个我正在开发的项目,名为Third Eye。它能实现视觉地理定位:给定一段视频,仅凭图像内容就能确定拍摄地点,并在地图上绘制出行驶路线。流程简要:逐帧进行地点识别(基于街景图像索引)、轨迹搜索(将各帧拼接成连贯路径)、几何验证步骤(检测误匹配)、每帧置信度(弱帧被标记而非伪造)。我在真实的行车记录仪视频上运行了该项目,路线还原效果相当不错。跨域匹配本就极具挑战性,因此该项目在诚实表达不确定性方面做了大量工作。非常期待大家对匹配和轨迹方面的反馈。视频演示:https://youtu.be/U3sItFlvq6E?si=-KJrwb0gSlk-GxVH 该索引覆盖纽约市周边12平方公里的区域。
查看原文

相似文章

detectly

Product Hunt

将车队行车记录仪视频转化为驾驶员安全评分,一款实用的AI驱动型车队管理产品。