DriveDNA:大规模多模态自然驾驶数据集及驾驶风格识别基准

Hugging Face Daily Papers 论文

摘要

介绍 DriveDNA,这是一个包含来自 115 种车型的 465 名驾驶员的 4,121 次行程的大规模多模态自然驾驶数据集,以及通过小样本驾驶员重识别和个性化行为预测等任务进行驾驶风格识别的基准。

驾驶风格捕捉了车辆驾驶过程中稳定的、特定驾驶员的行为模式。然而,在自然驾驶数据中,这种信号很难被分离出来,因为驾驶员是在不同的车辆、不同的道路以及不同的条件下被观察到的,因此模型可能会将车辆或情境特定的规律误认为是驾驶员特定的风格。我们推出了 DriveDNA,这是一个大规模的自然驾驶数据集和个性化驾驶风格建模基准,包含来自 115 种车型的 465 名驾驶员的 4,121 次行程,总计 975 小时的人类驾驶控制数据(10 Hz 采样率),并配有前视视频,数据来自社区驾驶员在日常使用中的收集。DriveDNA 将驾驶风格定义为在相似条件下车辆运动的一致且特定于驾驶员的行为模式。该基准通过三个核心任务评估这一信号:小样本驾驶员重识别、个性化行为预测和条件匹配比较,并提供行为注释以及通过大规模人工审核生成的 276,248 个规则驱动的六类机动事件。我们在固定多随机种协议下评估了基线方法,包括经典描述符、有监督和自监督时间序列编码器、多模态融合、概率预测以及零样本基础模型。学习到的表示在未见过的驾驶员上显著优于经典描述符(AUROC .935 vs .707),并在匹配的驾驶条件下保留了驾驶员特定信息,而描述符性能接近随机。仅使用视频的模型实现了相当的重识别准确率,但表现出严重的路线泄漏,这表明强识别能力可能来自上下文捷径而非驾驶行为。这些发现表明,可靠的驾驶风格评估必须同时评估学习表示的行为价值以及它们对车辆、行程和条件混杂因素的鲁棒性。
查看原文
查看缓存全文

缓存时间: 2026/07/28 06:34

论文页面 - DriveDNA:一个用于驾驶风格识别的大规模多模态自然驾驶数据集与基准

来源: https://huggingface.co/papers/2607.23822 发表于 7月26日

·

提交者 https://huggingface.co/HenryYHW

Henry (https://huggingface.co/HenryYHW) 于7月28日

摘要

驾驶风格捕捉了车辆如何被驾驶中的稳定、驾驶员特有的模式。然而在自然数据中,由于驾驶员在不同车辆、不同道路以及不同条件下被观察,这一信号难以孤立,模型可能会将车辆或情境特定的规律误认为是驾驶员特有的风格。我们引入 DriveDNA,一个用于个性化驾驶风格建模的大规模自然数据集和基准,包含来自 465 名驾驶员在 115 种车辆模型上的 4,121 次驾驶,总计 975 小时的人类控制驾驶(10Hz 采样率,含前向视频),数据由社区驾驶员在日常使用中收集。DriveDNA 将驾驶风格定义为在相似条件下车辆运动的一致、驾驶员特有的行为模式。该基准通过三个核心任务评估这一信号:少样本驾驶员再识别、个性化行为预测以及条件匹配比较,并提供行为标注以及经大规模人工审核的 276,248 个规则生成的六类机动事件。我们在固定多随机种子协议下评估了涵盖经典描述符、有监督和自监督时序编码器、多模态融合、概率预测以及零样本基础模型的基线方法。学习到的表示在未见驾驶员上大幅优于经典描述符(AUROC .935 vs .707),并在匹配驾驶条件下保留了驾驶员特有信息,而描述符性能接近随机。纯视频模型取得了可比的再识别准确率,但存在严重的路线泄漏,表明强识别能力可能源于上下文捷径而非驾驶行为。这些发现表明,可靠的驾驶风格评估必须同时评估学习到的表示的行为价值及其对车辆、驾驶和条件混淆因素的鲁棒性。

查看 arXiv 页面 (https://arxiv.org/abs/2607.23822)查看 PDF (https://arxiv.org/pdf/2607.23822)GitHub0 (https://github.com/WangYuHang-cmd/DriveDNA)添加至收藏 (https://huggingface.co/login?next=%2Fpapers%2F2607.23822)

在您的 agent 中获取此论文:

hf papers read 2607.23822

没有最新的 CLI?curl -LsSf https://hf.co/cli/install.sh | bash

引用此论文的模型0

无模型关联此论文

在模型的 README.md 中引用 arxiv.org/abs/2607.23822 以从此页面链接它。

引用此论文的数据集1

HenryYHW/DriveDNA 更新于大约4小时前 • 19 (https://huggingface.co/datasets/HenryYHW/DriveDNA)

引用此论文的 Space0

无 Space 关联此论文

在 Space 的 README.md 中引用 arxiv.org/abs/2607.23822 以从此页面链接它。

包含此论文的收藏0

无收藏包含此论文

将此论文添加至收藏 (https://huggingface.co/new-collection) 以从此页面链接它。

相似文章

DF3DV-1K:大规模无干扰新视角合成数据集与基准

Hugging Face Daily Papers

介绍了DF3DV-1K,一个包含1048个场景和89924张图像的大规模真实世界数据集,用于无干扰的新视角合成,同时提供了九种方法的基准测试,以及通过微调基于扩散的2D增强器来改进辐射场方法的应用。

Fast-dDrive: 用于自动驾驶的高效块扩散VLM

arXiv cs.CL

Fast-dDrive是一种用于端到端自动驾驶的块扩散VLA模型,实现了最先进的轨迹精度,同时相比自回归基线提供了超过12倍的吞吐量加速,解决了高保真规划与边缘部署高效推理之间的权衡。