OpenLongTail:长尾驾驶数据的生成式扩展
摘要
OpenLongTail 是一个开源生成式数据引擎,能将异构的长尾驾驶数据转化为视角对齐的多视角资产,用于训练鲁棒的自动驾驶策略,提升闭环驾驶的鲁棒性。
查看缓存全文
缓存时间: 2026/07/21 06:35
论文页面 - OpenLongTail: 长尾驾驶数据的生成式扩展
来源:https://huggingface.co/papers/2607.09655 作者:
,
,
,
,
,
,
,
,
,
,
,
,
,
,
,
,
摘要
扩展鲁棒驾驶策略的根本瓶颈在于 curated 数据集中边缘案例的稀缺性。虽然真实世界持续捕捉着这些关键事件,但当从异构来源收集时,此类长尾事件仍未得到充分利用。具体而言,多样但宝贵的野外长尾视频缺乏训练策略模型所需的完整视角覆盖,通常缺少多视角位姿,或仅来自单目行车记录仪。这种模态差距阻碍了将这些普遍存在的观测转化为用于长尾泛化的可扩展训练数据。我们提出 OpenLongTail,这是一个开源生成式数据引擎,用于在长尾事件下扩展自动驾驶策略。为了将异构数据源转换为视角对齐且时序连贯的多视角资产,从而可用于策略学习,我们开发了一个基于位姿的外推式视图合成流水线,以生成缺失的视角。我们通过将 Plücker 射线几何注入可扩展的生成引擎,进一步增强新生成视角的跨视角一致性和时序对齐。通过合成异构长尾数据,我们观察到在应对长尾事件时,闭环驾驶鲁棒性得到了显著提升。通过测量外推视图合成与位姿指标,我们验证了 OpenLongTail 在视觉保真度、跨视角一致性以及自车轨迹恢复方面的有效性。
查看 arXiv 页面 (https://arxiv.org/abs/2607.09655) 查看 PDF (https://arxiv.org/pdf/2607.09655) 项目页面 (https://openlongtail.github.io/) GitHub (https://github.com/phai-lab/OpenLongTail) 添加至收藏 (https://huggingface.co/login?next=%2Fpapers%2F2607.09655)
在你的 agent 中获取这篇论文:
hf papers read 2607.09655
没有最新的 CLI?curl -LsSf https://hf.co/cli/install.sh | bash
引用此论文的模型 0
无模型关联此论文
请在模型 README.md 中引用 arxiv.org/abs/2607.09655 以在此页面中建立链接。
引用此论文的数据集 0
无数据集关联此论文
请在数据集 README.md 中引用 arxiv.org/abs/2607.09655 以在此页面中建立链接。
引用此论文的空间 0
无空间关联此论文
请在空间 README.md 中引用 arxiv.org/abs/2607.09655 以在此页面中建立链接。
包含此论文的收藏集 0
无收藏集包含此论文
请将这篇论文添加至一个收藏集 (https://huggingface.co/new-collection) 以在此页面中建立链接。
相似文章
DeepSeek LLM:以长期主义扩展开源语言模型
DeepSeek LLM是一个开源语言模型项目,它开发了一个大规模数据集,并采用SFT和DPO,在各种基准测试和开放式评估中实现了超越LLaMA-2 70B和GPT-3.5的性能。
OpenResearcher: 面向长周期深度研究轨迹合成的全开放流水线
OpenResearcher 提出了一种可复现的流水线,用于使用离线搜索环境和合成轨迹训练深度研究智能体,在 BrowseComp-Plus 等基准任务上实现了显著的准确率提升。
OctoLong:跨仓库代码上下文的中间训练增强长上下文建模
引入了OctoLong,一个用于整理依赖丰富的跨仓库代码上下文的上下文工程流水线,以及OctoLong-Instruct,一套基于该数据训练的长上下文开放语言模型。实验表明,用OctoLong数据替换12%的传统长上下文语料,在长距离检索、状态跟踪、仓库级代码理解和智能体任务上带来了显著提升。
GoLongRL:面向能力的长上下文强化学习与多任务对齐
GoLongRL 提出了一种开源方法,通过面向能力的数据构建和 TMN-Reweight 方法,实现具有多样化奖励优化的长上下文强化学习。
LongLive-RAG:一种通用的检索增强长视频生成框架
LongLive-RAG将长视频生成形式化为检索增强生成问题,利用先前生成潜变量的动态记忆来减少误差积累和身份漂移,在多种自回归骨干网络上提升了生成质量。