Chat2Scenic:一种基于迭代RAG的自动驾驶场景生成框架

Hugging Face Daily Papers 论文

摘要

Chat2Scenic是一种基于迭代RAG的框架,能够从法规描述中生成可执行的领域特定语言场景脚本,用于自动驾驶测试,实现了76.42%的编译成功率,优于现有方法。

验证自动驾驶系统需要多样化且符合法规的测试场景。在基于仿真的测试中,场景被定义为可执行脚本。然而,从法规描述中自动生成此类脚本仍然是一个开放性挑战,现有方法面临根本性的权衡。检索组装方法编译率尚可但缺乏可扩展性,而基于检索的全脚本生成则编译成功率较低。我们提出了Chat2Scenic,这是首个迭代检索增强框架,用于生成领域特定语言(DSL)的场景脚本。具体而言,Chat2Scenic提供了一个聊天机器人界面,支持交互式场景优化,并集成了检索增强生成(RAG),使场景生成基于法规知识和DSL语法。此外,我们提出了一个开放的场景生成基准,包含来自NHTSA、联合国车辆法规及其他来源的123个场景。与最先进的大型语言模型(LLM)进行的广泛评估表明,Chat2Scenic实现了76.42%的编译成功率(CSR)和58.17%的框架准确率(FA),优于现有方法(检索组装:CSR 30.08%,FA 11.03%;检索全脚本生成:CSR 16.26%,FA 10.86%)。为促进未来研究,我们在https://github.com/TUM-AVS/chat2scenic开源了代码。
查看原文
查看缓存全文

缓存时间: 2026/07/20 09:41

论文页面 - Chat2Scenic:一种基于迭代RAG的自动驾驶场景生成框架

来源:https://huggingface.co/papers/2607.14387

摘要

验证自动驾驶系统需要多样化、符合法规的测试场景。在基于仿真的测试中,场景被定义为可执行脚本。然而,从法规描述中自动生成此类脚本仍然是一个开放挑战,现有方法面临根本性的权衡。检索-组装方法能实现合理的编译率但缺乏可扩展性,而基于检索的全脚本生成则编译成功率较低。我们提出Chat2Scenic——首个用于生成领域特定语言(DSL)场景脚本的迭代检索增强框架。具体来说,Chat2Scenic提供聊天机器人界面,支持交互式场景精炼,并集成检索增强生成(RAG)将场景生成建立在法规知识和DSL语法之上。此外,我们提出一个开放的场景生成基准,包含来自各种法规(包括NHTSA、联合国车辆法规及其他来源)的123个场景。采用最先进的大语言模型进行广泛评估表明,Chat2Scenic实现了76.42%的编译成功率(CSR)和58.17%的框架准确率(FA),优于现有方法(检索组装:30.08% CSR,11.03% FA;检索全脚本生成:16.26% CSR,10.86% FA)。为促进未来研究,我们在https://github.com/TUM-AVS/chat2scenic上开源发布代码。

查看arXiv页面 (https://arxiv.org/abs/2607.14387)查看PDF (https://arxiv.org/pdf/2607.14387)项目页面 (https://anonymous-research-paper.github.io/Chat2Scenic/)GitHub (https://github.com/TUM-AVS/Chat2scenic)添加到收藏 (https://huggingface.co/login?next=%2Fpapers%2F2607.14387)

在您的代理中获取此论文:

hf papers read 2607.14387

没有最新CLI?curl -LsSf https://hf.co/cli/install.sh | bash

引用此论文的模型0

没有模型链接此论文

在模型README.md中引用arxiv.org/abs/2607.14387以从此页面链接。

引用此论文的数据集1

chat2scenic/Chat2Scenic 更新于3天前 • 63 • 1 (https://huggingface.co/datasets/chat2scenic/Chat2Scenic)

引用此论文的Space0

没有Space链接此论文

在Space README.md中引用arxiv.org/abs/2607.14387以从此页面链接。

包含此论文的集合2

相似文章