DrivingDojo是什么?一文让你看懂DrivingDojo的技术原理、主要功能、应用场景

来源:卓商AI
发布时间:2025-04-05

DrivingDojo概述简介

DrivingDojo是中国科学院自动化研究所与美团无人车团队合作推出的数据集,用在训练和研究复杂的自动驾驶交互式世界模型。数据集包含18,000个视频片段,覆盖完整的驾驶操作、多智能体交互以及丰富的开放世界驾驶知识,为开发下一代自动驾驶模型提供了坚实的基础。DrivingDojo定义了动作指令跟随(AIF)基准,用在评估世界模型在执行动作控制的未来预测方面的能力。

DrivingDojo的功能特色

交互式世界模型训练:DrivingDojo提供一个平台,用在训练理解和模拟复杂驾驶动态的交互式世界模型。

动作指令跟随(AIF):数据集定义AIF基准,评估世界模型在遵循动作指令生成未来预测的能力。

多样化驾驶操作:基于DrivingDojo-Action子集,模型学习加速、减速、紧急制动和车道变换等多样化的驾驶操作。

多智能体交互:用DrivingDojo-Interplay子集,模型能理解和预测车辆与其他道路使用者之间的复杂交互。

开放世界知识:用DrivingDojo-Open子集,模型学习处理开放世界中的罕见事件和长尾场景。

视频生成与预测:模型基于初始帧和动作指令生成未来的视频,模拟和预测驾驶场景。

DrivingDojo的技术原理

数据收集:用美团无人车团队的自动驾驶车辆平台收集视频数据,。

数据策划:从大量收集的数据中精选出包含丰富驾驶操作、多智能体交互和开放世界知识的视频片段。

动作编码:将驾驶动作(如加速、制动、转向)编码为模型能理解的格式,方便在视频生成中使用。

视频生成模型:基于如Stable Video Diffusion等技术,开发从初始帧和动作指令生成视频的模型。

动作指令跟随(AIF):比较生成视频与输入动作指令的一致性,评估模型的预测准确性。

评估指标:用FID(Frechet Inception Distance)和FVD(Frechet Video Distance)等指标评估生成视频的视觉质量,用AIF错误评估动作指令的跟随能力。

DrivingDojo项目介绍

项目官网:drivingdojo.github.io

GitHub仓库:https://github.com/Robertwyq/Drivingdojo

HuggingFace模型库:https://huggingface.co/datasets/Yuqi1997/DrivingDojo

arXiv技术论文:https://arxiv.org/pdf/2410.10738

DrivingDojo能做什么?

自动驾驶算法开发:开发人员开发和测试自动驾驶车辆的感知、预测和决策算法。

世界模型训练:数据集用在训练模拟真实世界驾驶环境的交互式世界模型,模型能预测未来的状态和可能的事件。

多智能体交互模拟:模拟车辆与其他道路使用者(如行人、自行车、其他车辆)之间的交互,优化自动驾驶车辆的交互策略。

罕见事件和长尾场景处理:训练模型识别和响应罕见事件,如动物突然横穿道路或道路上的障碍物,提高自动驾驶系统的安全性。

虚拟测试和验证:在虚拟环境中测试自动驾驶系统,减少实车测试的成本和风险,加速开发流程。

© 版权声明:本站所有原创文章版权均归卓商AI工具集及原创作者所有,未经允许任何个人、媒体、网站不得转载或以其他方式抄袭本站任何文章。
卓商AI
卓商AI

AI爱好者的一站式人工智能AI工具箱,累计收录全球10,000⁺好用的AI工具软件和网站,方便您更便捷的探索前沿的AI技术。本站持续更新好的AI应用,力争做全球排名前三的AI网址导航网站,欢迎您成为我们的一员。

猜你喜欢
  • Mo 卡片
    Mo 卡片 卡片就是力量,一张卡片,一份知识!Mo 卡片通过轻松的卡片学习方式,掌握 AI 核心知识和实用技能,让你快速成长;每日更新 AI 实事卡片,足不出户了...
  • ToolBaz
    ToolBaz ToolBaz是一款免费的AI写作工具,可以帮助用户生成各种AI内容,包括故事、邮件、歌词、图片、语音等。它提供多种AI工具,能够快速生成与人类写作相...
  • zipchat
    zipchat Zipchat是专门为Shopify商人设计的AI动力聊天机器人。 Zipchat以Shopify徽标集成为特色,使商人可以快速有效地吸引客户,并提高...
  • Breyta
    Breyta Breyta 是一款专注于定性数据分析的 AI 工具,旨在帮助研究人员、UX 设计师和产品团队快速从大量定性数据中提取有价值的见解。其核心功能包括自动...
  • Vacation & Travel Chat (GPT)
    Vacation & Travel Chat (GPT) Vacay Chatbot是一款基于人工智能的聊天机器人,为用户提供个性化的旅行推荐和规划服务。它可以提供航班信息、酒店推荐、当地活动建议,甚至可以创...
  • open spoken ai
    open spoken ai 引入开放口语AI-未经审查的AI文本生成器,将内容创建提升到一个新的级别。凭借用户友好的体验,营销人员和作家可以制作有影响力的营销内容,引人入胜的故事...
  • 成语游戏大全
    成语游戏大全 成语游戏大全是一个集成了多种成语游戏的在线学习平台,旨在通过趣味互动的方式让学习成语变得简单有趣。平台提供了成语闯关、成语接龙、成语消消乐等多种游戏,...
  • kreadoai
    kreadoai Kreadoai是一个AI数字营销平台,可提供多功能和多功能的AI视频创建。它支持140多种多语言,100多个数字人类图像,并允许您快速创建高质量的数...