Prompt 语宙Prompt 语宙
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
Search
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2024 Prompt 语宙. HalfPX. All Rights Reserved.
阅读: DrivingDojo – 中科院联合美团推出的交互式驾驶世界模型数据集
Share
登陆
通知 阅读更多
Font Resizer字体
Font Resizer字体
Prompt 语宙Prompt 语宙
Search
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
已有帐户? 登陆
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2023 Prompt 语宙. Paooo.com. All Rights Reserved.
Prompt 语宙 > AIGC 资讯 > DrivingDojo – 中科院联合美团推出的交互式驾驶世界模型数据集
AIGC 资讯

DrivingDojo – 中科院联合美团推出的交互式驾驶世界模型数据集

站外新闻
最近更新: 2026年7月10日 下午8:48
SHARE

DrivingDojo是什么

DrivingDojo是中国科学院自动化研究所与美团无人车团队合作推出的数据集,用在训练和研究复杂的自动驾驶交互式世界模型。数据集包含18,000个视频片段,覆盖完整的驾驶操作、多智能体交互以及丰富的开放世界驾驶知识,为开发下一代自动驾驶模型提供了坚实的基础。DrivingDojo定义了动作指令跟随(AIF)基准,用在评估世界模型在执行动作控制的未来预测方面的能力。

阅读目录
  • DrivingDojo是什么
  • DrivingDojo的主要功能
  • DrivingDojo的技术原理
  • DrivingDojo的项目地址
  • DrivingDojo的应用场景

DrivingDojo

DrivingDojo的主要功能

  • 交互式世界模型训练:DrivingDojo提供一个平台,用在训练理解和模拟复杂驾驶动态的交互式世界模型。
  • 动作指令跟随(AIF):数据集定义AIF基准,评估世界模型在遵循动作指令生成未来预测的能力。
  • 多样化驾驶操作:基于DrivingDojo-Action子集,模型学习加速、减速、紧急制动和车道变换等多样化的驾驶操作。
  • 多智能体交互:用DrivingDojo-Interplay子集,模型能理解和预测车辆与其他道路使用者之间的复杂交互。
  • 开放世界知识:用DrivingDojo-Open子集,模型学习处理开放世界中的罕见事件和长尾场景。
  • 视频生成与预测:模型基于初始帧和动作指令生成未来的视频,模拟和预测驾驶场景。

DrivingDojo的技术原理

  • 数据收集:用美团无人车团队的自动驾驶车辆平台收集视频数据,。
  • 数据策划:从大量收集的数据中精选出包含丰富驾驶操作、多智能体交互和开放世界知识的视频片段。
  • 动作编码:将驾驶动作(如加速、制动、转向)编码为模型能理解的格式,方便在视频生成中使用。
  • 视频生成模型:基于如Stable Video Diffusion等技术,开发从初始帧和动作指令生成视频的模型。
  • 动作指令跟随(AIF):比较生成视频与输入动作指令的一致性,评估模型的预测准确性。
  • 评估指标:用FID(Frechet Inception Distance)和FVD(Frechet Video Distance)等指标评估生成视频的视觉质量,用AIF错误评估动作指令的跟随能力。

DrivingDojo的项目地址

  • 项目官网:drivingdojo.github.io
  • GitHub仓库:https://github.com/Robertwyq/Drivingdojo
  • HuggingFace模型库:https://huggingface.co/datasets/Yuqi1997/DrivingDojo
  • arXiv技术论文:https://arxiv.org/pdf/2410.10738

DrivingDojo的应用场景

  • 自动驾驶算法开发:研究人员开发和测试自动驾驶车辆的感知、预测和决策算法。
  • 世界模型训练:数据集用在训练模拟真实世界驾驶环境的交互式世界模型,模型能预测未来的状态和可能的事件。
  • 多智能体交互模拟:模拟车辆与其他道路使用者(如行人、自行车、其他车辆)之间的交互,优化自动驾驶车辆的交互策略。
  • 罕见事件和长尾场景处理:训练模型识别和响应罕见事件,如动物突然横穿道路或道路上的障碍物,提高自动驾驶系统的安全性。
  • 虚拟测试和验证:在虚拟环境中测试自动驾驶系统,减少实车测试的成本和风险,加速开发流程。
快手OneRec:颠覆传统推荐!端到端生成式AI系统引爆观看时长与GMV
FacePoke – 开源的实时面部编辑工具,拖拽操作面部表情
AIMangaStudio:开源AI漫画生成工具全解析,从脚本到分镜的一站式创作指南
Karpathy 开源 autoresearch:单 GPU 实现 AI 自主科研,自动跑实验、调参、迭代,打造你的专属 AI 科学家
KuaiMod – 快手推出的自动化短视频质量判别框架
分享
Email 复制链接 打印
Share
上一篇 FineWeb 2 – Hugging Face推出的多语言预训练数据集
下一篇 EXAONE 3.5 – LG 推出的开源AI模型,擅长长文本处理降低模型幻觉问题
发表评价

发表评价 取消回复

您的邮箱地址不会被公开。 必填项已用 * 标注

Please select a rating!

Ad image
- 入群领取知识星球折扣卷, 仅剩99份 -
Ad imageAd image

最近更新

Stadium Crowd Sports Broadcast Portrait
AI 生图 Prompt
Minimalist Melancholic Cosmic Anime
AI 生图 Prompt
Avatar Character Pose Sheet
AI 生图 Prompt
Neon Temple Chase
AI 生图 Prompt

相关推荐

AIGC 资讯

FantasyID – 阿里联合北邮大学推出的身份保持视频生成框架

站外新闻
AI 工具AIGC 资讯

字节豆包推出首款全模态理解模型Doubao-Seed-2.0-lite:视频、图像、音频、文本原生统一,Agent能力全面升级

站外新闻
Doubao-Seed-2.0-lite 全模态理解模型 字节跳动 火山方舟 豆包
AI 工具AIGC 资讯

VLN-R1:港大联合上海AI Lab发布具身智能框架,用视觉语言模型实现3D连续导航

站外新闻
VLN-R1 具身智能 强化微调 港大上海AI Lab 视觉语言模型
AI 工具AIGC 资讯

小米开源MiMo-Audio:首个端到端语音大模型发布,性能超越GPT-4o与Gemini

站外新闻
AIGC 小米 开源AI 端到端模型 语音大模型
/ Prompt 语宙 /

Experience the limitless creative possibilities of generative AI and unlock new levels of innovation.

Quick Link

  • Remaker AI
  • BGRemaker 抠图Hot
  • AIGC 工具
  • Prompt 咒语生成器
  • 去水印工具

Support

  • Contact
  • Blog
  • Complaint
  • Advertise

标签

AIGC Midjourney GPT Image 2 prompt AI Agent 写实人像 多模态大模型 EvoLink灵感 AI绘画 字节跳动 开源工具 开源模型 早报 时尚大片 杂志排版 具身智能 产品设计 openai 商业海报 皮克斯风格 3D动画 色彩分析 AI生图 大语言模型 开源大模型 阿里通义 强化学习 腾讯混元 MoE架构 多模态AI
Prompt 语宙Prompt 语宙
Follow US
© 2009-2026 Prompt 语宙. Paooo.com. All Rights Reserved.