Prompt 语宙Prompt 语宙
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
Search
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2024 Prompt 语宙. HalfPX. All Rights Reserved.
阅读: OpenEMMA – 德克萨斯联合多伦多等大学开源的端到端自动驾驶多模态模型
Share
登陆
通知 阅读更多
Font Resizer字体
Font Resizer字体
Prompt 语宙Prompt 语宙
Search
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
已有帐户? 登陆
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2023 Prompt 语宙. Paooo.com. All Rights Reserved.
Prompt 语宙 > AIGC 资讯 > OpenEMMA – 德克萨斯联合多伦多等大学开源的端到端自动驾驶多模态模型
AIGC 资讯

OpenEMMA – 德克萨斯联合多伦多等大学开源的端到端自动驾驶多模态模型

站外新闻
最近更新: 2026年6月9日 上午4:37
SHARE

OpenEMMA是什么

OpenEMMA是德州农工大学、密歇根大学和多伦多大学共同开源的端到端自动驾驶多模态模型框架,基于预训练的多模态大型语言模型(MLLMs)处理视觉数据和复杂驾驶场景的推理。框架基于链式思维推理过程,显著提高模型在轨迹规划和感知任务中的性能,同时集成专门优化的YOLO模型提高3D边界框预测的准确性。OpenEMMA提供了一个平台,促进更广泛的研究和开发,推动自动驾驶技术的进步。

阅读目录
  • OpenEMMA是什么
  • OpenEMMA的主要功能
  • OpenEMMA的技术原理
  • OpenEMMA的项目地址
  • OpenEMMA的应用场景

OpenEMMA

OpenEMMA的主要功能

  • 端到端轨迹规划:直接从传感器输入学习驾驶动作,实现从感知到决策的端到端优化,无需符号化接口。
  • 多模态数据处理:框架处理前向摄像头图像和文本历史 ego 车辆状态作为输入,将驾驶任务框架化为视觉问答(VQA)问题。
  • 链式思维推理:采用链式思维推理过程,指导模型生成关键对象的详细描述、行为洞察和元驾驶决策。
  • 3D对象检测:集成微调的YOLO模型,OpenEMMA能精确检测3D道路上的对象,提高对象检测的准确性。
  • 人类可读输出:基于MLLM的预存世界知识,OpenEMMA能为场景理解等感知任务产生可解释的、人类可读的输出。

OpenEMMA的技术原理

  • 预训练的MLLMs:基于预训练的MLLMs,处理复杂的视觉数据,推理驾驶场景。
  • 链式思维推理过程:基于链式思维推理,模型能生成速度向量和曲率向量,向量用在计算车辆的未来轨迹。
  • 速度和曲率向量:给定速度和曲率向量,模型首先整合每个时间步的航向角,然后计算速度的x和y分量,最终用积分速度分量计算最终轨迹。
  • 对象检测增强:为克服MLLMs在空间推理上的局限,集成一个专门优化用在3D边界框预测的YOLO模型。
  • 端到端规划与推理:OpenEMMA遵循基于指令的方法,提示MLLMs产生人类可解释的知识,将轨迹生成任务分解为人类可解释的组成部分,反映驾驶过程。

OpenEMMA的项目地址

  • GitHub仓库:https://github.com/taco-group/OpenEMMA
  • arXiv技术论文:https://arxiv.org/pdf/2412.15208

OpenEMMA的应用场景

  • 城市道路驾驶:在复杂的城市交通环境中,处理多变的交通信号、行人、自行车和其他车辆,为自动驾驶车辆提供实时决策和轨迹规划。
  • 高速公路驾驶:在高速公路上,处理高速行驶中的车辆,进行车道保持、超车、避障等操作的决策支持。
  • 停车和低速驾驶:在停车场或低速环境中,帮助自动驾驶车辆进行精确的停车操作,避免障碍物,能在狭小空间中导航。
  • 夜间驾驶:OpenEMMA能在低光照条件下工作,提供夜间驾驶时的决策支持,包括对象检测和轨迹规划。
  • 复杂天气条件:在雨、雾等复杂天气条件下,辅助自动驾驶车辆保持安全行驶,减少天气对驾驶的影响。
AdaCache – Meta推出加速AI视频实时高质量生成的开源项目
Baichuan-M1-preview – 百川智能推出的国内首个全场景深度思考模型
清华×腾讯混元夺MLSys2026 MoE推理挑战赛冠军,NPU推理提速4.1倍突破万亿参数瓶颈
Anthropic “Claude Mythos”模型泄露:代码能力飙升,安全威胁引发行业恐慌?
Avat3r – 慕尼黑大学联合 Meta 推出的 3D 高斯头像生成模型
分享
Email 复制链接 打印
Share
上一篇 Mobile-Agent – 阿里开源的自主多模态移动设备智能体
下一篇 Claude 3.7 Sonnet – Anthropic 推出的首款混合推理模型
发表评价

发表评价 取消回复

您的邮箱地址不会被公开。 必填项已用 * 标注

Please select a rating!

Ad image
- 入群领取知识星球折扣卷, 仅剩99份 -
Ad imageAd image

最近更新

全息流体渐变通用占位特色图
OpenAI 为数据中心争取社区支持:承诺不推高电费、用水量极低
AIGC 资讯
全息流体渐变通用占位特色图
一人薅羊毛致全县被电商拉黑:男子用AI生成烂果图骗取1. 6 万元水果”仅退款”获刑一年
AIGC 资讯
[AI生图咒语] 奢华故事板演示布局
产品与广告
[AI生图咒语] 极简黑白风婚礼邀请函
产品与广告

相关推荐

AIGC 资讯

Light-A-Video – 上海AI Lab联合交大等高校推出的视频重照明方法

站外新闻
AI 工具AIGC 资讯

CombatVLA:淘天集团推出3D游戏专用VLA模型,推理速度提升50倍,超越人类玩家

站外新闻
VLA模型 机器人控制 淘天集团 游戏AI 视觉语言动作模型
AIGC 资讯

AndroidLab – 清华和北大联合推出系统化评估Android智能代理的框架

站外新闻
AI 工具AIGC 资讯

谷歌重磅开源MedGemma 1.5:多模态AI医疗模型革新影像诊断与临床决策

站外新闻
MedGemma 临床决策 医学影像 多模态AI 谷歌
/ Prompt 语宙 /

Experience the limitless creative possibilities of generative AI and unlock new levels of innovation.

Quick Link

  • Remaker AI
  • BGRemaker 抠图Hot
  • AIGC 工具
  • Prompt 咒语生成器
  • 去水印工具

Support

  • Contact
  • Blog
  • Complaint
  • Advertise

标签

AIGC Midjourney prompt GPT Image 2 AI Agent 多模态大模型 EvoLink灵感 AI绘画 字节跳动 开源工具 开源模型 早报 具身智能 openai YouMind灵感 大语言模型 图像设计 开源大模型 阿里通义 强化学习 腾讯混元 Anthropic MoE架构 多模态AI 开源框架 AI智能体 教程 AI工具 扩散模型 AI视频生成
Prompt 语宙Prompt 语宙
Follow US
© 2009-2026 Prompt 语宙. Paooo.com. All Rights Reserved.