Prompt 语宙Prompt 语宙
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • 强化 AI 学习
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • 社区
Search
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2024 Prompt 语宙. HalfPX. All Rights Reserved.
阅读: Aether – 上海 AI Lab 开源的生成式世界模型
Share
登陆
通知 阅读更多
Font Resizer字体
Font Resizer字体
Prompt 语宙Prompt 语宙
Search
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • 强化 AI 学习
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • 社区
已有帐户? 登陆
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2023 Prompt 语宙. Paooo.com. All Rights Reserved.
Prompt 语宙 > AIGC 资讯 > Aether – 上海 AI Lab 开源的生成式世界模型
AIGC 资讯

Aether – 上海 AI Lab 开源的生成式世界模型

站外新闻
最近更新: 2026年6月8日 上午8:32
SHARE

Aether是什么

Aether 是上海AI Lab开源的生成式世界模型,完全基于合成数据训练。Aether 首次将三维时空建模与生成式建模深度融合,具备 4D 动态重建、动作条件视频预测和目标导向视觉规划三大核心能力。Aether 能感知环境、理解物体位置和运动关系,做出智能决策。Aether 在真实世界中展现出强大的零样本泛化能力,使用虚拟数据训练完成高效完成复杂任务,为具身智能系统提供强大的空间推理和决策支持。

阅读目录
  • Aether是什么
  • Aether的主要功能
  • Aether的技术原理
  • Aether的项目地址
  • Aether的应用场景

Aether

Aether的主要功能

  • 4D 动态重建:从视频中重建包含时间和空间的三维场景模型,捕捉动态变化。
  • 动作条件视频预测:根据初始观察和动作轨迹预测未来场景的变化。
  • 目标导向视觉规划:根据起始和目标场景生成合理路径,辅助智能系统规划行动路线。

Aether的技术原理

  • 统一多任务框架:将动态重建、视频预测和动作规划三项任务融合在一个统一的框架中进行优化。基于任务交错的特征学习,实现不同任务之间的协同优化,提升模型的稳定性和鲁棒性。
  • 几何感知建模:引入三维时空建模,构建几何空间提升模型的空间推理能力。用海量仿真 RGBD 数据(彩色图像和深度图),开发一套完整的数据清洗与动态重建流程,标注丰富的动作序列。
  • 相机轨迹作为动作表征:选择相机轨迹作为全局动作的表示方式。在导航任务中,相机轨迹直接对应导航路径;在机器人操作中,手柄相机的运动可以捕捉末端执行器的 6D 运动。
  • 扩散模型与多模态融合:基于预训练的视频扩散模型,用合成 4D 数据进行后训练。将深度视频转换为尺度不变的归一化视差表示,将相机轨迹编码为与扩散变换器(DiTs)时空框架对齐的尺度不变射线图序列表示。基于动态整合跨任务和跨模态的条件信号,Aether 实现多模态信息的融合和协同优化。
  • 零样本泛化能力:完全在虚拟数据上训练,实现对真实世界的零样本泛化。基于组合不同的条件输入(如观察帧、目标帧和动作轨迹),结合扩散过程,实现对多种任务的统一建模与生成。让模型在没有真实世界数据的情况下,迁移到真实场景中表现出色。

Aether的项目地址

  • 项目官网:https://aether-world.github.io/
  • GitHub仓库:https://github.com/OpenRobotLab/Aether
  • HuggingFace模型库:https://huggingface.co/AetherWorldModel/AetherV1
  • arXiv技术论文:https://arxiv.org/pdf/2503.18945
  • 在线体验Demo:https://huggingface.co/spaces/AmberHeart/AetherV1

Aether的应用场景

  • 机器人导航:帮助机器人规划路径,避开动态障碍。
  • 自动驾驶:实时重建道路场景,预测交通动态。
  • 虚拟现实:生成沉浸式虚拟场景,增强用户体验。
  • 工业机器人:优化机器人操作路径,提高生产效率。
  • 智能监控:分析监控视频,预测异常行为。
蚂蚁灵波LingBot-VA论文入选RSS2026:全球首个开源因果世界模型如何让机器人‘边想边做’?
OpenCLI 震撼发布:一键将网站变身命令行接口,AI Agent 自动化终极利器
小米OneVL开源:0.24秒延迟!具身智能团队发布SOTA级自动驾驶VLA世界模型
Claude Mythos攻克百年Erdős猜想:Anthropic多智能体范式对决OpenAI,AI纯数学推理进入新纪元
Gemini 3.5 Flash深度解析:Google发布速度提升4倍、成本减半的AI Agent新王者
分享
Email 复制链接 打印
Share
上一篇 Evolving Agents – 开源的AI Agent管理与进化框架
发表评价

发表评价 取消回复

您的邮箱地址不会被公开。 必填项已用 * 标注

Please select a rating!

Ad image
- 入群领取知识星球折扣卷, 仅剩99份 -
Ad imageAd image

最近更新

Evolving Agents – 开源的AI Agent管理与进化框架
AIGC 资讯
QLIP – 英伟达推出的视觉标记化方法
AIGC 资讯
TxGemma – 谷歌推出的通用医学治疗大模型
AIGC 资讯
ScholarCopilot – 滑铁卢与卡内基梅隆大学联合推出的AI学术写作助手
AIGC 资讯

相关推荐

AI 工具AIGC 资讯

微软发布MAI-Image-2-Efficient:轻量高效文生图模型,成本降低41%速度提升,专为企业级商业量产设计

站外新闻
AIGC MAI-Image-2 企业级AI 微软 文生图模型
量子芯片科技感占位特色图
AI 工具AIGC 资讯

OpenClaw 工程师紧急警告:AI 生成代码质量隐患与开发成本危机

站外新闻
AI生成代码 OpenClaw 初创公司 安全隐患 开发成本
AIGC 资讯

Webwright – 微软开源的终端原生网页智能体框架

站外新闻
AIGC 资讯

Odysseus – 开源的本地自托管 AI 工作空间

站外新闻
/ Prompt 语宙 /

Experience the limitless creative possibilities of generative AI and unlock new levels of innovation.

Quick Link

  • Remaker AI
  • BGRemaker 抠图Hot
  • AIGC 工具
  • Prompt 咒语生成器
  • 去水印工具

Support

  • Contact
  • Blog
  • Complaint
  • Advertise

标签

Agent AGI AI AI Agent AIGC AI商业化 AI大模型 AI安全 AI工具 AI搜索 AI智能体 AI生成内容 AI监管 AI绘画 AI编程 AI编程工具 AI编程智能体 AI芯片 AI视频 AI视频生成 AI设计 Anthropic chatgpt Claude Claude Code Claude Mythos Claude Opus 4.8 DeepSeek DuckDuckGo Gemini GPT-5.5 MCP协议 meta Midjourney MiniMax MoE MoE架构 NVIDIA openai OpenRouter Pika prompt SpaceX stable diffusion SWE-Bench xAI 世界模型 丛林 人工智能 人物 企业级AI 具身智能 命令行工具 图像生成模型 多模态 多模态大模型 大模型 大模型API 大模型应用 大语言模型 字节跳动 家居 小米 展台 建筑 开源 开源大模型 开源工具 开源框架 开源模型 强化学习 微软 教程 早报 智能体 智能体编程 智谱AI 月之暗面 本地AI 海报设计 生成式AI 科大讯飞 科幻 端侧AI 端侧大模型 网络安全 联想 腾讯混元 英伟达 苹果 视频生成模型 语音合成 谷歌 谷歌AI 赛博朋克 长上下文 阶跃星辰 阿里通义 阿里通义千问 风景
Prompt 语宙Prompt 语宙
Follow US
© 2009-2026 Prompt 语宙. Paooo.com. All Rights Reserved.