Prompt 语宙Prompt 语宙
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
Search
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2024 Prompt 语宙. HalfPX. All Rights Reserved.
阅读: LeviTor – 南大联合蚂蚁等机构开源的3D目标轨迹控制视频合成技术
Share
登陆
通知 阅读更多
Font Resizer字体
Font Resizer字体
Prompt 语宙Prompt 语宙
Search
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
已有帐户? 登陆
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2023 Prompt 语宙. Paooo.com. All Rights Reserved.
Prompt 语宙 > AIGC 资讯 > LeviTor – 南大联合蚂蚁等机构开源的3D目标轨迹控制视频合成技术
AIGC 资讯

LeviTor – 南大联合蚂蚁等机构开源的3D目标轨迹控制视频合成技术

站外新闻
最近更新: 2026年7月9日 上午5:48
SHARE

LeviTor是什么

LeviTor是南京大学、蚂蚁集团、浙江大学等机构推出的图像到视频合成技术,结合深度信息和K-means聚类点控制视频中3D物体的轨迹,无需显式的3D轨迹跟踪。LeviTor用高质量的视频对象分割数据集进行训练,有效捕捉复杂场景中的物体运动和交互,基于用户友好的推理流程简化3D轨迹输入,让视频生成技术更加先进和易用。LeviTor的引入为3D物体轨迹控制铺平道路,拓宽创意应用范围,适用于更广泛的用户群体。

阅读目录
  • LeviTor是什么
  • LeviTor的主要功能
  • LeviTor的技术原理
  • LeviTor的项目地址
  • LeviTor的应用场景

LeviTor

LeviTor的主要功能

  • 精确操控物体运动:在从静态图像生成视频时,精确控制物体的运动轨迹。
  • 增强创意应用:基于3D轨迹控制,拓宽视频合成的创意应用范围。
  • 简化用户输入:用户用简单的2D图像上的绘制和深度调整输入3D轨迹,降低技术门槛。
  • 自动提取深度信息和物体掩码:系统自动从图像中提取深度信息和物体掩码,减少用户操作。
  • 交互式轨迹绘制:用户交互式地绘制物体轨迹,系统将其解释为3D路径。

LeviTor的技术原理

  • K-means聚类:对视频对象掩码(mask)的像素进行K-means聚类,得到一组代表性的控制点。
  • 深度信息融合:深度估计网络DepthAnythingV2预测相对深度图,并在每个控制点采样深度,为控制点增添深度信息。
  • 控制信号构建:结合2D坐标和估计的深度值,构建控制轨迹,轨迹作为视频扩散模型的控制信号。
  • 视频扩散模型:将控制信号输入到视频扩散模型中,生成与3D轨迹对齐的视频。
  • 用户友好的推理流程:设计用户友好的交互系统,用户用点击和调整深度值输入3D轨迹。

LeviTor的项目地址

  • 项目官网:ppetrichor.github.io/levitor
  • GitHub仓库:https://github.com/qiuyu96/LeviTor
  • HuggingFace模型库:https://huggingface.co/hlwang06/LeviTor
  • arXiv技术论文:https://arxiv.org/pdf/2412.15214

LeviTor的应用场景

  • 电影特效制作:生成逼真的特效场景,减少实地拍摄成本,提高制作效率。
  • 游戏动画生成:在游戏开发中,创造动态的游戏背景和角色动画,增强游戏的沉浸感。
  • 虚拟现实体验:在VR应用中合成逼真的虚拟环境,为用户提供更加真实的沉浸式体验。
  • 增强现实展示:在AR领域将虚拟信息与现实世界无缝结合,用在教育、导航等场景。
  • 广告视频制作:制作动态广告视频,吸引观众注意力,提升品牌形象和产品吸引力。
VideoGameBunny – 专为视频游戏设计的开源多模态大模型
启元重症大模型 – 腾讯和迈瑞医疗联合推出的重症医疗大模型
谷歌CEO皮查伊罕见坦承:编程领域暂落后于竞品,AI搜索将稳健转型而非激进颠覆
SmolLM2 – Hugging Face推出的紧凑型大语言模型
OpenAI大整合:聊天、办公、编程三合一,全新ChatGPT桌面应用上线
分享
Email 复制链接 打印
Share
上一篇 LongWriter – 清华联合智谱AI推出的长文本生成模型
下一篇 PDF2Audio – 将PDF文档转换成音频博客的开源工具
发表评价

发表评价 取消回复

您的邮箱地址不会被公开。 必填项已用 * 标注

Please select a rating!

Ad image
- 入群领取知识星球折扣卷, 仅剩99份 -
Ad imageAd image

最近更新

FeyNoBg – Feyn Labs 开源的自动背景去除模型
AIGC 资讯
Qwen-Audio-3.0-ASR-Flash – 阿里千问推出的语音识别大模型
AIGC 资讯
全息流体渐变通用占位特色图
微软云端隐忧:千亿营收背后的增速换挡与杠杆风险
AIGC 资讯
全息流体渐变通用占位特色图
微信公众号推出 AI”一键排版”:自动分段、生成小标题、匹配配图三步到位
AIGC 资讯

相关推荐

AIGC 资讯

Seed-ASR – 字节跳动推出的AI语音识别模型

站外新闻
全息流体渐变通用占位特色图
AIGC 资讯

PixVerse 完成 4.39 亿美元 C 轮扩展融资 估值飙升至 20 亿美元

站外新闻
AIGC 资讯

LanceDB – 为AI应用设计的无服务器向量数据库,降低运维成本

站外新闻
AI 工具AIGC 资讯最新趋势

DeepScientist:西湖大学发布全自动AI科学家系统,实现科研流程全自动化

站外新闻
DeepScientist 全自动AI科学家 多智能体架构 西湖大学 贝叶斯优化
/ Prompt 语宙 /

Experience the limitless creative possibilities of generative AI and unlock new levels of innovation.

Quick Link

  • Remaker AI
  • BGRemaker 抠图Hot
  • AIGC 工具
  • Prompt 咒语生成器
  • 去水印工具

Support

  • Contact
  • Blog
  • Complaint
  • Advertise

标签

AIGC Midjourney prompt AI Agent GPT Image 2 多模态大模型 EvoLink灵感 AI绘画 字节跳动 开源工具 开源模型 早报 具身智能 openai 大语言模型 开源大模型 阿里通义 强化学习 腾讯混元 Anthropic MoE架构 多模态AI 开源框架 AI智能体 教程 AI工具 扩散模型 AI视频生成 chatgpt 大模型
Prompt 语宙Prompt 语宙
Follow US
© 2009-2026 Prompt 语宙. Paooo.com. All Rights Reserved.