Prompt 语宙Prompt 语宙
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
Search
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2024 Prompt 语宙. HalfPX. All Rights Reserved.
阅读: LeviTor – 南大联合蚂蚁等机构开源的3D目标轨迹控制视频合成技术
Share
登陆
通知 阅读更多
Font Resizer字体
Font Resizer字体
Prompt 语宙Prompt 语宙
Search
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
已有帐户? 登陆
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2023 Prompt 语宙. Paooo.com. All Rights Reserved.
Prompt 语宙 > AIGC 资讯 > LeviTor – 南大联合蚂蚁等机构开源的3D目标轨迹控制视频合成技术
AIGC 资讯

LeviTor – 南大联合蚂蚁等机构开源的3D目标轨迹控制视频合成技术

站外新闻
最近更新: 2026年7月9日 上午5:48
SHARE

LeviTor是什么

LeviTor是南京大学、蚂蚁集团、浙江大学等机构推出的图像到视频合成技术,结合深度信息和K-means聚类点控制视频中3D物体的轨迹,无需显式的3D轨迹跟踪。LeviTor用高质量的视频对象分割数据集进行训练,有效捕捉复杂场景中的物体运动和交互,基于用户友好的推理流程简化3D轨迹输入,让视频生成技术更加先进和易用。LeviTor的引入为3D物体轨迹控制铺平道路,拓宽创意应用范围,适用于更广泛的用户群体。

阅读目录
  • LeviTor是什么
  • LeviTor的主要功能
  • LeviTor的技术原理
  • LeviTor的项目地址
  • LeviTor的应用场景

LeviTor

LeviTor的主要功能

  • 精确操控物体运动:在从静态图像生成视频时,精确控制物体的运动轨迹。
  • 增强创意应用:基于3D轨迹控制,拓宽视频合成的创意应用范围。
  • 简化用户输入:用户用简单的2D图像上的绘制和深度调整输入3D轨迹,降低技术门槛。
  • 自动提取深度信息和物体掩码:系统自动从图像中提取深度信息和物体掩码,减少用户操作。
  • 交互式轨迹绘制:用户交互式地绘制物体轨迹,系统将其解释为3D路径。

LeviTor的技术原理

  • K-means聚类:对视频对象掩码(mask)的像素进行K-means聚类,得到一组代表性的控制点。
  • 深度信息融合:深度估计网络DepthAnythingV2预测相对深度图,并在每个控制点采样深度,为控制点增添深度信息。
  • 控制信号构建:结合2D坐标和估计的深度值,构建控制轨迹,轨迹作为视频扩散模型的控制信号。
  • 视频扩散模型:将控制信号输入到视频扩散模型中,生成与3D轨迹对齐的视频。
  • 用户友好的推理流程:设计用户友好的交互系统,用户用点击和调整深度值输入3D轨迹。

LeviTor的项目地址

  • 项目官网:ppetrichor.github.io/levitor
  • GitHub仓库:https://github.com/qiuyu96/LeviTor
  • HuggingFace模型库:https://huggingface.co/hlwang06/LeviTor
  • arXiv技术论文:https://arxiv.org/pdf/2412.15214

LeviTor的应用场景

  • 电影特效制作:生成逼真的特效场景,减少实地拍摄成本,提高制作效率。
  • 游戏动画生成:在游戏开发中,创造动态的游戏背景和角色动画,增强游戏的沉浸感。
  • 虚拟现实体验:在VR应用中合成逼真的虚拟环境,为用户提供更加真实的沉浸式体验。
  • 增强现实展示:在AR领域将虚拟信息与现实世界无缝结合,用在教育、导航等场景。
  • 广告视频制作:制作动态广告视频,吸引观众注意力,提升品牌形象和产品吸引力。
Agent Development Kit – 谷歌开源的 AI Agent 开发与部署框架
ComfyUI-MochiEdit – 开源的AI视频编辑工具,支持视频转视频和局部编辑
Follow-Your-Canvas – 腾讯与清华合作推出的高分辨率视频扩展技术
RAG Logger – 专为检索增强生成应用设计的开源日志工具
SmoothCache – Roblox 和女王大学推出用于DiT的通用推理加速技术
分享
Email 复制链接 打印
Share
上一篇 LongWriter – 清华联合智谱AI推出的长文本生成模型
下一篇 PDF2Audio – 将PDF文档转换成音频博客的开源工具
发表评价

发表评价 取消回复

您的邮箱地址不会被公开。 必填项已用 * 标注

Please select a rating!

Ad image
- 入群领取知识星球折扣卷, 仅剩99份 -
Ad imageAd image

最近更新

1100 多名 AI 员工联名呼吁美国政府踩刹车,奥尔特曼罕见表态支持
AIGC 资讯
Fresh Burst Sprite Ad Poster
AI 生图 Prompt
Taco Supreme Extreme Poster
AI 生图 Prompt
Toy Figure Character Transformation
AI 生图 Prompt

相关推荐

AI 工具AIGC 资讯

美团开源LongCat-Video-Avatar 1.5:13.6B参数模型如何用单音频秒生成级数字人视频?

站外新闻
AIGC工具 数字人视频生成 美团LongCat 视频生成模型 音频驱动模型
AIGC 资讯

olly.bot – 个人AI助理,集成多种通用AI能力支持本地使用

站外新闻
AIGC 资讯

CSM – Sesame团队推出的语音对话模型

站外新闻
AI 工具AIGC 资讯

谷歌重磅开源A2UI:AI Agent 3秒生成原生界面,告别前端代码!开发者效率革命

站外新闻
A2UI AI Agent 前端开发 声明式UI 谷歌
/ Prompt 语宙 /

Experience the limitless creative possibilities of generative AI and unlock new levels of innovation.

Quick Link

  • Remaker AI
  • BGRemaker 抠图Hot
  • AIGC 工具
  • Prompt 咒语生成器
  • 去水印工具

Support

  • Contact
  • Blog
  • Complaint
  • Advertise

标签

AIGC Midjourney prompt AI Agent GPT Image 2 多模态大模型 EvoLink灵感 AI绘画 字节跳动 开源工具 开源模型 早报 具身智能 openai 大语言模型 开源大模型 阿里通义 强化学习 腾讯混元 写实人像 Anthropic MoE架构 多模态AI 开源框架 AI智能体 教程 AI工具 扩散模型 AI视频生成 chatgpt
Prompt 语宙Prompt 语宙
Follow US
© 2009-2026 Prompt 语宙. Paooo.com. All Rights Reserved.