Prompt 语宙Prompt 语宙
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
Search
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2024 Prompt 语宙. HalfPX. All Rights Reserved.
阅读: GEN3C – NVIDIA 联合多伦多大学等推出的生成式视频模型
Share
登陆
通知 阅读更多
Font Resizer字体
Font Resizer字体
Prompt 语宙Prompt 语宙
Search
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
已有帐户? 登陆
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2023 Prompt 语宙. Paooo.com. All Rights Reserved.
Prompt 语宙 > AIGC 资讯 > GEN3C – NVIDIA 联合多伦多大学等推出的生成式视频模型
AIGC 资讯

GEN3C – NVIDIA 联合多伦多大学等推出的生成式视频模型

站外新闻
最近更新: 2026年6月8日 下午11:30
SHARE

GEN3C是什么

GEN3C 是NVIDIA、多伦多大学和向量研究所推出的新型生成式视频模型,基于精确的相机控制和时空一致性生成高质量的 3D 视频内容。GEN3C构建基于点云的 3D 缓存指导视频生成,用输入图像或视频帧的深度估计反投影生成 3D 场景,根据用户提供的相机轨迹渲染 2D 视频,作为生成模型的条件输入。GEN3C 的核心优势在于精确控制相机运动,避免传统方法中因缺乏显式 3D 建模导致的不一致性问题。GEN3C支持从单视角到多视角的视频生成,适用于静态和动态场景,在稀疏视图的新型视图合成任务中取得了最先进的结果。GEN3C 支持 3D 编辑和复杂相机运动(如推拉镜头)的生成,为视频创作和模拟提供了强大的工具。

阅读目录
  • GEN3C是什么
  • GEN3C的主要功能
  • GEN3C的技术原理
  • GEN3C的项目地址
  • GEN3C的应用场景

GEN3C

GEN3C的主要功能

  • 精确的相机控制:根据用户指定的相机轨迹生成视频,支持复杂的相机运动(如推拉镜头、旋转镜头等),保持视频的时空一致性。
  • 3D 一致性视频生成:支持生成具有真实感和一致性的视频,避免物体突然出现或消失等问题。
  • 多视角和稀疏视角的新型视图合成:支持从单视角、稀疏多视角到密集多视角的输入,生成高质量的新型视图视频。
  • 3D 编辑和场景操作:用户修改 3D 点云(如删除或添加物体)编辑场景,生成相应的视频。
  • 长视频生成:支持生成长视频,同时保持时空一致性。

GEN3C的技术原理

  • 构建 3D 缓存:输入图像或视频帧的深度估计反投影生成 3D 点云,形成时空一致的 3D 缓存。缓存作为视频生成的基础,提供场景的显式 3D 结构。
  • 渲染 3D 缓存:根据用户提供的相机轨迹,将 3D 缓存渲染成 2D 视频。
  • 视频生成:用预训练的视频扩散模型(如 Stable Video Diffusion 或 Cosmos),将渲染的 3D 缓存作为条件输入,生成高质量的视频。模型基于优化扩散过程中的去噪目标,修复渲染中的瑕疵填补缺失信息。
  • 多视角融合:当输入包含多个视角时,GEN3C 基于最大池化的融合策略,将不同视角的信息聚合到视频生成模型中,生成一致的视频。
  • 自回归生成和缓存更新:对于长视频生成,GEN3C 将视频分为多个重叠的块,逐块生成,更新 3D 缓存保持视频的时空一致性。

GEN3C的项目地址

  • 项目官网:https://research.nvidia.com/labs/toronto-ai/GEN3C/
  • GitHub仓库:https://github.com/nv-tlabs/GEN3C
  • arXiv技术论文:https://arxiv.org/pdf/2503.03751

GEN3C的应用场景

  • 单视角视频生成:从一张图片生成动态视频,适用于快速内容创作。
  • 新型视图合成:从少量视角生成新视角视频,用在VR/AR和3D重建。
  • 驾驶模拟:生成驾驶场景的不同视角视频,助力自动驾驶训练。
  • 动态视频重渲染:为已有视频生成新视角,用在视频编辑和二次创作。
  • 3D场景编辑:修改场景内容后生成新视频,助力影视制作和游戏开发。
CogView-4 – 智谱AI推出的文本到图像生成模型
VQAScore – CMU联合Meta推出的文本到视觉图像生成评估方法
抖音×港中文发布SAIL-Embedding:全模态嵌入模型革新多模态检索与推荐系统
SynCamMaster – 快手联合浙大、清华等机构推出的多视角视频生成模型
AI抓虫革命!Anthropic Project Glasswing首月战报:1万+高危漏洞被揪出,效率暴增10倍
分享
Email 复制链接 打印
Share
上一篇 InfiniteYou – 字节跳动开源的身份保持图像生成框架
下一篇 HealthGPT – 浙大联合阿里等机构推出的医学视觉语言模型
发表评价

发表评价 取消回复

您的邮箱地址不会被公开。 必填项已用 * 标注

Please select a rating!

Ad image
- 入群领取知识星球折扣卷, 仅剩99份 -
Ad imageAd image

最近更新

GPT‑5.3 Instant – OpenAI 推出的轻量级对话模型
AIGC 资讯
GPT‑5.4 – OpenAI推出面向专业工作的旗舰AI模型
AIGC 资讯
Ming‑Flash‑Omni 2.0 – 蚂蚁开源的全模态大模型
AIGC 资讯
GPT‑5.3‑Codex‑Spark – OpenAI推出的轻量级编程模型
AIGC 资讯

相关推荐

AIGC 资讯

MooER – 摩尔线程推出的业界首个音频理解大模型

站外新闻
AIGC 资讯

X-R1 – 基于强化学习的低成本训练框架

站外新闻
AIGC 资讯

ChildMandarin – 智源联合南开开源的低幼儿童中文语音数据集

站外新闻
AI 工具AIGC 资讯

PosterCopilot重磅发布:南京大学联手LibLib.ai推出专业海报设计大模型,全链路AI创意设计新范式

站外新闻
AIGC AI创意设计 LibLib.ai PosterCopilot 海报设计大模型
/ Prompt 语宙 /

Experience the limitless creative possibilities of generative AI and unlock new levels of innovation.

Quick Link

  • Remaker AI
  • BGRemaker 抠图Hot
  • AIGC 工具
  • Prompt 咒语生成器
  • 去水印工具

Support

  • Contact
  • Blog
  • Complaint
  • Advertise

标签

AIGC Midjourney prompt AI Agent openai 多模态大模型 AI绘画 字节跳动 开源模型 开源工具 早报 具身智能 大语言模型 MoE架构 开源大模型 强化学习 阿里通义 Anthropic 腾讯混元 多模态AI 大模型 开源框架 AI智能体 教程 chatgpt AI工具 扩散模型 AI视频生成 蚂蚁集团 开源
Prompt 语宙Prompt 语宙
Follow US
© 2009-2026 Prompt 语宙. Paooo.com. All Rights Reserved.