Prompt 语宙Prompt 语宙
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
Search
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2024 Prompt 语宙. HalfPX. All Rights Reserved.
阅读: Generative Omnimatte – 谷歌联合马里兰大学等机构推出的视频分解技术
Share
登陆
通知 阅读更多
Font Resizer字体
Font Resizer字体
Prompt 语宙Prompt 语宙
Search
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
已有帐户? 登陆
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2023 Prompt 语宙. Paooo.com. All Rights Reserved.
Prompt 语宙 > AIGC 资讯 > Generative Omnimatte – 谷歌联合马里兰大学等机构推出的视频分解技术
AIGC 资讯

Generative Omnimatte – 谷歌联合马里兰大学等机构推出的视频分解技术

站外新闻
最近更新: 2026年7月12日 上午8:48
SHARE

Generative Omnimatte是什么

Generative Omnimatte 是 Google DeepMind 等机构推出的视频编辑技术,能将视频智能分解为多个透明背景的RGBA图层,每个图层对应一个物体及其相关效果(如阴影、反射等)。无需绿幕或深度信息,能实现物体与背景的精确分离,处理被遮挡的部分。Generative Omnimatte的核心是一个名为“Casper”的视频扩散模型,能精准擦除视频中的物体及其阴影,同时保持背景完好无损。用户能轻松实现各种创意效果,如瞬移、改变运动速度,甚至让时间倒流。

阅读目录
  • Generative Omnimatte是什么
  • Generative Omnimatte的主要功能
  • Generative Omnimatte的技术原理
  • Generative Omnimatte的项目地址
  • Generative Omnimatte的应用场景

Generative Omnimatte的主要功能

  • 视频分层:将视频分解成多个 RGBA 层,每个层包含一个完全可见的对象及其相关的效应,如阴影和反射。
  • 视频编辑:支持用户进行广泛的视频编辑操作,包括对象和效应的移除、背景替换等。
  • 动态背景处理:处理动态背景,避免背景元素与前景对象层的纠缠。
  • 多对象场景:有效处理包含多个对象的场景,包括相似对象的隔离和效应关联。
  • 用户指定的 Trimask:支持用户用指定 Trimask 精细控制视频编辑过程中的保留和移除区域。

Generative Omnimatte的技术原理

  • 对象效应移除模型 Casper:给定输入视频和二进制对象掩码,用 Casper 模型生成干净的背景板和一系列单对象(solo)视频,应用不同的 Trimask 条件。
  • Trimask 条件:Trimask 指定保留(白色)、移除(黑色)和可能包含不确定对象效应(灰色)的区域。有助于精确处理多对象场景。
  • 测试时优化:在第二阶段,用测试时优化从 solo 视频和背景视频对中重建 Omnimatte 层。
  • 训练数据:用多个数据集(Omnimatte、Tripod、Kubric 和 Object-Paste)训练模型,提供真实视频的因果关系示例,并增强模型处理多对象场景的能力。
  • 自注意力分析:基于分析 Lumiere 模型的自注意力模式,研究文本到视频(T2V)模型对对象效应关联的内在理解,训练有效的对象效应移除模型。

Generative Omnimatte的项目地址

  • 项目官网:https://gen-omnimatte.github.io/
  • arXiv技术论文:https://arxiv.org/pdf/2411.16683

Generative Omnimatte的应用场景

  • 电影和视频制作:在电影制作中,移除不需要的背景元素,或者替换背景,实现特效场景的无缝合成。
  • 视频编辑和后期制作:视频编辑者分离视频中的对象和背景,进行颜色校正、特效添加或其他创意编辑。
  • 广告制作:在广告中,替换产品背景,或移除拍摄中的干扰元素,突出产品。
  • 虚拟现实和增强现实:在 VR 和 AR 应用中,将现实世界的视频内容与虚拟元素结合,提供更加沉浸式的体验。
  • 游戏开发:在游戏制作中,创建复杂的游戏环境,将现实世界的元素与虚拟游戏世界无缝融合。
Kimi K2.6 – 月之暗面开源的最新旗舰模型
SongGen – 上海 AI Lab 和北航、港中文推出的歌曲生成模型
可灵O1模型发布:全球首个统一多模态视频生成AI,支持文生视频、图生视频、720p模式与自由叙事
OpenAudio S1重磅发布:Fish Audio 200万小时数据训练,支持13种语言与50+情感标记的革命性TTS模型
谷歌图片迎来25周年重大改版:全面致敬Pinterest并引入AI画图
分享
Email 复制链接 打印
Share
上一篇 GLM-PC – 智谱推出的电脑智能体,基于CogAgent视觉多模态模型构建
下一篇 Voice-Pro – 开源AI音频处理工具,集成转录、翻译、TTS等一站式服务
发表评价

发表评价 取消回复

您的邮箱地址不会被公开。 必填项已用 * 标注

Please select a rating!

Ad image
- 入群领取知识星球折扣卷, 仅剩99份 -
Ad imageAd image

最近更新

FeyNoBg – Feyn Labs 开源的自动背景去除模型
AIGC 资讯
Qwen-Audio-3.0-ASR-Flash – 阿里千问推出的语音识别大模型
AIGC 资讯
全息流体渐变通用占位特色图
微软云端隐忧:千亿营收背后的增速换挡与杠杆风险
AIGC 资讯
全息流体渐变通用占位特色图
微信公众号推出 AI”一键排版”:自动分段、生成小标题、匹配配图三步到位
AIGC 资讯

相关推荐

AIGC 资讯

Image-to-LoRA-V2 – 魔搭社区开源的免训练风格迁移工具

站外新闻
AI 工具AIGC 资讯

DeepSeek V3.1 正式发布:128K上下文窗口、混合推理架构与Agent能力全面升级

站外新闻
AIGC DeepSeek MoE架构 开源模型
AI 工具AIGC 资讯

米哈游蔡浩宇押注!17B参数LPM 1.0:实时全双工、无限时长、跨风格数字人新标杆

站外新闻
AI视频生成 LPM 1.0 实时交互 数字人 蔡浩宇
AIGC 资讯

CodeGemma – 谷歌开源推出的代码生成大模型

站外新闻
/ Prompt 语宙 /

Experience the limitless creative possibilities of generative AI and unlock new levels of innovation.

Quick Link

  • Remaker AI
  • BGRemaker 抠图Hot
  • AIGC 工具
  • Prompt 咒语生成器
  • 去水印工具

Support

  • Contact
  • Blog
  • Complaint
  • Advertise

标签

AIGC Midjourney GPT Image 2 prompt AI Agent 写实人像 多模态大模型 EvoLink灵感 AI绘画 字节跳动 时尚大片 杂志排版 开源工具 开源模型 产品设计 商业海报 皮克斯风格 3D动画 色彩分析 AI生图 早报 具身智能 openai 大语言模型 开源大模型 阿里通义 强化学习 腾讯混元 MoE架构 多模态AI
Prompt 语宙Prompt 语宙
Follow US
© 2009-2026 Prompt 语宙. Paooo.com. All Rights Reserved.