Prompt 语宙Prompt 语宙
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
Search
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2024 Prompt 语宙. HalfPX. All Rights Reserved.
阅读: VideoPainter – 港中文联合腾讯等机构推出的视频修复和编辑框架
Share
登陆
通知 阅读更多
Font Resizer字体
Font Resizer字体
Prompt 语宙Prompt 语宙
Search
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
已有帐户? 登陆
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2023 Prompt 语宙. Paooo.com. All Rights Reserved.
Prompt 语宙 > AIGC 资讯 > VideoPainter – 港中文联合腾讯等机构推出的视频修复和编辑框架
AIGC 资讯

VideoPainter – 港中文联合腾讯等机构推出的视频修复和编辑框架

站外新闻
最近更新: 2026年6月8日 下午3:00
SHARE

VideoPainter是什么

VideoPainter 是香港中文大学、腾讯ARC Lab、东京大学、澳门大学等机构推出的视频修复和编辑框架,专门用在处理任意长度的视频内容。VideoPainter基于双分支架构,结合轻量级上下文编码器和预训练的扩散模型,实现高效的背景保留和前景生成。框架支持插件式操作,用户根据需求灵活调整修复效果。VideoPainter 引入 ID 重采样技术,能在长视频中保持对象一致性。VideoPainter构建了 VPData 和 VPBench,目前最大的视频修复数据集,包含超过 39 万段视频剪辑,为大规模训练和评估提供支持。VideoPainter 在视频质量、掩码区域保留和文本对齐等多个指标上展现卓越了性能,为视频修复和编辑领域带来新的突破。

阅读目录
  • VideoPainter是什么
  • VideoPainter的主要功能
  • VideoPainter的技术原理
  • VideoPainter的项目地址
  • VideoPainter的应用场景

VideoPainter

VideoPainter的主要功能

  • 任意长度的视频修复:处理从短片段到长视频的各种内容,修复被遮挡或损坏的部分。
  • 背景保留与前景生成:基于双分支架构,实现背景的精确保留和前景的高质量生成。
  • 文本指导的视频编辑:支持用文本指令进行视频编辑,如添加、删除、替换或修改视频中的对象。
  • 对象一致性维持:在长视频中保持对象的身份一致性,避免出现对象漂移或突变。
  • 插件式控制:支持与不同的扩散模型或LoRA(低秩适配)模型结合,实现多样化的视频生成和编辑需求。

VideoPainter的技术原理

  • 双分支架构:
    • 背景分支:基于轻量级上下文编码器提取背景特征,注入到预训练的扩散模型中,确保背景的连贯性。
    • 前景分支:基于扩散模型的生成能力,根据文本提示生成前景内容,与背景特征结合,实现高质量的修复。
  • 轻量级上下文编码器:仅包含两层,占用主模型参数的6%,提取背景特征并以分组方式注入到扩散模型中。基于选择性特征融合,将背景特征注入到模型中,避免前景和背景信息混淆。
  • ID重采样技术:在训练时,增强目标区域的ID信息,提升模型对修复区域的感知能力。在推理时,将前一视频片段的修复区域特征与当前片段结合,确保长视频中对象的一致性。
  • 插件式控制:支持与不同的扩散模型或LoRA模型结合,用户根据需求选择合适的模型进行视频修复或编辑。兼容文本到视频(T2V)和图像到视频(I2V)扩散模型,进一步扩展应用范围。
  • 大规模数据集构建:用先进的视觉模型(如SAM2、Grounding DINO等),自动生成精确的分割掩码和密集的文本描述。构建VPData和VPBench,包含超过39万段视频剪辑,为大规模训练和评估提供支持。

VideoPainter的项目地址

  • 项目官网:https://yxbian23.github.io/project/video-painter/
  • GitHub仓库:https://github.com/TencentARC/VideoPainter
  • HuggingFace模型库:https://huggingface.co/TencentARC/VideoPainter
  • arXiv技术论文:https://arxiv.org/pdf/2503.05639

VideoPainter的应用场景

  • 影视修复与制作:修复老电影、电视剧中的损坏画面,或添加特效、修改场景。
  • 广告与营销:快速生成高质量视频内容,添加或替换背景、道具,实现个性化定制。
  • 视频创作与直播:实时修复视频中的错误或干扰,添加虚拟道具,提升视觉效果。
  • VR与AR应用:生成沉浸式视频内容,修复或修改虚拟场景,增强现实感。
  • 教育与培训:制作教学视频,修复古籍影像,添加虚拟设备或标注,增强教学效果。
ScreenAgent – 基于视觉语言模型的计算机控制智能体
VLM-R1 – 浙大 Om AI Lab 推出的视觉语言模型
太空数据砸进AI!马斯克掏出SpaceX家底, 2 万亿参数Grok大模型即刻炼成
auto-video-generator – AI自动解说视频生成器
Llama 3.3 – Meta AI推出的纯文本语言模型
分享
Email 复制链接 打印
Share
上一篇 Granite 4.0 Tiny Preview – IBM推出的语言模型
下一篇 Evo 2 – Acr研究所联合英伟达、斯坦福等推出的生物学AI模型
发表评价

发表评价 取消回复

您的邮箱地址不会被公开。 必填项已用 * 标注

Please select a rating!

Ad image
- 入群领取知识星球折扣卷, 仅剩99份 -
Ad imageAd image

最近更新

FeyNoBg – Feyn Labs 开源的自动背景去除模型
AIGC 资讯
Qwen-Audio-3.0-ASR-Flash – 阿里千问推出的语音识别大模型
AIGC 资讯
全息流体渐变通用占位特色图
微软云端隐忧:千亿营收背后的增速换挡与杠杆风险
AIGC 资讯
全息流体渐变通用占位特色图
微信公众号推出 AI”一键排版”:自动分段、生成小标题、匹配配图三步到位
AIGC 资讯

相关推荐

全息流体渐变通用占位特色图
AIGC 资讯

发布仅三天就踩下刹车:Kimi K3 用户请求爆表,月之暗面算力顶到天花板

站外新闻
全息流体渐变通用占位特色图
AIGC 资讯

Kimi K3 开源首夜至少 18 家美国企业火速部署

站外新闻
全息流体渐变通用占位特色图
AIGC 资讯

Anthropic纽约大扩军:租赁曼哈顿 16 层办公楼,员工规模翻番至 1000 人

站外新闻
AIGC 资讯

REEF – 上海AI Lab联合中科院等高校推出用于大模型的指纹识别技术

站外新闻
/ Prompt 语宙 /

Experience the limitless creative possibilities of generative AI and unlock new levels of innovation.

Quick Link

  • Remaker AI
  • BGRemaker 抠图Hot
  • AIGC 工具
  • Prompt 咒语生成器
  • 去水印工具

Support

  • Contact
  • Blog
  • Complaint
  • Advertise

标签

AIGC Midjourney prompt AI Agent GPT Image 2 多模态大模型 EvoLink灵感 AI绘画 字节跳动 开源工具 开源模型 早报 具身智能 openai 大语言模型 开源大模型 阿里通义 强化学习 腾讯混元 Anthropic MoE架构 多模态AI 开源框架 AI智能体 教程 AI工具 扩散模型 AI视频生成 chatgpt 大模型
Prompt 语宙Prompt 语宙
Follow US
© 2009-2026 Prompt 语宙. Paooo.com. All Rights Reserved.