Prompt 语宙Prompt 语宙
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
Search
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2024 Prompt 语宙. HalfPX. All Rights Reserved.
阅读: DICE-Talk – 复旦联合腾讯优图推出的情感化动态肖像生成框架
Share
登陆
通知 阅读更多
Font Resizer字体
Font Resizer字体
Prompt 语宙Prompt 语宙
Search
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
已有帐户? 登陆
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2023 Prompt 语宙. Paooo.com. All Rights Reserved.
Prompt 语宙 > AIGC 资讯 > DICE-Talk – 复旦联合腾讯优图推出的情感化动态肖像生成框架
AIGC 资讯

DICE-Talk – 复旦联合腾讯优图推出的情感化动态肖像生成框架

站外新闻
最近更新: 2026年6月7日 下午8:02
SHARE

DICE-Talk是什么

DICE-Talk是复旦大学联合腾讯优图实验室推出的新颖情感化动态肖像生成框架,支持生成具有生动情感表达且保持身份一致性的动态肖像视频。DICE-Talk引入情感关联增强模块,基于情感库捕获不同情感之间的关系,提升情感生成的准确性和多样性。框架设计情感判别目标,基于情感分类确保生成过程中的情感一致性。在MEAD和HDTF数据集上的实验表明,DICE-Talk在情感准确性、对口型和视觉质量方面均优于现有技术。

阅读目录
  • DICE-Talk是什么
  • DICE-Talk的主要功能
  • DICE-Talk的技术原理
  • DICE-Talk的项目地址
  • DICE-Talk的应用场景

DICE-Talk

DICE-Talk的主要功能

  • 情感化动态肖像生成:根据输入的音频和参考图像,生成具有特定情感表达的动态肖像视频。
  • 身份保持:在生成情感化视频时,保持输入参考图像的身份特征,避免身份信息的泄露或混淆。
  • 高质量视频生成:生成的视频在视觉质量、唇部同步和情感表达方面均达到较高水平。
  • 泛化能力:能适应未见过的身份和情感组合,具有良好的泛化能力。
  • 用户控制:用户输入特定的情感目标,控制生成视频的情感表达,实现高度的用户自定义。
  • 多模态输入:支持多种输入模态,包括音频、视频和参考图像。

DICE-Talk的技术原理

  • 解耦身份与情感:基于跨模态注意力机制联合建模音频和视觉情感线索,将情感表示为身份无关的高斯分布。用对比学习(如InfoNCE损失)训练情感嵌入器,确保相同情感的特征在嵌入空间中聚集,不同情感的特征则分散。
  • 情感关联增强:情感库是可学习的模块,存储多种情感的特征表示。用向量量化和基于注意力的特征聚合,学习情感之间的关系。情感库存储单一情感的特征,学习情感之间的关联,帮助模型更好地生成其他情感。
  • 情感判别目标:在扩散模型的生成过程中,基于情感判别器确保生成视频的情感一致性。情感判别器与扩散模型联合训练,确保生成的视频在情感表达上与目标情感一致,保持视觉质量和唇部同步。
  • 扩散模型框架:从高斯噪声开始,逐步去噪生成目标视频。基于变分自编码器(VAE)将视频帧映射到潜在空间,在潜在空间中逐步引入高斯噪声,基于扩散模型逐步去除噪声,生成目标视频。在去噪过程中,扩散模型基于跨模态注意力机制,结合参考图像、音频特征和情感特征,引导视频生成。

DICE-Talk的项目地址

  • 项目官网:https://toto222.github.io/DICE-Talk/
  • GitHub仓库:https://github.com/toto222/DICE-Talk
  • arXiv技术论文:https://arxiv.org/pdf/2504.18087

DICE-Talk的应用场景

  • 数字人与虚拟助手:为数字人和虚拟助手赋予丰富的情感表达,与用户交互时更加自然和生动,提升用户体验。
  • 影视制作:在影视特效和动画制作中,快速生成具有特定情感的动态肖像,提高制作效率,降低制作成本。
  • 虚拟现实与增强现实:在VR/AR应用中,生成与用户情感互动的虚拟角色,增强沉浸感和情感共鸣。
  • 在线教育与培训:创建具有情感反馈的教学视频,让学习内容更加生动有趣,提高学习效果。
  • 心理健康支持:开发情感化虚拟角色,用在心理治疗和情感支持,帮助用户更好地表达和理解情感。
LayerDiffusion – AI生成具有透明度的图像的框架
本田与谷歌强强联手!新车型将实现自然对话体验
警报:微软Copilot惊现‘幽灵周报’漏洞!AI助手竟成企业数据‘内鬼’
百度ERNIE-Image 8B文生图模型重磅开源:中英长文本精准渲染+24GB显存本地跑
微软MAI-Voice-1语音模型深度解析:速度与表现力兼具的AI语音生成革命
分享
Email 复制链接 打印
Share
上一篇 Llama 4 – Meta 开源的多模态系列AI模型,重夺开源王座
下一篇 ACI.dev – 为AI智能体设计的开源MCP基础设施平台
发表评价

发表评价 取消回复

您的邮箱地址不会被公开。 必填项已用 * 标注

Please select a rating!

Ad image
- 入群领取知识星球折扣卷, 仅剩99份 -
Ad imageAd image

最近更新

FeyNoBg – Feyn Labs 开源的自动背景去除模型
AIGC 资讯
Qwen-Audio-3.0-ASR-Flash – 阿里千问推出的语音识别大模型
AIGC 资讯
全息流体渐变通用占位特色图
微软云端隐忧:千亿营收背后的增速换挡与杠杆风险
AIGC 资讯
全息流体渐变通用占位特色图
微信公众号推出 AI”一键排版”:自动分段、生成小标题、匹配配图三步到位
AIGC 资讯

相关推荐

全息流体渐变通用占位特色图
AIGC 资讯

目标过于激进?分析师指OpenAI百亿广告收入愿景恐难实现

站外新闻
AIGC 资讯

你的数据正在“喂养”AI:谷歌隐私设置静默更新,如何守护个人信息?

站外新闻
AIGC 资讯

Vary-toy:开源的小型视觉多模态模型

站外新闻
AI 工具AIGC 资讯

MOVA:中国首个端到端开源音视频生成大模型,320亿参数实现电影级口型同步

站外新闻
AIGC MOVA 开源 端到端生成模型 音视频大模型
/ Prompt 语宙 /

Experience the limitless creative possibilities of generative AI and unlock new levels of innovation.

Quick Link

  • Remaker AI
  • BGRemaker 抠图Hot
  • AIGC 工具
  • Prompt 咒语生成器
  • 去水印工具

Support

  • Contact
  • Blog
  • Complaint
  • Advertise

标签

AIGC Midjourney prompt AI Agent GPT Image 2 多模态大模型 EvoLink灵感 AI绘画 字节跳动 开源工具 开源模型 早报 具身智能 openai 大语言模型 开源大模型 阿里通义 强化学习 腾讯混元 Anthropic MoE架构 多模态AI 开源框架 AI智能体 教程 AI工具 扩散模型 AI视频生成 chatgpt 大模型
Prompt 语宙Prompt 语宙
Follow US
© 2009-2026 Prompt 语宙. Paooo.com. All Rights Reserved.