Magic Copy – 开源的AI抠图工具,在浏览器中自动识别图像进行抠图
Magic Copy是什么 Magic Copy是开源的AI抠图工具,支持Chrome浏览器扩展,基于Meta的Segment Anything Model技术,从图像中…
NSFW Detector – 开源 AI 不适宜内容检测工具,支持识别图像、PDF、视频文件
NSFW Detector是什么 NSFW Detector(Not Safe For Work,简称 NSFW)是开源的检测不适宜内容工具,NSFW Detector能…
MultiFoley – Adobe 联合密歇根大学推出的音效生成系统
MultiFoley是什么 MultiFoley是Adobe Research和密歇根大学共同推出的音效生成系统,能基于文本、音频和视频的多模态控制生成Foley声音效果…
CAT4D – 谷歌和哥伦比亚大学等高校推出的单目视频创建4D场景方法
CAT4D是什么 CAT4D是Google DeepMind、哥伦比亚大学和加州大学圣地亚哥分校共同推出的,能从单目视频创建4D场景(动态3D)表示。CAT4D基于多视图…
Make-It-Animatable – 中科大联合腾讯推出的自动生成即时动画准备资产
Make-It-Animatable是什么 Make-It-Animatable是中国科学技术大学和Tencent PCG推出的数据驱动框架,能在不到一秒钟内让任何3D人…
Co-op Translator – 微软推出面向开发者的开源多语言翻译工具
Co-op Translator是什么 Co-op Translator是微软推出的开源多语言翻译工具,基于Azure AI服务实现项目文档和图像中文本的自动化多语言翻译…
AnchorCrafter – 中科院联合腾讯推出的AI虚拟主播带货视频制作技术
AnchorCrafter是什么 AnchorCrafter是基于扩散模型的智能视频制作系统,用在自动生成具有高保真度的主播风格产品推广视频。基于整合人-物交互(HOI)…
MyTimeMachine – AI个性化面部年龄转换技术,实现20至40年的时间跨度
MyTimeMachine是什么 MyTimeMachine(MyTM)是先进的个性化面部年龄转换技术,基于大约50张个人照片,跨越20至40年的时间跨度,训练一个适配器…
HiFiVFS – 腾讯联合VIVO推出的高保真视频换脸框架
HiFiVFS是什么 HiFiVFS(High Fidelity Video Face Swapping)是腾讯和VIVO公司推出的高保真视频换脸框架,HiFiVFS基于…
MVGenMaster – 复旦联合阿里等实验室推出的多视图扩散模型
MVGenMaster是什么 MVGenMaster是复旦大学、阿里巴巴达摩院和湖潘实验室共同推出的多视图扩散模型,基于增强3D先验处理多样化的新视角合成(NVS)任务。…
360Zhinao2-7B – 360 推出自研360智脑大模型的升级版
360Zhinao2-7B是什么 360Zhinao2-7B是360自研的AI大模型360智脑7B参数升级版,涵盖基础模型及多种上下文长度的聊天模型。360Zhinao2…
GeneMAN – 上海AI Lab联合北大等高校推出的3D人体模型创建框架
GeneMAN是什么 GeneMAN是上海AI实验室、北京大学、南洋理工大学、上海交通大学联合推出的3D人形创建框架,能从单张图片中创建出高保真度的3D人体模型。框架不依…
MagicDriveDiT – 华为联合港中文等机构推出的自动驾驶高分辨率长视频生成方法
MagicDriveDiT是什么 MagicDriveDiT是香港中文大学、香港科技大学、华为云和华为诺亚方舟实验室共同推出基于DiT架构的新型视频生成方法,专为自动驾驶…
EfficientTAM – Meta AI推出的视频对象分割和跟踪模型
EfficientTAM是什么 EfficientTAM是Meta AI推出的轻量级视频对象分割和跟踪模型,能解决SAM 2模型在移动设备上部署时的高计算复杂度问题。基于…
Amazon Nova – 亚马逊推出的全新大模型系列,覆盖文本、图像、视频生成领域
Amazon Nova是什么 Amazon Nova 是亚马逊云服务(AWS)推出的新一代AI基础模型系列,提供行业领先的性能和成本效益。系列包括专门处理文本的Amazo…
HunyuanVideo – 腾讯推出的开源视频生成模型,参数高达130亿
HunyuanVideo是什么 HunyuanVideo是腾讯开源的视频生成模型,拥有130亿参数,是目前参数量最大的开源视频模型之一。HunyuanVideo具备物理模…
