AiNiee – AI翻译工具,游戏爱好者和小说迷的翻译神器
AiNiee是什么 AiNiee 是一款AI翻译工具,能一键自动翻译RPG、SLG游戏、Epub、TXT格式的小说、Srt、Lrc字幕文件等。工具支持多格式文件,接入多个…
UniReal – 港大联合 Adobe 推出的通用图像生成和编辑框架
UniReal是什么 UniReal是香港大学和Adobe研究院共同推出的框架,专注于实现多种图像生成和编辑任务。框架基于模拟现实世界动态,能在单一模型中处理包括图像生成…
Seedream 5.0 Pro – 字节跳动推出的多模态图像创作模型
Seedream 5.0 Pro是什么 Seedream 5.0 Pro 是字节跳动 Seed 团队推出的多模态图像创作模型,专为复杂专业场景设计。模型在图文匹配、文字渲…
SadTalker – 开源AI数字人项目,一键让照片说话
SadTalker是什么 SadTalker是西安交通大学、腾讯AI实验室和蚂蚁集团联合推出的开源AI数字人项目。SadTalker专注于通过单张人脸图像和语音音频,利用…
Molmo 72B – 开源的多模态AI模型,基于Qwen2-72B模型,超越Llama 3.2
Molmo 72B是什么 Molmo 72B是由艾伦人工智能研究所(Ai2)推出的一个开源多模态AI模型,专门设计用于处理和理解图像和文本数据。基于Qwen2-72B模型…
QA-MDT – 中科大联合科大讯飞推出开源音乐生成模型
QA-MDT是什么 QA-MDT(Quality-aware Masked Diffusion Transformer)是由中国科学技术大学和科大讯飞联合推出的开源音乐生…
Jamba – AI21开源的首个基于Mamba架构的大模型
Jamba是什么 Jamba是由AI21 Labs推出的首个基于Mamba架构的生产级别的大语言模型,目前大部分的大模型(如GPT、Gemini 和 Llama)都是基于…
山海大模型 – 云知声推出的多模态AI大模型
山海大模型是什么 山海大模型是云知声推出的多模态AI大模型,具备丰富的知识储备和多模态交互能力。山海大模型能通过文本、音频、图像等多种形式与用户进行实时互动,提供信息查询…
MiniCPM 3.0 – 面壁智能开源的端侧AI模型,4B参数性能超越GPT-3.5
MiniCPM 3.0是什么 MiniCPM 3.0是面壁智能推出的一款高性能端侧AI模型,具备4B参数,以较小的模型规模实现了超越GPT-3.5的性能表现。MiniCP…
Gemma 2 – 谷歌DeepMind推出的新一代开源人工智能模型
Gemma 2是什么 Gemma 2是谷歌DeepMind推出的新一代开源人工智能模型,包含90亿和270亿参数版本。该模型以卓越的性能、高效的推理速度和广泛的硬件兼容性…
SDXL-Lightning – 字节跳动推出的文本到图像生成模型
SDXL-Lightning是什么 SDXL-Lightning是由字节跳动的研究团队推出的一种基于扩散模型的文本到图像生成技术,旨在解决传统扩散模型在图像生成速度和计算…
ANTO – 开源的Windows桌面字幕翻译工具
ANTO是什么 ANTO是一款开源的Windows桌面字幕翻译工具,用于翻译SRT格式的视频字幕文件。集成多种翻译引擎,如谷歌翻译、DeepL、微软翻译、百度翻译和有道翻…
X-AnyLabeling – AI图像标注工具,支持图像和视频多样化标注样式
X-AnyLabeling是什么 X-AnyLabeling是集成多种深度学习算法的图像标注软件,专注于提升标注效率和精度。X-AnyLabeling支持图像和视频的多样…
xGen-MM – Salesforce推出的开源多模态AI模型
xGen-MM是什么 xGen-MM是Salesforce推出的一款开源多模态AI模型,具有处理交错数据的能力,能同时理解和生成文本、图像等多种数据类型。xGen-MM通…
ProX – 提高大语言模型预训练数据质量的框架
ProX是什么 ProX(Programming Every Example)是一个旨在提高大型语言模型预训练数据质量的框架。与传统依赖人类专家制定规则的方法不同,Pro…
书生·筑梦2.0(Vchitect 2.0) – 上海人工智能实验室推出的AI视频生成模型
书生·筑梦2.0是什么 书生·筑梦2.0(Vchitect 2.0)是由上海人工智能实验室推出的升级版视频生成开源大模型,旨在生成符合中国文化和东方审美的视频内容。模型支…
