MooER – 摩尔线程推出的业界首个音频理解大模型
MooER是什么 MooER是摩尔线程推出的业界首个基于国产全功能GPU训练的开源音频理解大模型。不仅能进行中文和英文的语音识别,还具备中译英的语音翻译能力。MooER在…
HivisionIDPhotos – 免费开源的AI证件照制作工具
HivisionIDPhotos是什么 HivisionIDPhoto 是一款基于 AI 的轻量级证件照制作工具,能智能识别和抠图,快速生成符合多种规格的证件照。支持自定…
ToonCrafter – 腾讯等开源的卡通动画视频插帧工具
conda create -n tooncrafter python=3.8.5 conda activate tooncrafter pip install -r re…
OLMo – 艾伦AI研究所开源的完全开放的大语言模型框架
OLMo是什么? OLMo(Open Language Model)是由Allen AI(AI2,艾伦人工智能研究所)开发的一个完全开源开放的大型语言模型(LLM)框架,…
VITA – 腾讯推出的开源多模态AI模型
VITA是什么 VITA是腾讯优图实验室推出的全球首个开源多模态大语言模型(MLLM),能理解和处理视频、图像、文本和音频。基于Mixtral 8×7B模型,扩展了中文词…
Torch-MLU – 寒武纪开源的PyTorch后端插件,支持大模型一键迁移
Torch-MLU是什么 Torch-MLU 是寒武纪开源的 PyTorch 设备后端扩展插件,支持开发者将寒武纪 MLU 系列智能加速卡作为 PyTorch 的加速后端…
Stable Video 3D (SV3D) – 多视角合成和3D生成模型,由Stability AI推出
Stable Video 3D是什么 Stable Video 3D(简称SV3D)是由Stability AI公司开发的一个多视角合成和3D生成模型,能够从单张图片生成…
StockBot – 基于Llama3的AI金融Agent,提升股票投资效率
StockBot 是什么 StockBot 是一个基于Llama3的AI金融Agent,提供实时股票信息、财务数据、新闻和互动图表。支持多资产市场,包括股票、外汇、债券和…
Step-1X – 阶跃星辰推出的AI图像生成大模型
Step-1X是什么 Step-1X 是阶跃星辰推出的AI图像生成大模型,采用自研的 DiT 架构,擅长深度语义理解和细节生成。Step-1X支持长达2000字符的复杂指…
Stability AI开源Stable Diffusion 3 Medium文生图模型
6月12日晚间消息,人工智能初创公司Stability AI宣布正式开源发布其最新的文本到图像生成模型——Stable Diffusion 3 Medium(SD3 Me…
DiffusionGPT – 开源的大模型驱动的文本到图像生成系统
DiffusionGPT是什么? DiffusionGPT是由来自字节跳动与中山大学的研究人员推出的一个开源的大模型(LLM)驱动的文本到图像生成系统,旨在解决文生图领域…
AI Scientist – Sakana AI推出的全自动科学发现AI系统
AI Scientist是什么 AI Scientist是Sakana AI推出的首个全自动科学发现AI系统。能独立完成从创意生成、编码、实验执行到撰写科学论文的整个研究…
ImageBind – Meta推出开源多模态AI模型,实现六种多模态数据整合
ImageBind是什么 ImageBind是Meta公司推出的开源多模态AI模型,将文本、音频、视觉、温度和运动数据等六种不同类型的信息整合到一个统一的嵌入空间中。模型…
AnimateDiff-Lightning – 字节推出的快速生成高质量视频的模型
AnimateDiff-Lightning是什么 AnimateDiff-Lightning是由字节跳动的研究人员最新推出的一个高质量视频生成模型,利用了渐进式对抗性扩散…
Imagine Yourself – Meta公司推出的个性化AI图像生成模型
Imagine Yourself是什么 Imagine Yourself 是Meta公司推出的个性化AI图像生成模型,突破了传统方法的局限,无需对每个用户进行单独调整,通…
Melty – 开源的AI编程助手,大幅提升编码效率和质量
Melty是什么 Melty是一款开源AI编程助手,专为提升开发者的编码效率和代码质量而设计。Melty通过实时理解开发者的编程活动,从终端操作到 GitHub 交互,提…
