智谱AI开放平台 – 智谱AI推出的大模型开发平台
BigModel是什么 BigModel 是智谱推出的企业级大模型开放平台(MaaS),专注于为开发者提供 GLM 系列全栈大模型能力。BigModel集成 GLM-5 …
GLM-4-long – 智谱AI推出的200万字长文本模型(已开放API)
GLM-4-long是什么 GLM-4-long 是智谱AI推出的200万字长文本模型,现已在 智谱AI开放平台 BigModel 上开放API调用。支持超长输入专为处理…
Deep-Live-Cam – 开源的 AI 实时换脸工具
Deep-Live-Cam是什么 Deep-Live-Cam 是开源的AI实时换脸工具,用户仅需一张图片即可在视频中实现实时人脸交换。支持 CPU、NVIDIA CUDA…
Qwen2-Audio – 阿里通义千问团队推出的开源AI语音模型
Qwen2-Audio是什么 Qwen2-Audio是阿里通义千问团队最新推出的开源AI语音模型,支持直接语音输入和多语言文本输出。具备语音聊天、音频分析功能,支持超过8…
Imagen 3 – Google推出的AI图像生成模型
Imagen 3是什么 Imagen 3是Google推出的AI图像生成模型,可以生成高质量、逼真的图像。Imagen 3是Google最高质量的文本到图像模型,可生成细…
EAFormer – 复旦推出的AI文本分割框架
EAFormer是什么 EAFormer是复旦推出的AI文本分割框架。擅长在照片中找到文字,并且能很精确地把文字从背景中分离出来。即使文字的边缘很模糊或者背景很复杂,EA…
WiseFlow – 开源的AI信息挖掘工具
WiseFlow是什么 WiseFlow是开源的AI信息挖掘工具,能从网站、微信公众号、社交平台等多源信息中智能提取并分类数据。结合了统计学习和大型语言模型(LLM),支…
Agents – AIWaves公司推出的AI Agent开发工具
Agents是什么 Agents是AIWaves公司推出的AI Agent开发工具,支持用户对AI模型进行详细调整和优化,构建更加智能和个性化的AI Agent。通过Ag…
MiniCPM-V – 面壁智能推出的开源多模态大模型
MiniCPM-V是什么 MiniCPM-V是面壁智能推出的开源多模态大模型,拥有80亿参数,擅长图像和视频理解。MiniCPM-V在单图像理解上超越了GPT-4V等模型…
VideoDoodles – Adobe推出的AI视频编辑框架
VideoDoodles是什么 VideoDoodles是Adobe公司联合多所大学推出的AI视频编辑框架。支持用户在视频中轻松插入手绘动画,实现与视频内容的无缝融合。通…
CharacterFactory – 大连理工推出的AI角色创作工具
CharacterFactory是什么 CharacterFactory是大连理工大学IIAU团队推出的AI角色创作工具,通过扩散模型在无需参考图片的情况下,仅需2.5G…
UniBench – Meta推出的视觉语言模型(VLM)评估框架
UniBench是什么 UniBench是Meta FAIR机构推出的视觉语言模型(VLM)评估框架,对视觉语言模型(VLM)进行全面评估。UniBench包含50多个基…
Retinex-Diffusion – AI图像照明控制框架,让图像明暗更自然、细腻
Retinex-Diffusion是什么 Retinex-Diffusion是基于Retinex理论的AI图像照明控制技术,让图像明暗更加自然、细腻、富有层次感。Reti…
EXAONE 3.0 – LG 推出的开源 AI 模型,专为英语和韩语设计
EXAONE 3.0是什么 EXAONE 3.0是LG AI Research推出的开源AI模型,具有7.8亿参数,专为英语和韩语设计。EXAONE 3.0在英语和韩语的…
DressCode – 上海科技大学推出的3D服装生成框架
DressCode是什么 DressCode是上海科技大学、宾夕法尼亚大学和Deemos科技联合推出的3D服装生成框架。支持用户通过文本描述来自动生成各种风格和材质的3D…
ReSyncer – 清华联合百度推出的AI视频编辑工具
ReSyncer是什么 ReSyncer是清华大学和百度联合推出的AI视频编辑工具,通过音频驱动生成与声音同步的高质量嘴唇动作视频。ReSyncer用Style-Sync…
