法信法律基座大模型 – 最高法发布法律行业千亿参数通用大模型
法信法律基座大模型 法信法律基座大模型是基于清华大学与面壁智能科研成果转化的千亿参数通用大模型,由最高人民法院发布,定位为国家级法律AI基础设施。提供生成式AI底层能力,…
Audio Decomposition – 开源音乐转谱工具,一键将音乐转换为五线谱
Audio Decomposition是什么 Audio Decomposition是音频处理技术,基于傅里叶变换和信封匹配将音乐中的各个音符和乐器分离,实现音乐到乐谱的…
Florence-2 – 微软 Azure AI 团队推出的多功能视觉语言模型
Florence-2是什么 Florence-2 是微软 Azure AI 团队推出的多功能视觉模型,能执行图像描述、目标检测、视觉定位和图像分割等多种计算机视觉任务。F…
k0-math – 月之暗面Kimi推出的数学推理模型,对标o1
k0-math是什么 k0-math是月之暗面旗下Kimi最新发布的新一代数学推理模型。模型在多项数学基准测试中表现出色,数学能力足以与全球领先的OpenAI的o1系列模…
MagicQuill – 蚂蚁集团联合多所高校共同开源的AI互动式图像编辑工具
MagicQuill是什么 MagicQuill是香港科技大学、蚂蚁集团、浙江大学和香港大学共同推出的开源AI互动式图像编辑工具。基于用户友好的界面和AI支持的智能建议,…
ai-chatbot – 开源AI聊天机器人模板,快速构建高性能聊天应用
ai-chatbot是什么 ai-chatbot是Vercel推出的开源项目,基于Next.js框架和Vercel AI SDK构建。ai-chatbot提供一个功能完备…
LLaMA-Mesh – 清华联合英伟达推出的自然语言生成复杂的3D模型项目
LLaMA-Mesh是什么 LLaMA-Mesh是清华大学和NVIDIA共同推出的项目,基于将3D网格生成与大型语言模型(LLMs)结合,实现用文本提示直接生成3D模型的…
iAgents – 清华大学推出的多AI智能体协作框架
iAgents是什么 iAgents是清华大学推出的多AI智能体协作框架,基于为每个用户配备个人AI智能体促进协作和完成日常任务。智能体能理解用户的文件、命令,从协作中学…
DanceFusion – 清华大学推出音频驱动舞蹈动作重建与生成的开源框架
DanceFusion是什么 DanceFusion是清华大学推出的开源框架,专注于音频驱动的舞蹈动作重建与生成。DanceFusion结合分层时空Transformer…
Symphony Creative Studio – TikTok推出的AI广告创意视频生成工具
Symphony Creative Studio是什么 Symphony Creative Studio是TikTok推出的AI视频创作工具,帮助广告主和内容创作者简化视…
Skywork o1 – 昆仑万维推出的天工大模型4.0 o1版
Skywork o1是什么 Skywork o1是昆仑万维推出的天工大模型4.0 o1版,是国内首款具备中文逻辑推理能力的o1模型。Skywork o1在模型输出中内生了…
Voyage Multimodal-3 – Voyage AI 推出的多模态嵌入模型
Voyage Multimodal-3是什么 Voyage Multimodal-3 是 Voyage AI 推出的先进的多模态嵌入模型,能处理交错的文本和图像,并从 P…
Hali – 特斯联Buttons推出的多模态多智能体协作Agent
Hali是什么 Hali是特斯联联合国际轻奢品牌Buttons推出的多模态多智能体协作AI Agent。Hali具备类人思考、长记忆、物理世界感知和多智能体协作四大特点,…
Agent K v1.0 – 华为诺亚方舟实验室联合伦敦大学推出的端到端自主数据科学智能体
Agent K v1.0是什么 Agent K v1.0 是华为诺亚方舟实验室与伦敦大学学院团队联合推出的端到端自主数据科学智能体,能自动化、优化和泛化处理多种数据科学任…
Pixtral Large – Mistral AI开源的超大多模态模型
Pixtral Large是什么 Pixtral Large是法国Mistral AI开源的1240亿参数超大多模态模型,具备前沿级图像理解能力,支持128K上下文,能理…
Qwen2.5-Turbo – 阿里推出的长文本模型,支持上下文长度1M tokens
Qwen2.5-Turbo是什么 Qwen2.5-Turbo是阿里推出的先进模型,将上下文长度从 128k 扩展到了 1M tokens ,相当于100万个英文单词或15…
