Multi-Agent Orchestrator – 亚马逊开源的多智能体框架
Multi-Agent Orchestrator是什么 Multi-Agent Orchestrator 是用于管理和协调多个智能代理(Agent)的框架。通过分类器识别…
DeepSeek-Prover-V2 – DeepSeek推出的开源数学推理大模型
DeepSeek-Prover-V2是什么 DeepSeek-Prover-V2是深度求索团队 DeepSeek 开源的专注于数学推理的超大规模语言模型。包含两个版本:D…
混元图像2.0 – 腾讯推出的实时AI图片生成大模型
混元图像2.0是什么 混元图像2.0(Hunyuan Image 2.0)是腾讯推出的业内首个毫秒级响应的实时AI图片生成大模型。混元图像2.0支持文本、语音、草图等多种…
Seedream 3.0 – 字节推出的 AI 图片生成模型,精准生成复杂中文内容
Seedream 3.0是什么 Seedream 3.0(即梦3.0)是字节跳动推出的AI图片生成模型,模型支持原生 2K 分辨率图像输出,快速生成高品质图像,仅需 3 …
UFO² – 微软推出的 Windows 桌面 Agent 操作系统
UFO²是什么 UFO² 是微软推出的面向 Windows 桌面的多Agent操作系统(AgentOS),基于深度系统集成和自然语言交互实现复杂桌面任务的自动化。UFO²…
KuaiMod – 快手推出的自动化短视频质量判别框架
KuaiMod是什么 KuaiMod 是快手推出的基于多模态大模型的短视频质量判别框架,能高效识别和过滤有害及低质量内容。框架借鉴普通法(Common Law)体系,基于…
Vidu Q1 – 生数科技推出的高可控视频大模型
Vidu Q1是什么 Vidu Q1 是清华大学人工智能研究院副院长、生数科技创始人兼首席科学家朱军教授团队推出的高可控视频大模型。支持生成1080p高清视频,画质细腻,…
The AI Scientist-v2 – 通用端到端 AI 系统,自动探索科学假设生成论文
The AI Scientist-v2是什么 The AI Scientist-v2 是 Sakana AI 、不列颠哥伦比亚大学、Vector研究所等机构联合推出的完全…
龙猫LongCat – 美团自主研发的生成式AI大模型
龙猫LongCat是什么 LongCat(龙猫)是美团自主研发的生成式AI大模型,通过人工智能技术提升公司内部工作效率和创新能力。模型具备强大的多模态能力,能处理文本、图…
Rowboat – 开源AI编程工具,快速构建多智能体助手
Rowboat是什么 Rowboat 是开源的低代码 AI IDE,专注于构建多智能体助手的 MCP(多云平台)工具。通过可视化界面和 AI 辅助开发功能,帮助用户快速设…
BAGEL – 字节跳动开源的多模态基础模型
BAGEL是什么 BAGEL是字节跳动开源的多模态基础模型,拥有140亿参数,其中70亿为活跃参数。采用混合变换器专家架构(MoT),通过两个独立编码器分别捕捉图像的像素…
Quasar Alpha – 支持百万 token 上下文的免费 AI 模型
Quasar Alpha是什么 Quasar Alpha 是支持 100 万 token 的超大上下文窗口的预发布版 AI 模型,可处理超长文本和复杂文档。代码生成能力出…
AvatarFX – Character.AI 推出的 AI 视频生成模型
AvatarFX是什么 AvatarFX 是 Character.AI 推出的先进 AI 视频生成模型。基于上传一张图片和选择声音,让角色瞬间“活起来”,实现说话、唱歌和…
VITA-Audio – 开源的端到端多模态语音大模型,低延迟、推理快
VITA-Audio是什么 VITA-Audio 是开源的端到端多模态语音大模型,具有低延迟、推理速度快的特点。通过轻量级的多模态交叉标记预测(MCTP)模块,可在首次前…
ObjectMover – 港大联合 Adobe 推出的新型图像编辑模型
ObjectMover是什么 ObjectMover 是香港大学和 Adobe Research 联合提出的新型图像编辑模型,解决图像中物体移动、插入和移除时出现的光照、…
PixelFlow – 港大联合 Adobe 推出的图像生成模型
PixelFlow是什么 PixelFlow 是香港大学和Adobe联合推出的图像生成模型,支持直接在像素空间中生成图像。PixelFlow基于高效的级联流建模,从低分辨…
