360Zhinao2-7B – 360 推出自研360智脑大模型的升级版
360Zhinao2-7B是什么 360Zhinao2-7B是360自研的AI大模型360智脑7B参数升级版,涵盖基础模型及多种上下文长度的聊天模型。360Zhinao2…
GeneMAN – 上海AI Lab联合北大等高校推出的3D人体模型创建框架
GeneMAN是什么 GeneMAN是上海AI实验室、北京大学、南洋理工大学、上海交通大学联合推出的3D人形创建框架,能从单张图片中创建出高保真度的3D人体模型。框架不依…
MagicDriveDiT – 华为联合港中文等机构推出的自动驾驶高分辨率长视频生成方法
MagicDriveDiT是什么 MagicDriveDiT是香港中文大学、香港科技大学、华为云和华为诺亚方舟实验室共同推出基于DiT架构的新型视频生成方法,专为自动驾驶…
EfficientTAM – Meta AI推出的视频对象分割和跟踪模型
EfficientTAM是什么 EfficientTAM是Meta AI推出的轻量级视频对象分割和跟踪模型,能解决SAM 2模型在移动设备上部署时的高计算复杂度问题。基于…
Amazon Nova – 亚马逊推出的全新大模型系列,覆盖文本、图像、视频生成领域
Amazon Nova是什么 Amazon Nova 是亚马逊云服务(AWS)推出的新一代AI基础模型系列,提供行业领先的性能和成本效益。系列包括专门处理文本的Amazo…
HunyuanVideo – 腾讯推出的开源视频生成模型,参数高达130亿
HunyuanVideo是什么 HunyuanVideo是腾讯开源的视频生成模型,拥有130亿参数,是目前参数量最大的开源视频模型之一。HunyuanVideo具备物理模…
Lobe Vidol – AI数字人交互平台,可与虚拟人和 3D 模型聊天互动
Lobe Vidol是什么 Lobe Vidol是开源的数字人创作平台,让每个人都能轻松创建和互动自己的虚拟偶像。Lobe Vidol提供流畅的对话体验、背景设置、动作姿…
GPT学术优化 – 专为学术研究和写作设计的多功能开源项目
GPT学术优化是什么 GPT学术优化(GPT Academic)是功能丰富的开源项目,专为学术研究和写作设计。GPT学术优化集成一键论文翻译、源代码解析、互联网信息获取、…
Vanna – 开源AI检索生成框架,自动生成精确的SQL查询
Vanna是什么 Vanna是开源的Python RAG(Retrieval-Augmented Generation)框架,能帮助用户基于大型语言模型(LLMs)为其数…
PersonaCraft – 首尔国立大学推出的单参考图像生成多身份全身图像技术
PersonaCraft是什么 PersonaCraft是韩国首尔国立大学推出的个性化全身图像合成技术,结合扩散模型和3D人类建模,能从单一参考图像生成多个人物的逼真、个…
StableAnimator – 复旦联合微软等机构推出的端到端身份一致性视频扩散框架
StableAnimator是什么 StableAnimator是复旦大学、微软亚洲研究院、虎牙公司和卡内基梅隆大学共同推出的端到端高质量身份保持视频扩散框架。Stabl…
I2V-01-Live – 海螺AI推出的图生视频模型,将静态图像转化为动态视频
I2V-01-Live是什么 I2V-01-Live是海螺AI推出的图生视频模型,能将静态二维图像转化为动态视频。模型基于深度学习技术,增强动作的流畅度和生动性,让人物或…
Genie 2 – 谷歌DeepMind推出的最新一代基础世界模型
Genie 2是什么 Genie 2是DeepMind推出的新一代大规模基础世界模型,仅凭一张图片生成长达1分钟的可交互3D游戏世界。Genie 2能模拟出物体交互、角色…
Luma Photon – Luma AI 推出的全新图像生成模型
Luma Photon是什么 Luma Photon 是 Luma AI 推出的新一代图像生成模型,用创新的架构提供超高图像质量和低成本效率。Luma Photon支持个…
TeleAI 视频生成大模型 – 中国电信AI研究院推出的视频生成模型
TeleAI 视频生成大模型是什么 TeleAI 视频生成大模型是中国电信AI研究院推出的视频生成模型,基于两阶段生成框架:先根据文本描述创建分镜头草图,再基于草图生成视…
Agents-A1 – 上海 AI Lab开源的混合专家智能体模型
Agents-A1是什么 Agents-A1是上海AI实验室开源的35B参数混合专家(MoE)智能体模型,专为复杂科研任务设计。模型通过知识-行动图谱构建可验证长轨迹基础…
