FlexiAct – 清华联合腾讯推出的动作迁移模型
FlexiAct是什么 FlexiAct是清华大学和腾讯ARC实验室联合推出的新型动作迁移模型。FlexiAct能在给定目标图像的情况下,将参考视频中的动作迁移到目标主体…
RF-DETR – Roboflow推出的实时目标检测模型
RF-DETR是什么 RF-DETR是Roboflow推出的实时目标检测模型。RF-DETR是首个在COCO数据集上达到60+平均精度均值(mAP)的实时模型,性能优于现…
MoLing – 本地AI办公自动化助手,基于 MCP 服务器
MoLing是什么 MoLing 是无依赖的本地办公自动化助手,是基于计算机和浏览器使用的 MCP 服务器。MoLing 基于操作系统 API 实现系统交互,支持文件系统…
WeGen – 中科大联合上海交大等推出的统一多模态生成模型
WeGen是什么 WeGen 是中国科学技术大学联合上海交通大学、微信团队、中国科学院等机构推出的统一多模态生成模型,基于自然对话实现多样化的视觉生成任务。WeGen结合…
子曰翻译2.0 – 网易有道推出的最新翻译大模型
子曰翻译2.0是什么 子曰翻译2.0是网易有道推出的最新翻译大模型,模型在数据、算法和评估三个关键维度进行了系统性升级,实现了翻译质量、效率和鲁棒性的质的飞跃。 在数据层…
Maestro – 开源的端到端自动化测试框架
Maestro是什么 Maestro是用在移动和Web应用的端到端自动化测试框架。基于内置的容错能力和延迟容忍机制,解决传统测试中常见的不稳定性和等待问题。Maestro…
LangGraph WhatsApp Agent – 用于构建与 WhatsApp 用户互动的 AI Agent
LangGraph WhatsApp Agent是什么 LangGraph WhatsApp Agent 是基于 LangGraph 和 Twilio 构建的开源项目,用…
FaceShot – 同济大学联合上海 AI Lab等推出的肖像动画生成框架
FaceShot是什么 FaceShot是同济大学、上海 AI Lab和南京理工大学推出的新型无需训练的肖像动画生成框架。用外观引导的地标匹配模块和基于坐标的地标重定位模…
SWEET-RL – Meta 推出的多轮强化学习框架
SWEET-RL是什么 SWEET-RL是Meta推出的多轮强化学习框架,专门用在训练大型语言模型(LLM)代理进行协作推理任务。SWEET-R基于训练时的额外信息(如参…
VideoFusion – AI视频剪辑工具,自动去除视频黑边、水印和字幕
VideoFusion是什么 VideoFusion 是开源的短视频拼接与处理软件,专为高效视频编辑设计。支持自动去除视频中的黑边、水印和字幕,能将视频自动旋转为横屏或竖…
Omnitool – 开源 AI 桌面,支持多种主流AI平台和服务
Omnitool是什么 Omnitool是开源的AI桌面环境,为用户提供统一的交互界面,能快速接入和使用多种AI模型。Omnitool支持本地运行,能在Mac、Windo…
HumanRig – 阿里高德推出的3D人形角色自动绑定任务数据集
HumanRig是什么 HumanRig 是阿里巴巴团队开发的 3D 人形角色自动绑定研究项目。解决现有绑定技术因缺乏高质量数据集而发展受限的问题,通过提供大规模、高质量…
Moonlight-16B-A3B – 月之暗面开源的 MoE 模型
Moonlight-16B-A3B是什么 Moonlight-16B-A3B 是 Moonshot AI 推出的新型 Mixture-of-Expert (MoE) 模型…
DeepSeek百宝箱 – DeepSeek API在多种软件中的集成应用
DeepSeek百宝箱是什么 DeepSeek百宝箱是 DeepSeek官方 维护的 GitHub 项目,展示如何将 DeepSeek API 集成到各种流行软件中。项目…
Klavis AI – 开源MCP集成平台,快速接入生产级MCP服务器
Klavis AI是什么 Klavis AI 是开源的 MCP(Multimodal Communication Protocol,多模态通信协议)集成平台,帮助 AI …
Bolt3D – 牛津大学联合谷歌推出的 3D 场景生成技术
Bolt3D是什么 Bolt3D 是谷歌研究院、牛津大学 VGG 团队和谷歌 DeepMind 联合推出的新型 3D 场景生成技术,是潜在扩散模型,能在单个 GPU 上,…
