Open Avatar Chat – 阿里开源的实时数字人对话系统
Open Avatar Chat是什么 Open Avatar Chat 是阿里开源的模块化的实时数字人对话系统,支持在单台电脑上运行完整的功能。Open Avatar …
Minion Agent – 开源的多功能 AI Agent 框架
Minion Agent是什么 Minion Agent是Agent框架,支持浏览器操作、MCP、自动规划和深度研究等功能。Minion Agent支持多种模型,基于灵活…
Qlib – 微软开源的金融 AI 量化投资工具
Qlib是什么 Qlib 是微软亚洲研究院推出的面向金融行业的AI量化投资工具,帮助量化研究者探索 AI 技术在投资领域的潜力。Qlib提供高性能的数据处理基础设施,支持…
video-subtitle-master – 开源AI字幕生成工具,支持批量为视频或音频生成字幕
video-subtitle-master是什么 video-subtitle-master 是能批量为视频或音频生成字幕的工具,基于开源项目 VideoSubtitle…
Cline – AI编程助手,集成于 VSCode 实时检查语法错误
Cline是什么 Cline 是集成于 VSCode 的 AI 编程助手,通过智能化手段提升开发效率。具备强大的代码生成与编辑能力,能根据用户需求快速创建或修改代码文件,…
Magnitude – 开源 AI Agent 驱动的端到端测试框架
Magnitude是什么 Magnitude 是开源的视觉 AI Agents驱动的端到端测试框架。Magnitude基于自然语言构建测试用例,用强大的推理代理规划和调整…
AI co-scientist – 谷歌推出多智能体协作的 AI 科研助手
AI co-scientist是什么 AI co-scientist 是谷歌推出的多智能体AI系统,作为虚拟科研机器人,协助科研人员搞定各种繁琐的科研任务,包括科研选题、…
DINO-XSeek – IDEA 研究院推出的多模态目标检测模型
DINO-XSeek是什么 DINO-XSeek 是 IDEA 研究院推出的多模态目标检测模型,结合视觉感知和自然语言理解能力。DINO-XSeek基于复杂的语言描述精准…
HUGWBC – 上海交大联合上海 AI Lab 推出的人形机器人全身控制器
HUGWBC是什么 HUGWBC(Humanoid Unified and General Whole-Body Controller)是上海交通大学、上海AI Lab联…
LHM – 阿里通义开源的单图生成可动画3D人体模型
LHM是什么 LHM(Large Animatable Human Reconstruction Model)是阿里巴巴通义实验室推出的从单张图像重建可动画化3D人体模型…
Nova Sonic – 亚马逊推出的新型生成式 AI 语音模型
Nova Sonic是什么 Nova Sonic 是亚马逊推出的新型生成式 AI 语音模型。将语音理解与生成能力整合到一个模型中,能根据说话者的语调、风格等声学上下文调整…
MindLLM – 耶鲁联合剑桥等机构推出的医疗领域 AI 模型
MindLLM是什么 MindLLM 是耶鲁大学、达特茅斯学院和剑桥大学联合推出的AI模型,能将脑部功能性磁共振成像(fMRI)信号解码为自然语言文本。MindLLM基于…
CoA – 谷歌推出的多智能体协作框架
CoA是什么 CoA(Chain-of-Agents)是谷歌推出的多智能体协作框架,用于解决大语言模型(LLM)在处理长文本任务时面临的上下文限制问题。CoA框架将长文本…
Step-1o Vision – 阶跃星辰推出的原生端到端视觉理解模型
Step-1o Vision是什么 Step-1o Vision 是阶跃星辰最新研发的原生端到端多模态生成与理解一体化模型中的视觉版本。专注于视觉任务,具备强大的图像识别…
Mistral Small 3.1 – Mistral AI 开源的多模态 AI 模型
Mistral Small 3.1是什么 Mistral Small 3.1 是 Mistral AI 开源的多模态人工智能模型,有 240 亿参数,基于 Apache …
RealtimeSTT – AI实时语音转文本库,自动检测说话的开始与结束
RealtimeSTT是什么 RealtimeSTT是开源的实时语音转文本库,专为低延迟应用设计。有强大的语音活动检测功能,可自动识别说话的开始与结束,通过WebRTCV…
