子曰-o1 – 网易有道推出国内首个输出分步式讲解的推理模型
子曰-o1是什么 子曰-o1是网易有道发布的国内首个输出分步式讲解的推理模型。模型采用14B轻量级架构,专为消费级显卡设计,能在低显存设备上稳定运行。通过思维链技术,模拟…
MHA2MLA – 复旦、上海AI Lab等推出优化LLM推理效率的方法
MHA2MLA是什么 MHA2MLA是复旦大学、华东师范大学、上海AI Lab等机构联合推出的数据高效的微调方法,基于引入DeepSeek的多头潜在注意力机制(MLA),…
LangManus – AI自动化框架,多智能体协同完成复杂任务
LangManus是什么 LangManus 是 AI 自动化框架,基于分层多智能体系统设计。包含多种智能体,如协调员、规划员、研究员、程序员等,各司其职,协同完成复杂任…
AutoMouser – AI Chrome扩展程序,实时交互跟踪自动生成测试代码
AutoMouser是什么 AutoMouser是Chrome扩展程序,能智能地跟踪用户交互,基于OpenAI的GPT模型自动生成Selenium测试代码。通过记录用户的…
LiveCC – 字节联合新加坡国立大学开源的实时视频解说模型
LiveCC是什么 LiveCC 是新加坡国立大学Show Lab 团队联合字节跳动推出的实时视频解说模型,基于自动语音识别(ASR)字幕进行大规模训练。LiveCC像专…
AlphaEvolve – 谷歌 DeepMind 推出的通用科学AI Agent
AlphaEvolve是什么 AlphaEvolve是谷歌DeepMind推出的通用科学Agent,基于结合大型语言模型(LLMs)的创造力和自动评估器来设计和优化高级算…
Second Me – 心识宇宙开源的 AI 身份模型
Second Me是什么 Second Me 是心识宇宙(Mindverse)推出的开源AI身份模型,支持创建完全私有且深度个性化的AI代理,代表用户的“真实自我”。Se…
Phi-4-Mini – 微软推出专注于文本任务的小型语言模型
Phi-4-Mini是什么 Phi-4-Mini 是微软 Phi-4 系列中最新推出的专注于文本任务的小型语言模型,参数量为 38 亿。基于密集的解码器-only Tra…
Matrix3D – 南大联合Apple、港科大推出的统一摄影测量模型
Matrix3D是什么 Matrix3D 是南京大学、苹果公司和香港科技大学合作推出的新型的统一摄影测量模型,能在一个模型中完成多个摄影测量子任务,包括姿态估计、深度预测…
Neural4D 2o – DreamTech 推出支持多模态交互的 3D 模型
Neural4D 2o是什么 Neural4D 2o 是 DreamTech 推出的全球首个支持多模态交互的 3D 大模型。模型基于文本、图像、3D 和运动数据的联合训练…
Migician – 北交大联合清华、华中科大推出的多模态视觉定位模型
Migician是什么 Migician是北京交通大学、华中科技大学和清华大学的研究团队联合推出的多模态大语言模型(MLLM),专门用在自由形式的多图像定位(Multi-…
Heygem – 硅基智能推出的开源数字人模型
Heygem是什么 Heygem 是硅基智能推出的开源数字人模型,专为 Windows 系统设计。基于先进的AI技术,仅需 1 秒视频或 1 张照片,能在 30 秒内完成…
potpie.ai – AI代码库Agent构建平台,自动化代码分析、测试和开发任务
potpie.ai是什么 potpie.ai 是开源平台,基于AI技术为代码库创建定制化的工程代理(Agents)。potpie.ai基于构建代码库的知识图谱,深度理解代…
kimi-thinking-preview – 月之暗面推出的多模态思考模型
kimi-thinking-preview是什么 kimi-thinking-preview 是月之暗面推出的多模态思考模型,具备深度推理能力,擅长解决复杂问题,如代码、…
pdf-craft – 开源 PDF 转 Markdown 工具
pdf-craft是什么 pdf-craft 是用在将 PDF 文件转换为其他格式(如 Markdown、EPUB)的工具,专注于处理扫描书籍的 PDF 文件。pdf-c…
UltraMem – 字节豆包大模型团队推出的全新超稀疏模型架构
UltraMem是什么 UltraMem 是字节跳动豆包大模型团队提出的全新超稀疏模型架构,解决传统 MoE 架构在推理时的高额访存问题。架构通过优化内存访问和计算效率,…
