AxBench – 斯坦福大学推出评估语言模控制方法的基准测试框架
AxBench是什么 AxBench 是斯坦福大学推出的评估语言模型(LM)可解释性方法的基准测试框架。基于合成数据生成训练和评估数据,比较不同模型控制技术在概念检测和模…
OmniSVG – 复旦大学联合 StepFun 推出端到端多模态矢量图形生成模型
OmniSVG是什么 OmniSVG 是复旦大学和 StepFun 联合开发的全球首个端到端多模态 SVG(可缩放矢量图形)生成模型。基于预训练视觉语言模型(VLM),通…
Asyncflow v1.0 – Podcastle 推出的 AI 文本转语音模型
Asyncflow v1.0是什么 Asyncflow v1.0 是播客平台 Podcastle 推出的 AI 文本转语音模型。支持超过 450 种语音选项,能为文本内容…
AstrBot – 开源多平台聊天机器人及开发框架
AstrBot是什么 AstrBot是多平台聊天机器人及开发框架,支持多种大语言模型(如 OpenAI GPT、Google Gemini、Llama 等)和多种消息平台…
OmniManip – 智元机器人联合北大推出的通用机器人操作框架
OmniManip是什么 OmniManip 是北京大学与智元机器人联合实验室开发的通用机器人操作框架,通过结合视觉语言模型(VLM)的高层次推理能力和精确的三维操作能力…
VACE – 阿里通义推出的视频生成与编辑框架
VACE是什么 VACE(Video Creation and Editing)是阿里巴巴通义实验室推出的一站式视频生成与编辑框架。基于整合多种视频任务(如参考视频生成、…
SmolDocling – 轻量级的多模态文档处理模型
SmolDocling是什么 SmolDocling(SmolDocling-256M-preview )是高效轻量级的多模态文档处理模型。能将文档图像端到端地转换为结构…
加大学开启 AI 实验:50 万师生与 ChatGPT 共探未来教育
美国加州州立大学(CSU)最近与 OpenAI 达成了一项重磅协议,成为全球范围内单一机构最大规模的 ChatGPT 应用实验。这项合作价值 1690 万美元,将使该校系…
汽车行业AI新坐标!长安“天枢大模型”正式通过国家生成式AI备案
近日,长安汽车官方发布消息,其全栈自研的“天枢大模型”已顺利通过国家网信办的“生成式人工智能服务”备案审批。这一关键节点的突破,不仅让长安汽车成为重庆首家、同时也是国内极…
微信开放平台发布AI生态接入指引,小程序可支持微信AI直接调用
微信开放平台于2026年6月8日正式发布《关于开发者接入微信AI生态的指引》,宣布为小程序开发者提供便捷接入微信AI生态的能力。这一举措标志着微信正加速构建智能交互生态,…
Kimi-Audio – Moonshot AI 开源的音频基础模型
Kimi-Audio是什么 Kimi-Audio 是 Moonshot AI 推出的开源音频基础模型,专注于音频理解、生成和对话任务。在超过 1300 万小时的多样化音频…
WorldMem – 南洋理工联合北大和上海 AI Lab 推出的世界生成模型
WorldMem是什么 WorldMem 是南洋理工大学、北京大学和上海 AI Lab 推出的创新 AI 世界生成模型。模型基于引入记忆机制,解决传统世界生成模型在长时序…
GLM-Z1-Rumination – 智谱推出的沉思模型
GLM-Z1-Rumination是什么 GLM-Z1-Rumination 是智谱推出的沉思模型,基于 GLM-Z1 进一步优化而成,具体参数为GLM-Z1-Rumin…
Scribe – ElevenLabs 推出的高精度语音转文本模型
Scribe是什么 Scribe 是 ElevenLabs 推出的高精度语音转文本模型,专为多语言和复杂音频环境设计。支持99种语言,英语和意大利语的转录准确率分别达到9…
员工反弹与技术翻车:Meta 缩减“监控员工训练 AI”计划
Meta 公司此前宣布的内部 AI 训练计划遭遇重大挫折。这项名为“模型能力计划”(MCI)的工具原计划通过追踪员工的键盘敲击和鼠标点击数据,来获取真实的电脑使用数据并训…
Finedefics – 北大团队推出的细粒度多模态大模型
Finedefics是什么 Finedefics 是北京大学彭宇新教授团队推出的细粒度多模态大模型,提升多模态大语言模型(MLLMs)在细粒度视觉识别(FGVR)任务中的…
