智谱AI发布GLM-5-Turbo:专为龙虾Agent优化,深度解决大模型工具调用与长任务失速难题
💡 站外导读:当前,大模型在落地到具体Agent应用时面临“中看不中用”的尴尬:工具调用不稳定、复杂任务理解不准、长流程执行易中断。这些“失速”问题严重制约了AI从“聊天…
腾讯开源Covo-Audio:70亿参数端到端语音大模型,挑战GPT-4o的实时对话新标杆
💡 站外导读:传统语音AI依赖ASR-LLM-TTS的级联架构,存在延迟高、误差累积的行业痛点,严重制约了实时交互体验。随着GPT-4o等端到端模型的出现,行业迎来范式变…
Mistral AI开源Leanstral:120B参数仅$18,重新定义AI代码智能体与形式化证明
💡 站外导读:当AI编程助手从生成代码迈向确保代码绝对正确,形式化验证成为关键瓶颈。传统方法成本高昂、专家稀缺,限制了高可信软件(如航天、金融系统)的开发。Mistral…
Midjourney V8震撼发布:速度飙升5倍、原生2K直出,AI图像生成进入新时代
💡 站外导读:当AI绘画工具还在为生成速度、文本渲染和画面连贯性焦头烂额时,Midjourney直接甩出了一张王牌——V8模型。2026年3月17日发布的这一最新版本,以…
理想汽车发布MindVLA-o1:原生多模态VLA架构,定义自动驾驶与具身智能新范式
💡 站外导读:当行业仍在争论端到端纯视觉与多传感器融合路线孰优孰劣时,理想汽车已悄然开辟新赛道。其最新发布的MindVLA-o1,不仅是单纯的自动驾驶模型,更是一个面向“…
LangGraph – 基于图结构构建与部署多代理动态工作流的开源框架
LangGraph是什么 LangGraph是为构建状态化、多智能体(Multi-Agent) 系统而设计的,特别是与大型语言模型(LLMs)一起使用时,用在创建代理和多…
小米MiMo-V2-TTS重磅发布:上亿小时数据训练,Agent时代的语音合成革命
💡 站外导读:随着AI Agent时代到来,语音交互正从“能听清”迈向“有灵魂”。传统TTS系统在情感表达、多方言支持和复杂语境理解上瓶颈明显,难以满足智能体人性化交互需…
R2R – AI 检索增强生成应用开发平台,支持多模态内容处理、混合搜索、知识图谱构建
R2R是什么 R2R是先进的AI检索系统,专注于Retrieval-Augmented Generation(增强型检索生成)。R2R集成多模态内容摄取、混合搜索、知识图…
小米MiMo-V2-Omni全模态Agent基座模型发布:三模态融合、百万上下文,挑战Gemini与Claude
💡 站外导读:当AI行业还在争论多模态如何拼接时,小米已悄然亮出底牌。2026年3月,代号Healer Alpha的模型匿名调用量登顶OpenRouter榜单,测试用户惊…
Eliza – 开源多功能AI Agent框架,快速搭建智能、高效的AI系统
Eliza是什么 Eliza 是ai16z开源的多代理模拟框架,旨在创建、部署和管理自主 AI 代理。 以 TypeScript 作为编程语言开发,为构建智能代理提供了一…
smoltalk-chinese – OpenCSG 开源专为中文大型语言模型设计的合成数据集
smoltalk-chinese是什么 smoltalk-chinese 是OpenCSG开源的专为中文大型语言模型(LLM)设计的合成数据集,该数据集包含超过 70 万…
