Claude Opus 4.6发布:百万token上下文+自主智能体,全面超越GPT-5.2?
💡 站外导读:当大型语言模型(LLM)的竞争进入深水区,单纯的参数规模已不再是唯一焦点。如何突破上下文长度限制、提升复杂任务的自主执行能力,成为行业新赛点。Anthrop…
蚂蚁灵波科技开源LingBot-VA:首个通用机器人视频-动作世界模型,30次演示学会新技能
💡 站外导读:当前,通用机器人控制面临数据依赖高、泛化能力弱、长程任务执行难等核心痛点,严重制约了其在家庭服务、工业制造等真实场景的落地。在人工智能迈向具身智能的大背景下…
Mistral Small 4 开源发布:统一推理、多模态与编码的全能模型,性能飙升成本骤降
💡 站外导读:在 AI 应用追求“既强又省”的当下,企业部署常面临模型切换繁琐、多模态支持割裂、推理成本高企的痛点。Mistral AI 以开源的 Mistral Sma…
蚂蚁开源万亿参数思考模型Ring-2.5-1T:长文本吞吐提升3倍,IMO竞赛达金牌水平
💡 站外导读:随着大模型参数规模突破万亿,如何在长序列场景下实现高效推理成为行业核心挑战。蚂蚁集团inclusionAI团队开源的Ring-2.5-1T模型,通过创新的混…
小米开源首代机器人VLA大模型Xiaomi-Robotics-0:47亿参数MoT架构,实现实时流畅控制
💡 站外导读:具身智能(Embodied AI)正成为人工智能的下一个突破焦点,但机器人“大脑”与“小脑”的高效协同、以及实时控制中的延迟卡顿问题,始终是阻碍其从实验室走…
京东开源JoyAI-LLM-Flash:48B参数MoE架构,3B激活参数实现128K超长上下文与高效推理
💡 站外导读:在追求模型性能与部署效率平衡的AI竞赛中,如何以更低的计算成本实现更强的智能?京东开源的JoyAI-LLM-Flash给出了一个创新答案:它采用混合专家架构…
蚂蚁集团Ming-omni-tts重磅开源:16.8B参数统一音频生成大模型,粤语情感控制超93%,超越SeedTTS引领AIGC音频新范式
💡 站外导读:当前AI语音合成领域正面临多模态协同与精细控制的核心挑战:传统模型往往局限于单一语音生成,难以应对复杂场景下的多音轨需求,且缺乏对方言、情感等细粒度属性的精…
Google DeepMind发布Lyria 3:AI音乐生成模型重大突破,一句话生成带人声的30秒完整歌曲
💡 站外导读:在AIGC席卷内容创作的浪潮中,音乐生成领域长期面临“质量与易用性难以兼得”的痛点。用户渴望能像生成图片一样便捷地创作个性化音乐,但多数工具要么需要专业音乐…
Gemini 3.1 Pro:谷歌最强AI推理模型发布,性能飙升148%重塑复杂任务处理
💡 站外导读:当AI竞赛进入深水区,单纯的参数增长已难满足产业需求,推理能力成为衡量模型智能水平的核心标尺。谷歌最新发布的Gemini 3.1 Pro,正是对这一趋势的强…
