LongCat-2.0 – 美团开源的新一代万亿参数语言模型
LongCat-2.0是什么 LongCat-2.0 是美团开源的大规模 MoE 语言模型,拥有 1.6 万亿总参数,每 token 激活约 480 亿,基于 AI AS…
Nemotron-Labs-TwoTower – 英伟达开源的双塔架构扩散语言模型
Nemotron-Labs-TwoTower是什么 NVIDIA Nemotron-Labs-TwoTower 是英伟达开源的双塔架构扩散语言模型,总参数约60B、活跃参…
WorldCupVoice – 开源的 AI 实时体育解说系统
WorldCupVoice是什么 WorldCupVoice 是开源的 AI 实时体育解说系统,通过接入 Agora RTC 直播流,由视觉模型分析比赛画面并生成实时语音…
Wan-Streamer – 阿里开源的实时全双工多模态基础模型
Wan-Streamer是什么 Wan-Streamer 是阿里达摩院开源的端到端实时全双工多模态基础模型,通过统一因果 Transformer 架构将文本、音频、视频的…
Astryx – Meta 开源的 React 设计系统
Astryx是什么 Astryx 是 Meta 开源的 React 设计系统,目前处于 Beta 阶段。系统基于 React 与 StyleX 构建,提供 150+ 可访…
Octo – 明略科技开源的 AI-native 团队协作平台
Octo是什么 Octo 是明略科技开源的 AI-native 团队协作平台,将分散的 AI Agent 聚合到统一空间,通过 IM 形态实现人与 Agent、Agent…
AReaL 2.0 – 蚂蚁等开源的Agent在线强化学习基础架构
AReaL 2.0是什么 AReaL 2.0是蚂蚁联合香港科技大学、清华大学开源的Agent在线强化学习基础架构,能让已部署的Agent从真实交互轨迹中持续自我演进。AR…
Mirawork – 桌面 AI 办公智能体,覆盖办公全场景创作
Mirawork是什么 Mirawork 是安全优先的桌面 AI 办公智能体,支持 macOS/Windows/Linux。用户用自然语言下达任务,Mirawork能自动…
SemanticAudio – 港中文等推出的音频生成与编辑框架
SemanticAudio是什么 SemanticAudio 是香港中文大学、LIGHTSPEED、上海交通大学联合推出的音频生成与编辑框架。框架将文本到音频生成拆分为”…
Claude Sonnet 5 – Anthropic推出的最强智能体模型
Claude Sonnet 5是什么 Claude Sonnet 5是Anthropic推出的 Sonnet 系列中智能体能力最强的模型,支持制定计划、调用浏览器和终端等…
LiveWorld – 阿德莱德大学等推出的生成式视频世界模型
LiveWorld是什么 LiveWorld 是阿德莱德大学、澳大利亚国立大学等机构联合推出的生成式视频世界模型,核心解决视野外动态问题,当物体离开相机视野后,传统模型会…
全新蜕变!xAI 正式更名为 SpaceXAI,马斯克完成商业版图大整合
苹果与谷歌等巨头在 AI 领域激战正酣之际,埃隆·马斯克旗下的 AI 巨头 xAI 也于今日正式宣布更名为 SpaceXAI。随着全新品牌标识与社交媒体账号的同步上线,这…
TabFM – 谷歌开源的零样本表格基础模型
TabFM是什么 TabFM 是 Google Research 推出的零样本表格基础模型,支持对混合数值与类别特征的结构化数据进行分类(最多10类)和回归。模型在数百亿…
性能碾压对手!谷歌 Gemini 3.5 Pro 曝光:史诗级升级定档 7 月 17 日
据社交平台最新爆料显示,谷歌计划于今年 7 月 17 日正式发布全新的 Gemini 3.5 Pro 模型。这款备受瞩目的重磅模型将支持高达 200 万的超大上下文窗口,…
video-use – Browser Use 团队开源的 AI 视频剪辑 Agent
video-use是什么 Video-use 是 Browser Use 团队开源的 AI 视频剪辑 Agent,通过自然语言对话替代传统时间线操作。用户只需将原始素材放…
史上首次!苹果手表上线 Siri AI, 11 年语音助手迎来彻底进化
苹果今日向开发者推送了 watchOS 27 beta 3 测试版系统,新版系统首次加入了 Siri AI 及全新的 Siri 应用程序。这意味着 Apple Watch…
