FeyNoBg – Feyn Labs 开源的自动背景去除模型
FeyNoBg是什么 FeyNoBg 是 Feyn Labs 推出的开源自动背景去除模型,基于 BiRefNet 架构深度改进,拥有 2.63 亿参数。模型在 UHRSD…
Qwen-Audio-3.0-ASR-Flash – 阿里千问推出的语音识别大模型
Qwen-Audio-3.0-ASR-Flash是什么 Qwen-Audio-3.0-ASR-Flash 是阿里千问团队推出的语音识别大模型,现已通过阿里云百炼平台开放调…
微软云端隐忧:千亿营收背后的增速换挡与杠杆风险
在当下的云服务赛道中,巨头们的军备竞赛正在全面加速。微软在刚刚过去的财年中,年营收首次突破 1000 亿美元大关,同比增长达到43%。然而,这份成绩单背后并非高枕无忧,其…
微信公众号推出 AI”一键排版”:自动分段、生成小标题、匹配配图三步到位
微信公众号平台正式上线 AI 智能排版能力"一键排版"。创作者在手机端公众号助手 App 或网页版后台编辑文章时,系统会自动识别内容结构并弹出排版图标,点击即可完成整套排…
颠覆影视创作!字节跳动王牌模型Seedance 2. 5 正式发布, 30 秒一镜成片时代来了
近日,字节跳动 Seed 团队正式推出了全新一代视频创作模型Seedance2.5。作为一款主打“一镜成片”的音视频联合生成模型,新版本在长叙事、多模态参考以及后期编辑三…
我国人工智能迎来全产业链突破,将加快《人工智能法》立法
国产大模型全球下载量突破 100 亿次,万亿级开源模型频出,我国人工智能正迎来全产业链的整体突破。国家发展改革委政策研究室主任、新闻发言人蒋毅在 7 月 31 日的新闻发…
特斯拉中国车机正式接入豆包大模型
7 月 31 日消息,特斯拉中国于今日开始分批次推送2026.14. 13 版本的车机软件更新。此次更新覆盖了Model 3、Model Y、Model S以及Model…
韩国最大 AI 模型问世:LG 发布 7500 亿参数 K-EXAONE 2.0,Apache 开源直面中国模型
LG AI 研究院 7 月 31 日在 Hugging Face 上正式发布 K-EXAONE 2.0 模型,这是韩国科技信息通信部主权人工智能基金会模型项目下开发的第二…
Claude“闯出”测试环境?Anthropic承认AI模型曾入侵三家机构系统
Anthropic发布最新安全报告披露,在内部安全测试过程中,旗下Claude系列模型曾因测试环境配置问题意外访问互联网,并未经授权进入三家不同机构的生产系统。事件涉及C…
阿里发布语音识别新模型,医疗词汇”听中率”破 95%,曾拿全球最低错字率
阿里巴巴正式发布语音识别大模型 Qwen-Audio-3.0-ASR-Flash,核心目标很直接——让 AI 精准听懂专业词汇。模型在上下文一致性、行业词识别和热词定制化…
告别盲目像素预测:PhiZero开创“物理语言”先河,让AI世界模型学会像人一样思考
在当前的大模型浪潮中,视频生成模型常常被视为通往具身智能的未来模拟器。然而,主流模型多采用像素空间的直接预测,容易在物理规律的稳定性和连贯性上出现偏差。针对这一行业痛点,…
Google Earth推出基于Nano Banana 2的全新图像生成功能 一键生成逼真AI场景与历史风貌
在人工智能技术加速赋能日常工具的背景下,Google Earth(谷歌地球)近日正式推出了基于Nano Banana2模型的全新图像生成功能。通过将卫星、航空与3D实景地…
阿里千问发布Qwen-Audio-3.0-ASR-Flash,语音识别攻克专业场景”最后一公里”
7月31日,阿里通义千问正式发布语音识别大模型Qwen-Audio-3.0-ASR-Flash,主打"长音频不丢词、行业词不用教",已在阿里云百炼平台开放调用。新模型在五…
MiniMax H3 – 稀宇科技推出的通用全模态生成模型
MiniMax H3是什么 MiniMax H3 是稀宇科技推出的通用全模态生成模型,打破传统任务与模态边界,支持对文本、图像、视频、音频的统一理解与原生生成。模型能输出…
苹果暗示Siri AI将引入付费限制,重度用户或需订阅iCloud+
在蒂姆·库克担任苹果CEO期间最后一次财报电话会议上,人工智能成为投资者关注焦点。围绕Siri AI能否推动iPhone升级需求,以及AI基础设施投入带来的成本压力,苹果…
全模态视频模型迎来新突破:MiniMax正式发布H3 并承诺开源权重
在文本大模型领域持续发力之后,人工智能企业 MiniMax 于近日正式推出了全新的全模态生成模型MiniMax H3,并向行业承诺将在几天内全面开源模型权重。作为一款支持…
