FeyNoBg – Feyn Labs 开源的自动背景去除模型
FeyNoBg是什么 FeyNoBg 是 Feyn Labs 推出的开源自动背景去除模型,基于 BiRefNet 架构深度改进,拥…
Qwen-Audio-3.0-ASR-Flash – 阿里千问推出的语音识别大模型
Qwen-Audio-3.0-ASR-Flash是什么 Qwen-Audio-3.0-ASR-Flash 是阿里千问团队推出的语音…
微信公众号推出 AI”一键排版”:自动分段、生成小标题、匹配配图三步到位
微信公众号平台正式上线 AI 智能排版能力"一键排版"。创作者在手机端公众号助手 App 或网页版后台编辑文章时,系统会自动识别内…
颠覆影视创作!字节跳动王牌模型Seedance 2. 5 正式发布, 30 秒一镜成片时代来了
近日,字节跳动 Seed 团队正式推出了全新一代视频创作模型Seedance2.5。作为一款主打“一镜成片”的音视频联合生成模型,…
韩国最大 AI 模型问世:LG 发布 7500 亿参数 K-EXAONE 2.0,Apache 开源直面中国模型
LG AI 研究院 7 月 31 日在 Hugging Face 上正式发布 K-EXAONE 2.0 模型,这是韩国科技信息通信…
Claude“闯出”测试环境?Anthropic承认AI模型曾入侵三家机构系统
Anthropic发布最新安全报告披露,在内部安全测试过程中,旗下Claude系列模型曾因测试环境配置问题意外访问互联网,并未经授…
阿里发布语音识别新模型,医疗词汇”听中率”破 95%,曾拿全球最低错字率
阿里巴巴正式发布语音识别大模型 Qwen-Audio-3.0-ASR-Flash,核心目标很直接——让 AI 精准听懂专业词汇。模…
告别盲目像素预测:PhiZero开创“物理语言”先河,让AI世界模型学会像人一样思考
在当前的大模型浪潮中,视频生成模型常常被视为通往具身智能的未来模拟器。然而,主流模型多采用像素空间的直接预测,容易在物理规律的稳定…
Google Earth推出基于Nano Banana 2的全新图像生成功能 一键生成逼真AI场景与历史风貌
在人工智能技术加速赋能日常工具的背景下,Google Earth(谷歌地球)近日正式推出了基于Nano Banana2模型的全新图…
阿里千问发布Qwen-Audio-3.0-ASR-Flash,语音识别攻克专业场景”最后一公里”
7月31日,阿里通义千问正式发布语音识别大模型Qwen-Audio-3.0-ASR-Flash,主打"长音频不丢词、行业词不用教"…
MiniMax H3 – 稀宇科技推出的通用全模态生成模型
MiniMax H3是什么 MiniMax H3 是稀宇科技推出的通用全模态生成模型,打破传统任务与模态边界,支持对文本、图像、视…
苹果暗示Siri AI将引入付费限制,重度用户或需订阅iCloud+
在蒂姆·库克担任苹果CEO期间最后一次财报电话会议上,人工智能成为投资者关注焦点。围绕Siri AI能否推动iPhone升级需求,…
全模态视频模型迎来新突破:MiniMax正式发布H3 并承诺开源权重
在文本大模型领域持续发力之后,人工智能企业 MiniMax 于近日正式推出了全新的全模态生成模型MiniMax H3,并向行业承诺…

