AI 工具 Whisper 最近更新: 2026年5月23日 下午6:45 SHARE Whisper是一种通用的语音识别模型。它在不同音频的大型数据集上进行训练,也是一个多任务模型,可以执行多语言语音识别以及语音翻译和语言识别。 https://whisper.ai/ DeepMind推出CoF:视频模型的‘思维链’,让AI像人一样逐帧思考解决视觉难题 阿里通义发布万亿参数旗舰模型Qwen3-Max-Preview:支持100+语言,256K超长上下文,引领AI新高度 Office-PowerPoint-MCP-Server:基于MCP协议的开源PPT自动化工具,用AI指令高效生成与编辑演示文稿 Skywork R1V4-Lite:昆仑万维开源轻量级多模态智能体,单图驱动视觉推理新范式 谷歌DeepMind重磅开源TIPSv2:多模态模型SOTA,零样本分割领先,参数效率极高 分享 Email 复制链接 打印 Share 上一篇 Compose AI 下一篇 Cogniflow 发表评价 发表评价 取消回复您的邮箱地址不会被公开。 必填项已用 * 标注 Please select a rating! 评分 Rate… Perfect Good Average Not that Bad Very Poor Your Comment *你的姓名 * Your Email * 在此浏览器中保存我的显示名称、邮箱地址和网站地址,以便下次评论时使用。 Δ - 入群领取知识星球折扣卷, 仅剩99份 - 最近更新 FeyNoBg – Feyn Labs 开源的自动背景去除模型 AIGC 资讯 Qwen-Audio-3.0-ASR-Flash – 阿里千问推出的语音识别大模型 AIGC 资讯 微软云端隐忧:千亿营收背后的增速换挡与杠杆风险 AIGC 资讯 微信公众号推出 AI”一键排版”:自动分段、生成小标题、匹配配图三步到位 AIGC 资讯