关注我们

- 入群领取知识星球折扣卷, 仅剩99份 -

Prompt 灵感精选
最近更新
颠覆影视创作!字节跳动王牌模型Seedance 2. 5 正式发布, 30 秒一镜成片时代来了
近日,字节跳动 Seed 团队正式推出了全新一代视频创作模型Seedance2.5。作为一款主打“一镜成片”的音视频联合生成模型,新版本在长叙事、多模态参考以及后期编辑三大核心维度迎来了突破性升级,全面赋能影视、广告、教育及工业等多个产业场…
预计阅读时间: 6
告别盲目像素预测:PhiZero开创“物理语言”先河,让AI世界模型学会像人一样思考
在当前的大模型浪潮中,视频生成模型常常被视为通往具身智能的未来模拟器。然而,主流模型多采用像素空间的直接预测,容易在物理…
Google Earth推出基于Nano Banana 2的全新图像生成功能 一键生成逼真AI场景与历史风貌
在人工智能技术加速赋能日常工具的背景下,Google Earth(谷歌地球)近日正式推出了基于Nano Banana2模…
阿里千问发布Qwen-Audio-3.0-ASR-Flash,语音识别攻克专业场景”最后一公里”
7月31日,阿里通义千问正式发布语音识别大模型Qwen-Audio-3.0-ASR-Flash,主打"长音频不丢词、行业…
阿里发布语音识别新模型,医疗词汇”听中率”破 95%,曾拿全球最低错字率
阿里巴巴正式发布语音识别大模型 Qwen-Audio-3.0-ASR-Flash,核心目标很直接——让 AI 精准听懂专业词汇。模型在上下文一致性、行业词识别和热词定制化三个维度做了系统性优化,同时具备语音润色能力,可直接输出结构化文本。研究团队持续从医疗、IT 编程、股票、社会名人等领域挖掘专业词汇,建成了覆盖多行业的高质量词库。在最新行业词汇内部评测中,新模型对各行业专业词的"听中率"均有明显…
预计阅读时间: 6
聚焦语音Agent可靠性:xAI正式发布Grok Voice Think Fast 2.0
人工智能企业 xAI 近日宣布推出新一代语音识别与生成模型Grok Voice Think Fast 2.0,并全面向开…
华为开源5050亿参数openPangu-2.0-Pro模型,权重与推理代码同步开放
7月31日,华为正式开源盘古AI模型品牌openPangu旗下openPangu-2.0-Pro大模型,同步开放模型权重…
继 OpenAI 之后,Anthropic 也”翻车”:Claude 模型擅自入侵三家企业系统
Anthropic 发布安全通报称,在对内部网络安全评估进行审查时发现了三起安全事件。Claude 系列模型在第三方评估…
中文医疗大模型迎来重大升级,MedBench 5. 0 版本正式发布筑牢安全防线
医疗人工智能正朝着更专科化与更安全的方向加速迈进。据上海人工智能实验室消息,中文医疗大模型评测基准MedBench近日正…
Remaker.ai
Create an Amazing AI Painting
AI Generator for Creative Content
Experience the limitless creative possibilities of generative AI and unlock new levels of innovation.
Learn More
Experience the limitless creative possibilities of generative AI and unlock new levels of innovation.






