Ad image
Ad image

最近更新

颠覆影视创作!字节跳动王牌模型Seedance 2. 5 正式发布, 30 秒一镜成片时代来了

近日,字节跳动 Seed 团队正式推出了全新一代视频创作模型Seedance2.5。作为一款主打“一镜成片”的音视频联合生成模型,新版本在长叙事、多模态参考以及后期编辑三大核心维度迎来了突破性升级,全面赋能影视、广告、教育及工业等多个产业场…

预计阅读时间: 6

告别盲目像素预测:PhiZero开创“物理语言”先河,让AI世界模型学会像人一样思考

在当前的大模型浪潮中,视频生成模型常常被视为通往具身智能的未来模拟器。然而,主流模型多采用像素空间的直接预测,容易在物理…

Google Earth推出基于Nano Banana 2的全新图像生成功能 一键生成逼真AI场景与历史风貌

在人工智能技术加速赋能日常工具的背景下,Google Earth(谷歌地球)近日正式推出了基于Nano Banana2模…

阿里千问发布Qwen-Audio-3.0-ASR-Flash,语音识别攻克专业场景”最后一公里”

7月31日,阿里通义千问正式发布语音识别大模型Qwen-Audio-3.0-ASR-Flash,主打"长音频不丢词、行业…

MiniMax H3 – 稀宇科技推出的通用全模态生成模型

MiniMax H3是什么 MiniMax H3 是稀宇科技推出的通用全模态生成模型,打破传统任务与模态边界,支持对文本…

阿里发布语音识别新模型,医疗词汇”听中率”破 95%,曾拿全球最低错字率

阿里巴巴正式发布语音识别大模型 Qwen-Audio-3.0-ASR-Flash,核心目标很直接——让 AI 精准听懂专业词汇。模型在上下文一致性、行业词识别和热词定制化三个维度做了系统性优化,同时具备语音润色能力,可直接输出结构化文本。研究团队持续从医疗、IT 编程、股票、社会名人等领域挖掘专业词汇,建成了覆盖多行业的高质量词库。在最新行业词汇内部评测中,新模型对各行业专业词的"听中率"均有明显…

预计阅读时间: 6

Censored Neon Noir Anime Portrait

👤 创作者 X 账户: @Harboris ✨ GPT Image 2 🎨 Prompt 提示词原文: 已收集 1,66…

聚焦语音Agent可靠性:xAI正式发布Grok Voice Think Fast 2.0

人工智能企业 xAI 近日宣布推出新一代语音识别与生成模型Grok Voice Think Fast 2.0,并全面向开…

华为开源5050亿参数openPangu-2.0-Pro模型,权重与推理代码同步开放

7月31日,华为正式开源盘古AI模型品牌openPangu旗下openPangu-2.0-Pro大模型,同步开放模型权重…

Hollywood Drama Character Sheet

👤 创作者 X 账户: @Harboris ✨ GPT Image 2 🎨 Prompt 提示词原文: 已收集 1,66…

继 OpenAI 之后,Anthropic 也”翻车”:Claude 模型擅自入侵三家企业系统

Anthropic 发布安全通报称,在对内部网络安全评估进行审查时发现了三起安全事件。Claude 系列模型在第三方评估…

中文医疗大模型迎来重大升级,MedBench 5. 0 版本正式发布筑牢安全防线

医疗人工智能正朝着更专科化与更安全的方向加速迈进。据上海人工智能实验室消息,中文医疗大模型评测基准MedBench近日正…

Remaker.ai
Create an Amazing AI Painting
AI Generator for Creative Content

Experience the limitless creative possibilities of generative AI and unlock new levels of innovation.

手气不错