Ad image
Ad image

最近更新

红果短剧发布AI角色规范,专项整治“高频AI脸”与素材侵权

7月24日,红果短剧发布《关于规范AI剧角色创作的公告》,从角色差异化与版权合规两个维度明确创作标准,旨在降低“高频AI脸”使用率,防范素材违规风险。规范要求,单部剧集主要角色需具备清晰区分度与高辨识度,严禁跨剧或跨角色复用高度相似形象,以…

预计阅读时间: 3

小鹏人形机器人广州工厂开启小批量试生产 预计2026年实现量产

小鹏人形机器人近日在广州工厂正式开启小批量试生产,量产产线已进入最后联调阶段,标志着其量产冲刺进入倒计时。此前,小鹏集团…

黑森林实验室放出 Flux3:首个原生生成音频的多模态基础模型,20 秒音画同步一次成型

德国人工智能初创公司黑森林实验室(Black Forest Labs)正式发布多模态基础模型 Flux3。它基于 Sel…

新晋菲尔兹奖得主IMO 满分天才 Tsimerman 官宣加入 OpenAI

当地时间7月23日上午,2026年国际数学家大会在费城开幕,本年度菲尔兹奖四位得主揭晓——邓煜、约翰·帕登、雅各布·齐默…

快手入局AI互动内容赛道,开放首批创作者招募

继抖音内测“AI互动空间”后,快手正式宣布将推出“AI互动内容”创作功能,目前已开放首批合作创作者招募,标志着短视频平台…

MAI-Voice-2-Flash – 微软推出的高速语音合成模型

MAI-Voice-2-Flash是什么 MAI-Voice-2-Flash 是微软AI团队推出的高速语音合成模型。模型专为高并发、低延迟语音场景优化,相比前代MAI-Voice-2速度提升约2倍,成本降低32%,同时保持自然语调与高语音质量。模型支持15种以上语言及细粒度情绪控制,已落地Dynamics 365 Contact Center与Azure Voice Live等产品,适用客服中心、…

预计阅读时间: 22

img2threejs – 开源的 AI Skill,支持单图转 Three.js 3D 模型

img2threejs是什么 img2threejs 是开源的 AI skill,能将单张参考图片自动转换为可交互的 T…

阿里开源0.8B文档解析模型OvisOCR2,端到端方案登顶OmniDocBench

7月24日,阿里巴巴宣布开源发布仅0.8B参数规模的文档解析模型OvisOCR2。在权威文档解析基准OmniDocBen…

腾讯甩出 WorkBuddy Bench:一套把代码、网页、办公、安全全装进来的编码智能体考场

评测编码智能体,过去总在几块割裂的场子里打转——修 bug 的看 SWE-bench,做前端的看 Design2Code…

德国黑森林实验室发布Flux3 多模态模型:原生音频生成, 20 秒音视频同步输出

德国AI初创公司黑森林实验室正式发布多模态基础模型Flux3。该模型基于Self-Flow架构打造,配备专用的图像、视频…

ChatGPT 桌面端装上了”真人口吻”:GPT-Live 语音上线,你说话它就在后台干活

OpenAI 今天给 ChatGPT 桌面应用动了一刀大升级——这个已经和 Codex 合体的客户端,正式引入了由 GP…

FLUX 3 – Black Forest Labs 推出的多模态基础模型

FLUX 3是什么 FLUX 3 是 Black Forest Labs 推出的多模态基础模型,首次在统一架构下联合学习…