港科大、美团联手发布PosterCraft:告别模板,用AI生成高美学海报的统一框架
💡 站外导读:在数字营销与品牌传播高度依赖视觉内容的今天,海报设计仍是耗时耗力的环节。传统工具依赖设计师经验,而现有AI工具常受限于模板化布局和粗糙的文字渲染,难以兼顾艺…
谷歌发布首款本地具身智能模型Gemini Robotics On-Device:50个样本即可学会新任务,机器人离线精细操作时代来临
💡 站外导读:当机器人必须依赖云端才能思考,网络延迟和连接中断便是致命瓶颈。谷歌DeepMind推出的Gemini Robotics On-Device,作为首个可在机器…
OmniAvatar深度解析:浙大阿里联手打造音频驱动全身视频生成AI模型,实现精准唇形同步与复杂交互
💡 站外导读:在AIGC(人工智能生成内容)浪潮席卷全球的背景下,如何让AI生成的虚拟形象“动起来”且“动得真”,成为了行业核心痛点。传统方法往往难以实现音频与全身动作,…
AnimaTensor:基于V-Prediction技术的二次元图像生成模型|吐司AI发布Pro/Regular版本
💡 站外导读:随着AIGC技术在动漫、游戏、虚拟偶像等领域的渗透,创作者对高质量、风格化的二次元图像生成工具需求激增。传统模型常面临生成效率低、细节丢失、美学理解不足等痛…
阿里达摩院联合浙肿医院发布DAMO GRAPE:平扫CT识别早期胃癌,敏感性85.1%引领AI医疗突破
💡 站外导读:胃癌是全球高发恶性肿瘤,早期症状隐匿导致诊断率低,传统胃镜筛查侵入性强、依从性差,大量患者错失最佳治疗时机。与此同时,AI医疗影像技术正以前所未有的速度重塑…
谷歌重磅开源Gemini CLI:免费调用Gemini 2.5 Pro百万上下文窗口,AI编程利器全面解析
💡 站外导读:在AI编程助手成为开发者标配的今天,谷歌重磅开源Gemini CLI,免费提供旗舰级Gemini 2.5 Pro模型支持。这款终端AI工具直击开发者核心痛点…
