AnimePro FLUX – 动漫风格图像生成模型,基于Flux.1 Shnell模型微调
AnimePro FLUX是什么 AnimePro FLUX是基于Apache 2.0许可的动漫风格图像生成模型,专为生成高质量二次元插画设计。AnimePro FLUX…
VideoChat – 开源的实时数字人对话系统,首包延迟低至3秒
VideoChat是什么 VideoChat是开源的实时数字人对话系统,支持语音输入和实时对话功能。用户自定义数字人的形象和音色,无需训练即可进行音色克隆,首包延迟可低至…
TableGPT2 – 浙大推出整合与处理表格数据的多模态大模型
TableGPT2是什么 TableGPT2是浙江大学推出的新型大型多模态模型,针对表格数据的整合与处理。首次将结构化数据作为独立模态进行训练,直接理解并操作数据库、Ex…
GenXD – 新加坡国立和微软共同推出的通用3D和4D联合生成框架
GenXD是什么 GenXD是新加坡国立大学和微软公司共同推出的3D-4D联合生成框架,能从任意数量的条件图像中生成高质量的3D和4D场景。框架用一个数据整理流程从视频中…
Qwen-Audio-3.0-Realtime – 阿里推出的实时语音交互模型
Qwen-Audio-3.0-Realtime是什么 Qwen-Audio-3.0-Realtime 是阿里通义团队推出的实时语音交互对话模型,提供 Plus与 Flas…
AlphaFold 3 – 谷歌DeepMind开源的结构预测统一框架
AlphaFold 3是什么 AlphaFold 3是谷歌DeepMind团队推出的AI模型,能预测蛋白质、核酸(DNA和RNA)、小分子、离子及修饰残基等生物分子的三维…
PDFMathTranslate – 开源的PDF文档翻译和双语对照工具
PDFMathTranslate是什么 PDFMathTranslate是开源的PDF文档翻译工具,设计用于翻译科技论文等PDF文件,能保留原文的排版,包括公式和图表。P…
MoneyPrinterTurbo – 开源的AI短视频生成工具
MoneyPrinterTurbo是什么 MoneyPrinterTurbo是开源的AI短视频生成工具,能自动化地根据用户提供的视频主题或关键词生成视频文案、素材、字幕和…
Xiaomi-Robotics-U0 – 小米推出的统一具身合成模型
Xiaomi-Robotics-U0是什么 Xiaomi-Robotics-U0 是小米推出的 380 亿参数统一具身合成模型,基于世界基础模型持续训练,联合优化文生图、…
努比亚率先完成智能体大模型备案,全球首款AI智能体手机即亮相
近日,努比亚技术有限公司的总裁倪飞在发布会上宣布,该公司已经率先完成了智能体大模型的备案。这一举动标志着努比亚在人工智能领域迈出了重要一步,他们即将推出全球首款 AI 智…
X2.0 – Xmax AI 推出的全球首个实时交互视频生成模型
X2.0是什么 X2.0 是 Xmax AI 推出的全球首个实时交互视频生成模型,支持毫秒级流式生成。用户通过摄像头可实时替换角色服装、召唤虚拟物体、触屏操控画面,实现可…
我国首部AI拟人化互动服务新规今起施行,六大红线明确划定,不得向未成年人提供虚拟伴侣
由国家网信办、国家发改委、工信部、公安部、国家市场监管总局五部门联合发布的《人工智能拟人化互动服务管理暂行办法》正式施行。该办法明确了服务提供者的安全主体责任,针对具有情…
文心iRAG – 百度推出检索增强的文生图技术,解决生成上的幻觉问题
文心iRAG是什么 文心iRAG是百度在2024年百度世界大会上推出的检索增强的文生图技术(iRAG)技术,结合了百度搜索的亿级图片资源和强大的基础模型能力,解决大模型在…
MOSS-VL-Realtime – OpenMOSS 开源的视觉语言模型
MOSS-VL-Realtime是什么 MOSS-VL-Realtime 是 OpenMOSS 开源的 11B 参数流式视觉语言模型,专为实时视频理解设计。模型支持边看边…
Vidu 1.5 – 生数科技推出支持多主体一致性的多模态大模型
Vidu 1.5是什么 Vidu 1.5是生数科技推出的AI视频生成平台最新版本,致力于帮助创作者自由表达和高效创作。具备多模态视频大模型,支持参考生视频、图生视频和文生…
WAIC2026 大会火力全开!大模型概念股 MINIMAX 与智谱股价狂飙超 8%
在即将召开的 2026 世界人工智能大会(WAIC2026)前,港股市场上与人工智能相关的大模型概念股迎来了集体上涨。7 月 15 日,MINIMAX-W(00100.H…
