Follow-Your-Canvas – 腾讯与清华合作推出的高分辨率视频扩展技术
Follow-Your-Canvas是什么 Follow-Your-Canvas 是由腾讯混元团队与清华大学等机构合作推出的一种高分辨率视频扩展技术。通过分布式处理和布局…
auto-video-generator – AI自动解说视频生成器
auto-video-generator是什么 auto-video-generator是AI自动解说视频生成器,能实现一键生成解说视频。用户只需输入主题,系统便自动撰写…
CursorCore – 程序员的AI编程辅助框架,对话形式交互理解上下文
CursorCore是什么 CursorCore是一个基于大型语言模型(LLMs)的编程辅助框架,用对话式交互帮助程序员更高效地编写和修改代码。框架整合编程过程中的各种信…
LightEval – Hugging Face推出的轻量级AI大模型评估工具
LightEval是什么 LightEval是Hugging Face推出的一款轻量级AI评估工具,专门用于评估大型语言模型(LLMs)。LightEval支持多任务处理…
DCLM-7B – 苹果公司与合作团队推出的开源小模型
DCLM-7B 是什么 DCLM-7B是由苹果公司联合研究团队推出的70亿参数开源小模型,性能超越Mistral-7B,接近Llama 3和Gemma。最近,苹果公司作为…
豆包AI视频模型 – 字节跳动推出的AI视频生成大模型:PixelDance和Seaweed
豆包AI视频模型是什么 豆包AI视频模型是字节跳动推出的两款AI视频生成大模型:PixelDance 和 Seaweed 。PixelDance基于DiT结构,擅长理解复…
VisionFM – 通用眼科AI大模型,具备少样本多种疾病诊断能力
VisionFM是什么 VisionFM(伏羲慧眼)是多模态多任务的视觉基础模型,专为通用眼科人工智能而设计。通过预训练3.4百万张来自560,457个个体的眼科图像,覆…
TurboEdit – Adobe推出的AI即时图像编辑模型
TurboEdit是什么 TurboEdit是Adobe Research 推出的AI即时图像编辑模型。通过编码器迭代反演和基于文本的精细控制,能够在几步内实现对图像的精…
FLUX1.1 – Black Forest Labs团队推出的超写实AI图像生成模型,代号“蓝莓”
FLUX1.1是什么 FLUX1.1 Pro是Black Forest Labs团队最新推出的升级版AI图像生成模型,代号“蓝莓”,提供比前代快6倍的生成速度,同时保持了…
Filmfotos – 模拟和还原胶片质感效果的LoRA模型
Filmfotos是什么 Filmfotos是由DynamicWang推出的的基于Flux架构的LoRA模型,专注于模拟和还原胶片的质感效果。以低饱和度的日系胶片风格为特…
VFusion3D – Meta联合牛津大学推出的AI生成3D模型项目
VFusion3D是什么 VFusion3D 是由 Meta 和牛津大学的研究人员共同推出的AI生成3D模型项目,能从单张图片或文本描述中生成高质量的3D对象。VFusi…
MM1.5 – 苹果推出的升级版多模态大模型
MM1.5是什么 MM1.5是苹果公司推出的多模态大型语言模型,旨在增强文本丰富图像理解、视觉指代和定位以及多图像推理能力。模型基于数据为中心的训练方法,在大规模预训练、…
RegionDrag – 港大和牛津联合开发的基于区域的图像编辑技术
RegionDrag是什么 RegionDrag是由香港大学和牛津大学联合开发的一种基于区域的图像编辑技术。基于扩散模型,让用户定义手柄区域和目标区域来表达编辑意图,实现…
LivePortrait – 快手推出的开源人像动画生成框架
LivePortrait是什么 LivePortrait是快手推出的开源人像动画生成框架,专注于高效、可控地将驱动视频的表情和姿态迁移至静态或动态人像,创造出富有表现力的…
美图奇想大模型 – 美图公司推出的AI视觉大模型
美图奇想大模型是什么 美图奇想大模型(MiracleVision)是美图公司推出的一款AI视觉大模型,专注于美学创作,包括东方美学、人像和商业设计等。模型完成了视频生成能…
MetaMorph – 统一多模态理解与生成大模型,基于VPiT 预测多模态 token
MetaMorph是什么 MetaMorph是多模态大模型(MLLM),通过指令微调(Instruction Tuning)实现视觉理解和生成。它提出了一种名为Visua…
