Lobe Vidol – AI数字人交互平台,可与虚拟人和 3D 模型聊天互动
Lobe Vidol是什么 Lobe Vidol是开源的数字人创作平台,让每个人都能轻松创建和互动自己的虚拟偶像。Lobe Vidol提供流畅的对话体验、背景设置、动作姿…
GPT学术优化 – 专为学术研究和写作设计的多功能开源项目
GPT学术优化是什么 GPT学术优化(GPT Academic)是功能丰富的开源项目,专为学术研究和写作设计。GPT学术优化集成一键论文翻译、源代码解析、互联网信息获取、…
Vanna – 开源AI检索生成框架,自动生成精确的SQL查询
Vanna是什么 Vanna是开源的Python RAG(Retrieval-Augmented Generation)框架,能帮助用户基于大型语言模型(LLMs)为其数…
PersonaCraft – 首尔国立大学推出的单参考图像生成多身份全身图像技术
PersonaCraft是什么 PersonaCraft是韩国首尔国立大学推出的个性化全身图像合成技术,结合扩散模型和3D人类建模,能从单一参考图像生成多个人物的逼真、个…
StableAnimator – 复旦联合微软等机构推出的端到端身份一致性视频扩散框架
StableAnimator是什么 StableAnimator是复旦大学、微软亚洲研究院、虎牙公司和卡内基梅隆大学共同推出的端到端高质量身份保持视频扩散框架。Stabl…
I2V-01-Live – 海螺AI推出的图生视频模型,将静态图像转化为动态视频
I2V-01-Live是什么 I2V-01-Live是海螺AI推出的图生视频模型,能将静态二维图像转化为动态视频。模型基于深度学习技术,增强动作的流畅度和生动性,让人物或…
Genie 2 – 谷歌DeepMind推出的最新一代基础世界模型
Genie 2是什么 Genie 2是DeepMind推出的新一代大规模基础世界模型,仅凭一张图片生成长达1分钟的可交互3D游戏世界。Genie 2能模拟出物体交互、角色…
Luma Photon – Luma AI 推出的全新图像生成模型
Luma Photon是什么 Luma Photon 是 Luma AI 推出的新一代图像生成模型,用创新的架构提供超高图像质量和低成本效率。Luma Photon支持个…
TeleAI 视频生成大模型 – 中国电信AI研究院推出的视频生成模型
TeleAI 视频生成大模型是什么 TeleAI 视频生成大模型是中国电信AI研究院推出的视频生成模型,基于两阶段生成框架:先根据文本描述创建分镜头草图,再基于草图生成视…
Agents-A1 – 上海 AI Lab开源的混合专家智能体模型
Agents-A1是什么 Agents-A1是上海AI实验室开源的35B参数混合专家(MoE)智能体模型,专为复杂科研任务设计。模型通过知识-行动图谱构建可验证长轨迹基础…
TPDM – 西湖大学联合北大等高校推出的时间预测扩散模型
TPDM是什么 TPDM(Time Prediction Diffusion Model)是西湖大学MAPLE实验室、南方科技大学、北京大学及西湖大学高等研究院先进技术研…
ConsisID – 北大联合鹏城实验室等机构推出的文本到视频生成模型
ConsisID是什么 ConsisID是北京大学和鹏城实验室等机构推出的文本到视频(Text-to-Video, IPT2V)生成模型,基于频率分解技术保持视频中人物身…
Perplexideez – 开源本地AI搜索助手,智能搜索信息来源追溯
Perplexideez是什么 Perplexideez是本地AI助手,支持用户在网络和自托管应用中快速搜索信息。Perplexideez项目以Postgres数据库为基…
Micro LLAMA – 教学版 LLAMA 3模型实现,用于学习大模型的核心原理
Micro LLAMA是什么 Micro LLAMA是精简的教学版LLAMA 3模型实现,能帮助学习者理解大型语言模型架构。整个项目仅约180行代码,便于理解和学习。Mi…
GenCast – 谷歌DeepMind推出的AI气象预测模型
GenCast是什么 GenCast是DeepMind推出的革命性AI气象预测模型,基于扩散模型技术,提供长达15天的全球天气预报。GenCast在97.2%的预测任务中…
FullStack Bench – 字节豆包联合M-A-P社区开源的全新代码评估基准
FullStack Bench是什么 FullStack Bench是字节跳动豆包大模型团队与M-A-P社区联合推出的全新代码评估基准,专注于全栈编程和多语言编程能力评估…
