Llama Tutor – 开源的AI学习平台,提供学习主题生成定制学习计划
Llama Tutor是什么 Llama Tutor 是一个基于AI的个性化学习平台,由 Llama 3.1 和 Together AI 技术驱动,是一个完全开源的项目。…
ComfyGen – 英伟达联合特拉维夫推出的文本到图像生成系统
ComfyGen是什么 ComfyGen是由NVIDIA和特拉维夫大学研究人员推出的一种文本到图像生成系统,基于大型语言模型(LLM)自动创建与用户文本提示相匹配的工作流…
restorePhotos.io – 开源的AI照片修复项目,高质量修复老旧照片
restorePhotos.io 是什么 restorePhotos.io 是一个开源的AI项目,专注于修复老旧和模糊的人脸照片。用GFPGAN机器学习模型,基于Next…
PDFtoChat – AI驱动的与PDF互动提取关键信息的开源项目
PDFtoChat是什么 PDFtoChat 是一个开源的创新AI项目,支持用户基于自然语言对话的方式与 PDF 文件互动。工具基于最新的 AI 技术,包括 Togeth…
Self-Taught Evaluators – Meta推出的新型模型评估方法
Self-Taught Evaluators是什么 Self-Taught Evaluators是一种新型的模型评估方法,基于自我训练的方式提高大型语言模型(LLM)的评…
TurboSeek – AI驱动的开源的智能搜索引擎
TurboSeek是什么 TurboSeek是一个开源的AI搜索引擎,由Together.ai提供技术支持。基于现代化的技术栈,包括Next.js、Tailwind、Bi…
Napkins.dev – AI驱动的支持截图或线框图快速生成网页应用的开源项目
Napkins.dev是什么 Napkins.dev是一个创新的开源项目,基于AI技术将用户的截图或线框图快速转换成可运行的网页应用程序。项目背后依托于Meta的Llam…
MDM – 苹果推出开源的新型扩散模型框架
MDM是什么 Matryoshka Diffusion Models(MDM)是由苹果公司研究人员推出的一种新型扩散模型框架,旨在解决生成高分辨率图像和视频时面临的计算和…
Fluid – 谷歌联合MIT推出文本到图像的自回归生成模型
Fluid是什么 Fluid是由Google DeepMind和MIT共同推出的文本到图像的自回归生成模型,基于连续标记和随机生成顺序的方法,在视觉质量和评估性能上取得突…
SaRA – 上海交大联合腾讯推出的预训练扩散模型微调方法
SaRA是什么 SaRA是一种新型的预训练扩散模型微调方法,由上海交通大学和腾讯优图实验室共同推出。基于重新激活预训练过程中看似无效的参数,让模型能适应新任务。SaRA基…
Quanta Quest – 开源的AI个人数据库产品,多平台数据整合
Quanta Quest是什么 Quanta Quest是一款面向个人用户的开源AI智能数据库产品,基于将个人数据如Gmail、Dropbox、Notion等整合到一个平…
BiGR – 统一条件生成图像的模型框架,增强生成质量和表示能力
BiGR是什么 BiGR是一种新型的条件图像生成模型,用紧凑的二进制潜在代码进行生成训练,增强图像的生成质量和表示能力。作为首个在同一框架内统一生成和判别任务的模型,Bi…
MoE++ – 昆仑万维和北大联合推出的混合专家架构
MoE++是什么 MoE++是一种新型的混合专家(Mixture-of-Experts)架构,由昆仑万维2050研究院与北大袁粒团队联合推出。基于引入零计算量专家,零专家…
Granite 3.0 – IBM推出用于企业级应用的系列AI模型
Granite 3.0是什么 Granite 3.0 是 IBM 推出的一系列先进的AI模型,能在多个学术和企业基准测试中展现出卓越的性能。模型设计用在企业级应用,能执行…
Project Turntable – Adobe推出可旋转操作2D矢量图像的AI工具
Project Turntable是什么 Project Turntable是Adobe在2024年MAX大会上推出的一款创新AI工具。工具能让用户像操作3D对象一样旋转…
OmniAI – AI文档处理平台,支持多格式批量处理和信息提取
OmniAI是什么 OmniAI是一个强大的AI文档处理平台,基于先进的OCR技术,支持对PDF、DOCX、图片等多种文件格式进行快速处理和数据提取。平台支持用户轻松创建…
