GPTEngineer – 文本驱动生成Web网页的开源工具,AI自动写代码
GPTEngineer是什么 GPTEngineer 是一个基于 AI 技术通过简单的文本提示快速生成网页应用原型的开源工具。用户只需描述需求,AI 能自动编写并执行代码…
Adobe Firefly – Adobe推出的系列创意生成式AI模型
Adobe Firefly是什么 Adobe Firefly 是 Adobe 推出的一系列创意生成式 AI 模型,旨在帮助用户扩展其天生的创造力。这些模型集成在 Adob…
MMRole – AI多模态角色扮演智能体(MRPA)框架
MMRole是什么 MMRole是中国人民大学高瓴人工智能学院研究团队推出的的一种多模态角色扮演智能体(MRPA)框架。通过结合图像和文本,使智能体以特定角色进行更自然和…
CCI 3.0 – 智源研究院发布的大规模的中文互联网语料库
CCI 3.0是什么 CCI 3.0是智源研究院发布的一个大规模的中文互联网语料库,包含了1000GB的数据集和498GB的高质量子集CCI 3.0-HQ。该版本在数据规…
DisPose – 北大等多所高校推出的增强人物图像控制动画质量的技术
DisPose是什么 DisPose是北京大学、中国科学技术大学、清华大学和香港科技大学的研究团队共同推出的,提高人物图像动画质量的控制技术,基于从骨骼姿态和参考图像中提…
ScribbleDiff – 开源的涂鸦内容转换成图像的生成技术
ScribbleDiff是什么 ScribbleDiff是一种先进的文本到图像生成技术,基于用户简单涂鸦的视觉提示指导图像的生成过程。通过分析涂鸦确保生成的图像中的对象方…
CogVideoX-5B-I2V – 智谱 AI 开源的图生视频生成模型
CogVideoX-5B-I2V是什么 CogVideoX-5B-I2V 是智谱 AI 开源的一款图生视频模型,通过一张图片和文本提示词生成视频。模型采用了3D 因果变分…
Augmented Physics – 将教科书静态图表生成交互式物理模拟的AI技术
Augmented Physics是什么 Augmented Physics是一个创新的教育工具,基于集成机器学习技术,将物理教科书中的静态图表转换成互动式和嵌入式的物理…
ReHiFace-S – 硅基智能推出的实时人脸替换AI技术
ReHiFace-S是什么 ReHiFace-S是由硅基智能团队推出的开源项目,实现高保真、实时人脸替换的AI算法,用户通过简单的操作在视频或直播中进行面部交换。ReHi…
MemFree – 开源的混合AI搜索引擎,支持多模态搜索和提问
MemFree是什么 MemFree是一款开源的混合AI搜索引擎,通过整合多种AI模型和搜索引擎,提供高效、多样化的搜索体验。可以用文本、图像、文件和网页等多种方式进行搜…
OCTAVE – Hume AI推出的语音语言模型
OCTAVE 是什么 OCTAVE(Omni-Capable Text and Voice Engine)是Hume AI推出的新一代语音语言模型,结合EVI 2模型和O…
Boow-VTON – 阿里推出的AI虚拟试衣技术
Boow-VTON是什么 Boow-VTON是阿里巴巴推出的一种先进的虚拟试衣技术。能在野外场景中实现高质量的虚拟试衣效果,无需依赖精确的遮罩或修复工作。通过有效的数据增…
RapidPages – AI驱动的集成开放环境,实时生成UI组件和CSS代码
RapidPages是什么 RapidPages 是一个开源的集成开发环境(IDE),专注于基于AI技术快速生成 React 和 Tailwind CSS 的 UI 组件…
podlm-public – 开源的AI博客生成工具,支持网页URL、文本转换成博客
podlm-public是什么 podlm-public是一个开源AI播客工具,旨在创建一个中文版的NotebookLM替代品,专门用在将任意URL转换成播客内容,再推送…
NarratoAI – 开源自动化影视解说和视频剪辑的AI工具
NarratoAI是什么 NarratoAI 是基于AI技术自动化影视解说和编辑的工具。通过大型语言模型(LLM)理解视频内容,自动生成解说文案,并将文案转化为配音,同时…
GarDiff – AI虚拟试穿技术,生成高保真试穿图像保留服装细节
GarDiff是什么 GarDiff是一种创新的虚拟试穿技术,通过使用CLIP和VAE编码来提取服装的外观先验,结合服装聚焦适配器和高频细节增强算法,生成高保真且细节丰富…
