ReHiFace-S – 硅基智能推出的实时人脸替换AI技术
ReHiFace-S是什么 ReHiFace-S是由硅基智能团队推出的开源项目,实现高保真、实时人脸替换的AI算法,用户通过简单的操作在视频或直播中进行面部交换。ReHi…
MemFree – 开源的混合AI搜索引擎,支持多模态搜索和提问
MemFree是什么 MemFree是一款开源的混合AI搜索引擎,通过整合多种AI模型和搜索引擎,提供高效、多样化的搜索体验。可以用文本、图像、文件和网页等多种方式进行搜…
OCTAVE – Hume AI推出的语音语言模型
OCTAVE 是什么 OCTAVE(Omni-Capable Text and Voice Engine)是Hume AI推出的新一代语音语言模型,结合EVI 2模型和O…
Boow-VTON – 阿里推出的AI虚拟试衣技术
Boow-VTON是什么 Boow-VTON是阿里巴巴推出的一种先进的虚拟试衣技术。能在野外场景中实现高质量的虚拟试衣效果,无需依赖精确的遮罩或修复工作。通过有效的数据增…
RapidPages – AI驱动的集成开放环境,实时生成UI组件和CSS代码
RapidPages是什么 RapidPages 是一个开源的集成开发环境(IDE),专注于基于AI技术快速生成 React 和 Tailwind CSS 的 UI 组件…
podlm-public – 开源的AI博客生成工具,支持网页URL、文本转换成博客
podlm-public是什么 podlm-public是一个开源AI播客工具,旨在创建一个中文版的NotebookLM替代品,专门用在将任意URL转换成播客内容,再推送…
NarratoAI – 开源自动化影视解说和视频剪辑的AI工具
NarratoAI是什么 NarratoAI 是基于AI技术自动化影视解说和编辑的工具。通过大型语言模型(LLM)理解视频内容,自动生成解说文案,并将文案转化为配音,同时…
GarDiff – AI虚拟试穿技术,生成高保真试穿图像保留服装细节
GarDiff是什么 GarDiff是一种创新的虚拟试穿技术,通过使用CLIP和VAE编码来提取服装的外观先验,结合服装聚焦适配器和高频细节增强算法,生成高保真且细节丰富…
Granite 3.1 – IBM 推出的新版语言模型
Granite 3.1是什么 Granite 3.1是IBM推出的新一代语言模型,具有强大的性能和更长的上下文处理能力。Granite 3.1模型家族有 4 种不同的尺寸…
LiveKit Agents – 创建实时与用户互动的多模态AI代理框架
LiveKit Agents是什么 LiveKit Agents 是一个强大的框架,用于创建能实时通过语音、视频和数据与用户互动的多模态AI代理。框架支持 Python …
Ovis1.6 – 阿里国际AI团队推出的多模态大模型,超过闭源GPT-4o-mini
Ovis1.6是什么 Ovis1.6是阿里国际AI团队推出的多模态大模型,在多模态权威综合评测基准OpenCompass上取得了优异的成绩,特别是在30亿参数以下的模型中…
Yi-Lightning – 零一万物最新推出的高性能高速度旗舰模型
Yi-Lightning是什么 Yi-Lightning 是零一万物公司最新发布的旗舰模型,在国际权威盲测榜单 LMSYS 上取得了显著成绩,超越了硅谷知名 OpenAI…
Skywork-Reward – 昆仑万维推出的高性能奖励模型,辅助智能体决策
Skywork-Reward是什么 Skywork-Reward 是昆仑万维推出的一系列高性能奖励模型,包括 Skywork-Reward-Gemma-2-27B 和 S…
NeMo – 英伟达推出的用于构建、定制和部署生成式AI模型
NeMo是什么 NeMo 是由 NVIDIA 提供的端到端云原生框架,用于构建、定制和部署生成式 AI 模型。支持大型语言模型(LLMs)、多模态模型、语音识别和文本转语…
Sketch2Sound – Adobe 联合西北大学推出的AI音频生成技术
Sketch2Sound是什么 Sketch2Sound是Adobe 研究院和西北大学推出的AI音频生成技术,能基于声音模仿和文本提示生成高品质音效。Sketch2Sou…
Matryoshka Diffusion Models – 苹果开源高清图像和视频生成的扩散模型
Matryoshka Diffusion Models是什么 Matryoshka Diffusion Models(MDM)是苹果公司推出的一种创新的扩散模型,主要用于…
