甲骨文发布AI原生代理应用开发平台 支持无代码等多种开发方式
数字化转的浪潮中甲骨文(Oracle)于 714 日宣布项重磅消息推出了 “Oracle AI Agent Studio for Fusion Applications”…
苹果联手初创公司,力推 AI 模型压缩技术,让 iPhone 也能跑大型 AI!
据报道,苹果正在与硅谷的初创公司 PrismML 进行洽谈,致力于研发一项革命性的 AI 模型压缩技术。这项技术的目标是将原本庞大的 AI 模型压缩到能够在 iPhone…
BodyTalk – AI视频配音工具,自动适配新语音的唇形、面部表情和肢体动作
BodyTalk是什么 BodyTalk是Panjaya推出的AI视频配音工具,基于生成性AI技术,将视频中的人物声音转换为其他语言,自动调整视频中人物的面部表情和肢体动…
Devin Desktop – Codeium公司推出的AI开发平台
Devin Desktop是什么 Devin Desktop(原Windsurf )是 Cognition 将 Windsurf IDE 全面升级后的新一代 AI 开发平…
OmniParse – AI数据解析平台,提取和解析任何非结构化数据
OmniParse是什么 OmniParse是数据解析平台,将非结构化数据转换为结构化、可操作的数据,优化适用于GenAI(大型语言模型)应用。OmniParse支持约2…
Promptim – AI提示优化库,自动迭代优化、生成最佳配置
Promptim是什么 Promptim是实验性的AI提示优化库,基于自动化流程提升AI系统在特定任务上的提示效果。用户提供初始提示、数据集和自定义评估器,Prompti…
TinyTroupe – 微软推出的多智能体角色模拟库
TinyTroupe是什么 TinyTroupe是microsoft推出的实验性Python库,用在模拟具有特定个性、兴趣和目标的人工代理(TinyPersons),在模…
Thinking Claude – 17岁高中生推出的神级Prompt工具,AI 思维更接近人类
Thinking Claude是什么 Thinking Claude是基于深度思考协议和浏览器扩展工具,增强AI模型Claude-3.5的“深度思维”能力的项目,让其思考…
OmniVision – 专为边缘设备优化的最小参数多模态模型
OmniVision是什么 OmniVision是紧凑的多模态模型,拥有968M参数,专为边缘设备优化。OmniVision能处理视觉和文本输入,基于LLaVA架构改进,…
Free Video-LLM – 无需训练的高效视频语言模型
Free Video-LLM是什么 Free Video-LLM是创新的无需训练的高效视频语言模型,基于提示引导的视觉感知技术,实现对视频内容的高效理解。模型用预训练的图…
LogoCreator – 开源 AI Logo生成器,几秒内创建专业级定制化商标
logocreator是什么 LogoCreator是开源的logo生成器,基于Together AI提供的Flux Pro 1.1技术快速创建专业风格的logo。项目用…
法信法律基座大模型 – 最高法发布法律行业千亿参数通用大模型
法信法律基座大模型 法信法律基座大模型是基于清华大学与面壁智能科研成果转化的千亿参数通用大模型,由最高人民法院发布,定位为国家级法律AI基础设施。提供生成式AI底层能力,…
Audio Decomposition – 开源音乐转谱工具,一键将音乐转换为五线谱
Audio Decomposition是什么 Audio Decomposition是音频处理技术,基于傅里叶变换和信封匹配将音乐中的各个音符和乐器分离,实现音乐到乐谱的…
Florence-2 – 微软 Azure AI 团队推出的多功能视觉语言模型
Florence-2是什么 Florence-2 是微软 Azure AI 团队推出的多功能视觉模型,能执行图像描述、目标检测、视觉定位和图像分割等多种计算机视觉任务。F…
k0-math – 月之暗面Kimi推出的数学推理模型,对标o1
k0-math是什么 k0-math是月之暗面旗下Kimi最新发布的新一代数学推理模型。模型在多项数学基准测试中表现出色,数学能力足以与全球领先的OpenAI的o1系列模…
MagicQuill – 蚂蚁集团联合多所高校共同开源的AI互动式图像编辑工具
MagicQuill是什么 MagicQuill是香港科技大学、蚂蚁集团、浙江大学和香港大学共同推出的开源AI互动式图像编辑工具。基于用户友好的界面和AI支持的智能建议,…
