GLM-4-Flash – 智谱AI推出的首个免费大模型API
GLM-4-Flash是什么 GLM-4-Flash是智谱AI推出的首个免费大模型API,GLM-4-Flash不仅支持多轮对话和多语言处理,还具备网页浏览、代码执行等高…
AI编码圈再传重磅:瑞典新星Lovable估值或将翻倍至 132 亿美元
在AI编程领域持续升温的背景下,瑞典初创公司Lovable正处于新一轮融资的中心。据最新行业消息,该公司正计划筹集 3 亿美元,若融资顺利,其估值将达到 132 亿美元,…
PixWizard – 开源的AI图像视觉助手,多功能图像生成、编辑、翻译
PixWizard是什么 PixWizard是一个多功能的图像到图像视觉助手,基于自然语言指令执行图像生成、编辑和翻译等任务。系统通过统一的图像-文本到图像生成框架,将多…
蚂蚁灵波开源 LingBot-Video,全球首个面向具身的视频基模来了!
7月9日,蚂蚁灵波开源 LingBot-Video,这是全球首个基于 Mixture-of-Experts(MoE)架构、面向具身智能的开源视频生成基础模型。该模型围绕机…
xLAM – Salesforce开源的AI大模型,专注函数调用功能
xLAM是什么 xLAM 是 Salesforce 开源的一款大型语言模型,专为功能调用任务设计。模型能理解和执行基于自然语言指令的 API 调用,在自动化任务和与各种数…
Fish Speech – 开源的高效文本到语音合成TTS工具
--infer # --api # --listen ... ... # 创建一个 python 3.10 虚拟环境, 你也可以用 virtualenv conda cr…
ScreenAgent – 基于视觉语言模型的计算机控制智能体
ScreenAgent是什么 ScreenAgent是一个由吉林大学人工智能学院的研究团队开发的计算机控制智能体,该智能体是基于视觉语言模型(VLM)构建的,能够与真实计…
onewebot2 – 微信AI机器人一键运行包,双击exe直接使用
onewebot2是什么 oneWebot2是一款微信AI机器人一键运行软件包,用户下载exe文件后,双击即可启动,无需复杂的Python环境配置。有图形化界面,简化配置…
MiniMax计划推出新一代大模型 参数规模2.7万亿
日有消息称,稀宇科技(MiniMax)正在紧锣密鼓地筹备其新一代大模型的发布工作。据了解,该模型的参数规模将达到2. 7 万亿,这一量级标志着其在复杂任务处理及逻辑推理能…
Genesis – CMU 联合 20 多所研究机构开源的生成式物理引擎
Genesis是什么 Genesis是卡内基梅隆大学、马里兰大学、斯坦福大学、麻省理工学院等研究机构联合推出的开源生成式物理引擎,能模拟世界万物。Genesis能用简单的…
Moffee – 开源的Markdown转PPT工具
Moffee是什么 Moffee是开源的Markdown转PPT工具,支持用户使用Markdown语法快速创建专业的幻灯片。Moffee自动处理布局、分页和样式,支持实时…
GroundingBooth – Adobe联合多所高校推出主题和文本到图像的定制框架
GroundingBooth是什么 GroundingBooth 是一个先进的文本到图像定制框架,由华盛顿大学圣路易斯分校、Adobe和普渡大学的研究团队共同推出。基于文…
Claude Dev – AI编程助手,基于Claude 3.5 Sonnet模型
Claude Dev是什么 Claude Dev是一个集成在Visual Studio Code中的AI编程助手,基于Anthropic公司的Claude 3.5 Son…
AniPortrait – 腾讯开源的照片对口型视频生成框架
AniPortrait是什么 AniPortrait是腾讯开源的照片对口型AI视频生成框架,类似于此前阿里推出的EMO,能够通过音频和一张参考肖像图片生成高质量的动画。A…
AgentGen – 微软联合港大推出的提高AI大模型规划能力的框架
AgentGen是什么 AgentGen是香港大学与微软联合推出的AI项目框架,通过自动生成多样化环境和任务,显著提升了大语言模型(LLM)的规划能力。AgentGen利…
screenpipe – 搭建个性化AI助手的软件,捕捉屏幕和音频录音
screenpipe是什么 screenpipe是一款基于AI技术,全天候监控用户电脑屏幕和麦克风的开源软件。通过捕捉屏幕活动和音频,用AI进行智能分析,提升工作效率和保…
