港股AI板块热度不减:智谱、MiniMax解禁日表现抢眼
在港股人工智能板块近期持续走强的背景下,两家行业标杆企业——智谱与MiniMax,在7月9日这一天成为了市场关注的焦点。尽管面临着解禁压力,但这两家公司不仅顶住了震荡,股…
SFR-RAG – 专注于上下文理解和检索增强生成的语言模型
SFR-RAG是什么 SFR-RAG是由Salesforce AI Research推出的一款大型语言模型,专注于提升机器在理解和生成文本方面的应用能力。模型特别强调对上…
Prime Intellect完成1. 3 亿美元融资,估值达 10 亿美元
近日,专注于提供计算资源与开发工具的初创公司Prime Intellect宣布完成1. 3 亿美元的A轮融资,公司估值一举跨入 10 亿美元独角兽行列。本轮融资阵容豪华,…
Gemini 2.0 Flash Thinking – 谷歌推出的最新推理模型,支持百万上下文展示思考路径
Gemini 2.0 Flash Thinking是什么 Gemini 2.0 Flash Thinking 是谷歌最新发布的推理增强型 AI 模型,专为复杂问题的高效推…
Seed-ASR – 字节跳动推出的AI语音识别模型
Seed-ASR是什么 Seed-ASR是字节跳动推出的一款基于大型语言模型(LLM)的语音识别(ASR)模型。在超过2000万小时的语音数据和近90万小时的配对ASR数…
TeleChat2-115B – 中国电信AI研究院推出的开源星辰语义大模型
TeleChat2-115B是什么 TeleChat2-115B是由中国电信人工智能研究院(TeleAI)研发的大型语言模型,属于星辰语义大模型系列。基于国产算力进行训练…
PhotoPrism – 开源的AI照片管理工具,AI驱动的照片分类和搜索功能
PhotoPrism是什么 PhotoPrism 是一个开源的AI照片管理工具,用 Go 语言编写,旨在为用户提供一个去中心化的照片存储和组织解决方案。支持用户在自己的硬…
DreaMoving – 阿里开源的基于扩散模型的人类视频生成框架
DreaMoving是什么 DreaMoving是一个基于扩散模型的人类视频生成框架,由阿里巴巴集团的研究团队开发。DreaMoving通过视频控制网络和内容引导器实现对…
GLM-4-Flash – 智谱AI推出的首个免费大模型API
GLM-4-Flash是什么 GLM-4-Flash是智谱AI推出的首个免费大模型API,GLM-4-Flash不仅支持多轮对话和多语言处理,还具备网页浏览、代码执行等高…
AI编码圈再传重磅:瑞典新星Lovable估值或将翻倍至 132 亿美元
在AI编程领域持续升温的背景下,瑞典初创公司Lovable正处于新一轮融资的中心。据最新行业消息,该公司正计划筹集 3 亿美元,若融资顺利,其估值将达到 132 亿美元,…
PixWizard – 开源的AI图像视觉助手,多功能图像生成、编辑、翻译
PixWizard是什么 PixWizard是一个多功能的图像到图像视觉助手,基于自然语言指令执行图像生成、编辑和翻译等任务。系统通过统一的图像-文本到图像生成框架,将多…
蚂蚁灵波开源 LingBot-Video,全球首个面向具身的视频基模来了!
7月9日,蚂蚁灵波开源 LingBot-Video,这是全球首个基于 Mixture-of-Experts(MoE)架构、面向具身智能的开源视频生成基础模型。该模型围绕机…
xLAM – Salesforce开源的AI大模型,专注函数调用功能
xLAM是什么 xLAM 是 Salesforce 开源的一款大型语言模型,专为功能调用任务设计。模型能理解和执行基于自然语言指令的 API 调用,在自动化任务和与各种数…
Fish Speech – 开源的高效文本到语音合成TTS工具
--infer # --api # --listen ... ... # 创建一个 python 3.10 虚拟环境, 你也可以用 virtualenv conda cr…
ScreenAgent – 基于视觉语言模型的计算机控制智能体
ScreenAgent是什么 ScreenAgent是一个由吉林大学人工智能学院的研究团队开发的计算机控制智能体,该智能体是基于视觉语言模型(VLM)构建的,能够与真实计…
onewebot2 – 微信AI机器人一键运行包,双击exe直接使用
onewebot2是什么 oneWebot2是一款微信AI机器人一键运行软件包,用户下载exe文件后,双击即可启动,无需复杂的Python环境配置。有图形化界面,简化配置…
