OpenAI大整合:聊天、办公、编程三合一,全新ChatGPT桌面应用上线
OpenAI发布官方公告,宣布推出全新桌面应用程序,将Codex和ChatGPT体验整合为一体。此举旨在增强AI编程体验的同时,将产品覆盖面从开发者群体拓展至更广泛的非技…
AI初创公司Lyzr利用自主研发代理自主完成1亿美元B轮融资
7月9日,成立三年的企业级人工智能代理(AI Agent)初创公司Lyzr宣布成功完成1亿美元的B轮融资,公司估值达到约5亿美元。引人注目的是,本次融资的全程 negot…
中国移动上线“新消息Claw”应用号,支持短信远程操控电脑端AI智能体
7月10日,中国移动“新消息”服务正式上线“新消息Claw”应用号。该服务针对电脑端各类Claw(业内俗称“龙虾”)开源AI行动式智能体,打造了一条免下载安装App的短信…
CodeArena – 用于测试不同LLM编程能力的在线平台
CodeArena是什么 CodeArena是在线平台,基于让多个大型语言模型(LLM)同时构建相同的应用程序,实时显示排名结果,比较LLM生成代码的能力。CodeAre…
Phi-4 – 微软开源的14B参数小语言模型,擅长数学等领域的复杂推理
Phi-4是什么 Phi-4是微软推出的14B参数小型语言模型,在数学等领域的复杂推理以及传统语言处理方面表现出色。Phi-4用数据质量为核心训练重点,大量融入合成数据,…
Insight-V – 提升长链视觉推理能力的多模态模型
Insight-V是什么 Insight-V是南洋理工大学、腾讯公司和清华大学的研究者们共同推出的多模态模型,能提升多模态大型语言模型在长链视觉推理方面的能力。基于可扩展…
SVDQuant – MIT 推出的扩散模型后训练量化技术
SVDQuant是什么 SVDQuant是MIT研究团队推出的后训练量化技术,针对扩散模型,将模型的权重和激活值量化至4位,减少内存占用加速推理过程。SVDQuant引入…
Meta Motivo – Meta 推出控制数字智能体动作的人工智能模型
Meta Motivo是什么 Meta Motivo 是 Meta 公司推出的AI模型,能提升元宇宙体验的真实性。Meta Motivo基于控制虚拟人形智能体的全身动作,…
YOLOv9 – 新一代高效的实时目标检测系统
YOLOv9是什么 YOLOv9是一个由台北中研院和台北科技大学等机构的研究团队推出的新一代先进的目标检测系统,是YOLO(You Only Look Once)算法系列…
Step-1o Audio – 阶跃星辰推出的国内首个千亿参数端到端语音大模型
Step-1o Audio是什么 Step-1o Audio是阶跃星辰推出的国内首个千亿参数端到端语音大模型。具备强大的情绪感知能力,能精准识别用户语气中的情感,结合语境…
VideoPrism – 谷歌研究团队推出的通用视频编码器
VideoPrism是什么 VideoPrism是一个由谷歌研究团队开发的通用视频编码器,旨在通过一个单一的预训练模型来处理多种视频理解任务。该模型能够从视频中提取丰富的…
360gpt2-o1 – 360 推出国产自研 AI 大模型,多项评测优于GPT-4o
360gpt2-o1是什么 360gpt2-o1是 360 自研的 AI 大模型,在推理能力上有显著提升,特别是在数学和逻辑推理任务上表现出色。模型通过合成数据优化、模型…
GPT-SoVITS – 开源的声音克隆项目,只需少量数据即可合成声音
GPT-SoVITS是什么 GPT-SoVITS是一个开源的声音克隆项目,由B站UP主、RVC变声器创始人花儿不哭推出,该语音合成工具结合了GPT(Generative …
POINTS 1.5 – 腾讯微信推出的多模态大模型
POINTS 1.5是什么 POINTS 1.5 是腾讯微信发布的多模态大模型,是POINTS 1.0的升级版本。 模型继续沿用了POINTS 1.0中的LLaVA架构,…
OpenCodeInterpreter – 开源的代码解释器,可生成和执行代码
OpenCodeInterpreter是什么 OpenCodeInterpreter是一个开源的代码解释器系统,旨在通过利用大模型结合代码生成、执行和迭代精炼的能力,可以…
Llama 3 – Meta开源推出的新一代大语言模型
Llama 3是什么 Llama 3是Meta公司最新开源推出的新一代大型语言模型(LLM),包含8B和70B两种参数规模的模型,标志着开源人工智能领域的又一重大进步。作…
