MiniPerplx – AI 搜索引擎,基于 Grok 2.0 模型
MiniPerplx是什么 MiniPerplx 是开源的 AI 搜索引擎,基于 Grok 2.0 模型进行搜索。MiniPerplx提供了免费的替代方案,用在搜索网页、…
UI-TARS – 字节跳动推出的开源原生 GUI 代理模型
UI-TARS是什么 UI-TARS是字节跳动推出的新一代原生图形用户界面(GUI)代理模型,通过自然语言实现对桌面、移动设备和网页界面的自动化交互。具备强大的感知、推理…
CogVideoX-Flash – 智谱推出的首个免费AI视频生成模型
CogVideoX-Flash是什么 CogVideoX-Flash 是智谱推出的首个免费AI视频生成模型,继承CogVideoX自研的端到端视频理解模型,具备强大的视频…
PPTAgent – 中科院推出的自动生成高质量演示文稿框架
PPTAgent是什么 PPTAgent是中国科学院软件研究所中文信息处理实验室推出的创新框架,基于模仿人类工作流程的两阶段编辑方法,从文档自动生成高质量的演示文稿。PP…
OptoChat AI – 南智光电联合南大推出的光子芯片领域专用大模型
OptoChat AI是什么 OptoChat AI是南智光电与南京大学共同推出的国内首款光子专用大模型。模型聚焦光子领域全产业链,集成超过30万条光子芯片相关专利、文献…
Memory Layers – Meta 开源不增加算力时增加大模型的参数方法
Memory Layers是什么 Memory Layers是Meta推出的用可训练的键值查找机制为模型增加额外参数的方法,它不会增加浮点运算次数(FLOPs)。基于稀疏…
AddressCLIP – 中科院联合阿里云推出的端到端图像地理定位大模型
AddressCLIP是什么 AddressCLIP 是基于 CLIP 技术构建的端到端图像地理定位模型,中科院自动化所和阿里云联合开发。模型能通过一张照片实现街道级精度…
EMO2 – 阿里研究院推出的音频驱动头像视频生成技术
EMO2是什么 EMO2 (End-Effector Guided Audio-Driven Avatar Video Generation)是阿里巴巴智能计算研究院开发…
Mini-InternVL – 上海AI Lab联合清华等机构推出的轻量级多模态大模型
Mini-InternVL是什么 Mini-InternVL是“迷你版”书生·万象大模型,是上海AI实验室与清华大学、南京大学等机构联合推出的轻量级多模态大型语言模型系列…
HoloDrive – 商汤联合上海AI Lab等机构推出的2D-3D多模态街道场景生成框架
HoloDrive是什么 HoloDrive 是商汤和上海人工智能实验室等机构提出的用于自动驾驶的整体2D-3D多模态街道场景生成框架。框架联合生成相机图像和激光雷达点云…
Xianyu AutoAgent – AI闲鱼客服机器人,支持多专家协同决策
Xianyu AutoAgent是什么 Xianyu AutoAgent 是为闲鱼平台设计的智能客服机器人系统。支持实现7×24小时自动化值守,多专家协同决策、智能议价及…
Cognita – 面向生产环境的开源、模块化 RAG 框架
Cognita是什么 Cognita是开源的模块化RAG(Retrieval Augmented Generation)框架,能帮助开发者构建模块化、易于扩展和部署的生产…
TradingAgents – 加利福尼亚联合麻省理工推出的多智能体LLM金融交易框架
TradingAgents是什么 TradingAgents是加利福尼亚大学洛杉矶分校和麻省理工学院推出的多代理LLM金融交易框架,能模拟现实世界的交易公司环境。Trad…
VideoReward – 港中文、清华、快手等联合推出的视频生成偏好数据集及奖励模型
VideoReward是什么 VideoReward 是香港中文大学、清华大学、快手科技等联合创建的视频生成偏好数据集及奖励模型。包含182,000条标注数据,涵盖视觉质…
PaSa – 字节跳动推出的学术论文检索智能体
PaSa是什么 PaSa是字节跳动研究团队(ByteDance Research)推出的基于强化学习的学术论文检索智能体。能模仿人类研究者的行为,自动调用搜索引擎、浏览相…
Weebo – AI语音聊天机器人,实时响应用户语音指令和问题
Weebo是什么 Weebo是实时语音聊天机器人,基于Whisper Small、Llama 3.2和Kokoro-82M技术驱动。能通过语音识别和生成技术,与用户进行自…
