Prompt 语宙Prompt 语宙
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • 强化 AI 学习
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • 社区
Search
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2024 Prompt 语宙. HalfPX. All Rights Reserved.
阅读: AgentCPM-GUI – 清华联合面壁智能开源的端侧GUI智能体模型
Share
登陆
通知 阅读更多
Font Resizer字体
Font Resizer字体
Prompt 语宙Prompt 语宙
Search
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • 强化 AI 学习
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • 社区
已有帐户? 登陆
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2023 Prompt 语宙. Paooo.com. All Rights Reserved.
Prompt 语宙 > AIGC 资讯 > AgentCPM-GUI – 清华联合面壁智能开源的端侧GUI智能体模型
AIGC 资讯

AgentCPM-GUI – 清华联合面壁智能开源的端侧GUI智能体模型

站外新闻
最近更新: 2026年6月7日 下午8:03
SHARE

AgentCPM-GUI是什么

AgentCPM-GUI 是清华大学和面壁智能团队联合推出的开源端侧 GUI Agent ,针对中文应用优化。模型基于 MiniCPM-V(80 亿参数)构建,能接受智能手机截图作为输入,自主执行用户指定的任务。模型基于大规模中文安卓应用界面数据预训练,显著提升对 GUI 元素的理解和定位能力。AgentCPM-GUI 在中文 Grounding Benchmark 和 Agent Benchmark 上均取得 SOTA 性能,是首个针对中文应用精细优化的开源 GUI Agent。

阅读目录
  • AgentCPM-GUI是什么
  • AgentCPM-GUI的主要功能
  • AgentCPM-GUI的技术原理
  • AgentCPM-GUI的项目地址
  • AgentCPM-GUI的应用场景

AgentCPM-GUI

AgentCPM-GUI的主要功能

  • 中文应用操作:理解和操作多种中文应用,如高德地图、大众点评、哔哩哔哩和小红书等。
  • 任务自动化执行:接受用户指令后,自动拆分任务步骤,在对应应用中准确执行,如点单、播放视频等。
  • 高质量 GUI 定位:准确定位屏幕上的按钮、输入框、标签等 GUI 元素。
  • OCR 定位与识别:识别屏幕中的文本内容,根据文本描述执行相应操作。

AgentCPM-GUI的技术原理

  • 预训练:基于大规模中文安卓应用界面数据进行预训练,覆盖常见的按钮、输入框、标签、图标等通用 GUI 控件。基于高质量的 GUI Grounding 预训练,提升模型对视觉界面元素的理解和定位能力。具备 OCR Grounding 能力,准确定位和识别屏幕中的文本内容。
  • 强化微调(RFT):设计动作格式奖励、动作类型奖励、动作参数奖励三个维度的奖励函数,引导模型自主生成高质量的思维链过程。在奖励函数的引导下,模型不断优化自身策略,获取更高的奖励,提升任务的执行成功率。
  • 紧凑动作空间设计:基于紧凑的 JSON 格式,将动作平均长度压缩至 9.7 个 token,减少推理时的计算和内存需求。紧凑的动作空间设计让模型更适合在移动设备上部署,加快端侧推理速度,缓解隐私安全问题。

AgentCPM-GUI的项目地址

  • GitHub仓库:https://github.com/OpenBMB/AgentCPM-GUI
  • HuggingFace模型库:https://huggingface.co/openbmb/AgentCPM-GUI

AgentCPM-GUI的应用场景

  • 智能助手:帮助用户基于语音或文字指令完成各种应用操作,如点外卖、播放音乐等。
  • 自动化测试:用在自动化测试中文应用的功能和界面,提高测试效率。
  • 老年关怀:简化老年人使用智能手机的操作,如视频通话、查看天气等。
  • 视障人士辅助:结合语音指令和屏幕阅读器,帮助视障人士更便捷地使用应用。
  • 企业应用自动化:自动化执行企业中的重复性任务,如数据录入和报表生成,提高效率。
FreeLLMAPI – 开源 AI 模型聚合平台,统一OpenAI兼容格式
RoboBrain – 智源研究院开源的具身大脑模型
HiveChat – 开源 AI 聊天机器人,支持Deepseek等主流 AI 模型
LanDiff – 浙大联合月之暗面推出的文本到视频生成混合框架
99%高管确认AI将引发裁员潮:两年内大规模岗位流失,科技行业已裁超10万人
分享
Email 复制链接 打印
Share
上一篇 Vibe Draw – AI 3D建模工具,涂鸦草图一键转为3D模型
发表评价

发表评价 取消回复

您的邮箱地址不会被公开。 必填项已用 * 标注

Please select a rating!

Ad image
- 入群领取知识星球折扣卷, 仅剩99份 -
Ad imageAd image

最近更新

Vibe Draw – AI 3D建模工具,涂鸦草图一键转为3D模型
AIGC 资讯
DeepGEMM – DeepSeek 开源的 FP8 通用矩阵乘法库
AIGC 资讯
VersaGen – 实现文本到图像合成中视觉控制能力的生成式 AI 代理
AIGC 资讯
Aria-UI – 港大联合 Rhymes AI 开源面向 GUI 智能交互的多模态模型
AIGC 资讯

相关推荐

AIGC 资讯

Gemini 2.5 Pro (I/O 版) – 谷歌推出的升级版多模态AI模型

站外新闻
AIGC 资讯

Gemini 2.5 Pro – 谷歌推出的最新 AI 思考模型

站外新闻
量子芯片科技感占位特色图
AI 工具AIGC 资讯

IBM与红帽50亿美元押注开源安全:光井计划启动,AI重塑2万+工程师漏洞修复体系

站外新闻
AI安全 IBM 供应链安全 开源安全 红帽
AIGC 资讯

OmniManip – 智元机器人联合北大推出的通用机器人操作框架

站外新闻
/ Prompt 语宙 /

Experience the limitless creative possibilities of generative AI and unlock new levels of innovation.

Quick Link

  • Remaker AI
  • BGRemaker 抠图Hot
  • AIGC 工具
  • Prompt 咒语生成器
  • 去水印工具

Support

  • Contact
  • Blog
  • Complaint
  • Advertise

标签

Agent AGI AI AI Agent AIGC AI商业化 AI大模型 AI安全 AI工具 AI搜索 AI智能体 AI生成内容 AI监管 AI绘画 AI编程 AI编程工具 AI编程智能体 AI芯片 AI视频 AI视频生成 AI设计 Anthropic chatgpt Claude Claude Code Claude Mythos Claude Opus 4.8 DeepSeek DuckDuckGo Gemini GPT-5.5 MCP协议 meta Midjourney MiniMax MoE MoE架构 NVIDIA openai OpenRouter Pika prompt SpaceX stable diffusion SWE-Bench xAI 世界模型 丛林 人工智能 人物 企业级AI 具身智能 命令行工具 图像生成模型 多模态 多模态大模型 大模型 大模型API 大模型应用 大语言模型 字节跳动 家居 小米 展台 建筑 开源 开源大模型 开源工具 开源框架 开源模型 强化学习 微软 教程 早报 智能体 智能体编程 智谱AI 月之暗面 本地AI 海报设计 生成式AI 科大讯飞 科幻 端侧AI 端侧大模型 网络安全 联想 腾讯混元 英伟达 苹果 视频生成模型 语音合成 谷歌 谷歌AI 赛博朋克 长上下文 阶跃星辰 阿里通义 阿里通义千问 风景
Prompt 语宙Prompt 语宙
Follow US
© 2009-2026 Prompt 语宙. Paooo.com. All Rights Reserved.