Prompt 语宙Prompt 语宙
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • 强化 AI 学习
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • 社区
Search
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2024 Prompt 语宙. HalfPX. All Rights Reserved.
阅读: UFO² – 微软推出的 Windows 桌面 Agent 操作系统
Share
登陆
通知 阅读更多
Font Resizer字体
Font Resizer字体
Prompt 语宙Prompt 语宙
Search
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • 强化 AI 学习
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • 社区
已有帐户? 登陆
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2023 Prompt 语宙. Paooo.com. All Rights Reserved.
Prompt 语宙 > AIGC 资讯 > UFO² – 微软推出的 Windows 桌面 Agent 操作系统
AIGC 资讯

UFO² – 微软推出的 Windows 桌面 Agent 操作系统

站外新闻
最近更新: 2026年6月8日 上午4:02
SHARE

UFO²是什么

UFO² 是微软推出的面向 Windows 桌面的多Agent操作系统(AgentOS),基于深度系统集成和自然语言交互实现复杂桌面任务的自动化。UFO²基于中央 HostAgent 分解任务协调多个应用专用的 AppAgent 执行操作,结合 GUI 交互和原生 API 调用,提高任务执行的效率和鲁棒性。UFO² 引入混合控制检测、持续知识整合和非干扰式用户体验设计,支持在隔离的虚拟桌面中运行,避免干扰用户操作。UFO² 在多个真实 Windows 应用中表现出色,显著提升自动化任务的成功率和执行效率。

阅读目录
  • UFO²是什么
  • UFO²的主要功能
  • UFO²的技术原理
  • UFO²的项目地址
  • UFO²的应用场景

UFO²

UFO²的主要功能

  • 深度操作系统集成:支持深度集成到 Windows 系统中,实现对桌面应用的精细控制。
  • 非干扰式用户体验:UFO² 支持在隔离的虚拟桌面中运行,用户和智能体同时操作,互不干扰。
  • 多轮交互支持:支持多轮任务执行,用户在会话中逐步细化指令或干预智能体的操作。
  • 安全保障机制:检测潜在的危险操作,在执行前提示用户确认,确保用户数据和系统安全。

UFO²的技术原理

  • 多智能体架构:
    • HostAgent:作为中央控制平面,负责解析用户指令、分解任务、调度 AppAgent,协调跨应用的执行。
    • AppAgent:针对特定应用的执行模块,具备应用专用的 API、知识库和 GUI/API 混合动作接口,高效地执行任务。
  • 混合控制检测:结合 Windows UI Automation(UIA)APIs 提供的结构化数据和基于视觉的检测模型,实现对标准和自定义 UI 元素的可靠识别。
  • 统一 GUI/API 动作层:基于 Puppeteer 模块,UFO² 动态选择 GUI 操作或应用原生 API 调用,优化任务执行路径,减少 GUI 操作的脆弱性。
  • 持续知识整合:基于检索增强型记忆(RAG)技术,将外部文档和历史执行记录整合到智能体的知识库中,支持智能体在运行时动态学习和改进。
  • 推测性多动作执行:基于单次推理预测多个动作,在运行时验证这些动作的可行性,减少推理调用频率,提高执行效率。

UFO²的项目地址

  • 项目官网:https://microsoft.github.io/UFO/
  • GitHub仓库:https://github.com/microsoft/UFO
  • arXiv技术论文:https://arxiv.org/pdf/2504.14603

UFO²的应用场景

  • 办公自动化:自动处理 Excel 数据、编辑 Word 文档、制作 PowerPoint 演示文稿等。
  • 跨应用工作流:协调多个应用完成复杂任务,如从 Excel 导入数据到 Outlook。
  • 企业任务自动化:减少人工干预,高效完成数据录入、文件处理等重复性工作。
  • 智能客服:快速响应用户请求,基于自然语言交互解决问题。
  • 教育与培训:辅助教学,自动演示操作或生成学习报告。
MemPrivacy:记忆张量与荣耀AI联合开源,端云协同隐私保护框架,如何为Agent长期记忆筑牢安全防线?
Spotify CEO公开辩护AI音乐战略:以正版授权对抗盗版与AI垃圾内容泛滥
Qwen2.5-VL-32B – 阿里开源的最新多模态模型
AstrBot – 开源多平台聊天机器人及开发框架
ToonComposer:腾讯联手顶尖高校发布AI动画神器,草图秒变专业动画!
分享
Email 复制链接 打印
Share
上一篇 KuaiMod – 快手推出的自动化短视频质量判别框架
下一篇 Seedream 3.0 – 字节推出的 AI 图片生成模型,精准生成复杂中文内容
发表评价

发表评价 取消回复

您的邮箱地址不会被公开。 必填项已用 * 标注

Please select a rating!

Ad image
- 入群领取知识星球折扣卷, 仅剩99份 -
Ad imageAd image

最近更新

快手OneRec:颠覆传统推荐!端到端生成式AI系统引爆观看时长与GMV
AI 工具 AIGC 资讯
Kimi-Researcher:月之暗面端到端强化学习Agent,深度研究基准测试超Claude 4 Opus
AI 工具 AIGC 资讯
华为盘古大模型5.5震撼发布:7180亿参数Ultra MoE领衔,五大模型重塑产业智能
AI 工具 AIGC 资讯
腾讯清华重磅开源MindOmni:强化学习驱动的多模态推理生成模型,重塑视觉AI边界
AI 工具 AIGC 资讯

相关推荐

AIGC 资讯

Hibiki – Kyutai Labs 推出的实时语音翻译模型

站外新闻
量子芯片科技感占位特色图
AI 工具AIGC 资讯最新趋势

Robinhood 发布 Agentic Trading 与 AI 信用卡:用户可将第三方 AI 智能体接入平台实现自主交易,开启金融自动化新纪元

站外新闻
Agentic Credit Card Agentic Trading AI 智能体 Model Context Protocol Robinhood
AIGC 资讯

Chatlog – 开源AI聊天记录分析工具,自动解析、可视化和挖掘聊天记录

站外新闻
AIGC 资讯

InspireMusic – 阿里通义实验室开源的音乐生成技术

站外新闻
/ Prompt 语宙 /

Experience the limitless creative possibilities of generative AI and unlock new levels of innovation.

Quick Link

  • Remaker AI
  • BGRemaker 抠图Hot
  • AIGC 工具
  • Prompt 咒语生成器
  • 去水印工具

Support

  • Contact
  • Blog
  • Complaint
  • Advertise

标签

Agent AI AI Agent AIGC AI大模型 AI安全 AI工具 AI智能体 AI绘画 AI编程 AI编程助手 AI编程工具 AI编程模型 AI视频生成 AI音乐生成 Anthropic chatgpt Claude Claude Code DeepSeek Gemini GPT-5.3 Instant GPT-5.3-Codex-Spark GPT-5.4 MCP协议 meta Midjourney MiniMax MoE架构 MoE模型 openai prompt Qwen3 RAG SWE-Bench xAI 上海人工智能实验室 世界模型 人工智能 人物 代码生成 企业级AI 全模态大模型 具身智能 命令行工具 图像生成 图像生成模型 多智能体 多模态 多模态AI 多模态大模型 多模态模型 大模型 大模型应用 大语言模型 字节跳动 小红书 展台 开源 开源AI 开源AI工具 开源大模型 开源工具 开源平台 开源框架 开源模型 开源项目 强化学习 微软 扩散模型 教程 数字人 文本转语音 早报 昆仑万维 智谱AI 月之暗面 清华大学 知识管理 科大讯飞 端侧AI 美团 腾讯 腾讯混元 自然语言处理 英伟达 蚂蚁集团 视觉语言模型 视频生成 视频生成模型 语音合成 谷歌 谷歌AI 谷歌DeepMind 通义千问 阶跃星辰 阿里巴巴 阿里通义 面壁智能 香港大学
Prompt 语宙Prompt 语宙
Follow US
© 2009-2026 Prompt 语宙. Paooo.com. All Rights Reserved.