Prompt 语宙Prompt 语宙
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • 强化 AI 学习
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • 社区
Search
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2024 Prompt 语宙. HalfPX. All Rights Reserved.
阅读: Cursor发布Composer 2.5:自研Agentic编程模型,性能比肩Opus 4.7、成本仅1/10
Share
登陆
通知 阅读更多
Font Resizer字体
Font Resizer字体
Prompt 语宙Prompt 语宙
Search
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • 强化 AI 学习
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • 社区
已有帐户? 登陆
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2023 Prompt 语宙. Paooo.com. All Rights Reserved.
Prompt 语宙 > AI 工具 > Cursor发布Composer 2.5:自研Agentic编程模型,性能比肩Opus 4.7、成本仅1/10
AI 工具AIGC 资讯

Cursor发布Composer 2.5:自研Agentic编程模型,性能比肩Opus 4.7、成本仅1/10

站外新闻
最近更新: 2026年5月22日 下午9:30
Agentic编程模型 AI编程工具 Composer 2.5 Cursor SWE-Bench
SHARE

💡 站外导读:在AI编程工具竞争白热化的当下,企业正为高昂的API调用成本和模型在复杂、长时任务中的不稳定表现所困扰。Cursor作为AI驱动IDE的领跑者,此次推出自研模型Composer 2.5,直击这两个核心痛点。它不仅在编程能力上与顶尖的闭源模型旗鼓相当,更以颠覆性的成本优势和专为Agent工作流优化的行为表现,为开发者提供了一个既强大又经济的全新选择。

Composer 2.5是什么

Composer 2.5 是 Cursor 推出的自研 Agentic 编程模型。在智能水平和行为表现上较 Composer 2 有大幅提升,在 SWE-Bench Multilingual(79.8%) 和 CursorBench v3.1(63.2%) 等核心基准上与 Claude Opus 4.7、GPT-5.5 处于同一梯队,但单次任务成本仅为竞品的约 1/10,称为”性价比之王”。模型基于 Moonshot 开源的 Kimi K2.5 检查点持续训练,目前仅通过 Cursor IDE 及 SDK 提供服务。

阅读目录
  • Composer 2.5是什么
  • Composer 2.5的主要功能
  • 如何使用Composer 2.5
  • Composer 2.5的核心优势
  • Composer 2.5的同类竞品对比
  • Composer 2.5的应用场景
      • 📝 站长洞察 (Editor’s Insight)

Composer 2.5

Composer 2.5的主要功能

  • 长时任务持续工作:针对长时间运行的 Agent 会话深度优化,能在多步骤工具调用中保持专注,显著减少中途幻觉或提前终止的问题。
  • 复杂指令可靠遵循:对跨文件重构、终端命令执行、测试驱动开发等复杂指令的遵循可靠性较 Composer 2 大幅提升。
  • 努力级别动态校准:模型能根据任务难度自动分配计算量,简单任务快速完成,复杂任务深入思考,避免”小事空转、大事欠思考”。
  • 沟通风格优化:回复更简洁结构化,减少不必要的冗长解释,在多文件变更时提供更清晰的推理过程。
  • 工具调用精准度提升:显著减少无效的终端命令或冗余搜索,提升代码检索与终端操作效率。
  • 双版本灵活适配:提供 Standard(标准版,$0.50/$2.50 per M tokens)与 Fast(快速版,$3.00/$15.00 per M tokens),智能水平相同,分别适配后台批量任务与交互式实时编程。

如何使用Composer 2.5

  • 在 Cursor IDE 中启用:将 Cursor 更新至 2026 年 5 月最新稳定版,打开 Composer 面板(Cmd+I / Ctrl+I),点击模型选择器切换至 Composer 2.5
  • 选择速度档位:交互式开发默认使用 Fast 版(响应快、延迟低);后台 Agent 或批量任务可在 Settings > Models 中切换为 Standard 版(成本低,智能水平相同)
  • 通过 SDK 程序化调用:
import { Agent } from "@cursor/sdk";
const agent = await Agent.create({
  model: "composer-2.5",        // Standard 版
  // model: "composer-2.5-fast", // Fast 版
  workspace: "./",
  tools: ["edit", "shell", "search", "browser"],
});
  • 为长时任务设限:为无人看管的长时间 Agent 会话设置迭代次数上限和最大耗时,防止模型利用缓存等”捷径”进行奖励作弊
  • 领取首发福利:发布首周提供双倍用量额度,可在后台查看额度消耗情况
  • 多模型路由策略:将 90% 日常任务交给 Composer 2.5 处理;仅将架构评审类任务路由给 Claude Opus 4.7,重度终端 Shell 任务路由给 GPT-5.5

Composer 2.5的核心优势

  • 极致性价比:Standard 版输入 $0.50/M、输出 $2.50/M,Fast 版输入 $3.00/M、输出 $15.00/M,比 Claude Opus 4.7 便宜约 10~30 倍。
  • 前沿级基准表现:SWE-Bench Multilingual 79.8%(Opus 4.7 为 80.5%,GPT-5.5 为 77.8%),CursorBench v3.1 63.2%(与 Opus 4.7 的 64.8% 和 GPT-5.5 的 64.3% 基本持平)。
  • 行为层面深度优化:除了扩大训练规模,还改进了沟通风格和投入级别校准,这些维度虽难被基准充分反映,但对实际使用体验至关重要。
  • 双版本灵活选择:Standard(标准版)适合后台 Agent 与批量任务,Fast(快速版,默认)适合交互式 IDE 实时编程,两者智能水平完全相同。
  • 首发双倍用量福利:发布首周提供双倍用量额度。

Composer 2.5的同类竞品对比

对比维度 Composer 2.5 Claude Opus 4.7 GPT-5.5
厂商 / 平台 Cursor Anthropic OpenAI
产品定位 自研 Agentic 编程模型 旗舰推理模型 旗舰多模态模型
基座模型 Moonshot Kimi K2.5(开源检查点持续训练) Claude 4 系列 GPT-5 系列
发布日期 2026.05.18 2026 年 Q2 2026 年 Q2
SWE-Bench Multilingual 79.8% 80.5% 77.8%
Terminal-Bench 2.0 69.3% 69.4% 82.7%
CursorBench v3.1(困难任务) 63.2% 64.8%(max)/ 61.6%(默认 xhigh) 64.3%(xhigh)/ 59.2%(默认 medium)
输入价格(/M tokens) $0.50(Standard)<
$3.00(Fast)
未公开(行业参考约 $15) 未公开(行业参考约 $3–$5)
输出价格(/M tokens) $2.50(Standard)<
$15.00(Fast)
未公开(行业参考约 $75) 未公开(行业参考约 $15–$30)
单次任务相对成本 基准(约 $1–$2 / 任务) 约 10–30 倍 约 3–10 倍
上下文窗口 ~200K(参考 Kimi K2.5) 200K 128K–1M
权重开放性 闭源(仅 Cursor 基础设施) 闭源 闭源
接入方式 Cursor IDE / CLI / @cursor/sdk API / Claude Code / 第三方平台 API / ChatGPT / GitHub Copilot

Composer 2.5的应用场景

  • 多文件级重构:成本优势明显且精度持平前沿模型,适合大规模代码库迁移。
  • 交互式结对编程:Fast 版响应迅速,适合实时 IDE 协作。
  • 后台定时任务/云 Agent:Standard 版性价比极高,适合批量代码审查与修复。
  • 测试驱动开发:长时任务可靠性优于前代,能稳定完成多轮测试-修复循环。
  • 复杂终端自动化:Terminal-Bench 2.0 得分 69.3%,与 Opus 4.7(69.4%)持平,但重度 Shell 场景仍略逊于 GPT-5.5(82.7%)。

📝 站长洞察 (Editor’s Insight)

Composer 2.5的发布,标志着AI编程竞赛进入‘垂直整合’与‘成本优化’的新阶段。Cursor此举并非单纯追求模型榜单排名,而是将其深厚的IDE场景理解与用户数据反馈,反向注入到自研模型的训练中,实现了‘场景定义模型’的闭环。其‘性价比之王’的定位,直击企业大规模应用AI编程的最大障碍——成本。这预示着未来AI工具的竞争,将从单纯的‘智力竞赛’转向‘工程化效率’与‘总拥有成本’的综合比拼。拥有场景和用户入口的平台型企业,在自研垂直模型上将展现出巨大优势。

文心大模型4.5 – 百度推出的首个原生多模态大模型
GPT-5.4 mini发布:OpenAI最强小模型,速度提升2倍、成本仅1/3,性能直逼满血版
MiniMax-01 – MiniMax开源的全新系列模型
IBM与红帽50亿美元押注开源安全:光井计划启动,AI重塑2万+工程师漏洞修复体系
Eddy AI
TAGGED:Agentic编程模型AI编程工具Composer 2.5CursorSWE-Bench
分享
Email 复制链接 打印
Share
上一篇 腾讯联合中科院、故宫博物院推出 Chronicles-OCR:首个覆盖汉字’七体之变’的视觉大模型跨时间评测基准
下一篇 Step Image Edit 2:3.5B参数轻量模型如何秒杀20B级开源大模型?阶跃星辰发布新一代图像编辑模型
发表评价

发表评价 取消回复

您的邮箱地址不会被公开。 必填项已用 * 标注

Please select a rating!

Ad image
- 入群领取知识星球折扣卷, 仅剩99份 -
Ad imageAd image

最近更新

MiniCPM-SALA:面壁智能开源9B端侧大模型,百万级长文本推理首登消费级显卡
AI 工具 AIGC 资讯
MiniMax开源M2.5旗舰模型:10B参数实现100 TPS狂飙,编程与Agent能力颠覆行业格局
AI 工具 AIGC 资讯
谷歌Gemini 3 Deep Think发布:ARC-AGI-2达84.6%,专用推理模型如何重塑科研与工程?
AI 工具 AIGC 资讯
GPT-5.3-Codex-Spark:OpenAI首发实时编程模型,1000+ tokens/s极速编码体验
AI 工具 AIGC 资讯

相关推荐

AI 工具

Teach-O-Matic

remaker
AI 工具

Gimme Summary AI

remaker
AIGC 资讯

Motion Dreamer – 香港科技大学推出的运动合理视频生成框架

站外新闻
AI 工具

ChatNBX

remaker
/ Prompt 语宙 /

Experience the limitless creative possibilities of generative AI and unlock new levels of innovation.

Quick Link

  • Remaker AI
  • BGRemaker 抠图Hot
  • AIGC 工具
  • Prompt 咒语生成器
  • 去水印工具

Support

  • Contact
  • Blog
  • Complaint
  • Advertise

标签

Agent AI AI Agent AIGC AI大模型 AI安全 AI工具 AI搜索 AI智能体 AI绘画 AI编程 AI编程工具 AI视频 AI视频生成 AI设计 AI音乐生成 Anthropic chatgpt Claude Claude Code Claude Mythos Claude Opus 4.8 DeepSeek DuckDuckGo Gemini GPT-5.5 MCP协议 meta Midjourney MiniMax Mistral AI MoE架构 NVIDIA openai OpenClaw OpenRouter Pika prompt stable diffusion SWE-Bench xAI 世界模型 丛林 人工智能 人物 企业级AI 具身智能 命令行工具 图像生成 多智能体 多模态 多模态AI 多模态大模型 大模型 大模型API 大模型应用 大语言模型 字节跳动 家居 小米 小红书 展台 建筑 开源 开源AI工具 开源大模型 开源工具 开源框架 开源模型 强化学习 微软 教程 早报 智能体 智能体编程 智谱AI 本地AI 海报设计 清华大学 生成式AI 科幻 端侧AI 端侧大模型 网络安全 腾讯 腾讯混元 英伟达 苹果 视频生成模型 语音合成 谷歌 谷歌AI 赛博朋克 边缘计算 通义千问 阶跃星辰 阿里通义 阿里通义千问 面壁智能 风景
Prompt 语宙Prompt 语宙
Follow US
© 2009-2026 Prompt 语宙. Paooo.com. All Rights Reserved.