Composer 2 正式发布

Cursor Blog·2026-03-19 08:00·160天前·Cursor Team
AI 导读

Composer 2 登陆 Cursor,定价 $0.50/M(输入)和 $2.50/M(输出),Terminal-Bench 2.0 得分 61.3,SWE-bench Multilingual 达 73.7,显著优于前代。支持数百步长周期编码任务,团队同步发布训练技术报告。

Cursor Blog
精选

Composer 2 正式发布

2026-03-19 08:00· 160天前· Cursor Team
AI 导读

Composer 2 登陆 Cursor,定价 $0.50/M(输入)和 $2.50/M(输出),Terminal-Bench 2.0 得分 61.3,SWE-bench Multilingual 达 73.7,显著优于前代。支持数百步长周期编码任务,团队同步发布训练技术报告。

推荐理由

Cursor发布Composer 2编程Agent,性能大幅提升且定价极具竞争力

正文 · AI 翻译

它在编程方面达到了前沿水平,定价为每百万输入 token 0.50 美元、每百万输出 token 2.50 美元,成为智能与成本的全新最优组合。我们还发布了一份关于如何训练该模型的技术报告。

前沿水平的编程智能

我们正在快速提升模型质量。Composer 2 在我们衡量的所有基准测试中均取得了大幅改进,包括 Terminal-Bench 2.01 和 SWE-bench Multilingual:

模型CursorBenchTerminal-Bench 2.0SWE-bench Multilingual
Composer 261.361.773.7
Composer 1.544.247.965.9
Composer 138.040.056.9

这些质量提升源于我们首次进行的持续预训练,这为扩展强化学习提供了远更强大的基础。

在此基础之上,我们通过强化学习对长周期编程任务进行训练。Composer 2 能够解决需要数百个动作的挑战性任务。

立即体验 Composer 2

Composer 2 定价为每百万输入 token 0.50 美元、每百万输出 token 2.50 美元。

此外还有一个智能水平相同但速度更快的变体,定价为每百万输入 token 1.50 美元、每百万输出 token 7.50 美元,其成本低于其他快速模型²。我们正将快速版本设为默认选项。完整详情请参阅当前的 Composer 模型文档。

在个人套餐中,Composer 使用量计入第一方模型池,并包含慷慨的免费额度。立即在 Cursor 或我们新界面的早期 alpha 版本中体验 Composer 2。


  1. Terminal-Bench 2.0 是由 Laude Institute 维护的终端使用智能体评估基准。Anthropic 模型分数使用 Claude Code 测试框架,OpenAI 模型分数使用 Simple Codex 测试框架。我们的 Cursor 分数使用官方 Harbor 评估框架(Terminal-Bench 2.0 的指定测试框架)及默认基准设置计算得出。我们对每个模型-智能体组合运行了 5 次迭代,并报告平均值。有关该基准的更多详情,请访问官方 Terminal Bench 网站。对于 Composer 2 以外的其他模型,我们取官方排行榜分数与在我们基础设施中运行记录分数之间的最高值。↩
  2. 所有模型的每秒 token 数(TPS)均来自 2026 年 3 月 18 日 Cursor 流量的快照。Composer 与 GPT 模型的 token 大小相近。Anthropic 的 token 大约小 15%,TPS 数值已做归一化处理以反映这一差异。同样,非 Anthropic 模型的输出 token 价格也按约 15% 的相同比例进行了调整。实际速度可能因供应商容量及后续优化而有所变化。↩

Composer 2 技术报告

Sasha Rush

推出 Composer 2.5

来源:Cursor Blog· cursor.com