Cursor Composer 2 深度解析:Kimi K2.5 基底 + 强化学习,性能提升 37%

Cursor 于 2026 年 3 月推出专属编程模型 Composer 2,基于 Moonshot AI 的开源 Kimi K2.5 持续训练而成。本文解析其技术原理、争议始末以及对开发者的实际影响。

发布于 2026-04-20

2026 年 3 月 18 日,Cursor 宣布上线 Composer 2——一款专为 AI 编程场景打造的自研模型。官方宣称在真实代码任务基准 CursorBench 上得分 61.3,比上一代 Composer 1.5 提升 37%。消息一出,开发者社区沸腾了。

不过,三天后,另一波更大的讨论随之而来:Composer 2 的底层模型,是中国 AI 公司 Moonshot AI 开源的 Kimi K2.5


Composer 2 是什么

Composer 2 是 Cursor 的第三代自有编程模型(Composer 1 → Composer 1.5 → Composer 2),可在 Cursor 订阅的 Agent 模式下使用,定价为 Standard $0.50/$2.50、Fast $1.50/$7.50(每百万 token 输入/输出)。

其核心能力定位是:长上下文、多文件编辑、自主 Agent 任务——也就是”让 AI 独立完成你不想一步步手动操作的复杂任务”。

基准成绩

基准Composer 2Composer 1.5提升幅度
CursorBench61.344.7+37%
SWE-bench Multilingual73.7

CursorBench 由 Cursor 工程团队基于真实编程会话构建,测试任务故意措辞模糊、变更跨多个文件,更接近日常开发的真实难度。


技术内幕:Kimi K2.5 是什么

Kimi K2.5 是北京 Moonshot AI(月之暗面)于 2025 年底发布的开源大语言模型,重点能力为推理、技术问题求解和长上下文处理。

关键参数:

  • 架构:混合专家(Mixture of Experts,MoE)
  • 总参数:约 1 万亿(1T)
  • 活跃参数:每个 token 激活约 32B(共 384 个专家,每次激活 8+1 个)
  • 许可证:开源,允许商业使用,但对 MAU > 100 万或月收入 > $2000 万的产品要求显著标注来源

Cursor 在 Kimi K2.5 基础上做了两个阶段的额外训练:

  1. 持续预训练(Continued Pretraining):在偏向代码的数据混合上进一步训练,加深模型对编程知识的理解。
  2. 大规模强化学习(Large-Scale RL):在仿真的真实 Cursor 会话中训练,任务分布与线上用户的实际问法对齐。

争议始末

如何被发现

3 月 21 日,一名开发者在 Cursor 的 API 配置中发现了模型 ID:

kimi-k2p5-rl-0317-s515-fast

字面意思:Kimi 2.5 + 强化学习 + 0317 日期版本。这条信息随即被截图传播,并登上 Hacker News 头版,帖子标题直接:“Cursor Composer 2 is just Kimi K2.5 with RL”(Composer 2 不过是加了 RL 的 Kimi K2.5)。

Cursor 的回应

争议爆发约一天后,Cursor 联合创始人 Aman Sanger 公开承认:

“我们评估了大量基础模型的困惑度指标,Kimi K2.5 是最优的。没有在发布博客中提及 Kimi 基底是个失误。”

开发者教育副总裁 Lee Robinson 则补充:

“Composer 2 的最终模型中,来自基础模型(Kimi K2.5)的算力占比约为 1/4,其余 3/4 均来自我们自己的训练。”

Moonshot AI 随后也确认,Cursor 通过 Fireworks AI 平台以授权商业合作的形式使用了 Kimi K2.5,许可证合规。

开源许可证问题

Kimi K2.5 的许可证要求:月活用户超过 100 万、或月收入超过 2000 万美元的产品,必须显著标注使用了 Kimi K2.5。Cursor 作为估值超 90 亿美元、付费用户数百万级的产品,明显落入这一条款范围。

Cursor 在发布时的博客和产品 UI 均未提及 Kimi,这是争议的核心所在——不是非法,而是信息透明度不足


对开发者意味着什么

1. 编程能力实打实在提升

CursorBench +37% 并非虚数——它针对的正是模糊、跨文件的复杂任务,而不是标准的单文件填空题。Composer 2 在处理需要读多个文件、推断上下文意图的 Agent 任务时,体感改善明显。

2. 价格未变

Composer 2 纳入现有 Cursor Pro($20/月)的额度池,并非额外收费。如果你已订阅 Cursor Pro,默认的 Auto 模式会自动选择 Cursor 认为适合当前任务的模型,包括 Composer 2。

3. 对国内开发者的特殊意义

Kimi K2.5 是一款国产开源模型。Cursor 基于它做出性能领先的编程模型,这在一定程度上验证了国产基础模型在垂直场景(编程)上的竞争力。

同时,这也意味着 Composer 2 的能力基底对中国研究者和开发者而言并非黑盒——Kimi K2.5 的权重是公开的,Moonshot AI 也提供了详细的技术报告。

4. “自研”的边界在哪里

这次争议也触发了一个更普遍的行业讨论:基于开源模型做持续训练和强化学习的成果,算不算”自研”?

从技术上看,Cursor 投入的算力(75%)和工程工作量(真实 Cursor 会话环境、任务分布对齐)不可忽视。但从用户信任角度,发布时不主动披露基础模型来源,让不少开发者感到被误导。

这件事的结局是:Cursor 在技术报告中完整披露了训练细节,Moonshot AI 正式确认合作,争议平息。但它留下了一个值得行业铭记的教训:开源模型是透明的,你的微调轨迹不会永远是秘密。


总结

Composer 2 是一款真实有效的编程模型升级,在 Cursor 自己的基准上提升 37%,并在 SWE-bench 多语言版本上拿到竞争性成绩。它建立在 Kimi K2.5 这个高质量开源基底上,通过 Cursor 的持续预训练和大规模强化学习进一步打磨。

争议本身已经平息,不影响正常使用。

如果你正在使用 Cursor Pro,可以在 Agent 模式中切换至 Composer 2 体验——特别适合需要模型自主理解大型代码库、处理模糊需求的重型 Agent 任务。

如果你是国内开发者,Kimi K2.5 的开源化和 Cursor 对其的商业化使用,本身就是国产基础模型生态成熟的一个缩影:技术上能被顶级工具选择,商业上已建立成熟的授权机制。

📚 继续阅读

📚 相关指南

📖 相关对比文章

🔧 文中提到的工具

💰 相关省钱方案

基于本文涉及的工具与 API,这些组合能帮你以更低成本上手。

🎁 领取优惠 & 免费试用

汇总各工具与 Coding Plan 的免费额度、首月折扣与注册入口,随时更新。

查看优惠福利 →