Cursor 的含金量还在上升!新模型Compose,编程速度碾压 Claude!

这是一款专为软件开发设计,拥有200K的上下文窗口的编码大模型。核心的代码生成能力,来自于Cursor开发自定义代码补全模型 Cursor Tab 的经验沉淀。

文章集更新 · 2025-11-013 min read
大家好!我是瓜哥,前互联网技术总监,现在AI编程这条路上持续探索和分享。

Cursor 发布了 v2.0 新版本,最大亮点是首次推出了自研大模型 - Compose(指挥家)。

这是一款专为软件开发设计,拥有200K的上下文窗口的编码大模型。核心的代码生成能力,来自于Cursor开发自定义代码补全模型 Cursor Tab 的经验沉淀。

文末给大家准备了超详细的Cursor图文教程,点个 ‘关注’ ,免费获取!


实测表现

让我们来实测一波,看看表现如何?

01. 仿Mac操作系统

前段时间外网泄露的Gemini 3.0的内容,通过一句话就模拟出了MacOS,非常的惊艳,可以说是当前AI前端开发的天花板了。

Compose 也成功的复刻MacOS 操作系统桌面。

Compose 非常努力的,用1372行代码实现了基本功能,但跟Gemini 3.0仅用963行代码就生成的页面比较,还是有明显的差距。

我还有点“小坏”的把Compose拉出来鞭打了一遍,哈哈~

看Compose自己怎么说?

能明显看出,代码质量还是有很大的差异的。Compose还需要继续努力啊!

02. 3D地球旅行足迹

这是一个Web 3D的前端应用,考察大模型对于多种技术整合的能力,将所有代码装入一个代码文件里(Three.js、JavaScript和html)。

实现的效果还是非常不错的,地球支持缩放,点击标注地点,动画定位并展示对应图片。

03. 像素坦克大战

这是一款在红白机上经典的坦克大战小游戏,考察大模型在游戏逻辑、音频处理,画面细节生成能力。

经过几轮的打磨,敌方坦克的行走和攻击逻辑,游戏细节画面,包括:草丛、冰面、砖块细节都实现的很不错。

一句话结论Compose 作为claude/gpt/gemini的补充选项,完全没问题。

基准测试表现

接下来,我们看下对这款模型在基准测试里的表现。从性能上来说,Compose略低于GPT-5和Sonnet 4.5,生成速度却是它们的4倍。

图示解释:

  • Best Open:Qwen Coder 和 GLM 4.6
  • Fast Frontier:Haiku 4.5 和 Gemini Flash 2.5
  • Frontier 7/2025:今年 7 月份可用的最佳模型
  • Best Frontier:GPT-5 and Sonnet 4.5

4 倍输出速度:

Cursor内部将响应速度作为Vibe Coding(氛围开发)的关键要素,优化模型积极调用工具,最大化并行执行任务。

我执行了一个优化任务,原速录屏,大家可以感受下执行速度。

Cursor 在正式推出这款大模型之前,内部就已在大范围的使用,借助自身在代码补全开发的经验,以及定位响应速度上的优化,拿出了一个挺有竞争力的大模型!

小结一下

对于Cursor 推出自己的大模型,这是个必然的选项。如果仅做一个AI编程工具,依附于Claude、Gemini、GPT,相信Cursor的CEO没有一天晚上能睡好觉。因为你永远不知道,哪天起床上游大模型厂商直接切断跟你的合作了,那时候哭都来不及。

虽然Compose 在性能上并没达到Claude 4.5和GPT-5的水平,相信随着越来越多的用户使用和反馈,后续持续的进行优化,Compose会成为在Cursor大模型列表里一款合格的选项。

评论区

暂无公开评论

还没有公开评论。

提交反馈

图文Cursor 的含金量还在上升!新模型Compose,编程速度碾压 Claude!

反馈类型

请等待管理员审核,通过后将显示在评论区。

0 / 500