Cursor 3.0 出,Opus 4.7 出,Qoder 半价——我在四月的最后一周,把这几个 AI 编程工具全装了一遍

四月这三十天,AI 编程圈密得让人喘不过气。

四月二日,Cursor 3.0 发布,新界面把”多 Agent 并行”做成了主菜。四月十六日,Anthropic 扔出 Claude Opus 4.7,SWE-bench Verified 直接干到 87.6%,登顶。同一天,阿里 Qwen3.6-35B 跟上,跑分 78.8%。一周后,Qwen3.6-27B 又出,27B 的小模型干出了上一代旗舰的水准。四月二十六日,阿里 Qoder 把最贵的”极致档位”打到半价。

字节的 Trae 也没闲着,每周一个小版本,四月十五日的 v3.3.51 一口气塞进了 Rules 嵌套和 MCP OAuth。

我盯着账单,把电脑里能装的全装了一遍——Cursor、Claude Code、Qoder、Trae。一周用下来,我得出了一份不太”政治正确”的排位赛。

写在最前面:没有一个能一统江湖。但谁该用谁,四月这三十天已经把答案逼出来了。

一、Cursor 3.0:上限继续被它推

先说 Cursor。

四月二日的 3.0 大版本,最大的事是把 Agents Window 做成了一等公民。你可以同时跑很多个 Agent——本地、worktree、云端、远程 SSH,一并并行。配上 Canvases 这个新东西,AI 不再用一堵 Markdown 文字回你,而是直接画出可交互的小面板。给你看数据、给你点按钮,比看代码块直观十倍。

4 月 13 日的 3.1 又加了分屏布局和升级语音输入。4 月 14 日 CLI 引入了 /debug,自己生成假设、塞日志、定位 bug。

我用了三天,体感很简单:Cursor 把”AI 写代码”这件事的上限继续在抬。它现在不是一个”AI 助手”,是一个”AI 项目经理”——能并行派活,能可视化汇报。

但麻烦也写在这里。

去年九月那次计费改革阴影还没散。月费名义上还是 20 刀,写得清清白白。可是从”按请求次数”改成”按 Token 计费”以后,社区里的段子变了味——「20 刀买 20 刀的 API 额度,那我为什么不直接用 API。」

3.0 的多 Agent 并行更猛。你开三个 Agent 同时跑,Token 消耗也是三倍。我用了一天,Pro 版的额度肉眼可见地往下掉。

结论:能力天花板最高,但口袋越浅越疼。

二、Claude Code + Opus 4.7:CLI 党的最强大脑

四月十六日 Opus 4.7 发布那天我刷到消息,第一反应是”又来”。

但跑分数据让我安静下来——SWE-bench Verified 87.6%(上一版 80.8%),SWE-bench Pro 64.3%(上一版 53.4%),CursorBench 70%(上一版 58%)。软件工程类基准平均涨了十个百分点。视觉推理跳了 13%。1M Token 上下文,自适应推理深度。

把 Opus 4.7 配到 Claude Code 里用,差距是真能感觉到的。

我有一个搁了三周的项目,前端用 Vue 后端用 Go,跨四个仓库的事。让 Claude Code 跑,给它一句话需求和四个 git 路径,剩下的自己理。它先把每个仓的关键文件读了一遍,自己推断了模块边界,然后改、跑测试、改、提 PR。中间报错三次,自己修了三次。十二分钟。

这不是 IDE 能给你的体验。这是命令行工具配上一个真聪明的脑子,才有的体验。

但 Claude Code 也有它的代价。Anthropic 早些时候取消了 200 刀每月的 Claude Code 无限套餐——所有人开始按 Token 烧钱。Opus 4.7 比 Sonnet 贵很多,跑一个中等任务下来不是几毛钱的事。

结论:智商最高,但你得是”愿意为智商付费”的人。

三、Qoder + Qwen3.6:国产里唯一敢正面对标的

阿里这一波是我没想到的。

四月十六日 Qwen3.6-35B 发布,SWE-bench Verified 干到 78.8%。一周后 Qwen3.6-27B 又出——27B 的稠密模型,干出来的成绩超过上一代 Qwen3.5-397B-A17B。把 392B 压到 27B,性能反超,这不是常规升级,是降维打击。Qoder 是阿里自家平台,用上自家最猛的模型只是时间问题。

四月二十六日,Qoder 把”极致档位”的计费倍率从 1.6x 砍到 0.8x,等于半价。

我装上 Qoder,挑了一个真实的小项目让它做——一个三百行的 Python 脚本要重构成模块化的、加测试覆盖的版本。

好的部分是 Qoder 真的”理解项目”。它的 Repo Wiki 功能会先把仓库扫一遍,给你建一份内部文档;Quest 模式像 Cursor 的 Composer,但更激进,给你一句话它就开干。

不好的部分是 Credit 烧得心慌。Pro 版每月 2000 Credit,听着挺多,跑两个 Quest 就见底。极致档位半价之后好一些,但你想不焦虑,没戏。

还有一些工程上的粗糙。复杂任务有时候卡住、有时候改错文件、有时候输出的代码看起来对、跑起来不对。

结论:野心是国产里最大的,但 Credit 经济学还没想清楚。

四、Trae:勤快且本分

字节的 Trae 没那么大动静,但每周一个小版本。

四月十五日的 v3.3.51 是这一个月的高光:Rules 支持嵌套,子目录的规则会自动带给 Agent;Git Message 生成支持下拉菜单选规则;MCP 走完 OAuth 全链路;自定义模型支持自定义 baseURL——意思是想接什么外部模型就接什么。

它的 SOLO 模式我之前写过。简单说,就是给 AI 一句话,它自己写 PRD、装环境、写代码、跑测试、部署上线,全套。

Trae 在我这一周的体验里,是新手最容易上手的那一个。免费版图片识别可以用——拍一张微信小程序截图丢进去,它给你还原 UI 结构、生成代码。这个能力 Qoder 免费版关闭、CodeBuddy 没有、Cursor 有但烧 Token 烧得快。

但 Trae 的天花板也在那儿摆着。它是”副驾驶”路线——你来主导,它来辅助。Cursor 3.0 已经在做”主驾驶”了,Claude Code 早就是”主驾驶”了,Qoder 也想往”主驾驶”走。Trae 还在守”副驾驶”。

结论:免费版最良心,新手友好,但激进派的目标它不在。

五、所以四月这三十天,到底该选谁

我拿这一周的体感,给一个不”政治正确”但很实用的推荐:

  • 重度项目 + 不在乎钱 → Cursor 3.0 + Claude Code 双修,Cursor 当 IDE,Claude Code 跑长任务。
  • CLI 党 + 想要最强大脑 → 直接 Claude Code + Opus 4.7,别折腾 IDE。
  • 想试国产 + 项目复杂 → Qoder,用 Qwen3.6 做底座,趁极致档位半价。
  • 新手 + 小项目 + 不想花钱 → Trae,免费版能干很多事。
  • 不知道选什么 → 先开 Trae 学,再上 Claude Code,最后看预算决定要不要 Cursor。

四月这三十天,没人输得彻底,没人赢得干净。

Cursor 把多 Agent 玩到飞起,Claude Opus 4.7 把 SWE-bench 推到 87.6%,Qwen 3.6 把开源跑分干到 78.8%——这三家在抬上限。

但留给所有 IDE 的窗口期,只剩一个问题没解:模型再强,工程化、Credit 焦虑、付费模式,谁先想明白?

至少在四月,没有谁想明白。


本文写于 2026-04-29,工具版本与跑分数据截至当日。下个月可能就过期。