posts/cursor-spacex-feedback-loop.md
SpaceX 600 亿美元买 Cursor,最值钱的不是编辑器
600 亿美元,买一个代码编辑器。
这句话怎么读都像产品经理把预算表的小数点拖错了两位。可 Cursor 官方公告 已经把结果写得很明白,SpaceX 对 Cursor 的收购正式完成。交易从 4 月开始推进,现在 Cursor 成了 SpaceX 体系的一部分。
官方写得很克制,接下来会使用全球最大的 GPU 集群,训练更强、运行成本更低的模型,刚发布的 Grok 4.6 是双方共同训练的第一批结果。
好家伙,一个写代码的工具,身后突然接上了巨型算力、前沿模型和一家刚完成大额上市的公司。
但如果只把这件事理解成 SpaceX 买了个很火的 IDE,600 亿美元肯定算不明白。AP 对交易的报道 提到,SpaceX 看中的一项资产,是 Cursor 对专业开发者的广泛分发。这个表述比所有宏大愿景都更接近答案。
SpaceX 买到的不是一块编辑器界面,而是一条每天被真实程序员反复使用、能不断产出可验证反馈的代码回路。

交易落地后,Cursor 的开发者入口与 SpaceXAI 的算力正式站到同一条线上。
写代码可能是最值钱的训练场
普通聊天有个麻烦,答案好不好,经常很难立即判断。用户点个赞,不一定是内容真对,也可能只是语气顺耳。写代码不一样。
补丁能不能编译,单元测试过不过,类型检查报不报错,页面有没有按预期渲染,代码审查接受还是退回,反馈都很硬。一个智能体改了 12 个文件,跑完测试挂在第 317 个用例上,这不是模糊的审美判断,是一条可以继续训练和评测的信号。
很多朋友可能不知道,代码模型真正稀缺的从来不只是 GitHub 上那些公开仓库。公开代码能教模型代码长什么样,却很难完整展示一个工程任务从需求、检索、修改、执行、失败、重试到验收的全过程。
Cursor 恰好卡在这个过程最中间。
它看得到开发者给了什么上下文,模型调用了哪些工具,改动在哪一步被接受,在哪一步被撤回。这里先把边界说清楚,这不等于 Cursor 会把每个用户的私有代码拿去训练。Cursor 当前的 数据使用说明 明确写着,开启 Privacy Mode 后,客户数据不会被 Cursor 用于训练,模型提供方也有零数据保留约束。关闭该模式后,Cursor 才可能存储并使用代码片段、提示词、编辑动作等数据改进模型。
隐私边界归隐私边界,产品位置归产品位置。只看产品位置,Cursor 掌握的仍是一种极难复制的能力,它能设计任务、运行任务、收集结果,再把失败变成下一轮训练和评测材料。
这套东西有个工程词叫 harness,也就是让模型真正干活的脚手架。模型负责想,脚手架负责给工具、控权限、跑命令、收日志、判定成功。模型实验室很容易做一个漂亮 demo,难的是让几百万开发者每天在真实仓库里跑这套脚手架。
Cursor 已经把后半段做出来了。
这才是 600 亿美元里最难买的部分。
算力、模型和分发被接到了一起
把 4 月的 SpaceX 公开申报文件 和今天的公告放在一起看,交易结构就清楚了。
SpaceX 提供 GPU 集群和模型能力。Cursor 提供人员、数据集、文档、技术经验、工作流、提示词、规格与软件代码。双方共同改进 Grok,也可以共同开发新模型。
厉害了,这已经不是传统的软件收购。
过去 Cursor 的处境有点尴尬。它做出了很强的产品和脚手架,却要大量采购 Anthropic、OpenAI、Google 等公司的模型。供应商同时也是竞争对手,Claude Code 和 Codex 都在直接抢开发者入口。Cursor 用户越多,推理账单越大,底层模型什么时候升级、价格怎么变,也不完全由 Cursor 决定。
现在这几层开始垂直连起来。
最底下是 SpaceXAI 的算力,中间是 Grok 与 Cursor 自研的 Composer,上面是 Cursor 的编辑器、CLI、云智能体和团队协作入口,再往上才是开发者每天产生的任务与验收反馈。
模型变强,产品获得更多用户。用户带来更多真实任务,真实任务暴露新的失败模式。失败模式回到训练、强化学习和评测里,下一代模型再塞回同一个产品。
这条回路一旦转起来,单看某个基准榜单就会越来越失真。真正的竞争不再只是哪个模型一次考试分高,而是谁能最快发现模型在真实工作里怎么翻车,再把翻车修进下一版。
Grok 4.6 的官方页面 已经露出一点样子。Cursor 说它与 SpaceXAI 联合训练了这款模型,使用了工程数据、模型生成轨迹和多类智能体环境做强化学习。Cursor 自己公布的 CursorBench 3.2 得分从 Grok 4.5 的 66.7% 涨到 69.9%。
别急着开香槟。
同一张表里,Grok 4.6 在 Terminal-Bench 3.0 上只有 26%,低于表中两款对照模型的 34% 左右。官方自测可以看方向,不能当最终判决。它真正值得关注的地方,是模型、训练环境和产品入口已经由同一套组织共同调度。

数据来自 Cursor 的 Grok 4.6 官方页面,同一款模型在不同智能体任务上的差距依然明显。
以前是 Cursor 选模型,现在也可能是 Cursor 帮着造模型。
多模型工具的中立性要重新观察
对普通开发者来说,最现实的问题不是这笔交易贵不贵,而是以后打开 Cursor 时,模型选择还会不会保持足够中立。
官方公告没有说 Cursor 会下架 Claude、GPT 或 Gemini,也没有证据表明它马上要这么做。Cursor 现在仍然是多模型产品。把收购直接写成其他模型要被赶走,属于自己吓自己。
可利益方向确实变了。
当自家 GPU 已经开着,自家模型已经训练完,自家产品还掌握路由入口,优先推荐 Grok、给 Grok 更多额度、让新功能先适配 Grok,都会成为很自然的商业选择。不是说它一定会发生,而是说用户应该开始观察。
观察什么?
别只看模型下拉框里有没有 Claude。要看 Auto 模式实际把多少任务路由给自家模型,要看同等订阅额度下不同模型的可用量,要看云智能体、代码审查、Bug 修复等新功能是否出现模型绑定,还要看企业管理员能否固定模型和数据策略。
我自己的判断可能不成熟,Cursor 最难守住的不是编辑器体验,而是开发者过去默认相信的那层中立感。一个工具同时做模型、卖模型、路由模型、评测模型,效率会变高,利益冲突也会更难看清。
怎么说呢,这不是 Cursor 一家的问题。AI 编程工具正在从模型超市变成垂直栈。每家公司都想把算力、模型、智能体和分发握在自己手里。对公司来说,这是毛利和迭代速度。对开发者来说,这是迁移成本。
你今天把规则写死在某个编辑器的私有格式里,把评测只放在某家云智能体里,把团队工作流绑在一个自动路由器上,明天模型价格或产品策略一变,迁移就不再是换个 API key 那么轻松。
这话听着有点刺耳,但写代码的人应该比谁都熟悉供应商锁定。数据库、云服务、监控平台都演过同一集,现在轮到 AI 编程了。
程序员现在该做的四个检查
坦率讲,没必要因为收购消息连夜卸载 Cursor。工具好不好用,还是要看它能不能帮你把活干完。真正有用的动作,是趁产品边界还在变化,把自己的边界先立住。
先打开团队后台确认 Privacy Mode,不要靠记忆。Cursor 的 安全页面 明确说明,开启后不会用客户数据训练模型。个人项目和公司项目最好分开配置,企业仓库再检查一次管理员是否强制开启。尤其是密钥、客户数据、生产配置,继续放进 .cursorignore 一类排除规则里,别把隐私模式当万能结界。
然后把模型路由记录下来。团队如果用 Auto 模式,至少在一段时间内抽样记录实际模型、单次成本、测试通过率和返工次数。只看回答顺不顺眼没用,到头来还是要回到 CI、单元测试和代码审查结果。模型名会换,验收标准别跟着漂。
再把核心工作流做成可迁移资产。项目规则、测试命令、工具说明、MCP 配置和验收条件,尽量放在仓库里,用普通文本和公开协议表达。今天可以给 Cursor 读,明天也能给 Claude Code、Codex 或本地智能体读。别让团队最值钱的工程经验只活在一个产品的云端设置页里。
还有一个容易被忽略的检查,给自家任务留一套小评测。选十来个真实又能自动验收的任务,覆盖改接口、补测试、查并发问题、跨文件重构这几类高频工作。每次新模型上线就跑一遍,记录成功率、成本和人工接管点。榜单告诉你模型大概多聪明,自家评测才告诉你它会不会把仓库搞坏。
有点子牛逼的模型当然值得试,但生产环境从来不靠兴奋上线。
说真的,Cursor 被收购这件事最有意思的部分,不是某家公司又多了一块版图。它把 AI 编程接下来的竞争方式照亮了。
模型能力还会涨,价格还会降,编辑器界面也会继续互相抄。真正拉开差距的,会是谁拥有真实开发者入口,谁能拿到连续、可验证的工作反馈,谁又能把这些反馈最快送回训练系统。
SpaceX 花 600 亿美元,把算力和这条反馈回路接在了一起。
屏幕前的你不用替这笔交易算回本周期。更该算的是,自己的代码、规则、评测和工作流,有多少仍然握在自己手里。
模型是租来的。
家底最好别一起租出去。