人走了但底牌还在!马斯克祭出1.5T新大模型,注入Cursor数据决战AI编程
导语:人走了但底牌还在。马斯克祭出1.5T新大模型,砸600亿美元买下的Cursor数据底牌终于亮出。
创始班底离散之后,马斯克不退反进
最近一段时间,科技圈流传着各种关于xAI生存状态的传闻,大批创始成员的离散更是让唱衰声四起,很多人甚至怀疑Grok这个产品线是不是要走入历史死胡同了。然而,马斯克偏偏是个在质疑声中越战越勇的冒险狂人。就在这两天,马斯克彻底摊牌,直接亮出了最新的技术底牌:参数量高达1.5T的自研Grok基础模型V9-Medium已经完成了前期的全部基础训练,内部评估得出的结果相当出彩。
据了解,这个巨型模型目前已经进入到微调的深水区。按照当前的工程排期,再过几天它就会正式启动强化学习(RL)阶段。如果一切进展顺利,两至三周内它就会对外部开发者公开发布。对于一直被几家传统大厂把持的大模型竞赛来说,这无疑是投下了一颗深水炸弹。
马斯克在社交媒体上的表态也很直接。他毫不避讳地承认,目前正在承载所有Grok线上流量的其实是一个名为v8-small的旧版本(常被称为Grok 4.2),其核心参数仅为0.5T。由于种种客观局限性,旧版本在训练数据的整体质量、覆盖全面性以及各品类数据的占比层面上其实有着很明显的缺陷。而这一次彻底重构的V9-Medium,不仅把参数规模简单粗暴地扩大到前代的三倍,更是特别针对全新一代Blackwell架构GPU集群进行了深度的软硬件协同优化。无论是推理复杂性,还是解决极其刁钻的工程架构设计,新模型都将带来前所未有的工程突破。
对于爱动手的独立开源社区开发者而言,还有一个非常地道的消息:这套原本处于退役边缘的0.5T老版内核底座,马斯克团队计划在今年年底前彻底开源,方便大家在本地做私有化部署、轻量级微调或是构建个人的边缘端应用,算是在功成身退前留足了诚意。
砸下600亿美元买Cursor期权,这盘棋下得原来这么大
要理解Grok新一代大模型编写代码能力大幅度的跃进,必须先讲明白它的一张深藏不露的王牌,那就是高质量真实开发场景数据的注入。在微调和后续的训练中,研发团队源源不断地把大量来自人工智能编辑器Cursor的数据塞进数据管线里,而且这个独占性极强的数据通道还在持续扩张中。
这背后藏着一个关键的商业动作:今年4月SpaceX发布了一项略显怪异的财务协议,以高达600亿美元的价格锁定了在今年晚些时候收购Cursor的期权。当时许多主流分析机构都在摇头,质疑这笔钱花在区区一款AI代码编辑器上是不是太冤枉了。


回看这次收购安排,不得不叹服马斯克在算力与数据整合上的极度饥渴。Cursor的价值远远不能用单纯的功能或者用户量来衡量。它背后积攒的是全球几十万名一线敏捷开发人员,在真实的编码修Bug流程中沉淀出来的无形思维。在这里面,包含了一个优秀的程序员是如何针对崩溃日志进行层层剖析的、在微服务模块中又是怎么做diff重构的、遇到边缘漏洞又是如何写Mock测试去捕获异常的。这些充满逻辑转折、纠偏轨迹甚至挫败感的数据,在公开的开源社区GitHub里几乎是绝无仅有的。把这个庞大的“人类编码直觉库”作为强力语料塞入1.5T参数大模型的嘴里,Grok的工程逻辑和编码直觉完全有可能实现降维打击般的进化。
强力插班生Grok Build亮剑:死磕三大厂的AI程序员
为了让优秀的模型底盘有一个直观的触达渠道,马斯克甚至不等新一代模型完全就位,就高调对外宣示了他们的“AI程序员”新物种——Grok Build。你可以直接把它理解成紧跟时代发展、对标Anthropic家Claude Code的终极智能体。它不需要依赖复杂花哨的图形界面,只用直接跑在你最习惯的命令行终端(CLI)里。它一诞生,就具备了扫描整个大型项目工程、制定自主开发计划、跨文件编写和调试甚至直接执行Shell测试的端到端能力。

但要在如今竞争白热化的AI Agent生态里杀出生路,Grok Build拿出了非常有竞争力的独门绝招,那就是“计划模式”(Plan Mode)。
很多尝试过早期辅助写代码工具的工程师都有过类似的痛苦经历:你刚输入一条模糊的需求,AI就像个莽撞的新人一样疯狂扫射式修改了你十几个关键文件,最后编译结果全红。Grok Build设计上聪明得多。当你下达指令后,它第一步绝对不会去碰文件写哪怕一行新代码,而是先在大屏幕上弹出一份结构极为完美的执行计划安排。在这份精细的工程蓝图前,主动权完全在人类这一侧。你可以随时指正哪里想错了,修改某个重构环节,甚至可以自己写一个全新的计划覆盖它的思考。等到你的指令批准盖章之后,它才会像精准的手术刀一样,用最规范的diff补丁方式执行具体的底层修改任务。

不仅如此,Grok Build针对专业级的工程需要,几乎把辅助能力给拉满了:它原生支持最高8个子智能体同时开启无界面运行并并行做任务拆解,分别执行前台组件修改、API路由编写和SQL变更;另外它还拥有十分亮眼的竞技场打擂架构(Arena Mode),面对同一个高难度性能优化时,系统可以在逻辑内部让几个不同的设计方案自己打擂台,从而筛选出最优效率的解法;外加对最新MCP(Model Context Protocol)和ACP等行业协议的丝滑融入,整个架构的外部接入潜力简直深不足测。
四国大战正式引爆:留给xAI的新生路究竟好不好走?
横向扫视眼下的格局,曾经略显荒凉的原生终端AI Agent赛道已经在极短时间内挤满了异常剽悍的掠食野兽:率先完成防线卡位的Anthropic头牌黑马Claude Code,在底层框架以极速吞吐见长的OpenAI Codex CLI,以及底盘庞大、随时调动谷歌生态大军的Gemini-powered Antigravity。Grok Build的强势刺入,彻底宣示这个垂直领域进入了惨烈无比的四国大战阶段。
马斯克在这件事的心态上一直放得很平,之前就不止一次在公开场合直接表示过自己团队现阶段在AI编程的底层逻辑深度上的确是处于落后身位的。正因为这样,Grok Build此次抢摊登陆动作,实质上是一种带有强烈突袭意味的产品力补课追捕。它试图在极短的时间内追平竞品已有的王牌壁垒,然后利用“打擂台”和“强计划管理”这些功能,打一局漂亮的错位反击战。
但回归产品真实测评的维度,目前的Grok Build身上仍然套着一根极其坚固的生存枷锁。目前支撑这个工具运转的底层算力模型,本质上还是相对轻量的`grok-code-fast-1`。尽管它的响应十分迅捷,但其受限于256K-token的上下文窗口。面对庞大且混乱的独角兽级别企业工程项目,或者长时间维持上下文的开发Agent来说,这个缓冲区容量可以说是分分钟就会触顶爆满。这也让不少尝鲜的硬核开发者对它的工程稳定性暂时持谨慎观望态度。
但这也恰恰体现了Grok这盘棋最庞大的后手——那台正在机架上接受地狱微调、流淌着Cursor血液的1.5T Grok V9-Medium怪兽一旦顺利出山,被完美替换成Grok Build的最新大心脏,这个全新维度的AI智能体究竟能不能在硅谷的铁王座较量中分到最大的那一块蛋糕?对于那些每天手敲代码的开发者来说,这场极客竞速无疑才刚刚切入最精彩的那条弯道。