马斯克发帖承认:Grok 4.7难产,还得在烤箱里酝酿几天

2026年9月11日,马斯克在X平台回复网友时留下一句话:Grok 4.7还得再烤几天。原话是“needs a few more days to cook”。

原定9月12日上线的版本,就这么被一句“再烤几天”按在了烤箱里。

两天之后的9月13日,他直接跳过了Grok 4.7,宣布Grok 4.8将于本周完成训练、随后启动RL,参数量2.5万亿,用上了全新的C++软件栈。

从9月2日预告“10天后发布”,到9月11日说“再烤几天”,再到9月13日直接跳到4.8——这一次,马斯克的AI发布节奏,是真的跳票了。



01 强化学习阶段暴露的核心缺陷

据X平台公开帖子记录,Grok 4.7原定的发布窗口是9月12日。这个版本的参数量设计为2.1万亿,比上一代Grok 4.6增加了40%,按计划应该在9月中旬和用户见面。

让时间表整体后移的,是强化学习阶段暴露出来的一个关键缺陷。

马斯克在X帖中解释称,模型面对困难任务时“放弃得太早”。落到具体表现上:模型一旦首次尝试解题受挫,就倾向于直接给出一个不确定的答案,而不是像人类那样反复换路径、换假设、再试一次。

这个问题听起来像是一句产品吐槽,落到工程上却很棘手。大模型的能力上限,很大一部分正是在强化学习这一阶段被“喂”出来的——模型被奖励机制推着去尝试更难的推理链,一次失败就收手,意味着这一轮训练几乎没有把最难的那部分潜力榨出来

原定的2.1万亿参数,是冲着把这一轮能力再往上抬一截去的。结果最难的那道坎没迈过去,9月12日的上线节点自然就守不住了。

xAI给出的应对,不是回头死磕4.7,而是直接跳到4.8。新版本参数量拉到2.5万亿,软件栈整体换成C++,用更大的模型和更底层的工程重构去追赶被耽误的进度。

截至9月17日,Grok 4.7仍然没有上线,新的上线时间也迟迟没有公布。被跳过的这一版,像是被悄悄合上的一页。

02 Grok跳票格外刺眼的两个原因

大模型开发延期,在这个行业里其实不是新闻。

OpenAI的GPT-5原定2025年底发布,一路推迟到2026年中才和用户见面;Anthropic的Opus 5.1也前后延期了两次。头部实验室把发布时间往后挪,几乎成了新常态。

但落到Grok 4.7身上,这次跳票显得格外刺眼,原因有两个。

一是问题本身卡得很具体。强化学习那一步里,模型被观察到在困难任务上“太早放弃”,不能像人一样反复尝试不同解题路径;9月14日马斯克又承认,多模态能力也还存在待修的问题。一边是推理链上的退缩,一边是多模态上的欠账,两个问题叠在一起,4.7这一版就很难硬着头皮发出去。

二是同行没掉链子。OpenAI的GPT-6(代号Astra)和Anthropic的Fable模型都在按计划推进,时间线上没有明显松动。对手稳稳往前走,自己这边却把已经预告过的版本摁住不发,对比之下,xAI的节奏问题被放大了。



从公开招聘信息和行业报道的2026年口径来看,xAI团队规模约在4700到5500人之间,OpenAI约4000到4500人,Google DeepMind约5000到6000人。放到同一量级上看,xAI在人数上已经不再是最单薄的那个。模型竞赛走到这一步,比拼的不只是算力集群,更是算法团队的厚度、数据打磨的耐心、强化学习调参的经验——遇到“放弃得太早”这类深层问题,修复周期不会因为人数多就立刻缩短。

这也解释了xAI为什么选择跳版本而不是延期。继续死磕4.7,可能要再耗几周;直接上4.8,用更大的参数量和全新C++栈一次性把工程债清掉,账面上至少有一个“更大的新模型”可以交代。

跳版本,本质上是用新进度覆盖旧尴尬。

03 马斯克的AI时间线管理术

在AI领域,马斯克这套“预告—跳票”的做法已经上演了好几年。

2023年说Grok年底发布,2024年说AGI两年内实现,每一次公开表态,都比团队实际能交付的进度提前一截。这种节奏不是偶然,而是一种有意识的时间线管理。

好处摆在明面上:通过不断预告,维持市场对xAI的关注度,让投资者、开发者和媒体一直把注意力放在这家公司身上。热度不断,融资和人才就不会断流。

坏处同样明显。每一次跳票,都会消耗掉一部分信誉。开发者圈和科技媒体开始对马斯克的AI时间表自动打折扣——预告归预告,真正能用上才算数。

这次从4.7直接跳到4.8,某种程度上就是在用一个“更大的新闻”去覆盖跳票的尴尬。当所有人都在讨论新版本的参数量和C++软件栈时,4.7为什么没出来,反而少有人追问了。

但跳到4.8的同时,马斯克也自己拆了台。他承认,Grok 4.7的水平只是和Anthropic的Opus 5.0相当。这句话等于亲口说明:被跳过的这一版,并没有拉开和对手的差距,xAI在大模型竞赛的第一梯队里,位置并不稳固。

9月15日,他又往前迈了一步预告:Grok 4.9可能和OpenAI Astra或Anthropic Fable同级,Grok 5才是AGI。新一轮时间表已经摆上了桌面,能不能兑现,要等到下一个“烤几天”的时刻才知道。

预告是免费的,兑现才是成本。

04 AI竞赛的真实节奏

把视线从马斯克身上挪开,整个大模型竞赛其实正在换一条赛道。

过去几年,行业比的是“谁的参数最大”,万亿级、两万亿级的数字一个比一个吓人。但走到2026年,衡量标准已经悄悄换成了“谁的推理能力更强”——模型能不能在困难任务上不放弃、能不能一步步把复杂问题拆解开、能不能在多模态之间自由切换。参数量依然重要,却不再是唯一的胜负手。

OpenAI的GPT-6、Anthropic的Fable、Google的Gemini 3,都在同一条时间线上往前推。xAI的Grok系列不是唯一的玩家,也不是跑在最前面的那个。这次Grok 4.7跳票说明一件事:即使是马斯克这样自带流量的超级明星,也没法在AI竞赛里一直踩着自己喊出的节奏走。



更深一层的变化,是瓶颈本身转移了。早期卡住行业的主要是算力——芯片够不够、集群搭得够不够快。现在,算力依然贵,但更稀缺的是算法打磨和强化学习数据的质量。模型在困难任务上“太早放弃”这种问题,靠堆钱买GPU解决不了,得靠工程师一行行调奖励函数、一批批筛训练数据,慢工出细活

对普通用户来说,Grok 4.7跳票的直接影响其实不大。市场上可供挑选的大模型早已不止一款,缺的不是又一个聊天框,而是真正解决问题的那一两个。

AI竞赛的真实节奏,从来不是谁喊得响谁赢。谁能把真正能用的产品做出来、稳定地交到用户手里,谁才留在牌桌上。烤箱里的模型还要再烤几天,市场愿意等多久,是另一道题。

展开阅读全文

更新时间:2026-09-21

标签:游戏   烤箱   发帖   模型   跳票   预告   参数   节奏   版本   困难   时间表   能力   时间

1 2 3 4 5

上滑加载更多 ↓
推荐阅读:
友情链接:
更多:

本站资料均由网友自行发布提供,仅用于学习交流。如有版权问题,请与我联系,QQ:4156828  

© CopyRight All Rights Reserved.
Powered By 61893.com 闽ICP备11008920号
闽公网安备35020302034844号

Top