马斯克:Grok 4.8 本周完成训练,参数量冲到 2.5 万亿,全新 C++ 软件栈喂出来
9月14日,xAI首席执行官埃隆·马斯克在X平台发布动态,正式披露下一代大模型Grok 4.8的核心信息,该消息随后被IT之家、财联社等多家科技媒体报道确认,引发AI行业广泛关注。

马斯克X平台官宣Grok 4.8核心规格
马斯克明确表示,Grok 4.8是一款参数量达到2.5万亿的巨型AI模型,目前已完成绝大部分训练流程,将在本周内完成全部训练工作,随后正式启动强化学习(RL)环节。这是xAI截至目前公开的参数规模最大的模型,远超此前Grok系列的参数水平。
xAI自研全新C++软件栈支撑超大规模训练
马斯克透露,Grok 4.8的训练全程采用xAI新开发的C++软件栈完成。这一软件栈是马斯克此前多次提及的技术布局,核心规划包括三项内容:
- 2026年6月马斯克提出Grok训练、推理软件栈全面改写为C/C++代码的计划,预计落地周期约3个月
- 删除大量冗余中间层,降低算力损耗
- 针对英伟达GB300芯片做专项适配优化,提升训练效率
本次Grok 4.8的训练落地,也标志着该技术规划的正式兑现,为超大规模模型的训练效率提供了底层支撑。
Grok 4.7因强化学习问题延期,4.8迭代节奏紧凑
就在马斯克官宣Grok 4.8前不久,他曾向外界透露Grok 4.7将于9月12日正式发布,但临近上线又宣布该模型将延期推出。马斯克解释延期原因是强化学习阶段的回复长度惩罚机制设置过重,导致模型在处理复杂任务时容易过早放弃,且无法对自身输出内容进行严谨校验。目前Grok 4.7仍在进行最终优化,有望在本周内正式面向用户推出,与即将进入强化学习阶段的Grok 4.8形成迭代衔接。
2.5万亿参数模型启动强化学习,性能预期引行业关注
按照马斯克的规划,Grok 4.8完成训练后将立即进入强化学习阶段,这一环节将直接决定模型的逻辑推理、任务处理、内容生成等核心能力。2.5万亿的超大参数量叠加全新C++软件栈的技术加持,外界普遍对Grok 4.8的性能表现抱有极高期待,也有行业人士分析,该模型的落地将进一步推动大模型向超大规模、高算效的方向发展。