Grok 4.8与4.9时间线和参数曝光
xAI首席执行官埃隆·马斯克于9月14日在X平台透露多项关键信息:
- Grok 4.8:参数量达2.5万亿,采用全新C++软件栈训练,将于本周完成训练并启动强化学习(RL)阶段
- Grok 4.7:原定9月12日发布,实际推迟数日上线,延期主因强化学习阶段的回复长度惩罚过重,导致模型过早放弃困难任务且难以严谨自检
- Grok 4.9:马斯克表示其能力可能与OpenAI Astra(GPT-6)或Anthropic Fable同级
- Grok 5:马斯克回应网友提问时明确称,AGI(通用人工智能)的实现将依赖于Grok 5版本
这些时间点与参数数据均来自马斯克本人在X平台的公开回复。
模型能力对标与技术细节
据马斯克说明,Grok 4.7的能力大致与Anthropic Opus 5.0相当,而非5.1版本,主要短板在于多模态性能尚待修复。他指出Grok 4.8将带来明显改进,这与其采用全新C++训练栈直接相关——C++相较Python在推理速度与内存管理上更具优势,对超大规模模型训练至关重要。
一个值得注意的反差点在于:尽管Grok 4.7已属顶级模型行列(对标Opus 5.0),但其实际表现仍存在明显缺陷(如过度缩短回复、缺乏自检能力),这说明从模型能力上限到稳定输出之间仍存在工程化鸿沟。强化学习虽能提升模型表现,但调参不当反而会触发新的行为问题。
| 模型版本 | 参数量 | 训练阶段 | 能力对标 | 多模态性能 |
|---|---|---|---|---|
| Grok 4.7 | 未披露 | 已上线 | Anthropic Opus 5.0 | 待修复 |
| Grok 4.8 | 2.5万亿 | 训练中,将启RL | 未明确,马斯克称"明显改进" | 未说明 |
| Grok 4.9 | 未披露 | 未开始 | OpenAI Astra / Anthropic Fable | 未说明 |
| Grok 5 | 未披露 | 未提及 | 马斯克称"或超越一切" | 未说明 |
读者落地建议
- 若追求当前最稳定表现:建议继续使用Grok 4.7,其基础能力已达业界第一梯队,多模态问题不影响文本推理类任务
- 若能接受技术早期风险:可关注本周五起Grok 4.8的RL阶段进展,其改进方向可能包括更长、更严谨的推理路径
- 若有AGI探索兴趣:Grok 5是值得跟踪的里程碑,但当前无发布时间表,建议保持关注勿期待短期内落地
写在最后
超大规模参数量正成为头部模型的标配路径,但Grok系列反复提及的"工程修复"问题揭示了一个行业现实:模型规模与实用稳定性并非线性关系。xAI的快速迭代节奏若能持续,或加速整个行业的实用化进程。



