Featured image of post 马斯克披露Grok演进路线:4.8本周完成训练,4.9或达Astra/Fable水平,Grok 5有望实现AGI

马斯克披露Grok演进路线:4.8本周完成训练,4.9或达Astra/Fable水平,Grok 5有望实现AGI

马斯克宣布xAI系列模型最新进展,聚焦参数规模与AGI目标

Grok 4.8与4.9时间线和参数曝光

Grok 4.8与4.9时间线和参数曝光
Grok 4.8与4.9时间线和参数曝光|新闻截图

xAI首席执行官埃隆·马斯克于9月14日在X平台透露多项关键信息:

  • Grok 4.8:参数量达2.5万亿,采用全新C++软件栈训练,将于本周完成训练并启动强化学习(RL)阶段
  • Grok 4.7:原定9月12日发布,实际推迟数日上线,延期主因强化学习阶段的回复长度惩罚过重,导致模型过早放弃困难任务且难以严谨自检
  • Grok 4.9:马斯克表示其能力可能与OpenAI Astra(GPT-6)或Anthropic Fable同级
  • Grok 5:马斯克回应网友提问时明确称,AGI(通用人工智能)的实现将依赖于Grok 5版本

这些时间点与参数数据均来自马斯克本人在X平台的公开回复。

模型能力对标与技术细节

模型能力对标与技术细节
模型能力对标与技术细节|新闻截图

据马斯克说明,Grok 4.7的能力大致与Anthropic Opus 5.0相当,而非5.1版本,主要短板在于多模态性能尚待修复。他指出Grok 4.8将带来明显改进,这与其采用全新C++训练栈直接相关——C++相较Python在推理速度与内存管理上更具优势,对超大规模模型训练至关重要。

一个值得注意的反差点在于:尽管Grok 4.7已属顶级模型行列(对标Opus 5.0),但其实际表现仍存在明显缺陷(如过度缩短回复、缺乏自检能力),这说明从模型能力上限到稳定输出之间仍存在工程化鸿沟。强化学习虽能提升模型表现,但调参不当反而会触发新的行为问题。

模型版本参数量训练阶段能力对标多模态性能
Grok 4.7未披露已上线Anthropic Opus 5.0待修复
Grok 4.82.5万亿训练中,将启RL未明确,马斯克称"明显改进"未说明
Grok 4.9未披露未开始OpenAI Astra / Anthropic Fable未说明
Grok 5未披露未提及马斯克称"或超越一切"未说明

读者落地建议

读者落地建议
读者落地建议|新闻截图

  • 若追求当前最稳定表现:建议继续使用Grok 4.7,其基础能力已达业界第一梯队,多模态问题不影响文本推理类任务
  • 若能接受技术早期风险:可关注本周五起Grok 4.8的RL阶段进展,其改进方向可能包括更长、更严谨的推理路径
  • 若有AGI探索兴趣:Grok 5是值得跟踪的里程碑,但当前无发布时间表,建议保持关注勿期待短期内落地

写在最后

超大规模参数量正成为头部模型的标配路径,但Grok系列反复提及的"工程修复"问题揭示了一个行业现实:模型规模与实用稳定性并非线性关系。xAI的快速迭代节奏若能持续,或加速整个行业的实用化进程。