xAI 于周一推出新一代模型 Grok 4.7,并已同步接入 Grok 应用、Cursor、Grok Build 以及 xAI API。该公司称,这是目前表现最强的版本,在价格和响应速度不变的情况下,较 Grok 4.6 有所提升。
这次发布距离最初预期已多次推迟。自 7 月下旬以来,马斯克至少五次调整上线时间,最终在 9 月 21 日正式落地。
参数规模升至 2.1 万亿
Grok 4.7 的参数规模达到 2.1 万亿,较 Grok 4.6 的 1.5 万亿增加约 40%。定价方面,输入价格为每百万 token 2 美元,输出价格为每百万 token 6 美元。
xAI 表示,新模型在处理复杂问题时会投入更长推理时间,也会更频繁地复核答案,同时加入了更强的安全防护设置。
加入 SpaceX 工程数据训练
与此前版本相比,Grok 4.7 的一个新变化是加入了来自 SpaceX 的补充训练数据,包括 Starlink 卫星遥测、制造记录和工程故障日志。
xAI 希望借此提升模型对硬件系统和物理工程问题的理解能力,而不只是依赖互联网文本训练。这也让 Grok 4.7 的定位更偏向工程与现实系统推理。
多项测试仍未排到第一
从 xAI 披露的数据看,Grok 4.7 在多项测试中排名靠前,但尚未进入第一。在 GDPval 测试中,其得分为 1695,低于 Claude Fable 5.1 的 1735;在 AA-Briefcase 测试中,Grok 4.7 得分 1657,也低于后者的 1678。
在电气工程基准 EEBench 中,Grok 4.7 落后于 GPT-6 Astra。报道还提到,在面向真实编程任务的 CursorBench 4.0 中,Grok 4.7 的表现处于中间位置,整体仍未追上 Anthropic 的 Fable 5.1。
xAI继续押注低价覆盖
从 Grok 4.5 到 Grok 4.7,xAI 的路线并未明显改变。相比直接争夺榜首,该公司更强调成本、速度和分发渠道,希望以更低价格和更广覆盖扩大使用规模。
马斯克在发布前表示,Grok 4.7 的整体水平大致与 Claude Opus 5.0 相当,多模态能力仍需继续改进。他同时提到,后续还将推出 Grok 4.8、Grok 4.9 和 Grok 5,但暂未给出具体发布时间。











