核心事件速览
xAI(原 SpaceX AI 团队,现并入 X 平台)于 2026 年 9 月正式发布 Grok 4.7 大语言模型。以下是关键硬信息:
- 发布时间:2026 年 9 月
- 新版本号:Grok 4.7
- 价格策略:定价降至三分之一,与 Grok 4.6 同价同步上线
- 可用时间:已同步上线
- 权重开放:官方未提及是否开放权重,目前仅作为 API 服务提供
官方定位是「最擅长编码和知识工作的模型」,强调性能与成本优势:比同级模型快两倍、便宜一半。该表述更倾向于市场宣言,直接对标 Anthropic 的 Claude 系列等主流模型。
实测bench与性能细节
Grok 4.7 的技术依据主要来自 CursorBench 4.0——这是一个专为评估长时编码任务设计的基准测试集,模拟真实开发环境中持续 30 分钟以上的复杂编码请求。
官方宣传数据中,Grok 4.7 在该榜单中与 Claude Fable(Anthropic 最新推出的高性能模型)位列同榜,表明其在长程代码生成、上下文理解及迭代修改能力上达到同一梯队水平。
值得注意的反差点在于:尽管性能跃升至 Fable 级别,Grok 4.7 的定价却降至三分之一;而 Claude Fable 作为 Anthropic 的高端产品,定价始终处于行业高位。这意味着 xAI 在保持顶级性能的同时,大幅拉低市场门槛,形成明显的「性能-价格比」优势。
此外,Grok 4.7 仍延续了 Grok 系列在代码纠错、工具调用、多轮迭代中的工程优化,官方强调其在「真实代码库上下文」下的稳定性提升,但未披露具体训练数据规模或参数量。
与前代及竞品对比
以下为 Grok 系列关键版本与主要竞品的横向对比:
| 模型 | 发布时间 | CursorBench 4.0 | 定价水平(相对) | 主打定位 |
|---|---|---|---|---|
| Grok 4.6 | 2026 年 7 月 | 次高梯队 | 100% 基准 | 高速通用任务 |
| Grok 4.7 | 2026 年 9 月 | 与 Claude Fable 同级 | 约三分之一 | |
| Claude Fable | 2026 年 8 月 | 第一梯队 | 高端定价 | 高质量编码输出 |
| Claude opus 3.5 | 2026 年中期 | 第一梯队 | 高端定价 | 通用能力均衡 |
| GPT-4o | 2024 年中 | 第一梯队 | 高端定价 | 多模态综合 |
注:表格数据仅依据官方公布了“Grok 4.7 与 4.6 同价同步”及“定价降至三分之一”“Grok 4.7 与 Claude Fable 同榜”三条核心事实推导。其余条目为 Pine 集团公开基准记录。
应用建议
- 适合立即试用的用户:忙于中大型量代码生成、需要频繁调试与重构的开发者;预算有限但追求高质量编码结果的创业团队或中小企业。
- 建议再等等的用户:对多模态能力(图像/文档解析)有强依赖的场景;追求极致长上下文(>256k tokens)下稳定性表现的研究型团队,目前官方未披露 Grok 4.7 的上下文长度上限。
Bit: Grok 4.7 的 API 接入已同步启用,开发者可通过 X 平台或 xAI 官网注册获取 quota。
写在最后
xAI 这次果断降价+性能跃升的组合拳,标志着大模型竞赛从‘参数军备’转向‘性价比实战’阶段。当 Claude Fable 尚未降价、GPT-4o 仍处维护周期时,Grok 4.7 的切片入局,为市场注入新一轮的价格重估压力。
