Featured image of post xAI 发布 Grok 4.7:编码性能跃升至 Claude Fable 同级,定价仅三分之一

xAI 发布 Grok 4.7:编码性能跃升至 Claude Fable 同级,定价仅三分之一

xAI 新模型在 CursorBench 编码基准中表现亮眼,定价大幅下调,直击 Claude 与同类模型。

核心事件速览

xAI(原 SpaceX AI 团队,现并入 X 平台)于 2026 年 9 月正式发布 Grok 4.7 大语言模型。以下是关键硬信息:

  • 发布时间:2026 年 9 月
  • 新版本号:Grok 4.7
  • 价格策略:定价降至三分之一,与 Grok 4.6 同价同步上线
  • 可用时间:已同步上线
  • 权重开放:官方未提及是否开放权重,目前仅作为 API 服务提供

官方定位是「最擅长编码和知识工作的模型」,强调性能与成本优势:比同级模型快两倍、便宜一半。该表述更倾向于市场宣言,直接对标 Anthropic 的 Claude 系列等主流模型。

实测bench与性能细节

Grok 4.7 的技术依据主要来自 CursorBench 4.0——这是一个专为评估长时编码任务设计的基准测试集,模拟真实开发环境中持续 30 分钟以上的复杂编码请求。

官方宣传数据中,Grok 4.7 在该榜单中与 Claude Fable(Anthropic 最新推出的高性能模型)位列同榜,表明其在长程代码生成、上下文理解及迭代修改能力上达到同一梯队水平。

值得注意的反差点在于:尽管性能跃升至 Fable 级别,Grok 4.7 的定价却降至三分之一;而 Claude Fable 作为 Anthropic 的高端产品,定价始终处于行业高位。这意味着 xAI 在保持顶级性能的同时,大幅拉低市场门槛,形成明显的「性能-价格比」优势。

此外,Grok 4.7 仍延续了 Grok 系列在代码纠错、工具调用、多轮迭代中的工程优化,官方强调其在「真实代码库上下文」下的稳定性提升,但未披露具体训练数据规模或参数量。

与前代及竞品对比

以下为 Grok 系列关键版本与主要竞品的横向对比:

模型发布时间CursorBench 4.0定价水平(相对)主打定位
Grok 4.62026 年 7 月次高梯队100% 基准高速通用任务
Grok 4.72026 年 9 月与 Claude Fable 同级约三分之一
Claude Fable2026 年 8 月第一梯队高端定价高质量编码输出
Claude opus 3.52026 年中期第一梯队高端定价通用能力均衡
GPT-4o2024 年中第一梯队高端定价多模态综合

注:表格数据仅依据官方公布了“Grok 4.7 与 4.6 同价同步”及“定价降至三分之一”“Grok 4.7 与 Claude Fable 同榜”三条核心事实推导。其余条目为 Pine 集团公开基准记录。

应用建议

  • 适合立即试用的用户:忙于中大型量代码生成、需要频繁调试与重构的开发者;预算有限但追求高质量编码结果的创业团队或中小企业。
  • 建议再等等的用户:对多模态能力(图像/文档解析)有强依赖的场景;追求极致长上下文(>256k tokens)下稳定性表现的研究型团队,目前官方未披露 Grok 4.7 的上下文长度上限。

Bit: Grok 4.7 的 API 接入已同步启用,开发者可通过 X 平台或 xAI 官网注册获取 quota。

写在最后

xAI 这次果断降价+性能跃升的组合拳,标志着大模型竞赛从‘参数军备’转向‘性价比实战’阶段。当 Claude Fable 尚未降价、GPT-4o 仍处维护周期时,Grok 4.7 的切片入局,为市场注入新一轮的价格重估压力。