Grok 4.7 降低 API 价格但落后于 Claude 和 GPT-6

The Decoder··作者 Matthias Bastian

关键信息

Grok 4.7 在 Terminal-Bench 4.0 中的得分仅为 26%,而 GPT-6 Astra 和 Claude Fable 5.1 分别达到 60% 和 55%,价格更低的 DeepSeek V4.1 Flash 也达到 27%。该模型可通过 Grok API、Cursor 和 Grok Build 使用,xAI 称其改进来自更大的基础模型、更长时间的强化学习以及更强的自我验证能力。

资讯摘要

Elon Musk 创立的 xAI 发布了 Grok 4.7,并将其定位为目前最擅长编程和知识工作的模型。该公司表示,这一模型建立在更大的基础模型之上,接受了更长时间的强化学习训练,并且更注重验证自身输出。Grok 4.7 的 API 价格为每百万输入令牌 2 美元、每百万输出令牌 6 美元,价格更接近中国模型,而不是西方前沿模型。在独立的 Artificial Analysis Intelligence Index v4.3.2 中,Grok 4.7 获得 46 分;该指数综合了十项评测,覆盖推理、编程、知识、指令遵循和多步骤任务等能力。

Claude Fable 5.1 和 GPT-6 在该指数中均以 53 分领先。模型在智能体编程方面的表现更弱,因为这类测试要求模型通过工具和终端交互完成软件任务。Grok 4.7 在 Terminal-Bench 4.0 中的任务解决率为 26%,低于 GPT-6 Astra 的 60% 和 Claude Fable 5.1 的 55%,甚至略低于 DeepSeek V4.1 Flash 的 27%。目前,用户可以通过 Grok API、Cursor 和 Grok Build 使用该模型。

Grok 4.7 降低 API 价格但落后于 Claude 和 GPT-6

资讯正文

据该公司介绍,Elon Musk 的 xAI 推出了 Grok 4.7,这是其迄今在编程和知识工作方面能力最强的模型。该模型基于更大的基础模型构建,经过更长时间的强化学习训练,并旨在更好地核验自身输出。其定价为每百万输入 token 2 美元、每百万输出 token 6 美元。

这一费率更接近中国模型,而不是西方前沿模型,这或许是有充分理由的。在独立的 Artificial Analysis Intelligence Index(v4.3.2)中,Grok 4.7 在综合十项基准测试后得分 46 分,排名处于中游。Claude Fable 5.1 和 GPT-6 均以 53 分领跑。

来源与参考

  1. 原始链接
  2. xAI launches Grok 4.7 at bargain prices, but benchmarks reveal a wide gap to Claude and GPT-6

收录于 2026-09-22