ChinaModelAPI

新闻 / 模型观察 · 西方前沿

海外观察 Grok 4.6 xAI 前沿基准
2026-08-13 · 模型观察

Grok 4.6:xAI 官方推荐新旗舰,现已上线 API

xAI 官方开发者文档现已将 grok-4.6 列为其最新模型,并推荐用于代码开发。我们追踪 Grok 是将其作为对标国产开源模型的海外前沿基准(与 GPT-5.6 Sol 和 Claude Opus 5 的定位一致)——以下是基于官方文档一手信息的清晰解读,以及它对国产模型技术栈的参考意义。

核心结论

Grok 4.6 现已成为 xAI 官方 API 文档中推荐的旗舰模型。docs.x.ai/docs/models 上, grok-4.6 标明具备 500k 上下文窗口,定价为 每 1M tokens $2 / $6(Prompt 低于 200k)——文档建议开发者 “对于其他所有场景,包括代码,推荐使用 Grok 4.6”,称其为 xAI 最智能、最快速的模型。 知识截止日期为 2026 年 2 月 1 日。它也可以在 xAI 的代码工具 (grok-build 模型系列)中选用。注意:Grok 为海外闭源模型,ChinaModelAPI 并不提供路由——我们仅将其作为对比基准收录。

xAI 官方文档说明(已验证)

我们以官方文档为准,而非社交平台传闻。截至 2026-08-13,xAI 开发者模型页面对 Grok 4.6 的说明如下:

规格参数Grok 4.6(基于 xAI 文档)
模型 IDgrok-4.6
上下文窗口500k tokens
价格(< 200k Prompt)$2.00 / 1M 输入 · $6.00 / 1M 输出
价格(≥ 200k Prompt)$4.00 / 1M 输入 · $12.00 / 1M 输出
知识截止日期2026 年 2 月 1 日
定位“最智能且速度最快” · 推荐用于代码开发

参数量和训练细节源自 Elon Musk 在 X 上的声明(1.5T 参数,改进的 SFT & RL)——仅作为次要参考,并非官方文档主要来源。

从 8 月 7 日发布预期到文档正式收录

Grok 4.6 在发布前经历了一段热议与波折。Elon Musk 于 7 月底在 X 上宣布 Grok 4.6 将于“8 月 7 日左右”发布,为 1.5T 参数模型,在监督微调(SFT)和强化学习(RL)上有显著提升,接替“Opus 级别”的 Grok 4.5。随后该日期推迟,主流报道说法不一,该模型在最终定型前也曾短暂出现在第三方代码工具中。对于开发者而言,真正明确的信号是:grok-4.6 现已正式出现在 xAI 自己的 API 文档中,并附有定价和使用建议。

  • 版本沿革:Grok 4.5 的继任者(于 2026 年 7 月发布,定位为“Opus 级别”模型)。
  • 代码工具:同一文档页面中的 grok-build-0.1 模型为 xAI 的代码 CLI 提供支持——这与开发者在 xAI 构建工具中看到 Grok 4.6 的情况一致。
  • 后续动态:xAI 预告未来数周内将推出更大的 Grok 4.7(约 2.1T 参数模型)——目前暂不在本次讨论范围内。

对国内大模型开发者的启示

Grok 4.6 并非 ChinaModelAPI 路由接入的模型——它是一款海外闭源旗舰。我们追踪它是为了将其作为 质量与成本的上限参考基准,正如我们在模型追踪表中的 GPT-5.6 Sol 和 Claude Opus 5 一样。其实际用途在于横向对比,而非直接集成调用。

计费模式来源 / 接入方式技术栈中的最佳定位
Grok 4.6xAI · 闭源 API海外质量/成本上限参考基准
DeepSeek-V4-Pro-0813DeepSeek · 开源权重前沿 Agent/推理、支持私有化部署、成本极低
Qwen3.8-Max阿里 · 开源权重代码编写 & 长流程任务
GLM-5.2 / Kimi K3智谱 / 月之暗面 · 开源1M 上下文长流程任务 & Agent

完整实时对比:国产大模型对比

一手信息来源

FAQ

我可以通过 ChinaModelAPI 调用 Grok 4.6 吗?

不支持。Grok 为海外闭源模型。ChinaModelAPI 主要路由国产前沿模型(DeepSeek、Qwen、GLM、Kimi、Seedance、HappyHorse)。我们在此列出 Grok 4.6 仅作为海外基准以供对比。

是否有官方发布博客?

我们并未单独查证到独立的 Grok 4.6 发布博客;我们所依赖的权威依据是官方 API 文档中列出的 grok-4.6 及其定价和使用建议。

500k 对比 1M 上下文?

根据文档,Grok 4.6 提供 500k 上下文——容量很大,但仍低于多家国产旗舰(DeepSeek-V4-Pro、Qwen3.8、GLM-5.2、Kimi K3)所宣称的 1M 上下文。

是否有更便宜的海外选项?

对于对成本敏感的大调用量场景,开源权重的国产模型(如 DeepSeek-V4-Flash 以及 Qwen/GLM/Kimi 各梯队模型)在每 token 成本上通常远低于 Grok 的 $2/$6 价格区间。

相关指南