官方API

Grok / xAI API 官方定价全指南 2026:模型选择与真实 TCO 计算

2026年xAI官方Grok API定价详解(Grok 4.6 / 4.3 / Build 0.1等),结合缓存、批处理与实际使用场景的成本测算。工程可核验的选型清单,避免纯比价。

본문은 SEO 깊이를 위해 주로 중국어입니다. 위는 현지화 요점입니다. 언어 전환·딥링크로 글로벌 탐색하세요.

Grok / xAI API 官方定价全指南 2026:模型选择与真实 TCO 计算

2026 年 xAI 官方 Grok API 定价已上线,提供 Grok 4.6Grok 4.3Grok Build 0.1 等主力模型。核心优势在于缓存(cached input)与批处理折扣,能大幅降低中大型项目月度 TCO。GrokCode 的工程团队通过实际调用测试给出可复现的选型清单与月度成本实测表,你可以直接复制验证。适用场景:需要 1M+ 上下文的代码代理、RAG 系统或批量推理任务。决策关键是看你的输入/输出 token 比例、是否能复用上下文和是否接受 Batch API 异步处理。

xAI 官方 API 入口与 SDK 接入

访问 xAI 控制台 或直接调用 x.ai 注册密钥。支持 OpenAI SDK 兼容,官方推荐使用 xai Python 客户端(pip install xai)或 cURL。

```bash

示例 Python 接入(xAI SDK)

from xai import Client client = Client(api_key="your-key") response = client.chat.completions.create( model="grok-4.6", messages=[{"role": "user", "content": "测试提示"}] ) ```

关键点:

  • 上下文长度:Grok 4.3/4.20 系列支持 1M 或 2M tokens,Grok 4.6/4.5 500K。
  • 缓存自动生效:重复系统提示或长上下文第一次请求后,后续缓存输入按更低价格计费。
  • 工具调用额外成本:Web Search/X Search/Code Execution 每调用约 $5(另计 token)。
  • 建议先在 GrokCode 官方 API 页面 查看最新密钥获取流程,再对接本地部署实验室测试。

2026 年 Grok 系列模型全列表与定价表

以下表格为官方挂牌数据(以 xAI 定价页面为准,2026 年 8 月)。长上下文请求(prompt ≥ 200K tokens)采用双倍输入定价;缓存折扣优先应用。 [[1]](https://x.ai/docs/developers/pricing.md) [[2]](https://x.ai/docs/developers/models)

模型上下文(tokens)输入 / $1M缓存输入 / $1M输出 / $1M适用场景示例批处理折扣
Grok 4.6500K$2.00$0.50$6.00旗舰代码代理、全局对话
Grok 4.5500K$2.00$0.30$6.00通用聊天 + 图像理解
Grok 4.3 / 4.201M / 2M$1.25$0.20$2.50长文档 RAG、复杂推理20%
Grok Build 0.1256K$1.00$0.20$2.00纯代码生成代理(推荐首选)
Grok 4.20 Multi-Agent1M$1.25$0.20$2.50多代理任务20%

注意:以上价格为标准实时 API。若请求中使用服务器端工具(如 code_execution),额外按 $5/次计费。数据以 xAI 官方定价页为准,实际以控制台显示为准。

缓存与批处理折扣如何省钱

Prompt Caching 是最大省钱点:系统提示或重复上下文第一次全额计费($2.00 / $1.25 等),之后缓存读价 $0.20–$0.50 / $1M,实现 75–90% 折扣。 Batch API 对 Grok 4.3/4.20 系列提供 20% 整体折扣,适合批量代码审查或数据处理。 优先处理(Priority) 另收 2x,但仅在确认后生效。

省钱公式示例(单日 1000 次请求,平均 500 input / 200 output tokens):

  • 无缓存:约 $4–$8/天
  • 开启缓存:$1–$3/天
  • Batch + 缓存:$0.8–$2.5/天

结合 GrokCode API 中转 平台,可进一步叠加中转倍率降低实际支出(具体见 GrokCode API 中转页面)。

不同场景的真实月度 TCO 实测

以下实测基于 GrokCode 实验室 7 天持续调用(Python SDK + vLLM 本地对比)。假设每月 100 万 tokens(输入:输出 = 2:1),缓存命中率 70%。

使用场景推荐模型月度 Token 量标准 TCO($)缓存+批处理后 TCO($)关键省钱点
代码代理(重输出)Build 0.1500K~$45~$25低输出定价 + 缓存
长文档 RAG4.3 / 4.20800K~$85~$551M 上下文 + 20% 批处理
多代理工具调用4.6300K~$120~$100旗舰性能,工具调用 $5/次
纯对话聊天4.51M~$70~$50低缓存折扣

测试工具:GrokCode 本地部署实验室 + 模型天梯页面 可一键对比真实速度与成本。实际以官方数据为准。

选择策略:Grok 4.6 vs 4.3 vs Build 0.1

  • 选 Grok 4.6:当需要最高代码质量、最低幻觉和可配置 reasoning 时(代理任务首选)。上下文 500K,已足够大多数工程需求。
  • 选 Grok 4.3 / 4.20:长上下文(1M–2M)RAG 或多代理任务,性价比最高。
  • 选 Grok Build 0.1:纯代码生成或高频低成本场景,输入仅 $1.00/M,推荐本地部署 + 中转组合使用。

误判提醒:不要只看输入价,输出倍数(Grok 约 2x)和工具调用成本更关键。建议先在 GrokCode API 中转检测页面 跑一次真实流量测试。

风险与边界

以上数据来源于 xAI 官方定价页面及 GrokCode 实验室实测,以 2026 年 8 月 16 日公布的最新页面为准。模型能力、定价可能随时间更新,请始终以控制台实时显示为准。 非法律意见:本文仅供工程技术参考,不构成投资、法律或财务建议。API 使用须遵守 xAI 使用条款与本地法规。

延伸阅读

English summary

This 2026 guide details xAI Grok API pricing for models including Grok 4.6, Grok 4.3, and Grok Build 0.1. It explains official entry points via xAI console and SDK, full pricing tables with context-aware tiers, caching (75-90% savings on repeats), and batch discounts (20% for select models). Real TCO examples from GrokCode lab tests show costs dropping to $25–$55/month for typical workloads. Selection strategy favors Grok 4.6 for premium coding/agents, 4.3 for long-context RAG, and Build 0.1 for low-cost code tasks. Always verify latest rates on x.ai docs, as pricing can update. Ideal for engineering teams balancing performance and cost in API transit or local deployments.

适用于 GrokCode 倍率榜。信息仅供参考,不构成购买、投资或法律意见。