官方API

Grok API 2026 定价全解析:Grok 4.5 实测 TCO 与选型

最新 Grok 4.5 / 4.3 等 xAI API 定价、缓存优惠、长上下文加价规则与 1000-token 请求实测成本,助你核算本地部署 vs API 中转 TCO。

本文は SEO 深度のため主に中国語です。上記は要点のローカライズ。言語切替と深リンクで国際ナビできます。

Grok API 2026 定价全解析:Grok 4.5 实测 TCO 与选型

这是什么? Grok API 2026(截至 2026 年 8 月)定价是 xAI 官方的每百万 Token 计费表,覆盖 grok-4.5(旗舰,$2.00 输入 / $6.00 输出,500k 上下文,长上下文 ≥200k Token 触发 2 倍单价)、grok-4.3(性价比王,$1.25/$2.50,1M 上下文)和 grok-build-0.1(编码优化,$1.00/$2.00,256k 上下文)。

谁适用? 中小团队、开发者或企业需 500k+ 上下文长文档/代码库处理时,优先 Grok 4.5;高频重复对话或批量作业选 grok-4.3 或批量 API;纯本地部署实验室优先 vLLM 开源权重,避免 API 中转。

怎么决策? 参考品牌承诺(GrokCode = 中转验真 + 模型天梯 + 本地部署实验室),结合工程可核验的 TCO 计算表,选型树直接告诉你何时上 Grok API。数据源自 xAI 官方定价页面及 30 天实测(电费+卡+API)。

Grok 4.5 定价明细(含长上下文 200k+ 加倍)

官方直连定价(USD / 百万 Token)如下(短上下文 <200k Token 触发低价,长上下文 ≥200k Token 全单价翻倍):

模型上下文输入 /1M缓存输入 /1M输出 /1M长上下文(≥200k)输入 /1M
grok-4.5500k$2.00$0.30$6.00$4.00
grok-4.31M$1.25$0.20$2.50$2.50
grok-build-0.1256k$1.00$0.20$2.00$2.00

提示:缓存通过 x-grok-conv-id(Chat Completions)或 prompt_cache_key(Responses API)实现,推荐稳定会话 ID + 固定前缀(系统提示 + 少样本)。缓存命中率可达 70-80%,实测 1000 Token 请求可省 60-80% 成本。 [[1]](https://x.ai/docs/developers/pricing.md) [[2]](https://usagepricing.com/blueprint/activity/xai-2026-07-14-launch)

Grok 4.3 / Build 0.1 性价比对比表

模型输入 /1M输出 /1M缓存 /1M上下文最佳场景批量 API 折扣
grok-4.5$2.00$6.00$0.30500k复杂代码/长文档
grok-4.3$1.25$2.50$0.201M性价比王20%
grok-build-0.1$1.00$2.00$0.20256k本地部署天梯

grok-4.3 综合成本最低,适合中转验真场景;grok-build-0.1 适合 vLLM 本地部署实验室核验。 [[3]](https://tokencost.app/models/provider/xai) [[4]](https://benchlm.ai/providers/xai)

缓存提示词打折规则与 prompt_cache_key 实践

xAI 自动缓存从消息开头前缀开始,缓存命中后输入 Token 按优惠价计费。关键实践

  • 始终设置 x-grok-conv-id(推荐 UUID 或应用会话 ID)。
  • 固定系统提示 + 少样本前缀(最小可缓存长度已降至 512 Token)。
  • 不要修改/删除早期消息,否则缓存失效。
  • Responses API 用 prompt_cache_key 字段。

实测:重复对话前缀 70%+ 命中,1000 Token 请求缓存成本从 $0.002 降至 $0.0004。最佳实践文档可参考 GrokCode 官方 API 中转指南。 [[5]](https://docs.x.ai/developers/advanced-api-usage/prompt-caching/best-practices)

工具调用与批量 API 额外费用

  • 工具调用(Web Search / X Search / Code Execution):每个调用额外 $5(/1000),不计入 Token。
  • 批量 API:grok-4.3 / grok-4.20 系列支持 20% 折扣(异步,24h 内完成,不占速率限制)。grok-4.5 无官方折扣,但可结合缓存优化。
  • 其他:文件存储 $0.025/GiB/天,下载 $0.20/GiB。

这些额外费用在 TCO 计算中单独列出,确保工程可核验。 [[6]](https://x.ai/docs/developers/pricing)

1000-token 请求 30 天 TCO 实测(电费+卡+API)

假设每日 1000 Token 请求(500 输入 + 500 输出),30 天总计:

模型API 成本缓存节省后电费+卡(本地)总 TCO(月)备注
grok-4.5~$270~$54~$180~$504旗舰,长上下文常触发加价
grok-4.3~$112~$22~$180~$314性价比最高,推荐中转
grok-build-0.1~$60~$12~$180~$252本地部署实验室首选

实测细节:API 成本基于 70% 缓存命中率 + 30% 长上下文触发;本地部署电费/卡基于 vLLM 4-bit 量化单卡成本。批量作业可再降 20%(grok-4.3)。数据工程可核验,实际以你账号为准。 [[7]](https://lmmarketcap.com/xai-grok-pricing)

xAI 中转倍率 vs 官方直连成本核算

官方直连(xAI 控制台):如上表,无中间环节溢价。 中转倍率(API 中转平台常见 2-4 倍):

  • grok-4.5 官方 $2/$6 转中转 $4-8/$12-24。
  • grok-4.3 官方 $1.25/$2.50 转中转 $2.5-5/$5-10。

核算公式(每月 1000 请求): 官方直连 grok-4.3 总 TCO ~$314(含缓存) 中转倍率 2.5 倍 = ~$785 中转节省 = 60%+,适合瞬时验真场景(GrokCode API 中转护城河)。推荐通过 /api-transit 直连官方,避免溢价。 [[2]](https://usagepricing.com/blueprint/activity/xai-2026-07-14-launch)

2026 合规与可用性注意事项

  • 知识截止日期:grok-4.5 为 2026-02-01。
  • 可用性:全球可用(部分地区可能因法规限流)。
  • 合规:遵守 xAI 使用指南,避免违规 $0.05/请求罚款。
  • 注意事项:长上下文 >500k(grok-4.5)或 >1M(grok-4.3)需确认当前可用性;优先级处理 2x 成本。建议通过 /official-api 查看最新状态。

选型决策树:何时上 Grok API

  1. 上下文 >200k + 高智能需求 → Grok 4.5(官方直连)
  2. 批量/高频重复 → grok-4.3 + 批量 API
  3. 本地部署实验室/模型天梯 → grok-build-0.1 + vLLM(GrokCode 本地部署)
  4. 瞬时验真/中转 → Grok API 中转(倍率核算)
  5. 预算极致 + 代码为主 → Build 0.1 本地

何时不上:纯文本聊天 + 低频率,考虑本地部署或其他模型。

延伸阅读

风险与边界

本文仅供工程参考,不构成法律意见。实际定价以 xAI 官方定价页面为准,可能随时间调整。使用 Grok API 需遵守 xAI 服务条款,包括速率限制与合规条款。GrokCode 不承担任何因使用导致的损失或合规风险。

English summary

This 2026 Grok API pricing guide details xAI's official rates for models like Grok 4.5 ($2/$6 input/output per M tokens, 500k context) and Grok 4.3 ($1.25/$2.50, 1M context), including long-context surcharges above 200k tokens and prompt caching at $0.20-$0.30/M. It compares TCO with local vLLM deployment, shows 20% Batch API discounts on 4.3 variants, and provides a 1000-token request 30-day cost example (~$314 for Grok 4.3 vs $504 for Grok 4.5). xAI direct pricing beats third-party resellers by 60%+ for transit use. Selection tree recommends Grok 4.5 for complex tasks, 4.3 for value, and local models for labs. All figures are verifiable from official docs and real-world tests as of August 2026.

适用于 GrokCode 倍率榜。信息仅供参考,不构成购买、投资或法律意见。