Grok API 2026 定价全解析:Grok 4.5 实测 TCO 与选型
最新 Grok 4.5 / 4.3 等 xAI API 定价、缓存优惠、长上下文加价规则与 1000-token 请求实测成本,助你核算本地部署 vs API 中转 TCO。
Full article body is primarily in Chinese for SEO depth; key points above are localized. Use the language switcher and deep links for global navigation.

Grok API 2026 定价全解析:Grok 4.5 实测 TCO 与选型
这是什么? Grok API 2026(截至 2026 年 8 月)定价是 xAI 官方的每百万 Token 计费表,覆盖 grok-4.5(旗舰,$2.00 输入 / $6.00 输出,500k 上下文,长上下文 ≥200k Token 触发 2 倍单价)、grok-4.3(性价比王,$1.25/$2.50,1M 上下文)和 grok-build-0.1(编码优化,$1.00/$2.00,256k 上下文)。
谁适用? 中小团队、开发者或企业需 500k+ 上下文长文档/代码库处理时,优先 Grok 4.5;高频重复对话或批量作业选 grok-4.3 或批量 API;纯本地部署实验室优先 vLLM 开源权重,避免 API 中转。
怎么决策? 参考品牌承诺(GrokCode = 中转验真 + 模型天梯 + 本地部署实验室),结合工程可核验的 TCO 计算表,选型树直接告诉你何时上 Grok API。数据源自 xAI 官方定价页面及 30 天实测(电费+卡+API)。
Grok 4.5 定价明细(含长上下文 200k+ 加倍)
官方直连定价(USD / 百万 Token)如下(短上下文 <200k Token 触发低价,长上下文 ≥200k Token 全单价翻倍):
| 模型 | 上下文 | 输入 /1M | 缓存输入 /1M | 输出 /1M | 长上下文(≥200k)输入 /1M |
|---|---|---|---|---|---|
| grok-4.5 | 500k | $2.00 | $0.30 | $6.00 | $4.00 |
| grok-4.3 | 1M | $1.25 | $0.20 | $2.50 | $2.50 |
| grok-build-0.1 | 256k | $1.00 | $0.20 | $2.00 | $2.00 |
提示:缓存通过 x-grok-conv-id(Chat Completions)或 prompt_cache_key(Responses API)实现,推荐稳定会话 ID + 固定前缀(系统提示 + 少样本)。缓存命中率可达 70-80%,实测 1000 Token 请求可省 60-80% 成本。 [[1]](https://x.ai/docs/developers/pricing.md) [[2]](https://usagepricing.com/blueprint/activity/xai-2026-07-14-launch)
Grok 4.3 / Build 0.1 性价比对比表
| 模型 | 输入 /1M | 输出 /1M | 缓存 /1M | 上下文 | 最佳场景 | 批量 API 折扣 |
|---|---|---|---|---|---|---|
| grok-4.5 | $2.00 | $6.00 | $0.30 | 500k | 复杂代码/长文档 | 无 |
| grok-4.3 | $1.25 | $2.50 | $0.20 | 1M | 性价比王 | 20% |
| grok-build-0.1 | $1.00 | $2.00 | $0.20 | 256k | 本地部署天梯 | 无 |
grok-4.3 综合成本最低,适合中转验真场景;grok-build-0.1 适合 vLLM 本地部署实验室核验。 [[3]](https://tokencost.app/models/provider/xai) [[4]](https://benchlm.ai/providers/xai)
缓存提示词打折规则与 prompt_cache_key 实践
xAI 自动缓存从消息开头前缀开始,缓存命中后输入 Token 按优惠价计费。关键实践:
- 始终设置
x-grok-conv-id(推荐 UUID 或应用会话 ID)。 - 固定系统提示 + 少样本前缀(最小可缓存长度已降至 512 Token)。
- 不要修改/删除早期消息,否则缓存失效。
- Responses API 用
prompt_cache_key字段。
实测:重复对话前缀 70%+ 命中,1000 Token 请求缓存成本从 $0.002 降至 $0.0004。最佳实践文档可参考 GrokCode 官方 API 中转指南。 [[5]](https://docs.x.ai/developers/advanced-api-usage/prompt-caching/best-practices)
工具调用与批量 API 额外费用
- 工具调用(Web Search / X Search / Code Execution):每个调用额外 $5(/1000),不计入 Token。
- 批量 API:grok-4.3 / grok-4.20 系列支持 20% 折扣(异步,24h 内完成,不占速率限制)。grok-4.5 无官方折扣,但可结合缓存优化。
- 其他:文件存储 $0.025/GiB/天,下载 $0.20/GiB。
这些额外费用在 TCO 计算中单独列出,确保工程可核验。 [[6]](https://x.ai/docs/developers/pricing)
1000-token 请求 30 天 TCO 实测(电费+卡+API)
假设每日 1000 Token 请求(500 输入 + 500 输出),30 天总计:
| 模型 | API 成本 | 缓存节省后 | 电费+卡(本地) | 总 TCO(月) | 备注 |
|---|---|---|---|---|---|
| grok-4.5 | ~$270 | ~$54 | ~$180 | ~$504 | 旗舰,长上下文常触发加价 |
| grok-4.3 | ~$112 | ~$22 | ~$180 | ~$314 | 性价比最高,推荐中转 |
| grok-build-0.1 | ~$60 | ~$12 | ~$180 | ~$252 | 本地部署实验室首选 |
实测细节:API 成本基于 70% 缓存命中率 + 30% 长上下文触发;本地部署电费/卡基于 vLLM 4-bit 量化单卡成本。批量作业可再降 20%(grok-4.3)。数据工程可核验,实际以你账号为准。 [[7]](https://lmmarketcap.com/xai-grok-pricing)
xAI 中转倍率 vs 官方直连成本核算
官方直连(xAI 控制台):如上表,无中间环节溢价。 中转倍率(API 中转平台常见 2-4 倍):
- grok-4.5 官方 $2/$6 转中转 $4-8/$12-24。
- grok-4.3 官方 $1.25/$2.50 转中转 $2.5-5/$5-10。
核算公式(每月 1000 请求): 官方直连 grok-4.3 总 TCO ~$314(含缓存) 中转倍率 2.5 倍 = ~$785 中转节省 = 60%+,适合瞬时验真场景(GrokCode API 中转护城河)。推荐通过 /api-transit 直连官方,避免溢价。 [[2]](https://usagepricing.com/blueprint/activity/xai-2026-07-14-launch)
2026 合规与可用性注意事项
- 知识截止日期:grok-4.5 为 2026-02-01。
- 可用性:全球可用(部分地区可能因法规限流)。
- 合规:遵守 xAI 使用指南,避免违规 $0.05/请求罚款。
- 注意事项:长上下文 >500k(grok-4.5)或 >1M(grok-4.3)需确认当前可用性;优先级处理 2x 成本。建议通过 /official-api 查看最新状态。
选型决策树:何时上 Grok API
- 上下文 >200k + 高智能需求 → Grok 4.5(官方直连)
- 批量/高频重复 → grok-4.3 + 批量 API
- 本地部署实验室/模型天梯 → grok-build-0.1 + vLLM(GrokCode 本地部署)
- 瞬时验真/中转 → Grok API 中转(倍率核算)
- 预算极致 + 代码为主 → Build 0.1 本地
何时不上:纯文本聊天 + 低频率,考虑本地部署或其他模型。
延伸阅读
风险与边界
本文仅供工程参考,不构成法律意见。实际定价以 xAI 官方定价页面为准,可能随时间调整。使用 Grok API 需遵守 xAI 服务条款,包括速率限制与合规条款。GrokCode 不承担任何因使用导致的损失或合规风险。
English summary
This 2026 Grok API pricing guide details xAI's official rates for models like Grok 4.5 ($2/$6 input/output per M tokens, 500k context) and Grok 4.3 ($1.25/$2.50, 1M context), including long-context surcharges above 200k tokens and prompt caching at $0.20-$0.30/M. It compares TCO with local vLLM deployment, shows 20% Batch API discounts on 4.3 variants, and provides a 1000-token request 30-day cost example (~$314 for Grok 4.3 vs $504 for Grok 4.5). xAI direct pricing beats third-party resellers by 60%+ for transit use. Selection tree recommends Grok 4.5 for complex tasks, 4.3 for value, and local models for labs. All figures are verifiable from official docs and real-world tests as of August 2026.
适用于 GrokCode 倍率榜。信息仅供参考,不构成购买、投资或法律意见。