官方API

xAI Grok API 定价全解析:模型与费用结构详解

2026 年 xAI Grok API 官方定价表拆解,包含各模型输入输出缓存费率、上下文长度与 TCO 计算,帮助开发者选型。

正文為 SEO 深度以中文為主;上方要點已本地化。可用語言切換與深鏈進行全球導航。

xAI Grok API 定价全解析:模型与费用结构详解

xAI Grok API 定价是开发者在使用官方服务时最核心的决策依据。它为开发者提供了多款模型的输入输出费率、缓存机制和上下文长度选项,帮助你根据实际场景(如代码生成、长上下文分析或多代理任务)选择合适型号并精确估算成本。本文基于2026年8月23日官方数据拆解,适合需要工程可核验选型的开发者使用。无论你是小团队试用高阶推理还是大模型训练批处理,都能通过对比表和 TCO 计算工具快速决策。

GrokCode 作为中转验真 + 模型天梯 + 本地部署实验室,特别强调这些数据支撑真实项目落地。阅读后,你能直接对比官方费率、计算自定义 TCO,并决定是否走本地 vLLM 部署替代部分费用。

官方定价页面最新更新

xAI 官方开发者定价页面(https://x.ai/docs/developers/pricing)于 2026 年 8 月 23 日同步更新,新增 Grok 4.6 旗舰模型的详细分档费率,并明确标注长上下文触发条件。

页面采用 Markdown 结构,清晰列出所有当前活跃文本模型的上下文长度、输入/输出/缓存单价(单位:美元 / 百万 tokens),同时区分 <200k≥200k 提示 token 时的不同费率。这反映了 xAI 对长上下文场景的优化。

核心更新点

  • Grok 4.6 作为新旗舰,上下文扩大至 500k tokens,引入缓存读机制。
  • 所有模型均支持批量 API 折扣(最高 20%)。
  • 定价不包含额外服务费,仅按 token 实际使用计费。

建议开发者每天或每周核对官方页面,因为模型迭代速度快于市场其他平台。更多工程验证入口可访问 GrokCode 官方 API 中转页面GrokCode 模型天梯 获取对比工具。

核心模型费率对比表

以下表格汇总当前 xAI Grok API 主要文本模型的费率(数据来源于官方定价页 2026-08-23)。价格以美元为单位,每百万 tokens 计算,适合横向滚动查看。

模型上下文长度低门槛输入($)缓存输入($)高门槛输入($)输出($)适用场景示例
Grok 4.6500k2.000.504.006.00高质量代码、复杂推理
Grok 4.5500k2.000.304.006.00平衡任务,缓存友好
Grok 4.3 / 4.201M1.250.202.502.50长文档分析、代理工作流
Grok Build 0.1256k1.000.202.002.00快速原型、轻量任务
Grok 4.20 Multi-Agent1M1.250.202.502.50多智能体协作

使用说明

  • 低门槛指提示 token <200k 时触发;≥200k 触发高费率(所有 token 按高费率计)。
  • 缓存读价格低于普通输入,适合重复对话历史。
  • 输出价格始终固定,无上下文阈值。

更多原始数据可通过 GrokCode 官方 API 中转页面GrokCode 模型天梯 进一步验证。

上下文长度与缓存机制

xAI Grok API 支持最大上下文窗口,这直接影响开发者在单次请求中塞入多少历史记录,进而影响总 token 消耗和成本。

  • Grok Build 0.1:256k tokens,适合单次任务输入 + 少量历史。
  • Grok 4.3 / 4.20 系列:1M tokens(部分变体 2M),适合完整对话链或代码仓库快照。
  • Grok 4.5 / 4.6:500k tokens,兼顾速度与深度,适合复杂代理场景。

缓存机制亮点

  • 缓存输入价格远低于标准输入(例如 Grok 4.6 低门槛下 0.50 vs 2.00)。
  • 主要适用于工具调用历史、系统提示或重复指令,用户可通过 API 手动缓存键管理。
  • 长上下文触发高输入费率是为了平衡大窗口的灵活性与成本控制。

实际项目中,建议先用低上下文测试,再启用缓存以降低 TCO。更多本地部署方案可参考 GrokCode 本地部署实验室GrokCode 模型天梯,其中 vLLM 可在本地实现类似缓存加速。

业务 TCO 估算工具

为了让数据从理论走向工程落地,GrokCode 提供了简易 TCO 估算工具。你只需输入每日请求量、平均输入/输出 tokens 比例,即可自动计算月度费用(支持批量折扣后)。

基础估算示例(每日 1000 请求,平均 500 输入 + 200 输出 tokens):

  • Grok Build 0.1:约 $0.40/天,$12/月
  • Grok 4.3:约 $0.80/天,$24/月
  • Grok 4.6:约 $2.80/天,$84/月

使用步骤

  1. 访问 GrokCode 官方 API 中转页面 获取实时验证。
  2. 在页面底部输入自定义参数,生成完整账单表格。
  3. 结合本地部署方案进一步降低费用:用 vLLM 在自有硬件运行 Grok 4.3 变体,TCO 可降至官方的 20-40%(视硬件而定)。

完整工具入口见 GrokCode 模型天梯GrokCode 工具页,支持导出 Excel 用于财务汇报。

常见选型建议

开发者在实际项目中常遇到以下决策场景:

  • 预算优先 + 速度需求:选 Grok Build 0.1 或 Grok 4.1 Fast(若包含在内)。适合高频简单任务,单次调用成本低。
  • 推理与代码质量:优先 Grok 4.6。输出价格高,但工具调用成功率和非幻觉率领先,适合复杂代理或 IDE 集成。
  • 长上下文:Grok 4.3 / 4.20 系列 1M+ tokens 窗口,适合完整代码库或多轮对话。
  • 批量处理:开启批量 API 可省 20% 费用,所有模型均支持。
  • 混合使用:用官方 API 做原型验证,再通过 GrokCode API 中转页面GrokCode 本地部署实验室 迁移到 vLLM 本地运行,锁定成本上限。

通用检查清单

  • 计算平均每请求 token 消耗。
  • 考虑缓存应用场景(历史对话、工具返回)。
  • 预留 20% 浮动用于峰值流量。
  • 每月至少运行一次官方定价核对。

这些建议均工程可验证,可直接对接 GrokCode 官方 API 中转 验证接口兼容性。

风险与边界

API 定价以官方挂牌页当日数据为准,实际结算可能因促销、批量折扣或临时调整而有所差异。开发者需自行监控官方更新,避免因信息滞后导致意外支出。

本文仅为信息参考,非法律意见,不构成任何投资或服务承诺。如涉及具体交易,请咨询专业顾问。

延伸阅读

English summary

xAI Grok API pricing in 2026 offers transparent per-million-token rates for multiple models, with input, output, and cache pricing tiers that vary by context length thresholds. Key models include Grok 4.6 at $2/$6 (500k context), Grok 4.3 at $1.25/$2.50 (1M context), and Grok Build 0.1 at $1/$2 (256k context). Cached input is significantly cheaper for repeated history, while long prompts trigger higher rates. Developers can use TCO calculators to estimate monthly costs based on request volume and token ratios, with batch discounts available. For production, combine API usage with local vLLM deployment to reduce costs by 60-80%. Always verify latest rates on the official x.ai docs page, as pricing updates frequently. This breakdown supports informed model selection for coding, agents, or long-context tasks.

适用于 GrokCode 倍率榜。信息仅供参考,不构成购买、投资或法律意见。