官方 API入门7 分钟

官方 API Token 計費入門

輸入/輸出/快取單價、$/M 含義與粗算成本。

單位 $/M

API Token 計費以 $/M(美元每百万 tokens)為最基本單位。這是所有主流官方訂閱 API 的標準計量方式,包括 OpenAI、xAI Grok、Moonshot Kimi、火山引擎(豆包)、Groq 和部分腾讯 Hunyuan 系列。 “$/M” 表示“每百万 tokens 消耗 1 美元”。輸入(Input)和輸出(Output)價格分别独立計算,輸出通常是輸入的 5–20 倍。

常見字段拆解

  • Input:用戶提示詞(prompt)占用的 tokens。
  • Output:模型生成的回复占用的 tokens。
  • Cached:上下文缓存命中(Cache Hit)或寫入(Cache Write)的 tokens。
  • Batch:批量任务(Batch API)價格通常為標準價的 50%–60%,适合高量离线任务。

這些字段在官方定價頁(如 OpenAI developers.openai.com/api/docs/pricing、Kimi platform.kimi.ai/docs/pricing、火山引擎 volcengine.com/docs)都有明确表格,支持精确核算。

常見字段

  1. Input / Output

標準聊天补全(Chat Completion)必选字段。單價浮动由模型能力、上下文长度、實時性决定。

  1. Cache Hit / Cache Write

現代 API(OpenAI、Kimi、火山)提供上下文缓存功能。Cache Hit 價格远低于普通 Input(常為 1/10–1/30),适合對话历史复用场景。

  1. Batch / Streaming

Batch 定價更低,适用于批量生成任务。Streaming 通常按實時 token 計費,與標準一致。

  1. 额外扩展字段(视模型而定)

- Vision / Audio / Image:多模態 token 價格。 - Reasoning Effort:某些模型(OpenAI o-series、xAI)支持不同推理级别,價格阶梯递增。 - Region:資料驻留端點(Data Residency)可能加 10% 费用(OpenAI 2026 年 3 月 5 日后部分模型)。

粗算成本

公式: 总成本(USD) = Input(M)× Input 單價 + Output(M)× Output 單價 + Cache Hit(M)× Hit 單價 + Cache Write(M)× Write 單價

示例 1:中等量對话(OpenAI gpt-5.4-terra)

  • 每日提示詞 10 万 tokens(Input),回复 5 万 tokens(Output)
  • 缓存命中率 40%,每日缓存命中 4 万 tokens
  • 單價:Input $2.50,Output $15.00,Hit $0.50,Write $6.25

成本 = 0.1 × 2.5 + 0.05 × 15 + 0.04 × 0.5 + 0.01 × 6.25 = 0.25 + 0.75 + 0.02 + 0.0625 = $1.0625 / 天 全年约 $388(不含税)。

示例 2:高量生产场景(Kimi K3)

  • 日均 50 万輸入 + 200 万輸出,缓存命中率 60%
  • 單價:Input $3.00,Output $15.00,Hit $0.30

成本 = 0.5 × 3 + 2 × 15 + 1.2 × 0.3 = 1.5 + 30 + 0.36 = $31.86 / 天 全年约 $11,639(前置已抵扣 60% 缓存)。

表格:2026 年部分主流官方 API 基準單價(USD / 百万 tokens)

模型 / 平台Input 單價Output 單價Cache Hit 單價适用场景示例備註
OpenAI gpt-5.4-terra$2.50$15.00$0.50通用對话、Agent標準版,无缓存折扣
OpenAI o4-mini$0.55$2.20-轻量任务、分類、路由极致性價比
xAI Grok-4.5$2.00$6.00$0.30复杂推理、长上下文代碼旗舰模型,推理模式可选
Moonshot Kimi K3$3.00$15.00$0.30實時對话、AgentCache Hit 极低
Moonshot K2.6$0.95$4.00$0.16平衡任务、编碼中低價
火山引擎 Doubao6.00 元30.00 元1.20 元中文优先、视频/語音任务國內合規,人民币計費
Groq Llama 3.3 70B$0.59$0.79-高速推理、測試原型TPS 极高

提示:以上為 2026 年 7 月官方最新基準價,實際以各平台控制台显示為準。缓存命中率越高,总成本可降低 30%–70%。

缓存與阶梯

缓存机制: 現代 API 支持预載入對话历史、RAG 資料或系統提示詞。Cache Hit 價格远低于普通 Input,Cache Write 價格高于普通 Input(约 2–4 倍)。合理利用缓存可显著降低月度费用。

阶梯價格示例(以 OpenAI 為例):

  • 基础版:標準 $/M
  • Cache Hit:1/5–1/30 標準 Input
  • Reasoning Effort:非思考模式 vs 高思考模式(輸出價格 2–3 倍)
  • Batch:標準 50%

阶梯优化技巧

  1. 短上下文场景优先 Cache Hit。
  2. 长期會话使用模型內置缓存(OpenAI)或手动 KV Cache。
  3. 批量任务切换 Batch API。
  4. 结合 OpenAI-compatible 轉换层(如 GrokCode 提供的 /official-api 模块),統一接入多平台同一定價逻辑。

和中轉怎么比

官方訂閱 $/M 是纯合規、SLA 保障的底层價格。中轉站综合倍率通常為 1.5–4.0 倍(含穩定性、限流、部署風險),具体取决于平台、地区和当前市场。

對比示例(OpenAI gpt-5.4-terra)

  • 官方:$2.50 Input / $15 Output
  • 中轉综合倍率 2.5 倍:相当于 $6.25 Input / $37.5 Output
  • GrokCode 聚合站点實時显示:官方價 + 中轉卡網/官方 Token 中轉價 + 官方 API Token 倍率,可直观看到“官方價 vs 中轉價”差额。

建議:日常高频請求优先官方訂閱;低频、測試或突發高峰使用中轉。查看 GrokCode /official-prices 或 /api-transit 模块可實時對比。

風險與邊界

使用官方 API Token 必须遵守各平台 Terms of Service,包括反滥用、資料不用于训练及反欺诈政策。

  • 帳户封禁風險:高频請求或批量绕過風控可能触發。
  • 隐私風險:敏感資料上傳至云端需评估 GDPR/CCPA 等。
  • 價格波动:官方價格會随模型迭代调整,建議启用预算告警。
  • 合規提醒:非法律意見,建議咨询专业合規顾问。
  • 防御性安全:仅儲存凭證于加密环境,使用官方提供的 API Key 管理工具,避免公開暴露。
  • 限流與重試:官方文档明确 Rate Limit,合理處理 429 錯誤是必備运维知识。

延伸阅讀

通過 GrokCode /official-api 模块,您可一键查看各平台官方 Token 實時價格與中轉對比,說明您在合規前提下實現成本與性能的最优平衡。

---

免責聲明: GrokCode 僅聚合公開/提交資訊,不賣貨、不收款、不擔保第三方服務。下單或充值前請回原站核驗。本頁不構成法律意見。

适用于 GrokCode 倍率榜。信息仅供参考,不构成购买、投资或法律意见。