官方 API Token 計費入門
輸入/輸出/快取單價、$/M 含義與粗算成本。

單位 $/M
API Token 計費以 $/M(美元每百万 tokens)為最基本單位。這是所有主流官方訂閱 API 的標準計量方式,包括 OpenAI、xAI Grok、Moonshot Kimi、火山引擎(豆包)、Groq 和部分腾讯 Hunyuan 系列。 “$/M” 表示“每百万 tokens 消耗 1 美元”。輸入(Input)和輸出(Output)價格分别独立計算,輸出通常是輸入的 5–20 倍。
常見字段拆解
- Input:用戶提示詞(prompt)占用的 tokens。
- Output:模型生成的回复占用的 tokens。
- Cached:上下文缓存命中(Cache Hit)或寫入(Cache Write)的 tokens。
- Batch:批量任务(Batch API)價格通常為標準價的 50%–60%,适合高量离线任务。
這些字段在官方定價頁(如 OpenAI developers.openai.com/api/docs/pricing、Kimi platform.kimi.ai/docs/pricing、火山引擎 volcengine.com/docs)都有明确表格,支持精确核算。
常見字段
- Input / Output
標準聊天补全(Chat Completion)必选字段。單價浮动由模型能力、上下文长度、實時性决定。
- Cache Hit / Cache Write
現代 API(OpenAI、Kimi、火山)提供上下文缓存功能。Cache Hit 價格远低于普通 Input(常為 1/10–1/30),适合對话历史复用场景。
- Batch / Streaming
Batch 定價更低,适用于批量生成任务。Streaming 通常按實時 token 計費,與標準一致。
- 额外扩展字段(视模型而定)
- Vision / Audio / Image:多模態 token 價格。 - Reasoning Effort:某些模型(OpenAI o-series、xAI)支持不同推理级别,價格阶梯递增。 - Region:資料驻留端點(Data Residency)可能加 10% 费用(OpenAI 2026 年 3 月 5 日后部分模型)。
粗算成本
公式: 总成本(USD) = Input(M)× Input 單價 + Output(M)× Output 單價 + Cache Hit(M)× Hit 單價 + Cache Write(M)× Write 單價
示例 1:中等量對话(OpenAI gpt-5.4-terra)
- 每日提示詞 10 万 tokens(Input),回复 5 万 tokens(Output)
- 缓存命中率 40%,每日缓存命中 4 万 tokens
- 單價:Input $2.50,Output $15.00,Hit $0.50,Write $6.25
成本 = 0.1 × 2.5 + 0.05 × 15 + 0.04 × 0.5 + 0.01 × 6.25 = 0.25 + 0.75 + 0.02 + 0.0625 = $1.0625 / 天 全年约 $388(不含税)。
示例 2:高量生产场景(Kimi K3)
- 日均 50 万輸入 + 200 万輸出,缓存命中率 60%
- 單價:Input $3.00,Output $15.00,Hit $0.30
成本 = 0.5 × 3 + 2 × 15 + 1.2 × 0.3 = 1.5 + 30 + 0.36 = $31.86 / 天 全年约 $11,639(前置已抵扣 60% 缓存)。
表格:2026 年部分主流官方 API 基準單價(USD / 百万 tokens)
| 模型 / 平台 | Input 單價 | Output 單價 | Cache Hit 單價 | 适用场景示例 | 備註 |
|---|---|---|---|---|---|
| OpenAI gpt-5.4-terra | $2.50 | $15.00 | $0.50 | 通用對话、Agent | 標準版,无缓存折扣 |
| OpenAI o4-mini | $0.55 | $2.20 | - | 轻量任务、分類、路由 | 极致性價比 |
| xAI Grok-4.5 | $2.00 | $6.00 | $0.30 | 复杂推理、长上下文代碼 | 旗舰模型,推理模式可选 |
| Moonshot Kimi K3 | $3.00 | $15.00 | $0.30 | 實時對话、Agent | Cache Hit 极低 |
| Moonshot K2.6 | $0.95 | $4.00 | $0.16 | 平衡任务、编碼 | 中低價 |
| 火山引擎 Doubao | 6.00 元 | 30.00 元 | 1.20 元 | 中文优先、视频/語音任务 | 國內合規,人民币計費 |
| Groq Llama 3.3 70B | $0.59 | $0.79 | - | 高速推理、測試原型 | TPS 极高 |
提示:以上為 2026 年 7 月官方最新基準價,實際以各平台控制台显示為準。缓存命中率越高,总成本可降低 30%–70%。
缓存與阶梯
缓存机制: 現代 API 支持预載入對话历史、RAG 資料或系統提示詞。Cache Hit 價格远低于普通 Input,Cache Write 價格高于普通 Input(约 2–4 倍)。合理利用缓存可显著降低月度费用。
阶梯價格示例(以 OpenAI 為例):
- 基础版:標準 $/M
- Cache Hit:1/5–1/30 標準 Input
- Reasoning Effort:非思考模式 vs 高思考模式(輸出價格 2–3 倍)
- Batch:標準 50%
阶梯优化技巧:
- 短上下文场景优先 Cache Hit。
- 长期會话使用模型內置缓存(OpenAI)或手动 KV Cache。
- 批量任务切换 Batch API。
- 结合 OpenAI-compatible 轉换层(如 GrokCode 提供的 /official-api 模块),統一接入多平台同一定價逻辑。
和中轉怎么比
官方訂閱 $/M 是纯合規、SLA 保障的底层價格。中轉站综合倍率通常為 1.5–4.0 倍(含穩定性、限流、部署風險),具体取决于平台、地区和当前市场。
對比示例(OpenAI gpt-5.4-terra):
- 官方:$2.50 Input / $15 Output
- 中轉综合倍率 2.5 倍:相当于 $6.25 Input / $37.5 Output
- GrokCode 聚合站点實時显示:官方價 + 中轉卡網/官方 Token 中轉價 + 官方 API Token 倍率,可直观看到“官方價 vs 中轉價”差额。
建議:日常高频請求优先官方訂閱;低频、測試或突發高峰使用中轉。查看 GrokCode /official-prices 或 /api-transit 模块可實時對比。
風險與邊界
使用官方 API Token 必须遵守各平台 Terms of Service,包括反滥用、資料不用于训练及反欺诈政策。
- 帳户封禁風險:高频請求或批量绕過風控可能触發。
- 隐私風險:敏感資料上傳至云端需评估 GDPR/CCPA 等。
- 價格波动:官方價格會随模型迭代调整,建議启用预算告警。
- 合規提醒:非法律意見,建議咨询专业合規顾问。
- 防御性安全:仅儲存凭證于加密环境,使用官方提供的 API Key 管理工具,避免公開暴露。
- 限流與重試:官方文档明确 Rate Limit,合理處理 429 錯誤是必備运维知识。
延伸阅讀
通過 GrokCode /official-api 模块,您可一键查看各平台官方 Token 實時價格與中轉對比,說明您在合規前提下實現成本與性能的最优平衡。
---
免責聲明: GrokCode 僅聚合公開/提交資訊,不賣貨、不收款、不擔保第三方服務。下單或充值前請回原站核驗。本頁不構成法律意見。
适用于 GrokCode 倍率榜。信息仅供参考,不构成购买、投资或法律意见。