官方API

2026 OpenAI 官方 Token 价表怎么读:GPT-5.6 系列输入/输出/缓存字段速查

解析当前 OpenAI API 最全 Token 价格表,教你如何从官方定价页面直接读懂 GPT-5.6 Luna/Terra/Sol 的 $/M 输入、输出和缓存单价,以及 1M tokens 实际预算怎么算。

正文為 SEO 深度以中文為主;上方要點已本地化。可用語言切換與深鏈進行全球導航。

## 2026 OpenAI 官方 Token 价表怎么读:GPT-5.6 系列输入/输出/缓存字段速查

OpenAI API 的 Token 定价是开发者最核心的账单依据。当前 GPT-5.6 系列(Luna / Terra / Sol)已成为主流,本文教你从官方定价页面直接读懂每条字段的含义,以及如何快速对账自己的 API 账单。无论你是个人开发者还是企业用户,都能用这套速查方法精确算出 1M tokens 真实预算,避免超支。

适用人群

  • 刚开始用 OpenAI API 却看不懂单价的开发者
  • 需要精确对比官方表格的对账人
  • 想通过缓存节省成本的 Prompt 工程师

决策建议:先看模型选择(Luna 适合高量、Sol 适合复杂推理),再用缓存字段验证实际写入/命中率。

OpenAI 官方定价页面的字段解析:输入/输出/缓存/长上下文区别

OpenAI 官方定价页面(https://developers.openai.com/api/docs/pricing)把所有模型分成两大类:短上下文(标准)和长上下文(扩展上下文)。每行字段含义直接对应你的账单:

  • Input(输入):未缓存的原始提示词 tokens 价格。
  • Cached input(缓存输入):命中缓存后的读价,享受 90% 折扣。
  • Cache writes(缓存写入):新内容放入缓存的价格(GPT-5.6 系列为 1.25 倍原输入价)。
  • Output(输出):模型生成的 tokens 价格(通常最贵)。
  • Long context:上下文超过 128k tokens 时额外计费,价格通常为短上下文的 2 倍(输入/缓存写入/输出均翻倍)。

示例(gpt-5.6-luna 短上下文): Input $0.20 / Cached $0.02 / Writes $0.25 / Output $1.20 长上下文时 Input 变为 $0.40,Cached $0.04,Writes $0.50,Output $1.80。

这些字段直接来自官方表格,直接对照账单即可。缓存折扣只在读端生效,写入端有门槛(写满 30 分钟有效期)。

GPT-5.6 三大主力模型完整价表(Luna $0.20/$1.20、Terra $2/$12、Sol $5/$30)

以下是 GPT-5.6 系列当前(2026 年 8 月)官方完整价表(单位:$/M tokens):

模型Input(短)Cached Input(短)Cache Writes(短)Output(短)Input(长)Output(长)
gpt-5.6-sol$5.00$0.50$6.25$30.00$10.00$45.00
gpt-5.6-terra$2.00$0.20$2.50$12.00$4.00$18.00
gpt-5.6-luna$0.20$0.02$0.25$1.20$0.40$1.80

价格变化说明:2026 年 7 月 30 日后,Luna 降 80%、Terra 降 20%,Sol 保持不变。长上下文价格翻倍是官方标准。

缓存价格究竟是 90% 折扣还是 1.25x 写费?命中率门槛拆解

这是 2026 年最大变化之一:

  • 读取缓存:永远享受 90% 折扣(Cached Input = Input 的 10%)。
  • 写入缓存:不再免费,必须 1.25x 原输入价(e.g. Luna 写入 $0.25 而非 $0)。
  • 最低有效期:30 分钟(可延长至 24 小时,官方已支持)。
  • 命中率门槛:实际使用中需写满缓存才会触发折扣。单次写入 128 tokens 起,建议批量写前缀。

真实成本对比(Luna 例):

  • 纯输入 $0.20/M
  • 写入 + 读取:若命中率 80%,平均成本约 $0.04–$0.06/M(大幅节省)。

Batch API 与实时模式双倍节省计算示例

Batch API(异步处理)通常能省 50%–80%,实时模式(Priority/Fast)另有单独定价。 示例(Luna 10M tokens):

  • 实时模式:Input $0.20 + Output $1.20 = $14
  • Batch 模式:同 token 数通常仅计输入,节省约 60%(精确看账单)。

结合缓存,Batch + 缓存可把成本压到极低。

o 系列与 GPT-5 系列输出 tokens 吃预算的原因

o 系列(如 o1/o3)输出 tokens 价格通常更高(常 3–5 倍输入),因为推理深度高。GPT-5 系列输出也贵($30–$1.80 取决于模型)。 预算建议:优先用 Luna 做简单任务,Sol 仅处理复杂推理,严格限制输出 tokens。

中文提示词大约多少 token?1M tokens 真实预算模板

中文提示词一般 1.3–1.6 倍英文 token 数(OpenAI Tokenizer)。 1M tokens 真实预算模板(Luna 短上下文,假设 30% 输出 + 缓存命中率 80%):

场景输入 tokens输出 tokens总成本($)备注
简单问答(缓存命中)700k300k约 0.25缓存 80% 节省
复杂推理(无缓存)800k200k约 1.80仅输入价
Batch + 长上下文1M500k约 1.20官方长上下文翻倍

直接复制官方表格对照即可。

如何用官方表格快速对账自己 API 账单

  1. 打开 https://developers.openai.com/api/docs/pricing
  2. 找到对应模型(gpt-5.6-luna 等)
  3. 匹配账单中的 input/output/cached_tokens/cache_write_tokens
  4. 计算:总成本 = (input - cached) × uncached + cached × cached_rate + output × rate
  5. 用 https://www.grokcode.cn/tools/bill-reconcile 辅助核对。

2026 年最新变化:缓存保留期从分钟级延长至 24 小时

GPT-5.6 系列明确支持显式缓存断点(prompt_cache_breakpoints),最低保留期 30 分钟,可手动延长至 24 小时。这让多轮对话缓存更稳定。

---

延伸阅读

风险与边界

本文仅供参考,不构成任何投资、法律或财务建议。实际计费以 OpenAI 官方定价页面为准,价格可能随时调整。请始终以平台账单为准。OpenAICN 仅提供对照信息,不提供任何交易或购买服务。

English summary

This guide explains how to read OpenAI's official 2026 GPT-5.6 token pricing table for models Luna ($0.20/$1.20), Terra ($2/$12), and Sol ($5/$30) per million tokens. It covers input/output/cached fields, 90% read discount vs 1.25x write fee, long-context pricing, and real budget templates for 1M tokens. Use it to accurately reconcile your API bills after purchase—key for both ChatGPT API and OpenAI API users. Cache now supports 24-hour retention with explicit breakpoints. All data directly from OpenAI's pricing page. Not financial advice; always verify official sources.

适用于 GrokCode 倍率榜。信息仅供参考,不构成购买、投资或法律意见。