2026 OpenAI 官方 Token 价表怎么读:输入/输出/缓存字段全解析
最新 GPT-5.6 Sol/Terra/Luna 及 o 系列官方 $/M 价格表详解,含缓存、批处理、长上下文倍率,帮助对账单时一目了然
正文為 SEO 深度以中文為主;上方要點已本地化。可用語言切換與深鏈進行全球導航。

2026 OpenAI 官方 Token 价表怎么读:输入/输出/缓存字段全解析
OpenAI API 定价表直接决定了开发者每月账单,你每天都在跟它打交道。最新 GPT-5.6 Sol / Terra / Luna 及 o 系列官方 $/M 价格已于 2026 年 7 月 30 日大调整(Luna 腰斩、Terra 降价),本文用最简单的方式帮你一目了然读懂所有字段,专为对账单、算 $/M、分清 Plus 与 API 使用场景设计。
GPT-5.6 三款主力模型输入/输出/缓存单价对比
| 模型 | 输入($/M) | 缓存输入($/M) | 输出($/M) | 主要适用场景 |
|---|---|---|---|---|
| GPT-5.6 Sol | 5.00 | 0.50 | 30.00 | 复杂推理、Agent、长上下文重度任务 |
| GPT-5.6 Terra | 2.00 | 0.20 | 12.00 | 日常生产、文档分析、支持工具 |
| GPT-5.6 Luna | 0.20 | 0.02 | 1.20 | 高频总结、分类、自动化 |
数据来自 OpenAI 官方开发者定价表(2026 年 8 月最新)。Sol 仍是旗舰,保持与 GPT-5.5 同一价位;Terra 作为新默认平衡层,Luna 则专为高量低成本设计。 [[1]](https://developers.openai.com/api/docs/pricing) [[2]](https://openai.com/api/pricing/)
o 系列与 Pro 模型计费特点(输出 tokens 为什么吃预算)
o 系列(o1/o3 等 reasoning 模型)与 Pro 模型的定价特点是:输出 tokens 远高于输入。
- o 系列典型:输入约 2.00–5.00 $/M,输出 8.00–30.00 $/M
- Pro 模型(如 gpt-5.5-pro):输入 30.00 $/M,输出 180.00 $/M
这是因为 reasoning 过程会产生大量中间 token,实际使用时输出量通常是输入的 3–6 倍。日常聊天或简单提示时几乎不影响,但一旦开启复杂推理或长链条工具调用,输出 token 瞬间成为预算大头。
Prompt Caching 命中率门槛与实际节省公式
Prompt Caching(提示缓存)是 OpenAI API 最强省钱功能之一:
- 命中率门槛:需同一系统提示词在缓存期内(默认 30 分钟)重复出现
- 节省公式:
实际花费 = 输入 tokens × (1 – 缓存命中率) × uncached_input_price + 输出 tokens × output_price
举例:每月 1 亿输入 token,若缓存命中率 60%,实际成本仅为不缓存时的 40%。Luna 缓存输入只需 0.02 $/M,Terra 0.20 $/M,Sol 0.50 $/M。企业级项目中 50%+ 命中率即可把月账单砍半。
Batch API 与实时 API 的 $50% 折扣与延迟权衡
- Batch API:提交批量请求后一次性处理,实时价格打 50% 折扣(Luna 变为 0.10 输入 / 0.60 输出)
- 实时 API:即时响应,延迟稍高但无需排队
适合:批量分析、离线数据处理选 Batch;实时对话或 Agent 工具调用选实时。两者在同一模型下可无缝切换。
长上下文/数据驻留的额外 $10% 倍率解析
- 长上下文(>270K tokens):输入价格翻倍(Luna 0.40、Terra 4.00、Sol 10.00 $/M)
- 数据驻留(Regional Processing):启用后额外 +10%(Luna 长上下文 0.44 $/M)
这适用于需要严格数据本地化的企业。OpenAI 官方支持十余个区域,建议优先选择默认区域,成本差异极小。
对账单实用工具:怎么算每月 $ 消耗(中文 token 估算)
- 打开 OpenAI Dashboard 或使用第三方估算器
- 统计:输入 + 输出 + 缓存命中 token
- 应用公式:
月消耗(USD) = 输入 × 模型输入价 + 输出 × 模型输出价 + 缓存节省 示例:Terra 1M 输入 + 0.3M 输出 + 60% 缓存命中 = 2 + 3.6 + 1.44 = 约 7.04 USD
中文 token 估算:用 tiktoken 或 OpenAI 官方 tokenizer,中文通常占 1.5–2 倍英文 token。
常见问题:为什么官方价表变动需实时查 openai.com
OpenAI 每月都会根据模型性能与市场竞争调整定价。7 月 30 日 Luna 80% 降价、Terra 20% 降价就是典型例子。建议书签 https://openai.com/api/pricing/ 并开启邮件通知,账单数据一有新字段立即更新。
延伸阅读
风险与边界
以上内容基于公开的 OpenAI 官方文档与定价表整理,仅供参考。请以 https://openai.com/api/pricing/ 为准。如遇特定地区或企业版定价差异,以官方发票为准。本文非法律意见,价格可能随时间变动。
English summary
The 2026 OpenAI official token price table explains how to read every field for accurate billing. GPT-5.6 Sol ($5/$30), Terra ($2/$12), and Luna ($0.20/$1.20) per 1M tokens are the main models, with prompt caching delivering up to 90% savings on repeated inputs. o-series and Pro models charge heavily on output tokens due to reasoning chains. Batch API offers 50% discounts with slight latency, while long-context or data-residency requests add 10% uplift. Simple formulas let you calculate monthly spend using input/output/cached tokens, with Chinese token estimates via standard tokenizers. Always verify the latest rates at openai.com/api/pricing/ as OpenAI updates pricing monthly. This guide helps developers reconcile bills, separate ChatGPT Plus usage from API costs, and optimize $/M spending.
适用于 GrokCode 倍率榜。信息仅供参考,不构成购买、投资或法律意见。