官方API

2026 OpenAI 官方 Token 价表怎么读:输入/输出/缓存字段全解析

最新 GPT-5.6 Sol/Terra/Luna 及 o 系列官方 $/M 价格表详解,含缓存、批处理、长上下文倍率,帮助对账单时一目了然

正文為 SEO 深度以中文為主;上方要點已本地化。可用語言切換與深鏈進行全球導航。

2026 OpenAI 官方 Token 价表怎么读:输入/输出/缓存字段全解析

OpenAI API 定价表直接决定了开发者每月账单,你每天都在跟它打交道。最新 GPT-5.6 Sol / Terra / Luna 及 o 系列官方 $/M 价格已于 2026 年 7 月 30 日大调整(Luna 腰斩、Terra 降价),本文用最简单的方式帮你一目了然读懂所有字段,专为对账单、算 $/M、分清 Plus 与 API 使用场景设计。

GPT-5.6 三款主力模型输入/输出/缓存单价对比

模型输入($/M)缓存输入($/M)输出($/M)主要适用场景
GPT-5.6 Sol5.000.5030.00复杂推理、Agent、长上下文重度任务
GPT-5.6 Terra2.000.2012.00日常生产、文档分析、支持工具
GPT-5.6 Luna0.200.021.20高频总结、分类、自动化

数据来自 OpenAI 官方开发者定价表(2026 年 8 月最新)。Sol 仍是旗舰,保持与 GPT-5.5 同一价位;Terra 作为新默认平衡层,Luna 则专为高量低成本设计。 [[1]](https://developers.openai.com/api/docs/pricing) [[2]](https://openai.com/api/pricing/)

o 系列与 Pro 模型计费特点(输出 tokens 为什么吃预算)

o 系列(o1/o3 等 reasoning 模型)与 Pro 模型的定价特点是:输出 tokens 远高于输入

  • o 系列典型:输入约 2.00–5.00 $/M,输出 8.00–30.00 $/M
  • Pro 模型(如 gpt-5.5-pro):输入 30.00 $/M,输出 180.00 $/M

这是因为 reasoning 过程会产生大量中间 token,实际使用时输出量通常是输入的 3–6 倍。日常聊天或简单提示时几乎不影响,但一旦开启复杂推理或长链条工具调用,输出 token 瞬间成为预算大头。

Prompt Caching 命中率门槛与实际节省公式

Prompt Caching(提示缓存)是 OpenAI API 最强省钱功能之一:

  • 命中率门槛:需同一系统提示词在缓存期内(默认 30 分钟)重复出现
  • 节省公式

实际花费 = 输入 tokens × (1 – 缓存命中率) × uncached_input_price + 输出 tokens × output_price

举例:每月 1 亿输入 token,若缓存命中率 60%,实际成本仅为不缓存时的 40%。Luna 缓存输入只需 0.02 $/M,Terra 0.20 $/M,Sol 0.50 $/M。企业级项目中 50%+ 命中率即可把月账单砍半。

Batch API 与实时 API 的 $50% 折扣与延迟权衡

  • Batch API:提交批量请求后一次性处理,实时价格打 50% 折扣(Luna 变为 0.10 输入 / 0.60 输出)
  • 实时 API:即时响应,延迟稍高但无需排队

适合:批量分析、离线数据处理选 Batch;实时对话或 Agent 工具调用选实时。两者在同一模型下可无缝切换。

长上下文/数据驻留的额外 $10% 倍率解析

  • 长上下文(>270K tokens):输入价格翻倍(Luna 0.40、Terra 4.00、Sol 10.00 $/M)
  • 数据驻留(Regional Processing):启用后额外 +10%(Luna 长上下文 0.44 $/M)

这适用于需要严格数据本地化的企业。OpenAI 官方支持十余个区域,建议优先选择默认区域,成本差异极小。

对账单实用工具:怎么算每月 $ 消耗(中文 token 估算)

  1. 打开 OpenAI Dashboard 或使用第三方估算器
  2. 统计:输入 + 输出 + 缓存命中 token
  3. 应用公式:

月消耗(USD) = 输入 × 模型输入价 + 输出 × 模型输出价 + 缓存节省 示例:Terra 1M 输入 + 0.3M 输出 + 60% 缓存命中 = 2 + 3.6 + 1.44 = 约 7.04 USD

中文 token 估算:用 tiktoken 或 OpenAI 官方 tokenizer,中文通常占 1.5–2 倍英文 token。

常见问题:为什么官方价表变动需实时查 openai.com

OpenAI 每月都会根据模型性能与市场竞争调整定价。7 月 30 日 Luna 80% 降价、Terra 20% 降价就是典型例子。建议书签 https://openai.com/api/pricing/ 并开启邮件通知,账单数据一有新字段立即更新。

延伸阅读

风险与边界

以上内容基于公开的 OpenAI 官方文档与定价表整理,仅供参考。请以 https://openai.com/api/pricing/ 为准。如遇特定地区或企业版定价差异,以官方发票为准。本文非法律意见,价格可能随时间变动。

English summary

The 2026 OpenAI official token price table explains how to read every field for accurate billing. GPT-5.6 Sol ($5/$30), Terra ($2/$12), and Luna ($0.20/$1.20) per 1M tokens are the main models, with prompt caching delivering up to 90% savings on repeated inputs. o-series and Pro models charge heavily on output tokens due to reasoning chains. Batch API offers 50% discounts with slight latency, while long-context or data-residency requests add 10% uplift. Simple formulas let you calculate monthly spend using input/output/cached tokens, with Chinese token estimates via standard tokenizers. Always verify the latest rates at openai.com/api/pricing/ as OpenAI updates pricing monthly. This guide helps developers reconcile bills, separate ChatGPT Plus usage from API costs, and optimize $/M spending.

适用于 GrokCode 倍率榜。信息仅供参考,不构成购买、投资或法律意见。