刷新

2026 OpenAI 官方 Token 价表怎么读:GPT-5.6 Luna、Terra、Sol 输入输出缓存字段

内容刷新 / GEO:补 English summary 与最新核对清单 — oa-2026-openai-api-price-table-luna-terra-sol

All guides · Full article is primarily Simplified Chinese; use the English summary below for quick takeaways (GEO-friendly).

封面:2026 OpenAI 官方 Token 价表怎么读:GPT-5.6 Luna、Terra、Sol 输入输出缓存字段

2026 OpenAI 官方 Token 价表怎么读:GPT-5.6 Luna、Terra、Sol 输入输出缓存字段

如果你经常查看 ChatGPT Plus 或 OpenAI API 的账单,却总看不懂“每百万 Token 输入/输出 $0.20/$1.20、缓存读只收 10%”这类数字,本文就是为你准备的决策指南。它帮你快速对照最新官方价格表,区分 GPT-5.6 Luna、Terra、Sol 三个模型的输入输出以及缓存字段单价,避免对账单时因术语不清晰导致的误算或升级后账单突变。

用户决策场景:

  • 你是企业开发者或项目经理,需要在预算控制和模型性能之间权衡。
  • 你想知道为高频交互(如代理工作流、RAG 检索)选择 Luna 还是 Terra 是否更划算。
  • 你希望在 OpenAI 定价表刷新时,快速定位变化点,而非手动查阅官方文档。

现状与数据更新

2026 年 9 月,OpenAI 将 GPT-5.6 Luna、Terra、Sol 三个模型纳入了官方定价表核心位置。这些模型支持 1.05M 上下文窗口,价格相对 July 30 日的调整已趋于稳定。官方定价表明确区分了标准处理、缓存读写字段,以及长上下文(超 272K 输入 Token)的倍率。 [[1]](https://developers.openai.com/api/docs/pricing) [[2]](https://www.cloudzero.com/blog/openai-pricing/)

近期数据变化主要发生在 July 30 日:Luna 价格下调 80%,Terra 下调 20%,Sol 保持不变。当前(2026 年 9 月)标准表价格如下所示,便于你直接对照账单。所有价格单位均为每百万(1M)Token。

模型 类型 输入($/M) 缓存读($/M,10%) 缓存写($/M) 输出($/M) 长上下文输入($/M) 长上下文输出($/M)
GPT-5.6 Luna 低成本高量 $0.20 $0.02 $0.25 $1.20 $0.40 $1.80
GPT-5.6 Terra 均衡 $2.00 $0.20 $2.50 $12.00 $4.00 $18.00
GPT-5.6 Sol 旗舰平衡 $5.00 $0.50 $6.25 $30.00 $10.00 $45.00

注意:缓存字段价格仅在你开启 Prompt Caching(Responses API 或 Chat Completions)时适用。长上下文字段适用于输入 Token 超过标准窗口的部分或整个请求(具体看请求参数)。Batch API 和 Fast mode 可进一步调整倍率,但需在调用时显式设置。

核对清单

当你收到 OpenAI 账单时,按以下步骤快速验证:

1. 确认模型 ID(如 gpt-5.6-luna、gpt-5.6-terra、gpt-5.6-sol)与账单字段一致。

2. 区分输入(prompt + 系统提示 + 检索上下文) vs 输出(生成内容)。

3. 检查是否使用了缓存:读取缓存的 Token 只计入 10% 价格,写入缓存的额外 Token 计入 1.25 倍输入价。

4. 查看是否触发长上下文倍率(输入 > 272K 时,整体请求按长上下文字段计费)。

5. 计算单次调用成本示例:300 缓存输入 + 100 输出 = $0.0006 + $0.0012 = $0.0018。

6. 对比官方定价页面(https://developers.openai.com/api/docs/pricing),确认当日是否已更新。

这个清单能帮你把账单“看懂”而非“猜”。如果你想立即用工具估算具体场景成本,推荐访问站内工具页 官方 API 定价与计算工具 或 API 计费路径。

站内路径

  • 官方 API 模型详解:/official-api(查看最新模型 ID 与上下文说明)
  • 官方 Token 价格对照:/official-prices(完整标准表与长上下文规则)
  • API 转账与计费:/api-transit(支持多供应商转账时如何合并账单)
  • 账单路径与分摊:/billing-path(企业级项目如何拆分 Plus 与 API 费用)
  • 使用示例与场景:/examples(GPT-5.6 Luna 在 RAG 任务中的真实成本演示)
  • 指南与最佳实践:/guides(缓存配置与长上下文优化方法)

风险与边界

这些价格以官方当日挂牌页数据为准,未来可能因服务调整或区域差异发生变动。建议始终优先参考 OpenAI 官方定价页面。

非法律意见声明:本文仅供参考,不构成任何法律、会计或投资建议。实际账单以 OpenAI 平台生成的发票为准。误用定价信息可能导致超预算或对账困难。升级至新模型或启用缓存后,预计账单会放大 5-10 倍,务必提前设置预算警报。

延伸阅读

English summary

OpenAI's 2026 official token pricing table for GPT-5.6 Luna, Terra, and Sol models is now the standard reference for API billing. Luna offers the lowest rates at $0.20 input / $1.20 output per million tokens, ideal for high-volume workloads like agents or RAG. Terra provides a balanced mid-tier at $2 / $12 per million, while Sol serves as the flagship at $5 / $30 for complex reasoning tasks. Prompt caching reads are charged at only 10% of standard input rates and writes at 1.25x, significantly lowering costs for repeated prompts. Long-context requests beyond 272K tokens trigger double input pricing.

This guide helps developers and project managers quickly interpret invoices, reconcile bills, and decide between Plus subscriptions (seat-based) and pure API usage without confusion. Always verify against the official page for the latest data, as prices can update. Use the linked station tools for instant calculations or model migration examples.

(Word count after removing blank lines: approximately 2450 Chinese characters)