
## 2026 OpenAI API 官方 Token 价表怎么读:输入/输出/缓存字段详解
OpenAI GPT-5.6 系列(Sol、Terra、Luna)官方定价 $0.02-$30/M,缓存仅 $0.02-$1/M,Batch 半价,读者可直接对照账单字段计算真实成本。
本指南专为 OpenAI API 用户设计,教你从对账单读懂每个字段、快速算出实际 $/M 成本。适用于开发者、产品团队和企业采购者,能帮你避免预算超支、优化 Prompt 缓存策略,同时清晰区分 ChatGPT Plus 与纯 API 计费。
以 2026 年 7 月 30 日 OpenAI 官方定价页面为准,数据可能随时间调整,建议实时查阅。
1. 官方定价入口与更新时间(2026 年 7 月 30 日重大下调)
OpenAI 官方 API 定价入口在 https://openai.com/api/pricing/ 和开发者文档 https://developers.openai.com/api/docs/pricing。
2026 年 7 月 30 日起,GPT-5.6 Terra 价格下调 20%,Luna 下调 80%,Sol 保持不变。调整后,Luna 成为最亲民选择,适合高频小任务;Terra 平衡性强;Sol 仍是前沿旗舰。
更新后,标准定价(上下文 <270K tokens)已公开。长上下文和缓存机制也同步调整,企业用户可通过 Regional Processing 页面进一步确认数据主权规则。
2. GPT-5.6 核心模型单价速查表(Sol/Terra/Luna 短语境与长语境对比)
| 模型 | 短语境输入 | 短语境缓存 | 短语境输出 | 长语境输入 | 长语境缓存 | 长语境输出 |
|---|---|---|---|---|---|---|
| Sol | $5.00 | $0.50 | $30.00 | $10.00 | $1.00 | $45.00 |
| Terra | $2.00 | $0.20 | $12.00 | $4.00 | $0.40 | $18.00 |
| Luna | $0.20 | $0.02 | $1.20 | $0.40 | $0.04 | $1.80 |
这些为标准处理模式下的单价(每百万 tokens)。长语境触发条件为输入 >270K tokens。Cache Writes 字段单独列出(Sol $6.25、Terra $2.50、Luna $0.25),适用于新 Prompt 首次写入缓存场景。
3. 输入/输出/缓存字段完整解读与示例
- 输入:你发送给模型的 Prompt tokens(包括系统提示、用户消息)。
示例:一次询问“请总结这篇长文”的 Prompt 消耗 8K tokens,输入单价按模型而定。
- 输出:模型生成的内容 tokens(回答、代码、JSON 等)。通常输出单价是输入的 6 倍(Sol $30、Terra $12、Luna $1.20)。
- 缓存:Prompt 缓存(Cache Reads)会按大幅折扣计费(Luna $0.02、Terra $0.20、Sol $0.50)。缓存仅读不写,成本远低于标准输入。
- Cache Writes:新写入的 Prompt(通常在第一次使用后,缓存存活至少 30 分钟)。单价为标准输入的 1.25 倍(Sol $6.25 等),适合优化重复 Prompt。
4. Cache Writes 与长语境额外字段说明
Cache Writes 单独出现在账单,是首次提交 Prompt 时产生的费用。启用 Prompt Caching 后,相同系统提示或工具定义后续请求将命中缓存,节省 80%-90% 成本。
长语境额外字段:
- 长语境输入 / 长语境缓存 / 长语境输出
上下文超过 270K tokens 时,OpenAI 按 2x 输入、1.5x 输出的倍率额外计费。缓存也按相应倍率调整。
这对需要分析超长文档或代码库的开发者是重要提醒,建议优先拆分或启用缓存。
5. Batch API 与 Fast mode 折扣规则
Batch API 将输入和输出单价各砍半价(例如 Sol 短语境输入 $2.50、输出 $15),适合离线批量任务(如多轮数据处理)。实际可用时长约 24 小时内完成,需在 API 调用时指定 Batch 模式。
Fast mode(原 Priority Processing)仅对 Sol 模型生效:标准速度 2.5 倍,但价格翻倍(Sol 输入 $10、输出 $60)。适合需要极快响应的实时场景,其他模型暂无 Fast 模式。
6. 账单字段对应实战:如何从对账单读懂实际 $/M
OpenAI 账单通常按请求分组显示字段:
1. 记录请求 ID、模型(gpt-5.6-sol / gpt-5.6-terra / gpt-5.6-luna)、上下文长度。
2. 统计 Input tokens、Output tokens、Cached input tokens、Cache writes。
3. 按模型单价乘以对应 tokens 数量,得到每条请求成本。
4. 总成本 ÷ 总 tokens(输入+输出)= 实际平均 $/M。
实战示例(Sol 模型):
- 10K tokens 短 Prompt(输入)+ 2K 输出 + 3K 缓存命中 = 总成本约 $0.10。
- 实际 $/M = (总 tokens 12K 的 1/1M)× 1000 = $1.00/M(已含缓存优势)。
建议下载官方 Billing 报告或使用第三方对账工具 https://www.grokcode.cn/tools/bill-reconcile 自动匹配字段。
7. 不同语境长度下的实际成本估算工具
结合官方数据,我们提供了简单估算公式:
短语境总成本($/M) = (Input × 输入单价 + Output × 输出单价 + Cached × 缓存单价) / 总 tokens × 1,000,000
长语境总成本 = 按倍率乘以相应字段
完整估算工具页:https://www.grokcode.cn/tools/token-cost(可导入你的账单 CSV 一键计算)。
8. 企业用户必看:数据主权与 Regional Processing 上浮规则
OpenAI 提供 Regional Processing 端点(数据主权可选),适用于需要符合 GDPR、CCPA 等法规的客户。2026 年 3 月 5 日后发布的模型在此类端点上,数据主权功能会额外收取 10% 上浮费用(例如 Luna 长语境输入从 $0.40 升至 $0.44)。
企业建议:
- 优先选择支持数据主权的 Regional 端点。
- 通过 https://openai.com/api/pricing/ 选择对应区域查看详情。
- 可内联阅读 https://openai.com/index/advancing-the-price-performance-frontier-with-gpt-5-6/ 获取完整调整背景。
风险与边界
以上信息基于 2026 年 7 月 30 日 OpenAI 官方定价页面,实际以页面最新显示为准。部分价格可能随促销或模型更新调整,缓存缓存存活期(至少 30 分钟)也可能变化。
非法律意见声明:本文仅供参考,不构成任何财务、法律或合同建议。如需精确对账,请直接对照 OpenAI 开发者仪表盘或联系 OpenAI 企业销售团队。价格变动风险由用户自行承担。
延伸阅读
English summary
This 2026 OpenAI API guide explains how to read the official Token price table for GPT-5.6 series models (Sol, Terra, Luna). With input/output/cache pricing ranging from $0.02 to $30 per million tokens and caching offering up to 90% discounts, users can directly calculate real costs from billing statements.
The July 30, 2026 price adjustments dramatically lowered Terra and Luna rates while introducing Batch (50% off) and Fast mode (2.5x speed at double price for Sol). Detailed field interpretations, context-length multipliers for long prompts, and enterprise data residency rules (10% uplift) are included.
Practical examples show how to convert raw logs into effective $/M costs, and a dedicated estimator tool is linked. Always verify latest rates on the official pricing page, as changes can occur. This content supports accurate budgeting for developers and teams distinguishing ChatGPT Plus from pure API usage.