计费精算

2026 OpenAI GPT-5.6 官方 Token 价表详解:如何从账单中快速读懂 Input/Output/Cached 字段

最新 GPT-5.6 系列(Sol/Terra/Luna)官方 API 定价对比表,含缓存命中率门槛与 Fast/Standard 处理模式差异,帮助开发者对账单时秒懂成本构成。

ガイド一覧 · 本文は主に簡体字中国語です。国際向けの要点は English summary をご利用ください。

封面:2026 OpenAI GPT-5.6 官方 Token 价表详解:如何从账单中快速读懂 Input/Output/Cached 字段

2026 OpenAI GPT-5.6 官方 Token 价表详解:如何从账单中快速读懂 Input/Output/Cached 字段\n\n这是针对 OpenAI 官方 API 使用者的实用指南。无论你是开发者、团队管理员还是企业用户,都可以直接用这张价表与账单对账。OpenAICN 作为 OpenAI / 官方 API 计费对照站,帮你秒懂成本构成,区分 Plus 订阅(ChatGPT Plus 等)和纯 API 计费,避免被缓存或 Fast 模式误导。\n\n谁适用? \n- 日常开发者(ChatGPT Plus + API 混合使用) \n- 企业团队(计划调配 GPT-5.6 Sol / Terra / Luna) \n- 需要精确核对账单的用户 \n\n怎么决策? \n查看账单字段:input_tokensoutput_tokenscached_tokenscache_write_tokens。结合官方价表 + 命中率 >60% 的省钱阈值,就能快速算出真实成本。\n\n---\n\n## GPT-5.6 各模型最新官方定价一览(短上下文 vs 长上下文)\n\n2026 年 7 月后,OpenAI 将 GPT-5.6 拆分为三个独立模型,定价已大幅下调。以下是官方标准定价(上下文 <270K 时有效):\n\n| 模型 | Input ($/M) | Cached input ($/M) | Cache writes ($/M) | Output ($/M) | 适用场景 |\n|-------------------|-------------|--------------------|--------------------|--------------|---------------------------|\n| GPT-5.6 Sol | 5.00 | 0.50 | 6.25 | 30.00 | 复杂代理、深度推理、Agentic 任务 |\n| GPT-5.6 Terra| 2.00 | 0.20 | 2.50 | 12.00 | 日常生产、高频工作、性价比首选 |\n| GPT-5.6 Luna | 0.20 | 0.02 | 0.25 | 1.20 | 高体积、快速生成、日常总结 |\n\n长上下文额外规则(上下文 >272K 时):Input 与 Output 按 2x / 1.5x 计费(官方文档确认)。 \n\nCache writes(缓存写费用)已明确,读费用为 cached input 的 90% 折扣。\n\n---\n\n## 缓存字段如何在账单中精确标记:cached_tokens vs cache_write_tokens\n\nOpenAI API 账单(或 API Dashboard)会同时展示以下字段,精确读懂它们是核心:\n\n- input_tokens:总输入 Token(包括 prompt 全部) \n- output_tokens:生成 Token \n- cached_tokens命中缓存的输入 Token(官方称缓存命中率) \n- cache_write_tokens:新写入缓存的输入 Token(仅一次性产生写费用)\n\n真实成本公式(官方推荐): \n实际成本 = (input_tokens - cached_tokens) × uncached_input_rate + cached_tokens × cached_rate + output_tokens × output_rate + cache_write_tokens × cache_write_rate\n\n高命中率示例: \n- 50M input / 5M output / 80% cached = 缓存命中 40M Token \n- 缓存写 10M Token \n- Sol 模式:写费用 = 10M × $6.25 = $62.5 \n- 读费用 = 40M × $0.50 = $20 \n- 输出费用 = 5M × $30 = $150 \n- 总:约 $232.5(比无缓存低近 80%)\n\n---\n\n## Fast mode 与 Standard/Batch 处理模式 $/M 倍率对比\n\n- Standard:默认模式,正常价格 \n- Fast mode(原 Priority Processing):仅 GPT-5.6 Sol 支持,速度提升至 2.5×,但价格 ×2(Sol 则为 $10 / $60 / $1.00 cached) \n- Batch API:异步处理,输入与输出均 -50%(Terra/Luna 同样生效),适合非实时任务 \n\n建议:日常工作选 Terra + Standard;紧急任务用 Sol + Fast;大批量用 Batch API。\n\n---\n\n## o 系列与 GPT-5.6 输出 tokens 吃预算的特殊机制\n\nOpenAI 的 o 系列(o1/o3 等)与 GPT-5.6 在输出 Token 上存在“预算消耗”差异: \n- GPT-5.6 标准输出价格 $12–$30 /M \n- 但 o 系列推理链路可能额外消耗 “思考 Token”,在账单中表现为更高 output_tokens 计数 \n\n对账时注意: \n- GPT-5.6 输出按标准价格计费 \n- o 系列在相同任务中可能因复杂推理消耗更多 Token \n- 避免直接对比:使用官方 token counter 工具或 OpenAI Playground 预估 \n\n---\n\n## 实际对账单示例:高命中率 vs 低命中率场景计算\n\n场景 1(高命中率,推荐缓存): \n50M input(80% cached)、5M output、10M cache write(Terra 模式) \n- 写费:10M × $2.50 = $25 \n- 读费:40M × $0.20 = $8 \n- 输出费:5M × $12 = $60 \n- 总:$93(极致省钱)\n\n场景 2(低命中率,无缓存): \n50M input + 5M output(Terra) \n- 总:50M × $2 + 5M × $12 = $130\n\n结论:缓存命中率 >60% 即可明显省钱,建议在系统提示词中固定 repeatable prefix(系统指令、工具定义)。\n\n---\n\n## 缓存有效单价计算公式与命中率 >60% 的省钱阈值\n\n公式(所有模型通用): \n节省百分比 = (uncached_input_rate - cached_rate) / uncached_input_rate × 缓存命中率\n\nTerra 示例: \n节省率 = (2.00 - 0.20) / 2.00 = 90% \n- 命中率 30% 时,节省 27% \n- 命中率 >60% 时,节省 54%+(官方推荐阈值) \n\n快速计算器:输入你的实际命中率与模型,即可一键得出预计节省。\n\n---\n\n## 常见账单误区:忽略 Regional processing 10% 上调\n\n- Regional processing(数据驻留):数据所在地区不同时,账单会 +10%(2026 年 3 月后新模型均适用) \n- Batch vs Standard:很多人漏算 Batch 节省 \n- 忽略 cache_write_tokens:写入缓存的 Token 单独计费 \n- 输出 Token 误读:o 系列或 Fast 模式可能隐藏额外消耗 \n\n解决:在 OpenAI API Dashboard 或 billing API 中开启 “detailed billing” 标签,导出 CSV 后用本指南公式核对。\n\n---\n\n## 风险与边界\n\n本文基于 OpenAI 官方 2026 年 8 月定价页面信息整理,仅供学习与对账参考。实际账单以 OpenAI 平台实时数据为准,Regional 处理或政策调整可能导致差异。非法律意见,请以官方文档为准。\n\n---\n\n## 延伸阅读\n\n- 官方 API 价格总览 \n- OpenAI API 计费路径详解 \n- ChatGPT Plus 与 API 功能对比 \n- API 流量与 Transit 策略 \n- Token 成本计算工具 \n- 账单对账完整指南 \n- Bill Reconcile 实战\n\n---\n\n## English summary\n\nThis guide explains the 2026 OpenAI GPT-5.6 official token pricing table (Sol/Terra/Luna) and how to quickly interpret Input/Output/Cached fields from your bill. Prices per 1M tokens: Sol $5/$30 ($0.50 cached), Terra $2/$12 ($0.20 cached), Luna $0.20/$1.20 ($0.02 cached). Cache reads get 90% discount; writes cost 1.25× uncached input. Fast mode doubles Sol price for 2.5× speed; Batch saves 50%. High cache hit rate (>60%) can cut costs by over 50%. Always check Regional processing (+10%) and use official formulas for accurate reconciliation. All figures are current as of August 2026 and based on OpenAI’s public pricing page.