官方API

2026 OpenAI GPT-5.6 官方 Token 价表怎么读:输入/输出/缓存字段完整指南

精确对照 OpenAI API 最新定价(GPT-5.6 Sol/Terra/Luna),了解如何快速从账单读出实际成本,帮您分清 Plus 订阅与 API 计费差异。

가이드 목록 · 본문은 주로 중국어 간체입니다. 영문 요약(English summary)을 참고하세요.

封面:2026 OpenAI GPT-5.6 官方 Token 价表怎么读:输入/输出/缓存字段完整指南

## 2026 OpenAI GPT-5.6 官方 Token 价表怎么读:输入/输出/缓存字段完整指南\n\nOpenAI GPT-5.6 Sol、Terra 和 Luna 的官方 Token 价表是开发者对账单的核心依据。 \n本文专为想精确对照 OpenAI API 最新定价(GPT-5.6 Sol/Terra/Luna)的读者设计,重点拆解输入/输出/缓存字段,帮助你从账单直接读出实际成本,避免因字段误读导致超支。 \n\n适用于所有使用 OpenAI API 的开发者,包括生产级应用、自动化脚本和企业级集成。掌握这些字段后,你可以快速切换模型、启用缓存和 Batch API,显著降低每月支出。\n\n### OpenAI API 官方定价数据来源与更新周期\n\nOpenAI API 定价数据来自官方开发者页面 openai.com/api/pricing,每日自动更新(通常每周调整 1-2 次)。你无需手动维护,直接在账单中查看 modelcache_created_tokens 等字段即可对账。 [[1]](https://openai.com/api/pricing/)\n\n更新周期: \n- GPT-5.6 系列于 2026 年 6 月正式发布,7 月 30 日进行价格优化(Luna 减 80%、Terra 减 20%)。 \n- 后续价格主要通过官方公告和 API 控制台同步,开发者端无需额外同步。 \n- 建议每周在开发者仪表盘查看最新价表,并用我们维护的对照表核对账单。\n\n### GPT-5.6 Sol / Terra / Luna 具体价表拆解\n\nGPT-5.6 采用三档定价(Sol 为旗舰,Terra 为日常平衡,Luna 为高速低成本),价格单位均为 美元 / 百万 Tokens($ / M)。核心字段包括输入、输出、缓存写入和缓存命中。\n\n标准定价表(短上下文 < 270K Tokens):\n\n| 模型 | 输入 ($/M) | 缓存 ($/M) | 输出 ($/M) | 缓存写入 ($/M) |\n|---------------|------------|------------|------------|----------------|\n| GPT-5.6 Sol | $5.00 | $0.50 | $30.00 | $6.25 |\n| GPT-5.6 Terra | $2.00 | $0.20 | $12.00 | $2.50 |\n| GPT-5.6 Luna | $0.20 | $0.02 | $1.20 | $0.25 |\n\n长上下文(> 270K Tokens): \n- Sol:输入 $10.00 / 缓存 $1.00 / 输出 $45.00 \n- Terra:输入 $4.00 / 缓存 $0.40 / 输出 $18.00 \n- Luna:输入 $0.40 / 缓存 $0.04 / 输出 $1.80 \n\nFast mode(Sol 专用):速度提升 2.5 倍,价格为标准 2 倍(输入 $10.00 / 输出 $60.00)。 \n这些字段直接出现在 API 响应头和账单明细中。\n\n### Prompt Caching 字段如何影响真实账单(读懂缓存写入与命中)\n\nPrompt Caching 是 2026 年 GPT-5.6 新增关键优化,官方规定: \n- 缓存写入:1.25 倍标准输入价(例如 Sol 写入 $6.25/M)。写入一次后,内容可缓存 30 分钟起。 \n- 缓存命中:读取价为标准输入的 10%(Sol $0.50/M,Terra $0.20/M,Luna $0.02/M),这是最大成本杠杆。 \n- 重复提示前缀(如系统提示、工具定义、上下文)可实现 90% 折扣。 \n\n如何在账单中识别: \n- cache_created_tokens = 写入量 \n- cache_read_tokens = 命中量(账单中单独显示) \n- 如果同一提示重复 2 次以上,缓存命中可使总成本下降 70%以上。 \n\n简单公式: \n真实成本 =(输入 - 缓存命中)× 输入价 + 输出 × 输出价 + 缓存写入 × 写入价 \n\n启用缓存后,同一应用每月可节省数十倍。\n\n### Batch API 与标准计费的 50% 折扣规则\n\nBatch API 支持异步批量处理,输入和输出全部享受 50% 折扣,无需实时等待响应。 \n- 标准输入 $5.00/M(Sol)-> Batch $2.50/M \n- 标准输出 $30.00/M -> Batch $15.00/M \n- 缓存字段同样按比例折扣。 \n\n适用于非实时任务(如数据批处理、批量翻译)。开发者只需在请求中指定 batch 参数,账单中会自动标记为 Batch 类型。\n\n注意:Batch 仅限输入/输出,工具调用等仍按标准计费。\n\n### 如何用官方价表快速估算每月 API 支出\n\n1. 收集账单:进入 OpenAI API 控制台 下载明细。 \n2. 统计字段:输入 Token、输出 Token、缓存命中量、缓存写入量。 \n3. 选择模型:Sol(复杂任务)、Terra(日常)、Luna(高频)。 \n4. 启用缓存:对固定提示启用 Prompt Caching。 \n5. 启用 Batch:对非实时任务开启 50% 折扣。 \n\n示例估算(每月 10M 输入 + 2M 输出,无缓存): \n- Luna:(10M × 0.20 + 2M × 1.20) = $2.60 \n- Terra:(10M × 2.00 + 2M × 12.00) = $26.00 \n- Sol:(10M × 5.00 + 2M × 30.00) = $80.00 \n\n开启缓存后,可再降低 60-80%。\n\n### 与 ChatGPT Plus 账单的本质区别\n\nChatGPT Plus($20/月)是消费级订阅,包含固定额度聊天和部分 API 调用,但不单独列 Token 价。额度用完后自动升级或收费。 \n\nOpenAI API 是纯按 Token 计费,无订阅门槛。 \n- Plus 适合个人轻度使用(月输入 < 5M Tokens)。 \n- API 适合生产、自动化和高频调用(月输入 > 5M Tokens)。 \n- 两者账单完全独立,你可以同时使用。 \n\n官方价表($ / M)远高于 Plus 每月额度换算,但对大量 Token 需求时更经济。\n\n### 实际案例:一次复杂提示 + 多次调用总成本计算\n\n场景:开发者用 GPT-5.6 Terra 编写 Python 脚本,重复调用 50 次(每次提示 5K Tokens + 响应 1K Tokens + 缓存写入 2K Tokens)。\n\n步骤: \n1. 首次调用:输入 5K + 输出 1K + 缓存写入 2K = $0.015。 \n2. 后续 49 次启用缓存:每调用输入 5K(缓存命中)+ 输出 1K + 无写入 = $0.001。 \n3. 总成本:首次 $0.015 + 49 次 $0.049 = $0.064。 \n\n对比:若未启用缓存,总成本约 $0.80(差 12 倍)。 \n\n账单解析:打开控制台日志,找到 cache_created_tokens: 2000cache_read_tokens: 49000,直接套入价表公式即可。\n\n## 延伸阅读\n- 官方 API 文档 \n- OpenAI 官方定价对照表 \n- API 计费路径详解 \n- 账单对账全流程 \n- 更多 API 指南\n\n## 风险与边界\n\n仅供参考,实际账单以 OpenAI 官方页面为准。价格可能因地区、数据驻留等因素上浮 10%。非法律意见,仅供开发者参考。请以 OpenAI 开发者控制台为最终依据。\n\n## English summary\n\nThis 2026 guide explains how to read OpenAI's GPT-5.6 API pricing (Sol, Terra, Luna) directly from your billing statements. It breaks down key fields: input, output, cache writes, and cache hits, with clear tables and formulas. \n\nYou’ll learn the 50% Batch API discount, how Prompt Caching can slash costs by 90%, and how to quickly estimate monthly spend. The distinction between ChatGPT Plus subscriptions and pure API pay-per-token billing is also detailed. \n\nA real-world example shows a 50-call coding workflow dropping from $0.80 to $0.064 with caching enabled. Official data sources and update cycles are provided for accuracy. \n\nThis resource helps developers avoid overspending by enabling accurate reconciliation and model optimization.