2026 OpenAI 官方 Token 价表怎么读:输入/输出/缓存字段完全对照
内容刷新 / GEO:补 English summary 与最新核对清单 — oa-2026-openai-api-price-table-how-to-read

## 2026 OpenAI 官方 Token 价表怎么读:输入/输出/缓存字段完全对照
如果你正在查看 OpenAI API 对账单,想搞清楚每笔消费里输入、输出和缓存分别花了多少钱、为什么 Prompt 缓存能让你节省一半成本、以及 API 使用量和 ChatGPT Plus 订阅完全分账,这篇文章就是给你看的。对账单、算真实 $/M、区分 Plus 与纯 API 场景,一键对照即可。
现状与数据更新
2026 年 OpenAI 官方 API 价格已进入 GPT-5.6 时代,旗舰模型如 gpt-5.6-sol、gpt-5.6-terra、gpt-5.6-luna 和 gpt-6-astra 定价全面下调,同时 Prompt Caching 成为标配。官方定价页面(开发者文档)以 1M tokens 为单位给出标准价、缓存读价和缓存写价。 [[1]](https://developers.openai.com/api/docs/pricing)
价格受上下文长度、数据驻留(10% 上浮)和服务等级(Fast/Priority)影响,Batch API 可享 50% 折扣。ChatGPT Plus、Business 等订阅价格单独计算,不含 API 使用量。最新数据以开发者平台实时挂牌为准,建议登录 OpenAI Platform 查看当日账单。
核对清单
读懂官方 Token 价表的核心是看 三列 + 上下文长度,同时核对三个关键点:
1. 确认模型(例如 gpt-5.6-luna)和上下文长度(Short / Long)。
2. 分清缓存状态:新写(Cache write)还是已缓存(Cache read)。
3. 检查数据驻留 + 服务等级是否触发额外费用。
完整对照表(标准上下文长度 < 272K,单位 $/1M tokens,数据来源于 OpenAI 官方开发者定价页,2026 年 9 月最新核对):
| 模型 | 输入价格(标准) | 缓存输入(读) | 缓存写价 | 输出价格(标准) | 长上下文输入 | 长上下文输出 | 备注 |
|---|---|---|---|---|---|---|---|
| gpt-6-astra | $10.00 | $1.00 | $12.50 | $50.00 | $20.00 | $75.00 | 旗舰最强模型 |
| gpt-5.6-sol | $4.00 | $0.40 | $5.00 | $20.00 | $8.00 | $30.00 | 促销价(至 2026.11.21) |
| gpt-5.6-terra | $2.00 | $0.20 | $2.50 | $12.00 | $4.00 | $18.00 | 平衡高效型 |
| gpt-5.6-luna | $0.20 | $0.02 | $0.25 | $1.20 | $0.40 | $1.80 | 日常最便宜 |
| gpt-realtime-2.1 | 音频 $32 / 文本 $4 | 缓存输入 $0.40 | - | 输出 $64 / $24 | - | - | 实时语音专用 |
数据核对清单:
- 输入字段:prompt + 历史对话 token 总和。
- 输出字段:模型返回 token 总和。
- 缓存字段:Prompt Caching 必须明确启用(
cache_control: {"type": "ephemeral"}),新对话第一次写入算写价,后续读价大幅降低。 - 额外注意:图像/音频输入另计,Web Search 工具调用固定 $10 / 1k 次 + 内容 token。
风险边界
Prompt Caching 节省成本的边界是:连续重复提示词(同上下文长度 > 128K)才能体现优势,否则缓存开销可能抵消。长上下文模式下即使缓存读价也比短上下文高 2 倍。数据驻留模式会额外加 10% 上浮,优先处理(Fast)比标准慢 20%-30%。使用非官方修改器或注入工具可能导致账号封禁,官方计费对不上账。升级到新模型后,历史对话 token 不会自动迁移,建议提前预估。以上仅为信息参考,非法律意见,请以 OpenAI 官方定价为准。
站内路径
想更深入了解?从以下路径开始:
风险与边界
重要声明:本文仅供读者对账单、算 $/M 时参考,不构成任何投资、法律或专业建议。价格可能随 OpenAI 官方公告调整,以开发者平台实时数据为准。使用任何“修改器”“注入器”工具均存在账号封禁、计费对不上账或永久停用风险,强烈不推荐。升级计划后必挂现象常见于历史 token 未清算或缓存状态不一致的情况,建议立即登录 OpenAI Platform 查看使用详情。
English summary
This guide shows how to read the 2026 OpenAI official token price table in one click. It breaks down every line item on your billing statement — input tokens, output tokens, and prompt cache fields — with a clear comparison table for current flagship models like gpt-5.6-sol, gpt-5.6-terra and gpt-6-astra. Learn exactly why caching can cut costs by 80-90% on repetitive prompts, how to check short vs long context, and why API usage is completely separate from ChatGPT Plus subscription pricing. Includes a ready-to-use checklist to avoid billing mismatches, data residency surcharges and service-tier surprises. Perfect for developers who need accurate $/M calculations and instant reconciliation of their OpenAI API bills.