计费精算

2026 GPT-5.6 官方 Token 价格表全解析:Sol/Terra/Luna $/M 如何读

本文教你一分钟读懂 OpenAI GPT-5.6 系列官方 API 计费:输入/输出/Cached 输入/缓存写入 4 字段价格对照表,解决对账单时最常见的“哪一行看什么”问题。

ガイド一覧 · 本文は主に簡体字中国語です。国際向けの要点は English summary をご利用ください。

封面:2026 GPT-5.6 官方 Token 价格表全解析:Sol/Terra/Luna $/M 如何读

GPT-5.6 系列是 OpenAI 在 2026 年 7 月发布的旗舰模型家族,包含 Sol、Terra 和 Luna 三个主力变体。它们分别针对复杂推理、日常工作和高频低成本场景优化。如果你使用 OpenAI API 对账单,或在 ChatGPT Plus / API 间切换模型,精确读懂输入、输出、Cached 输入和 Cache 写入四列价格,就能快速计算每月花费并避免错误。

本文帮你一分钟拆解每一行数据,匹配真实对账单场景。数据基于 OpenAI 官方 2026 年 7 月 30 日 Luna 和 Terra 大幅降价后的最新挂牌信息(Sol 保持不变),供对账单时直接对照。

OpenAI GPT-5.6 模型家族三大主力(Sol / Terra / Luna)核心定位与2026年7月价格调整背景

GPT-5.6 是 OpenAI 标志性升级,打破单模型定价,推出三档分层结构。2026 年 7 月 9 日正式全面可用后,Luna 和 Terra 分别在 7 月 30 日降价 80% 和 20%,让高频任务更实惠。

  • Sol:旗舰定位,适合复杂编码、科学推理和长时域代理工作。性能最强,但价格最高,适合企业级需求。
  • Terra:平衡日常工作模型,性能接近 GPT-5.5,却约一半成本,适合生产环境默认使用。
  • Luna:最快、最便宜选项,强在高频生成任务,适合批量处理或预算敏感场景。

2026 年 7 月调整前,价格已调整至官方标准;之后 Luna/Terra 进一步优化,进一步降低门槛。OpenAI 官方 API 定价页(/official-prices)已更新,可实时校验。

详细拆解官方价格表:输入价格、Cached 输入价格、Cache 写入价格、输出价格每列含义与单位($/M tokens)

OpenAI API 账单按 $/M tokens(每百万 tokens)计费。核心字段拆解如下:

  • 输入价格:处理用户提示(prompt)的单价,包括文本、图像、音频等。
  • Cached 输入价格:命中提示缓存(prompt cache)的折扣价,同一缓存块可重复读取大幅降低成本。
  • Cache 写入价格:首次或更新缓存的单价,通常略高于输入价(通常 1.25 倍)。
  • 输出价格:生成回复的单价,输出通常是输入的 5-6 倍,是账单最大开支项。

这些字段直接对应 OpenAI 控制台账单行。读懂它们,就能快速匹配你的任务类型。

2026年最新价格表数据:Sol $5/$30、Terra $2/$12、Luna $0.20/$1.20 等核心模型对照

2026 年 7 月 30 日 Luna/Terra 大降价后,GPT-5.6 三大主力官方定价表如下(每百万 tokens):

模型 输入价格 Cached 输入价格 Cache 写入价格 输出价格
Sol $5 $0.50 $6.25 $30
Terra $2 $0.20 $2.50 $12
Luna $0.20 $0.02 $0.25 $1.20

(数据以 OpenAI 官方 2026 年 8 月挂牌页为准;实际可能随时间微调。)

对比显示:Luna 整体成本仅 Sol 的约 1/25,Terra 约 1/5,适合不同场景切换。

ChatGPT Plus 与 OpenAI API 账单为什么必须严格分账:订阅额度 vs API 实时计费差异

ChatGPT Plus($20/月)提供固定订阅额度,用于聊天界面和部分 API 访问,但额度有限制(如每日 token 限制)。OpenAI API 是独立实时计费,按实际使用的 Tokens 精确结算,不受 Plus 额度影响。

必须严格分账的原因:

  • 订阅模式无法看到“哪一行看什么”。
  • API 账单可精确匹配输入/输出/缓存字段。
  • 批量或企业使用时,Plus 额度耗尽后仍可继续 API 调用。

建议使用 OpenAI 控制台切换查看(/billing-path),避免混淆导致的预算超支。

Prompt 缓存何时触发并能省多少钱:命中率门槛与实际节省公式

Prompt 缓存支持重复相同提示块,命中后读价打折。触发条件:连续使用同一缓存块(30 分钟最低有效期)。

节省公式:

每月节省 ≈(命中率 × 输出 tokens)×(输入价 - Cached 读价)

示例:Terra 模型,命中率 60%,月输出 10M tokens。

节省 = 0.6 × 10M × ($2 - $0.20) = $1080/月。

实际操作:在 API 请求中添加 cache 头,结合 /api-transit 工具可模拟估算。

多模态模型(Realtime / Image / Audio)额外价格表与特殊计费规则

GPT-5.6 系列扩展支持多模态,额外规则如下(部分基于官方 API 定价):

类型 输入价格示例($/M) 输出价格示例($/M) 备注
Realtime $0.20 $1.20 实时交互任务
Image $0.80 $2.00 图像生成/分析
Audio $0.50 $1.50 语音转文本/生成

特殊规则:图像/音频输入需额外 token 计数,音频长对话可触发缓存优化。建议查看官方多模态定价页。

批量 API(Batch)50% 折扣如何申请与比对:实时 vs 异步任务决策表

Batch API 支持异步提交任务,单次提交 1-5 万 tokens 可申请 50% 折扣(非预付)。

决策表:

场景 推荐方式 优势
低延迟实时处理 实时 API 立即返回
高频批量任务 Batch + 50% 折扣 节省约一半成本
复杂推理 Sol + 实时 性能优先

申请方式:在 API 仪表盘提交任务,审核通过后享受折扣。实时 vs 异步对比见 /guides。

企业级数据驻留与 Fast Mode 计费注意事项:10% 溢价与服务等级选择

企业版支持数据驻留(可选 US/EU 等地区),但部分数据驻留服务等级需额外配置。Fast Mode 替换 Priority Processing,计费无溢价。

注意事项:

  • 数据驻留选择可能影响定价(+0-10%)。
  • Fast Mode 在 /official-api 页查看服务等级。

风险与边界

GPT-5.6 定价可能随官方公告更新,本文数据仅供参考,以 OpenAI 控制台最新值为准。非法律意见,实际计费以官方 API 为准。

延伸阅读