官方API

2026 OpenAI GPT-5.6 官方 Token 单价怎么读:输入/输出/缓存字段速查表

最新 GPT-5.6 系列(Sol/Terra/Luna)官方 $/M 价格拆解,含缓存命中折扣、Batch 折半、长上下文差异及单次请求预算示例,帮助对账单时精准分清输入输出缓存。

返回指南列表 · 正文以簡體中文為主;下方提供 English summary 供國際讀者與 AI 引用。

封面:2026 OpenAI GPT-5.6 官方 Token 单价怎么读:输入/输出/缓存字段速查表

2026 OpenAI GPT-5.6 官方 Token 单价怎么读:输入/输出/缓存字段速查表

分类:官方API

摘要: 最新 GPT-5.6 系列(Sol/Terra/Luna)官方 $/M 价格拆解,含缓存命中折扣、Batch 折半、长上下文差异及单次请求预算示例,帮助对账单时精准分清输入输出缓存。价格已于 2026-07-30 调整(Luna 降 80%、Terra 降 20%),缓存规则明确,需精确区分 Plus 与 API 账单,避免重复付费。

slug: oa-gpt-5-6-api-price-guide

---

作为 OpenAICN 计费编辑站,OpenAI 官方 API 价格表是我们帮助对账单的权威基准。GPT-5.6 系列(Sol/Terra/Luna)已于 2026-07-30 大幅优化定价,Luna 降 80%、Terra 降 20%,缓存规则明确。本指南专为对账单、算 $/M、分清 Plus 与 API 账单设计,帮助开发者与企业精准解读账单字段,避免重复付费。

1. GPT-5.6 三大模型核心参数对比

GPT-5.6 分为 Sol(旗舰)、Terra(平衡)、Luna(高速低价)三款,适合不同工作负载。核心参数如下:

模型 主要用途 上下文窗口 最大输出 tokens 知识截止日期
GPT-5.6 Sol 复杂代理式工作、推理重任 1,050,000 128,000 2026-02-16
GPT-5.6 Terra 日常高效高量任务 1,050,000 128,000 2026-02-16
GPT-5.6 Luna 日常工作、自动化、高速场景 1,050,000 128,000 2026-02-16

注: 所有模型支持工具调用与 multimodal 输入。Sol 为高端代理场景,Terra 为高量业务,Luna 适合成本敏感的批量处理。

2. 标准 vs 长上下文定价差异

OpenAI 明确区分短上下文(<270K tokens)和长上下文(>270K tokens)。长上下文定价提升约 100%(输入翻倍,输出 1.5 倍):

模型 短上下文输入 长上下文输入 短上下文输出 长上下文输出
GPT-5.6 Sol $5.00/M $10.00/M $30.00/M $45.00/M
GPT-5.6 Terra $2.00/M $4.00/M $12.00/M $18.00/M
GPT-5.6 Luna $0.20/M $0.40/M $1.20/M $1.80/M

适用场景:文档分析或多轮对话超过 270K 时,账单会自动按长上下文计费。建议用缓存策略压缩重复上下文。

3. Prompt Caching 官方规则与 10% 折扣详解

Prompt Caching(提示缓存)是 GPT-5.6 新增强力功能,系统提示或稳定前缀可重复命中。官方规则:

  • 缓存命中(Cached input):仅收取 10% 标准输入价(90% 折扣)。
  • 缓存写入(Cache writes):1.25 倍 uncached 输入价(一次性写成本)。
  • 写入后 30 分钟内可复用,建议将稳定指令(如系统提示、RAG 文档)前置缓存。

详细拆解

模型 标准输入 $/M 缓存命中 $/M 缓存写入 $/M 缓存命中折扣
GPT-5.6 Sol $5.00 $0.50 $6.25 90%
GPT-5.6 Terra $2.00 $0.20 $2.50 90%
GPT-5.6 Luna $0.20 $0.02 $0.25 90%

中文场景举例:企业知识库前置 100K tokens 缓存,单次请求命中 80%,可将输入成本从 $2/M 降至 $0.16/M(Terra)。缓存命中率越高,节省越明显,适合企业知识问答、代码仓库分析。

4. Batch API 50% 折扣如何触发与适用场景

Batch API 支持异步批量处理,输入与输出可享受 50% 折扣(仅限标准处理模式)。触发条件:上传 JSONL 文件,分批提交,不需要实时响应。

适用场景:批量总结、数据清洗、代码审查。示例:

  • 1000 条输入 + 2000 条输出单次请求:标准 Terra 约 $14.4,Batch 后仅 $7.2。
  • 适合高量数据处理(如日志分析、客户支持历史记录),异步运行,24 小时内完成。

注意:Batch 仅限输入输出,不包括缓存写入或长上下文溢价。

5. 2026 7 月 30 日价格调整前后对比

2026-07-30 调整后(Luna 降 80%、Terra 降 20%)与调整前对比:

模型 调整前输入 $/M 调整前输出 $/M 调整后输入 $/M 调整后输出 $/M 变化幅度
GPT-5.6 Sol $5.00 $30.00 $5.00 $30.00 无变化
GPT-5.6 Terra $2.50 $15.00 $2.00 $12.00 -20%
GPT-5.6 Luna $1.00 $6.00 $0.20 $1.20 -80%

对账单影响:Terra 和 Luna 使用量大幅下降,账单成本显著降低。Plus/Consumer 计划订阅不变,API 账单直接受益。

6. 单次请求预算计算公式与中文场景举例

预算计算公式(美元):


成本 = (输入 tokens × 输入价 / 1,000,000) + (输出 tokens × 输出价 / 1,000,000)

  • 缓存命中额外优惠:命中部分按缓存价计。
  • 长上下文:>270K 时输入价翻倍。
  • Batch:总输入输出 × 0.5。

中文场景举例(Terra 模型):

  • 场景:企业知识库问答,输入 50K tokens(缓存命中 30K),输出 2K tokens。
  • 标准:50K×$2 + 2K×$12 = $0.12(缓存命中部分节省)。
  • 实际账单:缓存命中 30K 只收 $0.006,合计约 $0.018(接近 90% 折扣)。
  • 对比 Plus 订阅:同一任务可能消耗 1 小时信用额度,API 按量计费更透明。

7. 工具调用与 multimodal 额外费用

  • 工具调用(web search、computer use 等):额外 $2.50–$10 / 1k calls(视工具而定)。
  • Multimodal 输入:图像/视频按对应模型价计费,无额外输出费用。
  • Web search:$10 / 1k calls + 搜索内容按模型价。

这些额外费用在账单中单独列出,建议在调用前确认。

8. 快速对账清单:如何从账单字段读懂

对账单时重点看以下字段:

账单字段 含义与判断 建议操作
model 选择 Sol/Terra/Luna 确认是否正确路由
input / output Token 数量 计算基础成本
cached_input 缓存命中量 检查折扣是否正确应用
cache_writes 写入成本 验证 1.25x 规则
total 合计 快速核对
service_tier Standard/Batch Batch 享 50% 折扣
context_length 输入长度 判断长上下文溢价

操作建议:每月导出账单,用 Excel 公式汇总,按模型分组,重点关注缓存命中率 >30% 的任务。

---

延伸阅读

风险与边界

本指南基于 OpenAI 官方公开信息整理,仅供参考。请以 OpenAI 官方定价页面 为准。非法律意见声明:OpenAICN 提供的是公开信息指导,不构成任何法律、税务或商业建议。本站不提供代充、代购或账号服务,价格以官方公布为准。