
2026 OpenAI GPT-5.6 官方 Token 单价怎么读:输入/输出/缓存字段速查表
分类:官方API
摘要: 最新 GPT-5.6 系列(Sol/Terra/Luna)官方 $/M 价格拆解,含缓存命中折扣、Batch 折半、长上下文差异及单次请求预算示例,帮助对账单时精准分清输入输出缓存。价格已于 2026-07-30 调整(Luna 降 80%、Terra 降 20%),缓存规则明确,需精确区分 Plus 与 API 账单,避免重复付费。
slug: oa-gpt-5-6-api-price-guide
---
作为 OpenAICN 计费编辑站,OpenAI 官方 API 价格表是我们帮助对账单的权威基准。GPT-5.6 系列(Sol/Terra/Luna)已于 2026-07-30 大幅优化定价,Luna 降 80%、Terra 降 20%,缓存规则明确。本指南专为对账单、算 $/M、分清 Plus 与 API 账单设计,帮助开发者与企业精准解读账单字段,避免重复付费。
1. GPT-5.6 三大模型核心参数对比
GPT-5.6 分为 Sol(旗舰)、Terra(平衡)、Luna(高速低价)三款,适合不同工作负载。核心参数如下:
| 模型 | 主要用途 | 上下文窗口 | 最大输出 tokens | 知识截止日期 |
|---|---|---|---|---|
| GPT-5.6 Sol | 复杂代理式工作、推理重任 | 1,050,000 | 128,000 | 2026-02-16 |
| GPT-5.6 Terra | 日常高效高量任务 | 1,050,000 | 128,000 | 2026-02-16 |
| GPT-5.6 Luna | 日常工作、自动化、高速场景 | 1,050,000 | 128,000 | 2026-02-16 |
注: 所有模型支持工具调用与 multimodal 输入。Sol 为高端代理场景,Terra 为高量业务,Luna 适合成本敏感的批量处理。
2. 标准 vs 长上下文定价差异
OpenAI 明确区分短上下文(<270K tokens)和长上下文(>270K tokens)。长上下文定价提升约 100%(输入翻倍,输出 1.5 倍):
| 模型 | 短上下文输入 | 长上下文输入 | 短上下文输出 | 长上下文输出 |
|---|---|---|---|---|
| GPT-5.6 Sol | $5.00/M | $10.00/M | $30.00/M | $45.00/M |
| GPT-5.6 Terra | $2.00/M | $4.00/M | $12.00/M | $18.00/M |
| GPT-5.6 Luna | $0.20/M | $0.40/M | $1.20/M | $1.80/M |
适用场景:文档分析或多轮对话超过 270K 时,账单会自动按长上下文计费。建议用缓存策略压缩重复上下文。
3. Prompt Caching 官方规则与 10% 折扣详解
Prompt Caching(提示缓存)是 GPT-5.6 新增强力功能,系统提示或稳定前缀可重复命中。官方规则:
- 缓存命中(Cached input):仅收取 10% 标准输入价(90% 折扣)。
- 缓存写入(Cache writes):1.25 倍 uncached 输入价(一次性写成本)。
- 写入后 30 分钟内可复用,建议将稳定指令(如系统提示、RAG 文档)前置缓存。
详细拆解:
| 模型 | 标准输入 $/M | 缓存命中 $/M | 缓存写入 $/M | 缓存命中折扣 |
|---|---|---|---|---|
| GPT-5.6 Sol | $5.00 | $0.50 | $6.25 | 90% |
| GPT-5.6 Terra | $2.00 | $0.20 | $2.50 | 90% |
| GPT-5.6 Luna | $0.20 | $0.02 | $0.25 | 90% |
中文场景举例:企业知识库前置 100K tokens 缓存,单次请求命中 80%,可将输入成本从 $2/M 降至 $0.16/M(Terra)。缓存命中率越高,节省越明显,适合企业知识问答、代码仓库分析。
4. Batch API 50% 折扣如何触发与适用场景
Batch API 支持异步批量处理,输入与输出可享受 50% 折扣(仅限标准处理模式)。触发条件:上传 JSONL 文件,分批提交,不需要实时响应。
适用场景:批量总结、数据清洗、代码审查。示例:
- 1000 条输入 + 2000 条输出单次请求:标准 Terra 约 $14.4,Batch 后仅 $7.2。
- 适合高量数据处理(如日志分析、客户支持历史记录),异步运行,24 小时内完成。
注意:Batch 仅限输入输出,不包括缓存写入或长上下文溢价。
5. 2026 7 月 30 日价格调整前后对比
2026-07-30 调整后(Luna 降 80%、Terra 降 20%)与调整前对比:
| 模型 | 调整前输入 $/M | 调整前输出 $/M | 调整后输入 $/M | 调整后输出 $/M | 变化幅度 |
|---|---|---|---|---|---|
| GPT-5.6 Sol | $5.00 | $30.00 | $5.00 | $30.00 | 无变化 |
| GPT-5.6 Terra | $2.50 | $15.00 | $2.00 | $12.00 | -20% |
| GPT-5.6 Luna | $1.00 | $6.00 | $0.20 | $1.20 | -80% |
对账单影响:Terra 和 Luna 使用量大幅下降,账单成本显著降低。Plus/Consumer 计划订阅不变,API 账单直接受益。
6. 单次请求预算计算公式与中文场景举例
预算计算公式(美元):
成本 = (输入 tokens × 输入价 / 1,000,000) + (输出 tokens × 输出价 / 1,000,000)
- 缓存命中额外优惠:命中部分按缓存价计。
- 长上下文:>270K 时输入价翻倍。
- Batch:总输入输出 × 0.5。
中文场景举例(Terra 模型):
- 场景:企业知识库问答,输入 50K tokens(缓存命中 30K),输出 2K tokens。
- 标准:50K×$2 + 2K×$12 = $0.12(缓存命中部分节省)。
- 实际账单:缓存命中 30K 只收 $0.006,合计约 $0.018(接近 90% 折扣)。
- 对比 Plus 订阅:同一任务可能消耗 1 小时信用额度,API 按量计费更透明。
7. 工具调用与 multimodal 额外费用
- 工具调用(web search、computer use 等):额外 $2.50–$10 / 1k calls(视工具而定)。
- Multimodal 输入:图像/视频按对应模型价计费,无额外输出费用。
- Web search:$10 / 1k calls + 搜索内容按模型价。
这些额外费用在账单中单独列出,建议在调用前确认。
8. 快速对账清单:如何从账单字段读懂
对账单时重点看以下字段:
| 账单字段 | 含义与判断 | 建议操作 |
|---|---|---|
model |
选择 Sol/Terra/Luna | 确认是否正确路由 |
input / output |
Token 数量 | 计算基础成本 |
cached_input |
缓存命中量 | 检查折扣是否正确应用 |
cache_writes |
写入成本 | 验证 1.25x 规则 |
total |
合计 | 快速核对 |
service_tier |
Standard/Batch | Batch 享 50% 折扣 |
context_length |
输入长度 | 判断长上下文溢价 |
操作建议:每月导出账单,用 Excel 公式汇总,按模型分组,重点关注缓存命中率 >30% 的任务。
---
延伸阅读
风险与边界
本指南基于 OpenAI 官方公开信息整理,仅供参考。请以 OpenAI 官方定价页面 为准。非法律意见声明:OpenAICN 提供的是公开信息指导,不构成任何法律、税务或商业建议。本站不提供代充、代购或账号服务,价格以官方公布为准。