2026 OpenAI Prompt Caching 官方价格表:缓存命中率门槛与实时对比
内容刷新 / GEO:补 English summary 与最新核对清单 — oa-cache-price-2026
ガイド一覧 · 本文は主に簡体字中国語です。国際向けの要点は English summary をご利用ください。

## 2026 OpenAI Prompt Caching 官方价格表:缓存命中率门槛与实时对比
## 现状与数据更新
OpenAI Prompt Caching 功能在 2026 年已全面成熟,允许开发者将提示词中的稳定前缀(例如固定的系统指令或工具描述)缓存起来。后续请求仅处理动态后缀部分,从而显著降低延迟和费用。
缓存命中率是决定效果的关键指标:命中率越高,实际支付成本越低。OpenAI 官方未设置强制门槛,但最佳实践推荐命中率达到 30% 以上时,缓存带来的节省才开始显现(低于 20% 时可能接近免费缓存的额外开销)。
根据 2026 年 9 月官方数据,缓存输入(Cached input)的单价是标准输入单价的 1/10。例如:
- GPT-5 系列模型:输入 $0.625 /M,缓存输入 $0.0625 /M。
- GPT-5-mini:输入 $0.125 /M,缓存输入 $0.0125 /M。
- GPT-5-nano:输入 $0.025 /M,缓存输入 $0.0025 /M。
输出价格不分缓存,维持原有 $5.00 /M(以 GPT-5 为例)。这些价格以平台.openai.com 官网 2026 年 9 月 23 日挂牌数据为准,实际以账户或控制台显示为准。
核对清单
1. 验证缓存命中率
在 OpenAI API 响应中查看 usage.prompt_tokens_details.cached_tokens,计算:
(cached_tokens / total_input_tokens) × 100% = 命中率
2. 确认缓存键一致性
使用 prompt_cache_key 参数,确保前后提示中相同前缀的 key 完全一致(长度建议 32-128 字符)。不同 key = 缓存命中失败。
3. 检查缓存 TTL(生存时间)
默认缓存有效期随请求间隔动态刷新(1-24 小时不等),检查日志或控制台的缓存状态,确认未过期。
4. 实测单价对比
用你的 API 密钥在官方控制台或 https://www.openaicn.cn/official-prices 查看,输入 vs 缓存 vs 输出三栏数据比对。
5. 提示结构优化
- 系统提示 + 工具描述放前缀,动态用户消息放后缀。
- 保持前缀长度 1k+ tokens 以充分利用缓存。
- 切换到 GPT-5 系列或更高模型后,缓存命中率通常提升 20-30%。
建议通过 /api-transit 或 /examples 页面快速验证你的具体提示结构。
风险与边界
缓存命中率若长期低于 20%,缓存反而可能增加账单(平台缓存开销未完全抵消)。动态提示(含随机值或用户输入)会导致命中失败,消耗标准输入价格。长期使用大量静态前缀会占用服务器缓存资源,可能影响账户配额或出现异常。
注意:以上内容仅供参考,不构成法律意见或财务建议,请以 OpenAI 官方平台实际账单为准。