刷新

2026 OpenAI Prompt Caching 官方价格表:缓存命中率门槛与实时对比

内容刷新 / GEO:补 English summary 与最新核对清单 — oa-cache-price-2026

返回指南列表

封面:2026 OpenAI Prompt Caching 官方价格表:缓存命中率门槛与实时对比

## 2026 OpenAI Prompt Caching 官方价格表:缓存命中率门槛与实时对比

## 现状与数据更新

OpenAI Prompt Caching 功能在 2026 年已全面成熟,允许开发者将提示词中的稳定前缀(例如固定的系统指令或工具描述)缓存起来。后续请求仅处理动态后缀部分,从而显著降低延迟和费用。

缓存命中率是决定效果的关键指标:命中率越高,实际支付成本越低。OpenAI 官方未设置强制门槛,但最佳实践推荐命中率达到 30% 以上时,缓存带来的节省才开始显现(低于 20% 时可能接近免费缓存的额外开销)。

根据 2026 年 9 月官方数据,缓存输入(Cached input)的单价是标准输入单价的 1/10。例如:

  • GPT-5 系列模型:输入 $0.625 /M,缓存输入 $0.0625 /M。
  • GPT-5-mini:输入 $0.125 /M,缓存输入 $0.0125 /M。
  • GPT-5-nano:输入 $0.025 /M,缓存输入 $0.0025 /M。

输出价格不分缓存,维持原有 $5.00 /M(以 GPT-5 为例)。这些价格以平台.openai.com 官网 2026 年 9 月 23 日挂牌数据为准,实际以账户或控制台显示为准。

核对清单

1. 验证缓存命中率

在 OpenAI API 响应中查看 usage.prompt_tokens_details.cached_tokens,计算:

(cached_tokens / total_input_tokens) × 100% = 命中率

2. 确认缓存键一致性

使用 prompt_cache_key 参数,确保前后提示中相同前缀的 key 完全一致(长度建议 32-128 字符)。不同 key = 缓存命中失败。

3. 检查缓存 TTL(生存时间)

默认缓存有效期随请求间隔动态刷新(1-24 小时不等),检查日志或控制台的缓存状态,确认未过期。

4. 实测单价对比

用你的 API 密钥在官方控制台或 https://www.openaicn.cn/official-prices 查看,输入 vs 缓存 vs 输出三栏数据比对。

5. 提示结构优化

  • 系统提示 + 工具描述放前缀,动态用户消息放后缀。
  • 保持前缀长度 1k+ tokens 以充分利用缓存。
  • 切换到 GPT-5 系列或更高模型后,缓存命中率通常提升 20-30%。

建议通过 /api-transit 或 /examples 页面快速验证你的具体提示结构。

风险与边界

缓存命中率若长期低于 20%,缓存反而可能增加账单(平台缓存开销未完全抵消)。动态提示(含随机值或用户输入)会导致命中失败,消耗标准输入价格。长期使用大量静态前缀会占用服务器缓存资源,可能影响账户配额或出现异常。

注意:以上内容仅供参考,不构成法律意见或财务建议,请以 OpenAI 官方平台实际账单为准。

站内路径

延伸阅读

English summary

OpenAI Prompt Caching, fully matured in 2026, caches stable prompt prefixes (system prompts, tools) so only dynamic suffixes are processed in subsequent requests. This delivers up to 90% cost savings and 80% lower latency when cache hit rate exceeds 30%. Official pricing sets cached input at exactly 1/10 of standard input (e.g., GPT-5: $0.625/M input vs $0.0625/M cached). Output pricing remains unchanged. Cache hit rate is measured via cached_tokens in API response; key consistency via prompt_cache_key and TTL refresh are critical. Low hit rates (<20%) may increase costs; dynamic content breaks caching. Data current as of September 23, 2026 from platform.openai.com—always verify in your account dashboard. For detailed token cost calculations, see https://www.openaicn.cn/official-prices. This guide helps API users reconcile bills and decide when caching is worthwhile.