站点特色
缓存命中保障
受保障的 OpenAI 分组设有每日最低缓存命中率,未达部分补回。
提示缓存能降低重复输入 Token 的价格,但命中率取决于上游线路,不取决于你的客户端。因此有三个 OpenAI 路由分组设有对外公布的每日最低缓存命中率:
| 分组 | 每日目标 |
|---|---|
openai-award |
65% |
openai-stable |
75% |
openai-premium |
85% |
如果某个 UTC 自然日实测命中率低于目标,距离目标还差的那部分 Token,会按这些请求上缓存未命中与缓存读取之间的价差补回。
让请求进入保障范围
Section titled “让请求进入保障范围”- 请求里带上
prompt_cache_key。Chat Completions 和 Responses 都接受该字段;不带的请求不计入。 - 保持该 key 对应的前缀稳定,和使用任何提示缓存时一样。
- 使用上表中的分组。
- 仅限普通文本输入。会计入图片 Token、音频 Token 或缓存写入的请求不在范围内,因为它们的计价无法共用同一套文本 Token 口径的比较。
一个序列(同一账号、同一个 prompt_cache_key、同一个模型)要先出现至少一次真实的缓存读取,证明该前缀确实可缓存,之后才开始计入;其可计入的输入量以该序列中实际从缓存读到的最大前缀为上限。
每个窗口是 UTC 自然日 [00:00, 24:00)。已结束当日的计算从 00:10 UTC 开始。审核通过的补偿会记入账户余额,同时补回发起这些请求的那把 Key 的剩余额度。
用量页面的 Cache Hit Guarantee 卡片会按分组展示每日目标、实测命中率,以及所选时间范围内已补偿的金额。
随用量凭证一起保存的只有 prompt_cache_key 的带密钥哈希。原始值永远不会写入数据库;该保护不可用时,本站也不会对外宣称提供这项保障。