跳转到内容
打开 Castaly控制台

站点特色

缓存命中保障

受保障的 OpenAI 分组设有每日最低缓存命中率,未达部分补回。

提示缓存能降低重复输入 Token 的价格,但命中率取决于上游线路,不取决于你的客户端。因此有三个 OpenAI 路由分组设有对外公布的每日最低缓存命中率:

分组 每日目标
openai-award 65%
openai-stable 75%
openai-premium 85%

如果某个 UTC 自然日实测命中率低于目标,距离目标还差的那部分 Token,会按这些请求上缓存未命中与缓存读取之间的价差补回。

  • 请求里带上 prompt_cache_key。Chat Completions 和 Responses 都接受该字段;不带的请求不计入。
  • 保持该 key 对应的前缀稳定,和使用任何提示缓存时一样。
  • 使用上表中的分组。
  • 仅限普通文本输入。会计入图片 Token、音频 Token 或缓存写入的请求不在范围内,因为它们的计价无法共用同一套文本 Token 口径的比较。

一个序列(同一账号、同一个 prompt_cache_key、同一个模型)要先出现至少一次真实的缓存读取,证明该前缀确实可缓存,之后才开始计入;其可计入的输入量以该序列中实际从缓存读到的最大前缀为上限。

每个窗口是 UTC 自然日 [00:00, 24:00)。已结束当日的计算从 00:10 UTC 开始。审核通过的补偿会记入账户余额,同时补回发起这些请求的那把 Key 的剩余额度。

用量页面的 Cache Hit Guarantee 卡片会按分组展示每日目标、实测命中率,以及所选时间范围内已补偿的金额。

随用量凭证一起保存的只有 prompt_cache_key 的带密钥哈希。原始值永远不会写入数据库;该保护不可用时,本站也不会对外宣称提供这项保障。