返回首页
术语指南

什么是 DeepSeek 缓存命中率?

DeepSeek 缓存命中率是输入 token 中按「缓存命中」低价而非全价计费的比例——越高越好,因为缓存命中输入最低仅需未命中单价的 1/50。

分析我的 DeepSeek 用量100% 本地处理,数据不出浏览器

如何计算

DeepSeek 的用量导出会为每个请求包含两行输入 token 数据:input_cache_hit_tokens(缓存命中)与 input_cache_miss_tokens(缓存未命中)。缓存命中率就是缓存命中量除以总输入 token(命中 + 未命中)。

命中率 50% 意味着一半输入 token 走了缓存通道。由于 DeepSeek 对缓存命中按未命中价的约 1/50 计费,这一个数字对账单的影响极其显著:从 20% 提升到 60%,输入成本可降低一半以上。

健康的命中率是多少

真实 DeepSeek 负载的命中率通常在 40% 到 96% 之间。例如在 OpenCode Go 上,DeepSeek V4 Flash 的真实缓存命中率达 96%,这就是它实际成本远低于标价的原因。

实用区间:低于 20% 通常意味着稳定前缀太短,或可变内容在 prompt 中太靠前;20–40% 可用但仍有空间;40–60% 很强;60%+ 对客服、模板化抽取等重复工作流非常优秀。

如何提升

DeepSeek 采用前缀匹配:从第一个 token 开始缓存计算结果,因此 prompt 开头的任何变动都会使缓存失效。保持 system prompt 固定、把动态内容放在最后、把 prompt 改动当发布版本一样管理。

查看真实命中率最直接的方式:把账单 CSV 上传到用量分析仪表盘,图表会一目了然地展示每日缓存命中率和各 Key 的命中/未命中对比。


常见问题

DeepSeek 缓存命中率越高越好吗?

是——缓存命中输入按未命中价的约 1/50 计费,命中率每提高一个百分点都在降低输入成本。更高的命中率没有坏处,唯一的问题是能否通过 prompt 结构达成。

多少算健康的 DeepSeek 缓存命中率?

真实负载通常在 40% 到 96% 之间。OpenCode Go 上的 DeepSeek V4 Flash 维持在 96%。低于 20% 说明 prompt 前缀不稳定;对多数生产团队 40% 以上即健康。

在哪里能查看我的真实缓存命中率?

把 DeepSeek 账单 CSV 上传到用量分析仪表盘即可。它从 input_cache_hit_tokens 与 input_cache_miss_tokens 两列计算命中率,并展示每日趋势和各 Key 明细。


深入阅读


相关术语

我们正在使用的好工具

我们正在使用这些工具自己进行开发和部署,好用,就推荐了。