返回首页
API 定价

DeepSeek V4 Flash API 定价

高峰 ¥2.00 输入 · ¥8.00 输出/百万 token — 闲时 5 折。全球使用率最高的编程模型。

DeepSeek V4 Flash 已悄然成为全球使用率最高的编程模型——在 OpenCode Go 上占据 69% 的 token 份额。它拥有 100 万 token 上下文窗口、96% 的真实缓存命中率,以及媲美旗舰模型的推理分数,价格却让它成为高并发 AI 负载的默认主力。

估算我的成本价格截至 2026 年 9 月

每百万 token 价格

DeepSeek V4 Flash · CNY 官方单价

类型单价
输入高峰 ¥2.00 · 闲时 ¥1.00
输出高峰 ¥8.00 · 闲时 ¥4.00
缓存命中高峰 ¥0.04 · 闲时 ¥0.02

DeepSeek 官方价格以 CNY 维护,USD 按 ≈ 6.9 汇率折算


适合场景

1

96% 缓存命中率

OpenCode Go 上的真实缓存命中率达 96%,大部分输入走缓存通道,高峰仅 ¥0.04/百万。

2

100 万上下文

100 万 token 上下文窗口,整个代码库和长对话都能放进一次请求。

3

100/100 推理

标准化推理分数 100/100——以零头的价格给出旗舰级的推理能力。


适合场景

高并发编程 agent、批量摘要、RAG 流水线,以及任何「每 token 成本比绝对上限更重要」的重复工作流。输入仍比 V4 Pro 便宜约 4 倍(输出约 3.4 倍),是当前市场上最好的日常 agent 模型。


计费说明

高峰 / 闲时计费

高峰时段为北京时间 09:00–12:00 和 14:00–18:00,按全价计费;其余时间一律 5 折。缓存命中输入按未命中价的 1/50 计费(高峰 ¥0.04 vs ¥2.00)。


与竞品对比

V4 Flash 与竞品对比

闲时价下,V4 Flash 输出 ¥4.00(约 $0.58)/百万——低于 GPT-5.6 Luna 的 $1.20,更远低于 V4 Pro 高峰的 ¥8.00。在缓存输入经济和上下文长度上均优于 OpenAI 与 Anthropic 的同类模型。


常见问题

DeepSeek V4 Flash 每百万 token 多少钱?

DeepSeek V4 Flash 高峰时段(北京时间 09:00–12:00 与 14:00–18:00)输入 ¥2.00/百万、输出 ¥8.00/百万;闲时减半,输入 ¥1.00、输出 ¥4.00。缓存命中输入仅 ¥0.04/百万(闲时 ¥0.02),约为未命中单价的 1/50。

DeepSeek V4 Flash 真的便宜到能支撑生产环境吗?

能。V4 Flash 拥有 100 万 token 上下文窗口、96% 的真实缓存命中率和接近旗舰模型的推理分数,已成为全球使用率最高的编程模型(占 OpenCode Go 69% 的 token 用量)。对高并发常规任务,它就是成本规划的下限。

V4 Flash 的高峰/闲时定价如何影响成本?

DeepSeek 把一天分成两半:高峰时段为北京时间 09:00–12:00 和 14:00–18:00,按全价计费;其余时间一律 5 折。每晚批量任务生成 1 亿输出 token,高峰需 ¥800,晚 8 点后只要 ¥400——同样的 token,零代码改动。


相关模型定价

将该模型与系列其他模型横向对比。


估算你的实际成本

用交互式价格计算器,按你自己的输入/输出 token 量、缓存命中率和高峰占比,对比任意模型组合的成本。

打开价格计算器

我们正在使用的好工具

我们正在使用这些工具自己进行开发和部署,好用,就推荐了。