高峰 ¥2.00 输入 · ¥8.00 输出/百万 token — 闲时 5 折。全球使用率最高的编程模型。
DeepSeek V4 Flash 已悄然成为全球使用率最高的编程模型——在 OpenCode Go 上占据 69% 的 token 份额。它拥有 100 万 token 上下文窗口、96% 的真实缓存命中率,以及媲美旗舰模型的推理分数,价格却让它成为高并发 AI 负载的默认主力。
DeepSeek V4 Flash · CNY 官方单价
| 类型 | 单价 |
|---|---|
| 输入 | 高峰 ¥2.00 · 闲时 ¥1.00 |
| 输出 | 高峰 ¥8.00 · 闲时 ¥4.00 |
| 缓存命中 | 高峰 ¥0.04 · 闲时 ¥0.02 |
DeepSeek 官方价格以 CNY 维护,USD 按 ≈ 6.9 汇率折算
OpenCode Go 上的真实缓存命中率达 96%,大部分输入走缓存通道,高峰仅 ¥0.04/百万。
100 万 token 上下文窗口,整个代码库和长对话都能放进一次请求。
标准化推理分数 100/100——以零头的价格给出旗舰级的推理能力。
高并发编程 agent、批量摘要、RAG 流水线,以及任何「每 token 成本比绝对上限更重要」的重复工作流。输入仍比 V4 Pro 便宜约 4 倍(输出约 3.4 倍),是当前市场上最好的日常 agent 模型。
高峰时段为北京时间 09:00–12:00 和 14:00–18:00,按全价计费;其余时间一律 5 折。缓存命中输入按未命中价的 1/50 计费(高峰 ¥0.04 vs ¥2.00)。
闲时价下,V4 Flash 输出 ¥4.00(约 $0.58)/百万——低于 GPT-5.6 Luna 的 $1.20,更远低于 V4 Pro 高峰的 ¥8.00。在缓存输入经济和上下文长度上均优于 OpenAI 与 Anthropic 的同类模型。
DeepSeek V4 Flash 高峰时段(北京时间 09:00–12:00 与 14:00–18:00)输入 ¥2.00/百万、输出 ¥8.00/百万;闲时减半,输入 ¥1.00、输出 ¥4.00。缓存命中输入仅 ¥0.04/百万(闲时 ¥0.02),约为未命中单价的 1/50。
能。V4 Flash 拥有 100 万 token 上下文窗口、96% 的真实缓存命中率和接近旗舰模型的推理分数,已成为全球使用率最高的编程模型(占 OpenCode Go 69% 的 token 用量)。对高并发常规任务,它就是成本规划的下限。
DeepSeek 把一天分成两半:高峰时段为北京时间 09:00–12:00 和 14:00–18:00,按全价计费;其余时间一律 5 折。每晚批量任务生成 1 亿输出 token,高峰需 ¥800,晚 8 点后只要 ¥400——同样的 token,零代码改动。
将该模型与系列其他模型横向对比。
用交互式价格计算器,按你自己的输入/输出 token 量、缓存命中率和高峰占比,对比任意模型组合的成本。
打开价格计算器我们正在使用这些工具自己进行开发和部署,好用,就推荐了。
订阅时,您可获得 $5,直接抵消首月 go 费用。
可能是全球最便宜的 deepseek v4 flash 模型调用。
获得 $300 测试 Vultr 云平台
被推荐用户需活跃 30 天以上且消费 $10–$25
无需复杂性即可部署任何内容(我们的各种前/后端服务和容器)
连接您的代码仓库,Railway 会处理其余部分
云服务器、云数据库、COS、CDN、短信等云产品特惠热卖中
AWS的优质替代品,我们应用COS替代S3
¥16 元全平台通用代金券,领取之日起 180 天内有效
全场景产品矩阵,支撑 AI 应用全流程落地
世界上最好用的 AI 终端工具之一
我们可以直接在 Warp 中使用各种顶级模型,而不离开终端