Skip to main content

DeepSeek V4 Pro 与 V4 Flash API 价格:峰谷时段均享官方价 7 折

Rock API 提供 deepseek-v4-prodeepseek-v4-flash,按 DeepSeek 官方对应时段价格的 70% 计费。官方进入高峰时段时使用高峰 7 折价,其余时间使用谷时 7 折价,不会把两个时段合并成一个固定价格。 最后更新:2026 年 8 月 19 日

官方价 7 折

峰时与谷时的每项 Token 单价都节省 30%。

区分峰谷时段

保留官方分时计费结构,让可延迟任务继续享受谷时优势。

Pro 与 Flash 可选

高频任务优先 Flash,复杂 Agent 与推理任务选择 Pro。

Rock API 与官方峰谷价格对比

下表单位均为美元/100 万 Token。Rock API 价格按 DeepSeek 2026 年 8 月 16 日生效的官方价格乘以 0.7 计算。 DeepSeek 官方定义的高峰时段是 UTC 01:00–04:00 和 06:00–10:00,其他时间均为谷时。换算成台北时间(UTC+8)是 09:00–12:00 和 14:00–18:00。其他地区换算时需留意夏令时变化。
模型可用性和价格可能调整。生产接入前请在 Rock API 控制台确认实时模型 ID、计费单位和价格;DeepSeek 的官方价格页是官方基准价与时段规则的来源。

“7 折 + 谷时”为什么更省

Rock API 在峰时和谷时都按官方对应价格的 7 折计费,而谷时调度还能提供第二层成本优势。由于官方谷时价是峰时价的一半,Rock API 谷时价相当于官方峰时价的 35%:
例如,1 亿个 V4 Flash 输出 Token 按官方峰时价需 132;通过RockAPI在峰时调用为132;通过 Rock API 在峰时调用为 92.40,在谷时调用则为 $46.20。对于可延迟任务,从 Rock API 峰时转到谷时还能再降低 50%。 适合错峰的任务包括:
  • 夜间评测、回归测试和批量质量检查;
  • 代码仓库索引、静态分析和长文档处理;
  • 文档抽取、摘要生成和离线内容流水线;
  • 没有严格交互时限的队列 Agent 任务;
  • 合成数据生成与批量分类。
实时聊天等低延迟请求应按业务需要即时处理。只有能够排队的任务才适合错峰,并应监控重试和积压,避免任务意外跨入高峰时段。

V4 Flash 与 V4 Pro 怎么选

两款模型都支持 100 万 Token 上下文、思考与非思考模式、JSON 输出、工具调用、Responses API、Anthropic API、前缀续写,以及非思考模式下的 FIM 补全。官方列出的最大输出长度为 384K Token。 官方价格页当前标注的服务版本为 DeepSeek-V4-Flash-0731 和 DeepSeek-V4-Pro-0813。DeepSeek 的V4 更新记录还说明,两款模型的思考强度支持 low、high 和 max 三档。

一套可执行的成本优化方案

  1. 高频常规请求优先路由到 V4 Flash。
  2. 仅将复杂任务或失败案例升级到 V4 Pro。
  3. 复用稳定的系统提示词前缀,提高缓存命中率。
  4. 按 UTC 时段把可延迟任务排入谷时队列。
  5. 分别记录输入、缓存输入、输出、模型和执行时段。
  6. 比较“完成一次任务的成本”,而不只比较单 Token 价格。

开始使用 DeepSeek V4

  1. 注册 Rock API
  2. 在控制台确认 deepseek-v4-prodeepseek-v4-flash 当前可用,并查看实时峰谷价格。
  3. 创建 API Key,并按认证指南安全保存。
  4. 根据快速开始发送少量测试请求,核对用量记录和计费时段。
  5. 批量生产任务上线前阅读价格与计费

常见问题

高峰时段也享受 7 折吗?

是。Rock API 在高峰与谷时均按 DeepSeek 官方对应时段价格的 70% 计费。

Rock API 谷时价比官方峰时价便宜 70% 吗?

不是,而是便宜 65%。官方谷时价先降为峰时的一半,再乘以 0.7,最终是官方峰时价的 35%。

计费时段按哪个时区判断?

DeepSeek 按 UTC 公布时段。高峰为 UTC 01:00–04:00 和 06:00–10:00,其余均为谷时。

查看 DeepSeek V4 实时峰谷价格

在 Rock API 控制台确认 V4 Pro、V4 Flash 的可用状态和分时 7 折价格。