> ## Documentation Index
> Fetch the complete documentation index at: https://docs.rockapi.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# DeepSeek V4 Pro 与 V4 Flash API 价格：峰谷时段均享官方价 7 折

> 对比 DeepSeek V4 Pro、V4 Flash 官方峰谷价格与 Rock API 7 折价格，并通过错峰调度进一步降低模型调用成本。

# DeepSeek V4 Pro 与 V4 Flash API 价格：峰谷时段均享官方价 7 折

Rock API 提供 `deepseek-v4-pro` 和 `deepseek-v4-flash`，按 **DeepSeek 官方对应时段价格的 70%** 计费。官方进入高峰时段时使用高峰 7 折价，其余时间使用谷时 7 折价，不会把两个时段合并成一个固定价格。

*最后更新：2026 年 8 月 19 日*

<CardGroup cols={3}>
  <Card title="官方价 7 折" icon="badge-percent">
    峰时与谷时的每项 Token 单价都节省 30%。
  </Card>

  <Card title="区分峰谷时段" icon="clock-3">
    保留官方分时计费结构，让可延迟任务继续享受谷时优势。
  </Card>

  <Card title="Pro 与 Flash 可选" icon="git-compare-arrows">
    高频任务优先 Flash，复杂 Agent 与推理任务选择 Pro。
  </Card>
</CardGroup>

## Rock API 与官方峰谷价格对比

下表单位均为美元/100 万 Token。Rock API 价格按 DeepSeek 2026 年 8 月 16 日生效的官方价格乘以 0.7 计算。

| 模型与 Token 类型     |   官方谷时价 | Rock API 谷时价 |   官方峰时价 | Rock API 峰时价 |
| ---------------- | ------: | -----------: | ------: | -----------: |
| V4 Flash 缓存命中输入  | \$0.007 |     \$0.0049 | \$0.014 |     \$0.0098 |
| V4 Flash 缓存未命中输入 |  \$0.22 |      \$0.154 |  \$0.44 |      \$0.308 |
| V4 Flash 输出      |  \$0.66 |      \$0.462 |  \$1.32 |      \$0.924 |
| V4 Pro 缓存命中输入    | \$0.022 |     \$0.0154 | \$0.044 |     \$0.0308 |
| V4 Pro 缓存未命中输入   |  \$0.66 |      \$0.462 |  \$1.32 |      \$0.924 |
| V4 Pro 输出        |  \$1.98 |      \$1.386 |  \$3.96 |      \$2.772 |

DeepSeek 官方定义的高峰时段是 **UTC 01:00–04:00 和 06:00–10:00**，其他时间均为谷时。换算成台北时间（UTC+8）是 09:00–12:00 和 14:00–18:00。其他地区换算时需留意夏令时变化。

<Note>
  模型可用性和价格可能调整。生产接入前请在 Rock API 控制台确认实时模型 ID、计费单位和价格；DeepSeek 的[官方价格页](https://api-docs.deepseek.com/quick_start/pricing/)是官方基准价与时段规则的来源。
</Note>

## “7 折 + 谷时”为什么更省

Rock API 在峰时和谷时都按官方对应价格的 7 折计费，而谷时调度还能提供第二层成本优势。由于官方谷时价是峰时价的一半，Rock API 谷时价相当于官方峰时价的 35%：

```txt theme={null}
官方峰时价 × 50% × 70% = 官方峰时价 × 35%
```

例如，1 亿个 V4 Flash 输出 Token 按官方峰时价需 $132；通过 Rock API 在峰时调用为 $92.40，在谷时调用则为 \$46.20。对于可延迟任务，从 Rock API 峰时转到谷时还能再降低 50%。

适合错峰的任务包括：

* 夜间评测、回归测试和批量质量检查；
* 代码仓库索引、静态分析和长文档处理；
* 文档抽取、摘要生成和离线内容流水线；
* 没有严格交互时限的队列 Agent 任务；
* 合成数据生成与批量分类。

实时聊天等低延迟请求应按业务需要即时处理。只有能够排队的任务才适合错峰，并应监控重试和积压，避免任务意外跨入高峰时段。

## V4 Flash 与 V4 Pro 怎么选

两款模型都支持 100 万 Token 上下文、思考与非思考模式、JSON 输出、工具调用、Responses API、Anthropic API、前缀续写，以及非思考模式下的 FIM 补全。官方列出的最大输出长度为 384K Token。

| 模型                  | 更适合的场景                                         |
| ------------------- | ---------------------------------------------- |
| `deepseek-v4-flash` | 高频 Agent、信息抽取、分类、常规代码任务，以及更看重延迟和单位成本的业务。       |
| `deepseek-v4-pro`   | 复杂 Agent 流程、高难度代码任务、长链路推理，以及能力提升能减少重试或人工复核的任务。 |

官方价格页当前标注的服务版本为 DeepSeek-V4-Flash-0731 和 DeepSeek-V4-Pro-0813。DeepSeek 的[V4 更新记录](https://api-docs.deepseek.com/updates/)还说明，两款模型的思考强度支持 low、high 和 max 三档。

## 一套可执行的成本优化方案

1. 高频常规请求优先路由到 V4 Flash。
2. 仅将复杂任务或失败案例升级到 V4 Pro。
3. 复用稳定的系统提示词前缀，提高缓存命中率。
4. 按 UTC 时段把可延迟任务排入谷时队列。
5. 分别记录输入、缓存输入、输出、模型和执行时段。
6. 比较“完成一次任务的成本”，而不只比较单 Token 价格。

## 开始使用 DeepSeek V4

1. [注册 Rock API](https://rockapi.ai/sign-up?utm_source=docs\&utm_medium=referral\&utm_campaign=deepseek_v4_70_off_zh)。
2. 在控制台确认 `deepseek-v4-pro`、`deepseek-v4-flash` 当前可用，并查看实时峰谷价格。
3. 创建 API Key，并按[认证指南](/zh-cn/authentication)安全保存。
4. 根据[快速开始](/zh-cn/quickstart)发送少量测试请求，核对用量记录和计费时段。
5. 批量生产任务上线前阅读[价格与计费](/zh-cn/pricing-and-billing)。

## 常见问题

### 高峰时段也享受 7 折吗？

是。Rock API 在高峰与谷时均按 DeepSeek 官方对应时段价格的 70% 计费。

### Rock API 谷时价比官方峰时价便宜 70% 吗？

不是，而是便宜 65%。官方谷时价先降为峰时的一半，再乘以 0.7，最终是官方峰时价的 35%。

### 计费时段按哪个时区判断？

DeepSeek 按 UTC 公布时段。高峰为 UTC 01:00–04:00 和 06:00–10:00，其余均为谷时。

<Card title="查看 DeepSeek V4 实时峰谷价格" icon="rocket" href="https://rockapi.ai/sign-up?utm_source=docs&utm_medium=referral&utm_campaign=deepseek_v4_70_off_zh">
  在 Rock API 控制台确认 V4 Pro、V4 Flash 的可用状态和分时 7 折价格。
</Card>
