DeepSeek 已正式发布 DeepSeek-V4-Pro 版本。随着这次最新发布,DeepSeek 宣布更新 API 定价结构,引入峰时和非峰时方案。
这项新定价政策将于北京时间 2026 年 8 月 17 日 00:00(即 UTC 时间 2026 年 8 月 16 日 16:00)生效。根据新规则,在非峰时时段使用 API 将比峰时费率享受 50% 的折扣。
模型规格与主要特性
DeepSeek-V4 提供两个主要版本:DeepSeek-V4-Flash 专注于速度效率,DeepSeek-V4-Pro 专注于高推理性能。两个模型均支持思考模式和非思考模式(默认启用思考模式)。
模型详情摘要
| 参数/特性 | DeepSeek-V4-Flash | DeepSeek-V4-Pro |
|---|---|---|
| 模型版本 | DeepSeek-V4-Flash-0731 |
DeepSeek-V4-Pro-0813 |
| 基础 URL(OpenAI) | https://api.deepseek.com |
https://api.deepseek.com |
| 基础 URL(Anthropic) | https://api.deepseek.com/anthropic |
https://api.deepseek.com/anthropic |
| 上下文长度 | 1,000,000 个令牌(1M) | 1,000,000 个令牌(1M) |
| 最大输出令牌 | 最多 384,000 个令牌(384K) | 最多 384,000 个令牌(384K) |
| 并发限制 | 2,500 | 500 |
| 支持的特性 | JSON 输出、工具调用、Responses API、Anthropic API、聊天前缀补全(Beta)、FIM 补全(Beta)* | JSON 输出、工具调用、Responses API、Anthropic API、聊天前缀补全(Beta)、FIM 补全(Beta)* |
*\FIM 补全(Beta)功能仅在非思考模式下可用。
API 定价结构调整(每 1M 个令牌)
计费基于输入和输出令牌的累计数量。上下文缓存功能继续为成功存储在缓存中的输入令牌(缓存命中)提供大幅节省。
1. 当前标准定价
| 模型变体 | 1M 输入(缓存命中) | 1M 输入(缓存未命中) | 1M 输出令牌 |
|---|---|---|---|
| DeepSeek-V4-Flash | $0.0028 | $0.14 | $0.28 |
| DeepSeek-V4-Pro | $0.003625 | $0.435 | $0.87 |
2. 新定价:峰时与非峰时方案
自 UTC 时间 2026 年 8 月 16 日 16:00(2026 年 8 月 17 日 00:00 WIB/北京时间)起,计费将根据 API 调用的时间进行调整。
峰时时段:
- 01:00 – 04:00 UTC(08:00 – 11:00 WIB)
- 06:00 – 10:00 UTC(13:00 – 17:00 WIB)
此范围之外的所有时段均归类为*非峰时,价格便宜 50%。*
基于使用时段的定价表
| 模型 | 时段状态 | 输入(缓存命中)/ 1M | 输入(缓存未命中)/ 1M | 输出 / 1M |
|---|---|---|---|---|
| deepseek-v4-flash | 非峰时 | $0.007 | $0.22 | $0.66 |
| 峰时 | $0.014 | $0.44 | $1.32 | |
| deepseek-v4-pro | 非峰时 | $0.022 | $0.66 | $1.98 |
| 峰时 | $0.044 | $1.32 | $3.96 |
余额扣除规则与省钱技巧
- 自动扣除系统: 费用按公式 费用 = 令牌数量 × 单价 计算。该费用直接从存款余额(充值余额)或赠金余额(赠送余额)中扣除。如果两者都有,系统会优先扣除赠送余额。
- 调用时间优化(批量任务): 对于大规模工作负载,如批量文档处理、数据提取或索引,安排任务在非峰时时段执行,可将运营成本降低最多一半。
- 利用上下文缓存: 尽可能多地使用重复的提示词(长系统提示词或参考文档),以更经济的价格触发缓存命中。
- 定期查看价格: DeepSeek 保留随时调整产品价格的权利。建议开发者根据实际需求充值余额,并定期查看官方定价文档页面。
Tags:
#编程
W
作者
Wilan
巴厘岛Tekno的常驻撰稿人,积极分享技术、编程和软件工程领域的知识。
返回首页
最后更新日期:2026年8月13日