DeepSeek 2026 年 8 月涨价后还有性价比吗?
DeepSeek V4 Flash 与 Pro 已启用峰谷 API 价格。对比 GPT-5.6 Luna、Mistral Small 4、Gemini 3.7 Flash 和 GLM-5.2,判断涨价后是否仍值得用。
DeepSeek 仍有性价比,但已经不再是所有文本工作负载下都稳赢的最低价 API。V4 新价格于 北京时间 2026 年 8 月 17 日 00:00 生效。北京时间 09:00-12:00 和 14:00-18:00 按高峰价计费,其余时间的闲时价为高峰价的 50%。
简短结论是:V4 Flash 在闲时、缓存比例高、需要 1M 上下文的 Agent 中仍有优势;普通短上下文流量下,Mistral Small 4 已可能更便宜。V4 Pro 则必须靠更高任务成功率证明价格。
DeepSeek V4 最新 API 价格
美元价格,单位为每百万 Token:
| 模型与时段 | 缓存输入 | 缓存未命中输入 | 输出 |
|---|---|---|---|
| DeepSeek V4 Flash,闲时 | $0.007 | $0.22 | $0.66 |
| DeepSeek V4 Flash,高峰 | $0.014 | $0.44 | $1.32 |
| DeepSeek V4 Pro,闲时 | $0.022 | $0.66 | $1.98 |
| DeepSeek V4 Pro,高峰 | $0.044 | $1.32 | $3.96 |
两个端点都保持 1M 上下文和 384K 最大输出。deepseek-v4-flash 当前服务 DeepSeek-V4-Flash-0731,deepseek-v4-pro 已升级到 DeepSeek-V4-Pro-0813。
“高峰 2 倍价”不能理解成旧价格统一翻倍。相对上一版价格,Flash 闲时缓存未命中输入上涨约 57%,闲时输出上涨约 136%;高峰输出则是旧输出价的 4.71 倍。Pro 的缓存价格变化更大。
同一工作负载的新账单
按跨多个请求累计 200 万缓存未命中输入 + 50 万输出 Token:
| 模型 | 成本 |
|---|---|
| Mistral Small 4 | $0.60 |
| DeepSeek V4 Flash,闲时 | $0.77 |
| GPT-5.6 Luna | $1.00 |
| DeepSeek V4 Flash,高峰 | $1.54 |
| DeepSeek V4 Pro,闲时 | $2.31 |
| Gemini 3.7 Flash,2026 引导价 | $3.38 |
| DeepSeek V4 Pro,高峰 | $4.62 |
| GLM-5.2 | $5.00 |
这只是 Token 成本,不是质量排名。Mistral Small 4 的上下文小得多;DeepSeek 有 1M 上下文和很大的输出上限;Gemini 还支持图片、视频、音频和 Google 原生工具。实际价值不能只看几毛钱差异。
DeepSeek 仍然有优势的地方
可调度到闲时的 Agent
在上述例子里,闲时 V4 Flash 比 GPT-5.6 Luna 便宜 23%。如果异步队列能避开每天七个高峰小时,时段调度现在已经是核心成本策略。
重复的大上下文
Flash 闲时缓存输入仍只有 $0.007/M。稳定的系统提示词、仓库摘要和会话前缀可以明显降低账单,但缓存命中是 best effort,必须从真实 usage 数据监控。
长输入与长输出
V4 保留 1M 上下文和 384K 最大输出。需要这些上限时,便宜但短上下文的模型并不是直接替代品。
DeepSeek 已失去旧优势的地方
- 短、无缓存流量: 标准算例里 Mistral Small 4 更便宜。
- 高峰流量: 同样 Token 结构下,V4 Flash 可能比 GPT-5.6 Luna 更贵。
- 默认使用 V4 Pro: 高峰 $1.32/$3.96 已不属于预算档,应该只在 Flash 未通过评测门槛时升级。
- 多模态任务: DeepSeek V4 仍是文本优先;Gemini 3.7 Flash 可直接接收图片、视频、音频和 PDF。
建议的路由策略
| 工作负载 | 起始路由 |
|---|---|
| 短、常规文本 | Mistral Small 4 或 GPT-5.6 Luna |
| 闲时、缓存密集、1M 上下文文本 Agent | DeepSeek V4 Flash |
| DeepSeek 高峰期的同类 Agent | 按真实输入输出比重新比较 Luna 与 Flash |
| 困难的 DeepSeek 兼容任务 | Flash 失败后再升级 V4 Pro |
| 多模态或 Google grounding | Gemini 3.7 Flash |
不要只按单价迁移。至少记录单次成功任务成本、推理与输出 Token、重试、缓存命中率、延迟和人工修复时间。
结论
DeepSeek 仍有价值,但价值主张已经从“始终最便宜”变为 “适合分时调度、缓存感知、长上下文的低价路由”。V4 Flash 仍是家族内更合理的默认选项;V4 Pro 应是经过评测的升级档,而不是全量替换。
AI 价格计算器默认采用保守的高峰价。完整时段规则见 DeepSeek API 最新价格指南。
官方来源核验于 2026 年 8 月 17 日:DeepSeek 价格、V4 Pro 0813 与调价公告、Mistral API 价格、OpenAI 价格、Gemini 价格。