DeepSeek API 价格 2026:V4 Flash 与 Pro 高峰/闲时最新费率
2026年8月17日涨价后的 DeepSeek API 价格:V4 Flash、V4 Pro 峰谷 Token 费率、缓存成本、计费时段、模型 ID 与成本算例。
DeepSeek 当前 V4 API 已启用分时计费。新价从 北京时间 2026 年 8 月 17 日 00:00 起执行。北京时间 09:00-12:00 和 14:00-18:00 为高峰,其余时间享受 50% 闲时折扣。
当前模型 ID 为 deepseek-v4-flash 和 deepseek-v4-pro。两者均提供 1M 上下文、384K 最大输出、思考/非思考模式、JSON、工具调用、Responses API,以及 OpenAI 和 Anthropic 兼容接口。
DeepSeek 最新价格
美元价格,单位为每百万 Token:
| 模型与计费时段 | 缓存输入 | 缓存未命中输入 | 输出 |
|---|---|---|---|
deepseek-v4-flash,闲时 | $0.007 | $0.22 | $0.66 |
deepseek-v4-flash,高峰 | $0.014 | $0.44 | $1.32 |
deepseek-v4-pro,闲时 | $0.022 | $0.66 | $1.98 |
deepseek-v4-pro,高峰 | $0.044 | $1.32 | $3.96 |
人民币官方价:Flash 闲时 ¥0.05/¥1.5/¥4.5,高峰 ¥0.10/¥3/¥9;Pro 闲时 ¥0.15/¥4.5/¥13.5,高峰 ¥0.30/¥9/¥27,依次对应缓存输入、缓存未命中输入和输出。
DevTk.AI 计算器默认采用保守的高峰价。可调度任务应再按闲时价做一份预算。
高峰时段
| 计费时段 | UTC | 北京时间 |
|---|---|---|
| 高峰 1 | 01:00-04:00 | 09:00-12:00 |
| 高峰 2 | 06:00-10:00 | 14:00-18:00 |
| 闲时 | 其他全部时段 | 其他全部时段 |
所谓 2 倍是指当前高峰价相对当前闲时价,不是旧价格统一翻倍。例如 V4 Flash 输出从旧 $0.28/M 调整为闲时 $0.66/M、高峰 $1.32/M。
当前版本与模型 ID
| API ID | 当前版本 | 上下文 | 最大输出 |
|---|---|---|---|
deepseek-v4-flash | DeepSeek-V4-Flash-0731 | 1M | 384K |
deepseek-v4-pro | DeepSeek-V4-Pro-0813 | 1M | 384K |
旧的 deepseek-chat 和 deepseek-reasoner 别名已于 2026 年 7 月 24 日退役,新接入应显式使用 V4 ID。
成本公式与缓存字段
费用 =
prompt_cache_hit_tokens * 缓存输入价 / 1,000,000
+ prompt_cache_miss_tokens * 缓存未命中价 / 1,000,000
+ completion_tokens * 输出价 / 1,000,000
可以从 usage 读取:
usage.prompt_cache_hit_tokens
usage.prompt_cache_miss_tokens
缓存是尽力而为。稳定的 system prompt、仓库规则、工具 schema 和对话前缀更容易复用。预算时应监控真实命中率,不能假设 100% 缓存。
成本算例
按跨多个请求累计 200 万缓存未命中输入 + 50 万输出 Token:
| 模型与时段 | 成本 |
|---|---|
| V4 Flash,闲时 | $0.77 |
| V4 Flash,高峰 | $1.54 |
| V4 Pro,闲时 | $2.31 |
| V4 Pro,高峰 | $4.62 |
若输入有 85% 命中缓存,同样工作负载的 V4 Flash 约为闲时 $0.408、高峰 $0.816。实际结果仍取决于缓存和输出 Token。
OpenAI 兼容 API 示例
from openai import OpenAI
client = OpenAI(
api_key="your-deepseek-api-key",
base_url="https://api.deepseek.com"
)
response = client.chat.completions.create(
model="deepseek-v4-flash",
messages=[
{"role": "system", "content": "你是一个严谨的编程助手。"},
{"role": "user", "content": "分析这个仓库结构。"}
],
)
print(response.choices[0].message.content)
Anthropic 格式的编程 Agent 可以设置:
export ANTHROPIC_BASE_URL=https://api.deepseek.com/anthropic
export ANTHROPIC_AUTH_TOKEN=your-deepseek-api-key
DeepSeek 还便宜吗?
V4 Flash 仍是有价值的低价模型,尤其适合闲时和重复长上下文;但它不再是所有流量下的价格底线。普通短请求里 Mistral Small 4 可能更便宜,部分 Token 结构下 GPT-5.6 Luna 也可能低于高峰 V4 Flash。
V4 Pro 更适合作为升级路由。只有它能减少失败工具循环、重试或人工修复时,较高价格才有意义。
详细判断见 DeepSeek 涨价后还有性价比吗,也可以用 AI 价格计算器代入实际流量。
官方来源核验于 2026 年 8 月 17 日:DeepSeek 价格、V4 Pro 0813 与调价公告、上下文缓存和 Anthropic API 兼容。