DeepSeek API 价格 2026:V4.1 Flash 与 Pro 高峰/闲时费率
DeepSeek V4.1 Flash、V4 Pro 最新峰谷 Token 费率、缓存成本、工作日计费时段、模型 ID、视觉能力与成本算例。
DeepSeek 于 2026 年 9 月 10 日用 DeepSeek-V4.1-Flash 替代 V4 Flash,并下调 Flash Token 价格。API 仍采用分时计费:工作日北京时间 09:00-12:00 和 14:00-18:00 为高峰,中国法定节假日与其他时段享受 50% 闲时折扣。
当前模型 ID 为 deepseek-flash 和 deepseek-v4-pro。两者均提供 1M 上下文、384K 最大输出、思考/非思考模式、JSON、工具调用、Responses API,以及 OpenAI 和 Anthropic 兼容接口。V4.1 Flash 还支持图片输入,V4 Pro 仍是纯文本模型。
DeepSeek 最新价格
美元价格,单位为每百万 Token:
| 模型与计费时段 | 缓存输入 | 缓存未命中输入 | 输出 |
|---|---|---|---|
deepseek-flash(V4.1 Flash),闲时 | $0.003 | $0.15 | $0.60 |
deepseek-flash(V4.1 Flash),高峰 | $0.006 | $0.30 | $1.20 |
deepseek-v4-pro,闲时 | $0.022 | $0.66 | $1.98 |
deepseek-v4-pro,高峰 | $0.044 | $1.32 | $3.96 |
DevTk.AI 计算器默认采用保守的高峰价。可调度任务应再按闲时价做一份预算。
高峰时段
| 计费时段 | UTC | 北京时间 |
|---|---|---|
| 高峰 1 | 工作日 01:00-04:00 | 工作日 09:00-12:00 |
| 高峰 2 | 工作日 06:00-10:00 | 工作日 14:00-18:00 |
| 闲时 | 其他时段与节假日 | 其他时段与中国法定节假日 |
所谓 2 倍是指当前高峰价相对当前闲时价。9 月 V4.1 Flash 上线后,两档都低于 8 月 V4 Flash:缓存未命中输入高峰价从 $0.44 降至 $0.30,输出从 $1.32 降至 $1.20。
当前版本与模型 ID
| API ID | 当前版本 | 上下文 | 最大输出 |
|---|---|---|---|
deepseek-flash | DeepSeek-V4.1-Flash | 1M | 384K |
deepseek-v4-pro | DeepSeek-V4-Pro-0813 | 1M | 384K |
旧名称 deepseek-v4-flash 和 deepseek-v4-flash-vision-exp 仍可调用,但对应旧模型已退役,请求会转到 V4.1 Flash 并按当前 Flash 价格计费。新接入应使用 deepseek-flash。
成本公式与缓存字段
费用 =
prompt_cache_hit_tokens * 缓存输入价 / 1,000,000
+ prompt_cache_miss_tokens * 缓存未命中价 / 1,000,000
+ completion_tokens * 输出价 / 1,000,000
可以从 usage 读取:
usage.prompt_cache_hit_tokens
usage.prompt_cache_miss_tokens
缓存是尽力而为。稳定的 system prompt、仓库规则、工具 schema 和对话前缀更容易复用。预算时应监控真实命中率,不能假设 100% 缓存。
成本算例
按跨多个请求累计 200 万缓存未命中输入 + 50 万输出 Token:
| 模型与时段 | 成本 |
|---|---|
| V4.1 Flash,闲时 | $0.60 |
| V4.1 Flash,高峰 | $1.20 |
| V4 Pro,闲时 | $2.31 |
| V4 Pro,高峰 | $4.62 |
若输入有 85% 命中缓存,同样工作负载的 V4.1 Flash 约为闲时 $0.350、高峰 $0.700。实际结果仍取决于缓存和输出 Token。
OpenAI 兼容 API 示例
from openai import OpenAI
client = OpenAI(
api_key="your-deepseek-api-key",
base_url="https://api.deepseek.com"
)
response = client.chat.completions.create(
model="deepseek-flash",
messages=[
{"role": "system", "content": "你是一个严谨的编程助手。"},
{"role": "user", "content": "分析这个仓库结构。"}
],
)
print(response.choices[0].message.content)
Anthropic 格式的编程 Agent 可以设置:
export ANTHROPIC_BASE_URL=https://api.deepseek.com/anthropic
export ANTHROPIC_AUTH_TOKEN=your-deepseek-api-key
DeepSeek 还便宜吗?
V4.1 Flash 再次成为低价托管长上下文模型之一,尤其适合闲时和重复前缀。按 200 万输入 + 50 万输出算,闲时 $0.60、高峰 $1.20;GPT-6 Luna 同样 Token 结构仅 $0.45,但 V4.1 Flash 提供视觉输入、1M 上下文和最高 384K 输出。
V4 Pro 更适合作为升级路由。只有它能减少失败工具循环、重试或人工修复时,较高价格才有意义。
详细判断见更新后的 DeepSeek 还有性价比吗,也可以用 AI 价格计算器代入实际流量。
官方来源核验于 2026 年 9 月 25 日:DeepSeek 价格、DeepSeek 更新记录、上下文缓存和 Anthropic API 兼容。