DevTk.AI
DeepSeek API 价格DeepSeek V4AI 模型缓存命中大模型定价

DeepSeek API 价格 2026:V4 Flash 与 Pro 高峰/闲时最新费率

2026年8月17日涨价后的 DeepSeek API 价格:V4 Flash、V4 Pro 峰谷 Token 费率、缓存成本、计费时段、模型 ID 与成本算例。

DevTk.AI 2026-02-22 更新于 2026-08-17 6 分钟阅读

DeepSeek 当前 V4 API 已启用分时计费。新价从 北京时间 2026 年 8 月 17 日 00:00 起执行。北京时间 09:00-12:00 和 14:00-18:00 为高峰,其余时间享受 50% 闲时折扣。

当前模型 ID 为 deepseek-v4-flashdeepseek-v4-pro。两者均提供 1M 上下文、384K 最大输出、思考/非思考模式、JSON、工具调用、Responses API,以及 OpenAI 和 Anthropic 兼容接口。

DeepSeek 最新价格

美元价格,单位为每百万 Token:

模型与计费时段缓存输入缓存未命中输入输出
deepseek-v4-flash,闲时$0.007$0.22$0.66
deepseek-v4-flash,高峰$0.014$0.44$1.32
deepseek-v4-pro,闲时$0.022$0.66$1.98
deepseek-v4-pro,高峰$0.044$1.32$3.96

人民币官方价:Flash 闲时 ¥0.05/¥1.5/¥4.5,高峰 ¥0.10/¥3/¥9;Pro 闲时 ¥0.15/¥4.5/¥13.5,高峰 ¥0.30/¥9/¥27,依次对应缓存输入、缓存未命中输入和输出。

DevTk.AI 计算器默认采用保守的高峰价。可调度任务应再按闲时价做一份预算。

高峰时段

计费时段UTC北京时间
高峰 101:00-04:0009:00-12:00
高峰 206:00-10:0014:00-18:00
闲时其他全部时段其他全部时段

所谓 2 倍是指当前高峰价相对当前闲时价,不是旧价格统一翻倍。例如 V4 Flash 输出从旧 $0.28/M 调整为闲时 $0.66/M、高峰 $1.32/M。

当前版本与模型 ID

API ID当前版本上下文最大输出
deepseek-v4-flashDeepSeek-V4-Flash-07311M384K
deepseek-v4-proDeepSeek-V4-Pro-08131M384K

旧的 deepseek-chatdeepseek-reasoner 别名已于 2026 年 7 月 24 日退役,新接入应显式使用 V4 ID。

成本公式与缓存字段

费用 =
  prompt_cache_hit_tokens * 缓存输入价 / 1,000,000
+ prompt_cache_miss_tokens * 缓存未命中价 / 1,000,000
+ completion_tokens * 输出价 / 1,000,000

可以从 usage 读取:

usage.prompt_cache_hit_tokens
usage.prompt_cache_miss_tokens

缓存是尽力而为。稳定的 system prompt、仓库规则、工具 schema 和对话前缀更容易复用。预算时应监控真实命中率,不能假设 100% 缓存。

成本算例

按跨多个请求累计 200 万缓存未命中输入 + 50 万输出 Token:

模型与时段成本
V4 Flash,闲时$0.77
V4 Flash,高峰$1.54
V4 Pro,闲时$2.31
V4 Pro,高峰$4.62

若输入有 85% 命中缓存,同样工作负载的 V4 Flash 约为闲时 $0.408、高峰 $0.816。实际结果仍取决于缓存和输出 Token。

OpenAI 兼容 API 示例

from openai import OpenAI

client = OpenAI(
    api_key="your-deepseek-api-key",
    base_url="https://api.deepseek.com"
)

response = client.chat.completions.create(
    model="deepseek-v4-flash",
    messages=[
        {"role": "system", "content": "你是一个严谨的编程助手。"},
        {"role": "user", "content": "分析这个仓库结构。"}
    ],
)

print(response.choices[0].message.content)

Anthropic 格式的编程 Agent 可以设置:

export ANTHROPIC_BASE_URL=https://api.deepseek.com/anthropic
export ANTHROPIC_AUTH_TOKEN=your-deepseek-api-key

DeepSeek 还便宜吗?

V4 Flash 仍是有价值的低价模型,尤其适合闲时和重复长上下文;但它不再是所有流量下的价格底线。普通短请求里 Mistral Small 4 可能更便宜,部分 Token 结构下 GPT-5.6 Luna 也可能低于高峰 V4 Flash。

V4 Pro 更适合作为升级路由。只有它能减少失败工具循环、重试或人工修复时,较高价格才有意义。

详细判断见 DeepSeek 涨价后还有性价比吗,也可以用 AI 价格计算器代入实际流量。

官方来源核验于 2026 年 8 月 17 日:DeepSeek 价格V4 Pro 0813 与调价公告上下文缓存Anthropic API 兼容

相关文章