DevTk.AI
DeepSeek API 价格DeepSeek V4.1AI 模型缓存命中大模型定价

DeepSeek API 价格 2026:V4.1 Flash 与 Pro 高峰/闲时费率

DeepSeek V4.1 Flash、V4 Pro 最新峰谷 Token 费率、缓存成本、工作日计费时段、模型 ID、视觉能力与成本算例。

DevTk.AI 2026-02-22 更新于 2026-09-25 6 分钟阅读

DeepSeek 于 2026 年 9 月 10 日用 DeepSeek-V4.1-Flash 替代 V4 Flash,并下调 Flash Token 价格。API 仍采用分时计费:工作日北京时间 09:00-12:00 和 14:00-18:00 为高峰,中国法定节假日与其他时段享受 50% 闲时折扣。

当前模型 ID 为 deepseek-flash 和 deepseek-v4-pro。两者均提供 1M 上下文、384K 最大输出、思考/非思考模式、JSON、工具调用、Responses API,以及 OpenAI 和 Anthropic 兼容接口。V4.1 Flash 还支持图片输入,V4 Pro 仍是纯文本模型。

DeepSeek 最新价格

美元价格,单位为每百万 Token:

模型与计费时段缓存输入缓存未命中输入输出
deepseek-flash(V4.1 Flash),闲时$0.003$0.15$0.60
deepseek-flash(V4.1 Flash),高峰$0.006$0.30$1.20
deepseek-v4-pro,闲时$0.022$0.66$1.98
deepseek-v4-pro,高峰$0.044$1.32$3.96

DevTk.AI 计算器默认采用保守的高峰价。可调度任务应再按闲时价做一份预算。

高峰时段

计费时段UTC北京时间
高峰 1工作日 01:00-04:00工作日 09:00-12:00
高峰 2工作日 06:00-10:00工作日 14:00-18:00
闲时其他时段与节假日其他时段与中国法定节假日

所谓 2 倍是指当前高峰价相对当前闲时价。9 月 V4.1 Flash 上线后,两档都低于 8 月 V4 Flash:缓存未命中输入高峰价从 $0.44 降至 $0.30,输出从 $1.32 降至 $1.20。

当前版本与模型 ID

API ID当前版本上下文最大输出
deepseek-flashDeepSeek-V4.1-Flash1M384K
deepseek-v4-proDeepSeek-V4-Pro-08131M384K

旧名称 deepseek-v4-flash 和 deepseek-v4-flash-vision-exp 仍可调用,但对应旧模型已退役,请求会转到 V4.1 Flash 并按当前 Flash 价格计费。新接入应使用 deepseek-flash。

成本公式与缓存字段

费用 =
  prompt_cache_hit_tokens * 缓存输入价 / 1,000,000
+ prompt_cache_miss_tokens * 缓存未命中价 / 1,000,000
+ completion_tokens * 输出价 / 1,000,000

可以从 usage 读取:

usage.prompt_cache_hit_tokens
usage.prompt_cache_miss_tokens

缓存是尽力而为。稳定的 system prompt、仓库规则、工具 schema 和对话前缀更容易复用。预算时应监控真实命中率,不能假设 100% 缓存。

成本算例

按跨多个请求累计 200 万缓存未命中输入 + 50 万输出 Token:

模型与时段成本
V4.1 Flash,闲时$0.60
V4.1 Flash,高峰$1.20
V4 Pro,闲时$2.31
V4 Pro,高峰$4.62

若输入有 85% 命中缓存,同样工作负载的 V4.1 Flash 约为闲时 $0.350、高峰 $0.700。实际结果仍取决于缓存和输出 Token。

OpenAI 兼容 API 示例

from openai import OpenAI

client = OpenAI(
    api_key="your-deepseek-api-key",
    base_url="https://api.deepseek.com"
)

response = client.chat.completions.create(
    model="deepseek-flash",
    messages=[
        {"role": "system", "content": "你是一个严谨的编程助手。"},
        {"role": "user", "content": "分析这个仓库结构。"}
    ],
)

print(response.choices[0].message.content)

Anthropic 格式的编程 Agent 可以设置:

export ANTHROPIC_BASE_URL=https://api.deepseek.com/anthropic
export ANTHROPIC_AUTH_TOKEN=your-deepseek-api-key

DeepSeek 还便宜吗?

V4.1 Flash 再次成为低价托管长上下文模型之一,尤其适合闲时和重复前缀。按 200 万输入 + 50 万输出算,闲时 $0.60、高峰 $1.20;GPT-6 Luna 同样 Token 结构仅 $0.45,但 V4.1 Flash 提供视觉输入、1M 上下文和最高 384K 输出。

V4 Pro 更适合作为升级路由。只有它能减少失败工具循环、重试或人工修复时,较高价格才有意义。

详细判断见更新后的 DeepSeek 还有性价比吗,也可以用 AI 价格计算器代入实际流量。

官方来源核验于 2026 年 9 月 25 日:DeepSeek 价格、DeepSeek 更新记录、上下文缓存和 Anthropic API 兼容。

相关文章