DevTk.AI
DeepSeek V4.1DeepSeek 价格API 价格GPT-6 LunaGLM-5.3 Flash

DeepSeek V4.1 Flash 降价后还有性价比吗?

DeepSeek V4.1 Flash 在 2026 年 9 月降价。对比高峰、闲时与缓存成本,以及 GPT-6 Luna、GLM-5.3 Flash、Mistral Small 4、Gemini 3.8 Flash。

DevTk.AI 2026-08-17 更新于 2026-10-02 6 分钟阅读

DeepSeek 仍有价格竞争力,但原因在六周内变了两次。V4 Flash 于 8 月涨价;9 月 10 日,DeepSeek 又用 V4.1 Flash 替代旧版,增加视觉输入,并把 Flash 高峰价降至 输入 $0.30/M、输出 $1.20/M,闲时再打五折。

简短结论:V4.1 Flash 对高缓存命中、长上下文、视觉输入或超长输出仍有明显性价比,但并非所有普通文本请求的最低价。

DeepSeek 当前 API 价格

美元价格,单位为每百万 Token:

模型与时段缓存输入缓存未命中输入输出
V4.1 Flash,闲时$0.003$0.15$0.60
V4.1 Flash,高峰$0.006$0.30$1.20
V4 Pro,闲时$0.022$0.66$1.98
V4 Pro,高峰$0.044$1.32$3.96

V4.1 Flash 应使用 deepseek-flash。已退役的 deepseek-v4-flash 和 deepseek-v4-flash-vision-exp 仍可调用,但请求会转到 V4.1 Flash 并按现价计费。

高峰仅为工作日 UTC 01:00-04:00、06:00-10:00,中国法定节假日除外;周末、节假日和其他时段均按闲时价。

同一工作负载的当前账单

按 200 万未缓存输入 + 50 万输出 Token,且单次请求未跨越特殊长上下文价格门槛:

模型成本
GPT-6 Luna$0.45
GLM-5.3 Flash$0.55
Mistral Small 4$0.60
DeepSeek V4.1 Flash,闲时$0.60
DeepSeek V4.1 Flash,高峰$1.20
DeepSeek V4 Pro,闲时$2.31
Gemini 3.8 Flash,2026 引导价$3.38
DeepSeek V4 Pro,高峰$4.62

这个 Token 结构下,GPT-6 Luna 的无缓存账单最低。DeepSeek 闲时与 Mistral Small 4 持平,高峰则更贵;但上下文、输出上限、视觉、工具和任务成功率也会改变实际总成本。

DeepSeek 仍有优势的场景

高缓存命中的长上下文 Agent

V4.1 Flash 缓存输入闲时仅 $0.003/M、高峰 $0.006/M。若上述 200 万输入有 85% 命中缓存,包含 50 万输出后的总价约为 闲时 $0.35、高峰 $0.70。这低于无缓存的 GPT-6 Luna 示例,但缓存是尽力而为,必须根据 usage 实测。

超长生成输出

DeepSeek 提供 1M 上下文和最高 384K 输出,不少更低价模型只允许 64K 或 128K 输出。若能避免切片续写和多次调用,能力差异可能比每百万 Token 几毛钱更重要。

不需要单独高价视觉路线

V4.1 Flash 直接支持图片,并沿用 Flash 价格。在部分文档、截图和代码任务里,它可以减少独立视觉预处理步骤。

可调度的非紧急流量

闲时会把输入、缓存输入和输出统一减半,也不要求改用独立 Batch 接口。评测、索引和非紧急 Agent 任务可以尽量避开工作日高峰。

哪些场景更适合其他模型

  • **普通短文本:**在标准化无缓存示例里,GPT-6 Luna 与 GLM-5.3 Flash 更便宜。
  • **固定费率预算:**DeepSeek 会产生 2 倍价格区间;GLM 和 OpenAI 标准价更易预测。
  • **高难旗舰任务:**V4 Pro 高峰不再是低价路线,应与 GPT-6.1 Sol、GLM-5.3、Claude Sonnet 5.5 比较单次成功任务成本。
  • **Google grounding 与广泛多模态:**Gemini 3.8 Flash 更贵,但提供更完整的 Google 工具和媒体输入生态。

推荐路由

工作负载建议起点
简单高频文本GPT-6 Luna 或 GLM-5.3 Flash
高缓存命中的 1M 上下文 AgentDeepSeek V4.1 Flash
需要长输出的图文任务DeepSeek V4.1 Flash
DeepSeek 兼容的困难任务通过评测门槛后再升级 V4 Pro
广泛多模态与 Google groundingGemini 3.8 Flash

DeepSeek 仍有真实价值,但准确结论应是:V4.1 Flash 是很便宜的缓存友好、多模态、长输出路线,而不是所有工作负载的绝对价格冠军。

可以用 AI 价格计算器按保守高峰价估算,并阅读 DeepSeek 当前 API 价格指南核对模型 ID 与时段。

官方来源核验于 2026 年 9 月 25 日:DeepSeek 价格、OpenAI 价格、Z.AI 价格、Mistral API 价格和 Gemini 价格。

相关文章