DeepSeek V4.1 Flash 降价后还有性价比吗?
DeepSeek V4.1 Flash 在 2026 年 9 月降价。对比高峰、闲时与缓存成本,以及 GPT-6 Luna、GLM-5.3 Flash、Mistral Small 4、Gemini 3.8 Flash。
DeepSeek 仍有价格竞争力,但原因在六周内变了两次。V4 Flash 于 8 月涨价;9 月 10 日,DeepSeek 又用 V4.1 Flash 替代旧版,增加视觉输入,并把 Flash 高峰价降至 输入 $0.30/M、输出 $1.20/M,闲时再打五折。
简短结论:V4.1 Flash 对高缓存命中、长上下文、视觉输入或超长输出仍有明显性价比,但并非所有普通文本请求的最低价。
DeepSeek 当前 API 价格
美元价格,单位为每百万 Token:
| 模型与时段 | 缓存输入 | 缓存未命中输入 | 输出 |
|---|---|---|---|
| V4.1 Flash,闲时 | $0.003 | $0.15 | $0.60 |
| V4.1 Flash,高峰 | $0.006 | $0.30 | $1.20 |
| V4 Pro,闲时 | $0.022 | $0.66 | $1.98 |
| V4 Pro,高峰 | $0.044 | $1.32 | $3.96 |
V4.1 Flash 应使用 deepseek-flash。已退役的 deepseek-v4-flash 和 deepseek-v4-flash-vision-exp 仍可调用,但请求会转到 V4.1 Flash 并按现价计费。
高峰仅为工作日 UTC 01:00-04:00、06:00-10:00,中国法定节假日除外;周末、节假日和其他时段均按闲时价。
同一工作负载的当前账单
按 200 万未缓存输入 + 50 万输出 Token,且单次请求未跨越特殊长上下文价格门槛:
| 模型 | 成本 |
|---|---|
| GPT-6 Luna | $0.45 |
| GLM-5.3 Flash | $0.55 |
| Mistral Small 4 | $0.60 |
| DeepSeek V4.1 Flash,闲时 | $0.60 |
| DeepSeek V4.1 Flash,高峰 | $1.20 |
| DeepSeek V4 Pro,闲时 | $2.31 |
| Gemini 3.8 Flash,2026 引导价 | $3.38 |
| DeepSeek V4 Pro,高峰 | $4.62 |
这个 Token 结构下,GPT-6 Luna 的无缓存账单最低。DeepSeek 闲时与 Mistral Small 4 持平,高峰则更贵;但上下文、输出上限、视觉、工具和任务成功率也会改变实际总成本。
DeepSeek 仍有优势的场景
高缓存命中的长上下文 Agent
V4.1 Flash 缓存输入闲时仅 $0.003/M、高峰 $0.006/M。若上述 200 万输入有 85% 命中缓存,包含 50 万输出后的总价约为 闲时 $0.35、高峰 $0.70。这低于无缓存的 GPT-6 Luna 示例,但缓存是尽力而为,必须根据 usage 实测。
超长生成输出
DeepSeek 提供 1M 上下文和最高 384K 输出,不少更低价模型只允许 64K 或 128K 输出。若能避免切片续写和多次调用,能力差异可能比每百万 Token 几毛钱更重要。
不需要单独高价视觉路线
V4.1 Flash 直接支持图片,并沿用 Flash 价格。在部分文档、截图和代码任务里,它可以减少独立视觉预处理步骤。
可调度的非紧急流量
闲时会把输入、缓存输入和输出统一减半,也不要求改用独立 Batch 接口。评测、索引和非紧急 Agent 任务可以尽量避开工作日高峰。
哪些场景更适合其他模型
- **普通短文本:**在标准化无缓存示例里,GPT-6 Luna 与 GLM-5.3 Flash 更便宜。
- **固定费率预算:**DeepSeek 会产生 2 倍价格区间;GLM 和 OpenAI 标准价更易预测。
- **高难旗舰任务:**V4 Pro 高峰不再是低价路线,应与 GPT-6.1 Sol、GLM-5.3、Claude Sonnet 5.5 比较单次成功任务成本。
- **Google grounding 与广泛多模态:**Gemini 3.8 Flash 更贵,但提供更完整的 Google 工具和媒体输入生态。
推荐路由
| 工作负载 | 建议起点 |
|---|---|
| 简单高频文本 | GPT-6 Luna 或 GLM-5.3 Flash |
| 高缓存命中的 1M 上下文 Agent | DeepSeek V4.1 Flash |
| 需要长输出的图文任务 | DeepSeek V4.1 Flash |
| DeepSeek 兼容的困难任务 | 通过评测门槛后再升级 V4 Pro |
| 广泛多模态与 Google grounding | Gemini 3.8 Flash |
DeepSeek 仍有真实价值,但准确结论应是:V4.1 Flash 是很便宜的缓存友好、多模态、长输出路线,而不是所有工作负载的绝对价格冠军。
可以用 AI 价格计算器按保守高峰价估算,并阅读 DeepSeek 当前 API 价格指南核对模型 ID 与时段。
官方来源核验于 2026 年 9 月 25 日:DeepSeek 价格、OpenAI 价格、Z.AI 价格、Mistral API 价格和 Gemini 价格。