2026 年 8 月 AI API 价格战:Google 降价,DeepSeek 涨价
Google 将 Gemini 3.7/3.6 Flash 年底前减半,DeepSeek 上调 V4 费率,xAI 发布 Grok 4.6。最新 API 价格战格局。
8 月 API 市场已经不是单纯的降价竞赛。OpenAI 月初大幅下调 GPT-5.6 Terra 和 Luna;Google 随后发布 Gemini 3.7 Flash,以年底前引导价上线,并把同样折扣应用到 3.6 Flash;DeepSeek 则反向调整,8 月 17 日正式启用新的峰谷 V4 价格,闲时和最高费率都显著高于旧的单一价格。
现在的价格战围绕 限时折扣、分时计费、上下文阈值和任务成功率 展开,不再存在一个对所有场景都最便宜的模型。
发生了什么
| 厂商与模型 | 当前变化 | 生效价格 |
|---|---|---|
| OpenAI GPT-5.6 Luna | 相对首发永久降低 80% | 输入 $0.20 / 输出 $1.20 |
| Google Gemini 3.7 Flash | 新 GA,年底前引导价 | 至 12 月 31 日 $0.75/$3.75 |
| Google Gemini 3.6 Flash | 旧模型获得同样引导价 | 至 12 月 31 日 $0.75/$3.75 |
| DeepSeek V4 Flash | 启用峰谷计费 | 闲时 $0.22/$0.66;高峰 $0.44/$1.32 |
| xAI Grok 4.6 | 新模型,缓存价高于 4.5 | 200K 以下 $2/缓存 $0.50/输出 $6 |
| Z.AI GLM-5.3 | 新模型,但按量价格待公布 | Coding Plan 可用,API 即将上线 |
价格单位是美元/百万输入与输出 Token。DeepSeek 显示缓存未命中输入/输出,Grok 中间值为缓存输入。
Google 用年底折扣换采用率
Gemini 3.7 Flash 和 3.6 Flash 当前为输入 $0.75/M、缓存输入 $0.075/M、输出 $3.75/M。Google 已明确这些值会在 2027 年 1 月 1 日翻倍。
这是很激进的当前价,尤其两者都提供约 1M 上下文、文本/图片/视频/音频/PDF 原生输入,以及 Batch/Flex。风险在于预算:12 月的运行成本不能直接复制到 1 月。
DeepSeek 开始对时间定价
DeepSeek V4 Flash 旧的 $0.14/M 缓存未命中输入和 $0.28/M 输出已经失效。新价为闲时 $0.22/$0.66、高峰 $0.44/$1.32;高峰对应 UTC 01:00-04:00 和 06:00-10:00,也就是北京时间 09:00-12:00 和 14:00-18:00。
闲时折扣让排队任务有了调度优势,但并没有保留旧价。即使闲时输出,也超过旧输出价两倍。
V4 Pro 当前为闲时 $0.66/$1.98、高峰 $1.32/$3.96。它已不再是默认预算档,必须靠更高完成率证明价值。
xAI 保持输入输出价,但上调缓存
Grok 4.6 在 200K 以下仍是输入 $2/M、输出 $6/M,与 Grok 4.5 相同;缓存输入从 $0.30 增至 $0.50,上涨 66.7%。Prompt 达到 200K 后,整个请求切换为输入 $4、缓存输入 $1、输出 $12。
xAI 走的是能力路线而不是价格路线。迁移理由是 xhigh 推理和更强 Agent/编程表现,缓存密集团队则需要承担更高账单。
同一工作负载
按跨短请求累计 200 万缓存未命中输入 + 50 万输出 Token:
| 模型 | 成本 |
|---|---|
| 小米 MiMo-V2.5 | $0.42 |
| Mistral Small 4 | $0.60 |
| DeepSeek V4 Flash,闲时 | $0.77 |
| GPT-5.6 Luna | $1.00 |
| MiniMax M3 | $1.20 |
| DeepSeek V4 Flash,高峰 | $1.54 |
| Gemini 3.5 Flash-Lite | $1.85 |
| Gemini 3.7 Flash,当前引导价 | $3.38 |
| GLM-5.2 | $5.00 |
| Grok 4.6 | $7.00 |
| Kimi K3 | $13.50 |
这不是质量排名。推理与输出 Token、重试、工具费用、上下文、多模态预处理和人工修复时间共同决定单次完成任务成本。
谁赢了价格战?
- 普通 Token 账单最低: 本算例中的 MiMo-V2.5 和 Mistral Small 4。
- 可调度长上下文文本: DeepSeek V4 Flash 闲时仍有优势。
- 低价 OpenAI 路由: GPT-5.6 Luna 已能与 DeepSeek 高峰流量竞争。
- 年底前多模态 Agent: Gemini 3.7 Flash 兼顾低引导价、广输入和 Google 工具。
- 能力升级路由: Grok 4.6、Kimi K3、GLM-5.2 及高端 GPT/Claude 必须靠完成率取胜。
开发者应该怎么做
价格配置必须带生效日期和条件。DeepSeek 需要时段字段,Grok 需要 200K 阈值,Gemini 需要 1 月 1 日计划价,Claude 或 Qwen 的临时价格也要设置到期监控。
然后比较单次成功任务成本,而不是每百万 Token。建议仪表盘至少记录缓存命中率、推理/输出 Token、重试、p95 延迟、工具费和人工修复时间。
使用 AI 价格计算器和 当前 API 价格总表查看最新数据。DeepSeek 专题见 涨价后还有性价比吗。
官方来源核验于 2026 年 8 月 17 日:Google 价格、DeepSeek 价格、xAI 价格、Z.AI 价格和 OpenAI 价格。