2026 国产大模型 API 价格:GLM-5.3 状态、Kimi K3 与 DeepSeek V4 新价
对比 GLM-5.3/5.2、Kimi K3、DeepSeek V4、MiniMax M3、Qwen3.7 和小米 MiMo 的最新 API 价格与可用状态。
国产模型已经不能简单归类为“便宜替代品”。现在既有极低价文本路由,也有主打长程编程、原生多模态和百万上下文的高端 Agent 模型。
真正有用的问题不是谁赢了厂商榜单,而是谁能以最低的任务总成本完成你的业务。总成本需要同时计算输出 token、缓存命中、长上下文溢价、延迟、重试次数和人工返工。
最新价格快照
美元价格使用官方国际站 API 价格;人民币价格保留人民币,不用浮动汇率伪装成官方美元价格。
| 模型 | 输入 / 百万 | 缓存输入 / 百万 | 输出 / 百万 | 上下文 | 适合场景 |
|---|---|---|---|---|---|
| DeepSeek V4 Flash,闲时 | $0.22 | $0.007 | $0.66 | 1M | 可调度的低价文本分流 |
| DeepSeek V4 Flash,高峰 | $0.44 | $0.014 | $1.32 | 1M | 保守的日间价格 |
| 小米 MiMo-V2.5 | $0.14 | $0.0028 | $0.28 | 1M | 低价多模态 Agent |
| MiniMax M3,输入不超过 512K | $0.30 | $0.06 | $1.20 | 1M | 长上下文多模态 Agent |
| GLM-5.2 | $1.40 | $0.26 | $4.40 | 1M | 当前已定价 GLM API |
| Kimi K3 | $3.00 | $0.30 | $15.00 | 1M | 多模态、超长输出 Agent |
| Qwen3.7 Plus,输入不超过 256K | ¥1.60 | 未列出 | ¥6.40 | 1M | 当前别名优惠价 |
| Qwen3.7 Max | ¥6 | 未列出 | ¥18 | 1M | 当前别名优惠价 |
MiniMax M3 输入超过 512K 后,输入、缓存输入和输出分别为 $0.60、$0.12 和 $2.40/M。按当前千问别名优惠,Qwen3.7 Plus 输入在 256K 到 1M 时,输入和输出分别为 ¥4.80 和 ¥19.20/M;阿里云尚未列出优惠结束日期。
这轮更新有什么不同
Kimi K3 增加一个 3T 级开放模型候选
Moonshot AI 于 7 月 16 日发布 Kimi K3。它拥有 2.8T 总参数、原生视觉理解、1M 上下文、严格结构化输出、动态工具加载和自动前缀缓存。API 当前始终使用最大推理强度,完整模型权重现已开放。
K3 的 $3/$15 并不是国产 API 最低价。只有图片/视频输入、超长输出或更少重试能覆盖溢价时,它才更划算。Moonshot 也明确表示 K3 整体仍落后于 GPT-5.6 Sol 和 Claude Fable 5。
MiniMax M3 把超长上下文价格打下来了
MiniMax M3 于 2026 年 6 月 1 日上线,支持 1M 上下文、图片和视频输入、工具调用以及非常大的最大输出。国际站标准价格只有 $0.30/$1.20,适合长代码库、多模态 Agent 和长输出任务。
GLM-5.3 更新,但按量价格待公布
Z.AI 于 8 月 14 日发布 GLM-5.3,提供 1M 上下文和 128K 最大输出。目前仅 GLM Coding Plan 可用,标准 API 和 Token 价格仍是即将上线。因此 GLM-5.2 继续作为当前 $1.40/$4.40 的按量价格行,不能把 5.2 价格复制给 5.3。
千问已经远不止 Qwen 2.5
Qwen3.7 Plus 和 Max 已通过阿里云百炼提供 1M 上下文。Plus 更适合作为性价比主力;Max 属于高价旗舰,只应在质量提升可以被业务评测证明时使用。
推荐路由
| 工作负载 | 建议起点 |
|---|---|
| 分类、抽取、简单工具调用 | DeepSeek V4 Flash |
| 成本敏感的 Coding Agent | 小米 MiMo-V2.5 |
| 长代码库、图片/视频输入、长输出 | MiniMax M3 |
| 需要已定价 API 的多小时工程工作流 | GLM-5.2 |
| 评测最新 GLM 编程模型 | 通过 Coding Plan 使用 GLM-5.3 |
| 图片/视频 Agent 或输出超过 384K | Kimi K3 |
| 已经使用阿里云技术栈 | Qwen3.7 Plus |
不要把全部流量都打到一个旗舰模型。应该测量任务成功率、总输出 token、重试次数、延迟和人工修复时间。高单价模型可能拥有更低的单任务成本,但必须由你的真实任务集证明。
可以使用 AI 模型价格计算器 对比 canonical 数据中使用美元定价的模型。
继续阅读 Kimi K3 API 指南或 GLM-5.3、DeepSeek V4 与 Kimi K3 对比。
官方来源核验于 2026 年 8 月 17 日:Kimi K3 定价、GLM-5.3 文档、Z.AI 定价、MiniMax 价格、阿里云百炼价格、DeepSeek 价格和 小米 MiMo 价格。