GLM-5.3 vs DeepSeek V4 vs Kimi K3:API 状态、价格与 Agent 选型
在不虚构 GLM-5.3 API 价格的前提下,对比 GLM-5.3、GLM-5.2、DeepSeek V4 与 Kimi K3 的上下文、输出、可用状态和路由建议。
GLM-5.3 于 2026 年 8 月 14 日发布,但目前还不能作为普通按量 API 参与价格排名。Z.AI 明确写明它已在 GLM Coding Plan 全量可用,标准模型 API 则“即将上线”。官方美元与人民币价格表都没有 GLM-5.3 Token 单价。
这个区别很重要。直接把 GLM-5.2 的 $1.40/$4.40 复制到 5.3,会得到整齐的表格,却会给出错误账单。
先看可用状态
| 模型 | 8 月 17 日可用状态 | 输入 | 缓存输入 | 输出 | 上下文 | 最大输出 |
|---|---|---|---|---|---|---|
| GLM-5.3 | GLM Coding Plan;按量 API 即将上线 | 未公布 | 未公布 | 未公布 | 1M | 128K |
| GLM-5.2 | Z.AI 按量 API | $1.40 | $0.26 | $4.40 | 1M | 128K |
| DeepSeek V4 Flash,闲时 | 按量 API | $0.22 | $0.007 | $0.66 | 1M | 384K |
| DeepSeek V4 Flash,高峰 | 按量 API | $0.44 | $0.014 | $1.32 | 1M | 384K |
| Kimi K3 | 全球按量 API | $3.00 | $0.30 | $15.00 | 1.05M | 最多 1.05M |
GLM-5.3 的文档模型 ID 是 glm-5.3,但模型 ID 出现在文档中不代表普通 Token 计费已经开放。模型文档、Coding Plan、权重下载和按量 API 是不同的发布状态。
GLM-5.3 更新了什么
Z.AI 将 GLM-5.3 描述为基于同一 GLM-5.2 base、完全通过 post-training 获得提升的版本,重点加强编程、复杂工程、Agent 和网络安全。它保持 1M 上下文和 128K 最大输出;Thinking 始终开启,支持 low、high、max 推理档。
Z.AI 称其内部 Z.ai Code Bench 提升 50%。这是厂商结果,不是独立跨模型评测,生产选型仍需使用自己的任务集。
官方还表示权重会在发布后开放。截至 8 月 17 日,更准确的表述是“已宣布的开放权重模型,权重下载仍待上线”,而不是“已经可以下载”。
已定价模型的工作负载对比
按 200 万缓存未命中输入 + 50 万输出 Token,只有已经公布按量价格的模型能进入成本表:
| 模型 | 成本 |
|---|---|
| DeepSeek V4 Flash,闲时 | $0.77 |
| DeepSeek V4 Flash,高峰 | $1.54 |
| GLM-5.2 | $5.00 |
| Kimi K3 | $13.50 |
| GLM-5.3 | 暂时无法计算 |
最低 Token 价不一定等于最低完成任务成本。K3 的原生视觉输入与超长输出可能减少预处理或多次调用;GLM-5.2 可能在长周期编程中减少升级次数;DeepSeek 的时段与缓存命中率会显著改变账单。
当前路由建议
| 需求 | 起始路由 |
|---|---|
| 最低成本的长上下文文本流量 | DeepSeek V4 Flash,优先闲时 |
| 需要已公布稳定价格的 GLM 按量 API | GLM-5.2 |
| 测试最新 GLM 编程能力 | 通过 Coding Plan 使用 GLM-5.3 |
| 原生图片/视频输入或极长输出 | Kimi K3 |
| 做 GLM-5.3 生产预算 | 等待官方价格表 |
在 Z.AI 发布按量 API 与价格之前,不要把生产路由中的 glm-5.2 直接替换成 glm-5.3。价格发布后也应重跑质量与成本评测,不能假设新模型沿用旧价。
结论
GLM-5.3 是最新模型,但 GLM-5.2 仍是当前已有美元按量价格的 Z.AI API。DeepSeek V4 Flash 是低价文本路由,Kimi K3 是高端多模态与长输出路由。现在可以用 Coding Plan 评测 GLM-5.3;公平的 API 价格对比必须等官方 Token 单价。
官方来源核验于 2026 年 8 月 17 日:GLM-5.3 模型文档、GLM-5.3 发布文章、Z.AI 美元价格、DeepSeek 价格、Kimi 平台价格。
当前完整价格见 国产 AI 模型 API 对比和 AI 价格计算器。