Kimi K3Kimi K2.7 CodeMoonshot AICoding 模型API 价格
Kimi K3 vs K2.7 Code:价格、上下文、Coding 与升级指南
对比 Kimi K3 与 Kimi K2.7 Code 的全球和中国区 API 价格、上下文、输出限制、多模态能力、缓存与升级策略。
DevTk.AI 2026-07-19 更新于 2026-07-19 5 分钟阅读
Kimi K3 是新一代通用旗舰,但对能放进现有限制的 Coding 任务,K2.7 Code 仍然便宜很多。把所有 K2.7 请求直接迁移到 K3,会让全球站输出价格从 $4/M 上升到 $15/M。
更合理的升级方式是按需路由:只有真正需要 1M 上下文、超长生成、更强 Agent 架构或高级结构化输出的任务才使用 K3。
全球 API 对比
| Kimi K2.7 Code | Kimi K3 | |
|---|---|---|
| 缓存未命中输入 / 百万 | $0.95 | $3.00 |
| 缓存输入 / 百万 | $0.19 | $0.30 |
| 输出 / 百万 | $4.00 | $15.00 |
| 上下文 | 256K 级 | 1M |
| canonical 最大输出 | 32K | 最高 1,048,576 |
| 定位 | Coding 专用 | Coding、研究和 Agent 通用旗舰 |
| 输入 | 文本、图片、视频 | 文本、图片、视频 |
| 推理 | Thinking-only | 始终推理;API 当前为 max |
K3 的缓存未命中输入价是 K2.7 Code 的 3.16 倍,输出价是 3.75 倍。缓存输入价差距小一些:K3 为 $0.30/M,K2.7 Code 为 $0.19/M。
中国区 API 对比
| Kimi K2.7 Code | Kimi K3 | |
|---|---|---|
| 缓存未命中输入 / 百万 | ¥6.50 | ¥20.00 |
| 缓存输入 / 百万 | ¥1.30 | ¥2.00 |
| 输出 / 百万 | ¥27.00 | ¥100.00 |
预算文档中必须保留货币和区域。全球美元表与中国区人民币表是两份独立官方价目,不是汇率换算。
任务成本示例
按照全球 API 价格,一次 200 万输入加 50 万输出 token 的任务,在没有缓存时:
| 模型 | 成本 |
|---|---|
| Kimi K2.7 Code | 2 × $0.95 + 0.5 × $4 = $3.90 |
| Kimi K3 | 2 × $3 + 0.5 × $15 = $13.50 |
每月运行 100 次这种任务,就是 $390 与 $1,350。K3 应该靠成功率赢得流量,而不是因为更新。
这些情况升级 K3
- 仓库或研究上下文经常超过 K2.7 窗口。
- 工作流需要明显超过 32K 的输出。
- Strict JSON Schema、Partial Mode 或动态工具加载能简化 Agent。
- 困难多步任务在 K2.7 上反复重试或需要人工修复。
- 希望用一个旗舰同时处理 Coding、研究、图片和视频任务。
这些情况保留 K2.7 Code
- 主要是 256K 以内的范围明确代码编辑。
- 应用会输出大量代码,输出单价是主要成本。
- K2.7 已经能首轮通过所需测试。
- 需要一个便宜默认路由,再把困难任务升级。
现有 K2.7 部署不需要一次性全量迁移。先把 K3 加成升级路由,把失败的 K2.7 任务在 K3 上重放,再把新增成功率与上面示例中的 $9.60 差价对比。
迁移清单
- 把
kimi-k3加成独立模型配置,不要静默覆盖旧 ID。 - 删除 K2.x 的
thinking对象,改用顶层reasoning_effort: "max"。 - 多轮对话和工具循环要回传完整 assistant message,包括
reasoning_content、content和tool_calls。 - 只为确实需要的工作流提高生成上限。
- 把稳定指令和工具 Schema 放在开头,以便自动缓存匹配。
- 用自己的 Schema 验证工具调用和结构化输出。
- 记录缓存命中、重试、测试通过、输出长度和人工修复时间。
- 只有单个成功任务成本下降时,才把 K3 提升为默认模型。
接入细节见 K3 API 价格指南,也可以继续对比 GPT-5.6 Sol和 GLM-5.2/DeepSeek V4。
官方来源核验于 2026 年 7 月 19 日:Kimi K3 发布、K3 API Quickstart、全球 API 价格、中国区 K3 价格和 Kimi Code 更新日志。