GPT-5.6GPT-5.6 SolGPT-5.6 TerraGPT-5.6 LunaOpenAI API模型路由
GPT-5.6 Sol、Terra、Luna 怎么选:价格、上下文与路由建议
对比 GPT-5.6 Sol、Terra、Luna 的 API 价格、缓存写入、长上下文费率、模型 ID,并给出生产环境分流建议。
DevTk.AI 2026-07-14 5 分钟阅读
OpenAI 在 GPT-5.6 中用 Sol、Terra、Luna 取代了过去旗舰、mini、nano 的命名方式。三个模型都支持文本与图片输入,拥有 105 万 Token 上下文和 12.8 万最大输出。真正的区别是能力、价格,以及生产流量应该如何分配。
快速对比
以下均为每百万 Token 的标准价格。
| 模型 | API 模型 ID | 输入 | 缓存读取 | 缓存写入 | 输出 | 适合场景 |
|---|---|---|---|---|---|---|
| GPT-5.6 Sol | gpt-5.6-sol | $5.00 | $0.50 | $6.25 | $30.00 | 高难代码、研究、复杂 Agent |
| GPT-5.6 Terra | gpt-5.6-terra | $2.50 | $0.25 | $3.125 | $15.00 | 默认生产模型 |
| GPT-5.6 Luna | gpt-5.6-luna | $1.00 | $0.10 | $1.25 | $6.00 | 高频、成本敏感流量 |
不带后缀的 gpt-5.6 会路由到 GPT-5.6 Sol。对成本可预测性有要求时,应使用明确的模型 ID。
长上下文价格
单次请求超过 27.2 万输入 Token 后,OpenAI 会对整次请求应用高价档:输入价格 2 倍,输出价格 1.5 倍。
| 模型 | 长上下文输入 | 长缓存读取 | 长缓存写入 | 长上下文输出 |
|---|---|---|---|---|
| GPT-5.6 Sol | $10.00 | $1.00 | $12.50 | $45.00 |
| GPT-5.6 Terra | $5.00 | $0.50 | $6.25 | $22.50 |
| GPT-5.6 Luna | $2.00 | $0.20 | $2.50 | $9.00 |
不要用短上下文费率估算一个 50 万 Token 的代码库请求。越过阈值后,不只是超出 27.2 万的部分涨价,而是整次请求全部按长上下文档计费。
月度成本示例
假设每月使用 1000 万未缓存输入 Token 和 200 万输出 Token,不计工具调用费用:
| 模型 | 输入成本 | 输出成本 | 合计 |
|---|---|---|---|
| GPT-5.6 Sol | $50 | $60 | $110 |
| GPT-5.6 Terra | $25 | $30 | $55 |
| GPT-5.6 Luna | $10 | $12 | $22 |
Terra 的 Token 单价正好是 Sol 的一半,Luna 则是 Sol 的五分之一。但不同模型完成同一任务所用的推理与输出 Token 可能不同,因此最终任务成本仍要以实际评测为准。
什么时候选 GPT-5.6 Sol
- 一次失败造成的成本高于模型差价。
- 任务涉及高难调试、架构、安全、科学或长时间 Agent 执行。
- 需要 GPT-5.6 最高能力档或
max推理强度。 - 正在评估
pro推理模式。Pro 是 Sol 的运行模式,不是单独的gpt-5.6-proAPI 模型。
什么时候选 GPT-5.6 Terra
- 需要一个用于代码 Agent、文档工作和生产助手的强默认模型。
- Sol 太贵,但小模型失败风险又太高。
- 希望用 Sol 一半的单价获得相同的上下文和输出上限。
对多数团队来说,Terra 是最值得先作为默认路由评测的模型。
什么时候选 GPT-5.6 Luna
- 工作负载是分类、抽取、摘要、搜索初筛或简单代码修改。
- 流量很大,并且可以在低置信度时自动升级模型。
- 需要 105 万上下文,但并非每次调用都需要 Sol 级推理。
Luna 并不只适合短提示词。它的官方上下文和最大输出与 Sol、Terra 相同,但仍应使用自己的任务集验证质量。
实用路由策略
- 日常简单请求先走 Luna。
- 普通代码和专业工作走 Terra。
- 模糊、高风险或首次失败的任务升级到 Sol。
- 不要求即时返回的流量使用 Batch 或 Flex。
- 固定可复用前缀,让缓存读取享受 90% 折扣。
可以先用 AI 模型价格计算器代入自己的 Token 比例,再阅读完整的 GPT-5.6 API 价格指南。