GPT-5.6 API 价格指南 2026:Sol、Terra、Luna Token 成本详解
详解 GPT-5.6 Sol、Terra、Luna API 价格,覆盖缓存读取、缓存写入、长上下文、Batch、Flex、Priority 和成本示例。
OpenAI 于 2026 年 7 月 9 日正式发布 GPT-5.6 系列。它包含三个 API 档位:面向前沿能力的 GPT-5.6 Sol、平衡智能与成本的 GPT-5.6 Terra,以及适合高频低成本任务的 GPT-5.6 Luna。
先看最核心的标准价格:
| 模型 | API 模型 ID | 输入 | 缓存读取输入 | 输出 |
|---|---|---|---|---|
| GPT-5.6 Sol | gpt-5.6-sol | $5.00 | $0.50 | $30.00 |
| GPT-5.6 Terra | gpt-5.6-terra | $2.50 | $0.25 | $15.00 |
| GPT-5.6 Luna | gpt-5.6-luna | $1.00 | $0.10 | $6.00 |
以上均为短上下文 Standard 模式下每 100 万 Token 的美元价格。gpt-5.6 是指向 gpt-5.6-sol 的别名。
GPT-5.6 三档模型概览
三个模型都有 1,050,000 Token 上下文窗口、128,000 最大输出 Token,知识截止日期均为 2026 年 2 月 16 日。它们支持文本和图片输入、文本输出,也支持流式响应、函数调用、结构化输出和推理 Token;目前不支持微调。
| 模型 | 定位 | 上下文 | 最大输出 | 推理强度 |
|---|---|---|---|---|
| GPT-5.6 Sol | 高难度专业、编程、研究与 Agent 工作 | 1.05M | 128K | none 到 max |
| GPT-5.6 Terra | 兼顾能力和成本的日常生产任务 | 1.05M | 128K | none 到 max |
| GPT-5.6 Luna | 高频路由和较轻量任务 | 1.05M | 128K | none 到 max |
GPT-5.6 还在 Responses API 中加入了 Programmatic Tool Calling、持久化推理、显式 Prompt 缓存控制,以及 Beta 阶段的 Multi-agent 编排。API 的 Pro 模式没有单独的 gpt-5.6-pro 模型 ID,而是在所选 GPT-5.6 模型上设置 reasoning.mode 为 pro。
标准价格与长上下文价格
GPT-5.6 新增了单独计费的缓存写入操作。缓存读取相对普通输入优惠 90%,把 Token 写入缓存则按普通输入价格的 1.25 倍计费。
当 Prompt 的输入超过 272K Token 时,OpenAI 会对整个请求应用长上下文价格:输入、缓存读取和缓存写入都是短上下文价格的 2 倍,输出是短上下文价格的 1.5 倍。
| 模型 | 上下文区间 | 输入 | 缓存读取 | 缓存写入 | 输出 |
|---|---|---|---|---|---|
| GPT-5.6 Sol | 输入不超过 272K | $5.00 | $0.50 | $6.25 | $30.00 |
| GPT-5.6 Sol | 输入超过 272K | $10.00 | $1.00 | $12.50 | $45.00 |
| GPT-5.6 Terra | 输入不超过 272K | $2.50 | $0.25 | $3.125 | $15.00 |
| GPT-5.6 Terra | 输入超过 272K | $5.00 | $0.50 | $6.25 | $22.50 |
| GPT-5.6 Luna | 输入不超过 272K | $1.00 | $0.10 | $1.25 | $6.00 |
| GPT-5.6 Luna | 输入超过 272K | $2.00 | $0.20 | $2.50 | $9.00 |
以上价格均按每 100 万 Token 计算。工具调用可能产生额外费用。例如,OpenAI 当前对 Web Search 按调用次数收费,搜索内容消耗的模型 Token 也会按模型价格计算。
Batch、Flex 与 Priority 价格
OpenAI 为 GPT-5.6 公布了四种处理模式。Batch 和 Flex 的短上下文 Token 价格都是 Standard 的 50%,Priority 则是 GPT-5.6 Standard 价格的 2 倍。
| 模型 | 处理模式 | 输入 | 缓存读取 | 缓存写入 | 输出 |
|---|---|---|---|---|---|
| GPT-5.6 Sol | Standard | $5.00 | $0.50 | $6.25 | $30.00 |
| GPT-5.6 Sol | Batch / Flex | $2.50 | $0.25 | $3.125 | $15.00 |
| GPT-5.6 Sol | Priority | $10.00 | $1.00 | $12.50 | $60.00 |
| GPT-5.6 Terra | Standard | $2.50 | $0.25 | $3.125 | $15.00 |
| GPT-5.6 Terra | Batch / Flex | $1.25 | $0.125 | $1.5625 | $7.50 |
| GPT-5.6 Terra | Priority | $5.00 | $0.50 | $6.25 | $30.00 |
| GPT-5.6 Luna | Standard | $1.00 | $0.10 | $1.25 | $6.00 |
| GPT-5.6 Luna | Batch / Flex | $0.50 | $0.05 | $0.625 | $3.00 |
| GPT-5.6 Luna | Priority | $2.00 | $0.20 | $2.50 | $12.00 |
这里展示的是短上下文价格。官方定价页也列出了更高的长上下文 Batch 和 Flex 价格。对于 2026 年 3 月 5 日及以后发布、符合数据驻留条件的模型,区域处理还会加收 10%。
简单月度成本示例
假设一个应用每月使用 200 万未缓存输入 Token 和 50 万输出 Token,采用短上下文 Standard 模式,并且不包含付费工具调用。
| 模型 | 输入成本 | 输出成本 | 合计 |
|---|---|---|---|
| GPT-5.6 Sol | 2 x $5.00 = $10.00 | 0.5 x $30.00 = $15.00 | $25.00 |
| GPT-5.6 Terra | 2 x $2.50 = $5.00 | 0.5 x $15.00 = $7.50 | $12.50 |
| GPT-5.6 Luna | 2 x $1.00 = $2.00 | 0.5 x $6.00 = $3.00 | $5.00 |
对于重复 Prompt 前缀,必须同时计算第一次写入和后续读取。一个 100 万 Token 的前缀先写入一次、再读取九次,Sol 的输入侧成本是 $10.75,而十次都走普通输入则是 $50.00。同样模式下,Terra 是 $5.375 对比 $25.00,Luna 是 $2.15 对比 $10.00。输出和工具费用需要另外计算。
你可以用 AI 模型价格计算器 测试自己的输入、输出和缓存比例。
GPT-5.6 Sol、Terra、Luna 怎么选?
当一次成功结果的价值远高于 Token 账单时,选择 GPT-5.6 Sol。它适合困难编程、研究、网络安全、科学、设计和多步骤专业工作流。
如果你需要较强推理能力,但无法让所有请求都使用 Sol,可以把 GPT-5.6 Terra 作为第一条生产基线。OpenAI 把 Terra 描述为 GPT-5.6 系列中对应以往 mini 档的模型,不过它的 $2.50/$15 标准价格高于旧款 mini 模型。
GPT-5.6 Luna 适合分类、抽取、路由、轻量 Agent 和高频任务。它是 GPT-5.6 系列中价格最低的选择,但旧款 GPT-5 和 GPT-5.4 nano 档模型的单 Token 成本仍可能更低。
从 GPT-5.5 或 GPT-5.4 迁移时,OpenAI 建议先测试相同推理强度,再额外测试低一级的设置。GPT-5.6 可能用更少输出 Token 保持质量,但这个结论仍需用你自己的评测集验证。
API 调用示例
对于推理、工具调用和多轮工作流,OpenAI 推荐使用 Responses API:
from openai import OpenAI
client = OpenAI()
response = client.responses.create(
model="gpt-5.6-terra",
reasoning={"effort": "medium"},
input="对比这两个 API 设计,并返回风险最高的三个取舍。"
)
print(response.output_text)
能力优先时使用 gpt-5.6-sol,平衡生产流量使用 gpt-5.6-terra,高频低成本任务使用 gpt-5.6-luna。
GPT-5.6 是否取消了 Codex 周限制?
目前没有官方来源支持“GPT-5.6 已全面取消个人 Codex 订阅周限制”这一说法。OpenAI 当前的 Codex 定价页仍列出本地消息与云任务共享的 5 小时用量窗口,并明确说明可能还有额外周限制。GPT-5.6 的 ChatGPT 帮助页也写明,该模型沿用现有套餐额度。
OpenAI 正在把旧的 Enterprise 和 Edu 管理员周度额度设置迁移为月度用量控制。这是企业工作区的计费管理调整,不代表 Plus、Pro 或 Business 可以无限使用,也不同于 API 的 RPM 和 TPM 速率限制。
总结
GPT-5.6 Sol、Terra、Luna 都有 1.05M 上下文和 128K 最大输出,但输入价格按 5:2.5:1 分档,输出价格按 30:15:6 分档。Terra 是更实用的平衡路线,Luna 是高频经济路线,Sol 则是质量优先路线。
做预算时要单独计算缓存写入,留意 272K 长上下文门槛,并把能接受相应处理特性的任务转到 Batch 或 Flex。更多旧款 OpenAI 模型和跨厂商价格,可继续查看 OpenAI API 定价指南 与 AI API 价格对比。
截至 2026 年 7 月 14 日核验的 OpenAI 官方来源: