DevTk.AI
GPT-5.6 价格OpenAI APIGPT-5.6 SolGPT-5.6 TerraGPT-5.6 LunaAPI 成本

GPT-5.6 API 价格指南 2026:Sol、Terra、Luna Token 成本详解

详解 GPT-5.6 Sol、Terra、Luna API 价格,覆盖缓存读取、缓存写入、长上下文、Batch、Flex、Priority 和成本示例。

DevTk.AI 2026-07-14 11 分钟阅读

OpenAI 于 2026 年 7 月 9 日正式发布 GPT-5.6 系列。它包含三个 API 档位:面向前沿能力的 GPT-5.6 Sol、平衡智能与成本的 GPT-5.6 Terra,以及适合高频低成本任务的 GPT-5.6 Luna

先看最核心的标准价格:

模型API 模型 ID输入缓存读取输入输出
GPT-5.6 Solgpt-5.6-sol$5.00$0.50$30.00
GPT-5.6 Terragpt-5.6-terra$2.50$0.25$15.00
GPT-5.6 Lunagpt-5.6-luna$1.00$0.10$6.00

以上均为短上下文 Standard 模式下每 100 万 Token 的美元价格。gpt-5.6 是指向 gpt-5.6-sol 的别名。

GPT-5.6 三档模型概览

三个模型都有 1,050,000 Token 上下文窗口128,000 最大输出 Token,知识截止日期均为 2026 年 2 月 16 日。它们支持文本和图片输入、文本输出,也支持流式响应、函数调用、结构化输出和推理 Token;目前不支持微调。

模型定位上下文最大输出推理强度
GPT-5.6 Sol高难度专业、编程、研究与 Agent 工作1.05M128Knonemax
GPT-5.6 Terra兼顾能力和成本的日常生产任务1.05M128Knonemax
GPT-5.6 Luna高频路由和较轻量任务1.05M128Knonemax

GPT-5.6 还在 Responses API 中加入了 Programmatic Tool Calling、持久化推理、显式 Prompt 缓存控制,以及 Beta 阶段的 Multi-agent 编排。API 的 Pro 模式没有单独的 gpt-5.6-pro 模型 ID,而是在所选 GPT-5.6 模型上设置 reasoning.modepro

标准价格与长上下文价格

GPT-5.6 新增了单独计费的缓存写入操作。缓存读取相对普通输入优惠 90%,把 Token 写入缓存则按普通输入价格的 1.25 倍计费。

当 Prompt 的输入超过 272K Token 时,OpenAI 会对整个请求应用长上下文价格:输入、缓存读取和缓存写入都是短上下文价格的 2 倍,输出是短上下文价格的 1.5 倍。

模型上下文区间输入缓存读取缓存写入输出
GPT-5.6 Sol输入不超过 272K$5.00$0.50$6.25$30.00
GPT-5.6 Sol输入超过 272K$10.00$1.00$12.50$45.00
GPT-5.6 Terra输入不超过 272K$2.50$0.25$3.125$15.00
GPT-5.6 Terra输入超过 272K$5.00$0.50$6.25$22.50
GPT-5.6 Luna输入不超过 272K$1.00$0.10$1.25$6.00
GPT-5.6 Luna输入超过 272K$2.00$0.20$2.50$9.00

以上价格均按每 100 万 Token 计算。工具调用可能产生额外费用。例如,OpenAI 当前对 Web Search 按调用次数收费,搜索内容消耗的模型 Token 也会按模型价格计算。

Batch、Flex 与 Priority 价格

OpenAI 为 GPT-5.6 公布了四种处理模式。Batch 和 Flex 的短上下文 Token 价格都是 Standard 的 50%,Priority 则是 GPT-5.6 Standard 价格的 2 倍。

模型处理模式输入缓存读取缓存写入输出
GPT-5.6 SolStandard$5.00$0.50$6.25$30.00
GPT-5.6 SolBatch / Flex$2.50$0.25$3.125$15.00
GPT-5.6 SolPriority$10.00$1.00$12.50$60.00
GPT-5.6 TerraStandard$2.50$0.25$3.125$15.00
GPT-5.6 TerraBatch / Flex$1.25$0.125$1.5625$7.50
GPT-5.6 TerraPriority$5.00$0.50$6.25$30.00
GPT-5.6 LunaStandard$1.00$0.10$1.25$6.00
GPT-5.6 LunaBatch / Flex$0.50$0.05$0.625$3.00
GPT-5.6 LunaPriority$2.00$0.20$2.50$12.00

这里展示的是短上下文价格。官方定价页也列出了更高的长上下文 Batch 和 Flex 价格。对于 2026 年 3 月 5 日及以后发布、符合数据驻留条件的模型,区域处理还会加收 10%。

简单月度成本示例

假设一个应用每月使用 200 万未缓存输入 Token50 万输出 Token,采用短上下文 Standard 模式,并且不包含付费工具调用。

模型输入成本输出成本合计
GPT-5.6 Sol2 x $5.00 = $10.000.5 x $30.00 = $15.00$25.00
GPT-5.6 Terra2 x $2.50 = $5.000.5 x $15.00 = $7.50$12.50
GPT-5.6 Luna2 x $1.00 = $2.000.5 x $6.00 = $3.00$5.00

对于重复 Prompt 前缀,必须同时计算第一次写入和后续读取。一个 100 万 Token 的前缀先写入一次、再读取九次,Sol 的输入侧成本是 $10.75,而十次都走普通输入则是 $50.00。同样模式下,Terra 是 $5.375 对比 $25.00,Luna 是 $2.15 对比 $10.00。输出和工具费用需要另外计算。

你可以用 AI 模型价格计算器 测试自己的输入、输出和缓存比例。

GPT-5.6 Sol、Terra、Luna 怎么选?

当一次成功结果的价值远高于 Token 账单时,选择 GPT-5.6 Sol。它适合困难编程、研究、网络安全、科学、设计和多步骤专业工作流。

如果你需要较强推理能力,但无法让所有请求都使用 Sol,可以把 GPT-5.6 Terra 作为第一条生产基线。OpenAI 把 Terra 描述为 GPT-5.6 系列中对应以往 mini 档的模型,不过它的 $2.50/$15 标准价格高于旧款 mini 模型。

GPT-5.6 Luna 适合分类、抽取、路由、轻量 Agent 和高频任务。它是 GPT-5.6 系列中价格最低的选择,但旧款 GPT-5 和 GPT-5.4 nano 档模型的单 Token 成本仍可能更低。

从 GPT-5.5 或 GPT-5.4 迁移时,OpenAI 建议先测试相同推理强度,再额外测试低一级的设置。GPT-5.6 可能用更少输出 Token 保持质量,但这个结论仍需用你自己的评测集验证。

API 调用示例

对于推理、工具调用和多轮工作流,OpenAI 推荐使用 Responses API:

from openai import OpenAI

client = OpenAI()

response = client.responses.create(
    model="gpt-5.6-terra",
    reasoning={"effort": "medium"},
    input="对比这两个 API 设计,并返回风险最高的三个取舍。"
)

print(response.output_text)

能力优先时使用 gpt-5.6-sol,平衡生产流量使用 gpt-5.6-terra,高频低成本任务使用 gpt-5.6-luna

GPT-5.6 是否取消了 Codex 周限制?

目前没有官方来源支持“GPT-5.6 已全面取消个人 Codex 订阅周限制”这一说法。OpenAI 当前的 Codex 定价页仍列出本地消息与云任务共享的 5 小时用量窗口,并明确说明可能还有额外周限制。GPT-5.6 的 ChatGPT 帮助页也写明,该模型沿用现有套餐额度。

OpenAI 正在把旧的 Enterprise 和 Edu 管理员周度额度设置迁移为月度用量控制。这是企业工作区的计费管理调整,不代表 Plus、Pro 或 Business 可以无限使用,也不同于 API 的 RPM 和 TPM 速率限制。

总结

GPT-5.6 Sol、Terra、Luna 都有 1.05M 上下文和 128K 最大输出,但输入价格按 5:2.5:1 分档,输出价格按 30:15:6 分档。Terra 是更实用的平衡路线,Luna 是高频经济路线,Sol 则是质量优先路线。

做预算时要单独计算缓存写入,留意 272K 长上下文门槛,并把能接受相应处理特性的任务转到 Batch 或 Flex。更多旧款 OpenAI 模型和跨厂商价格,可继续查看 OpenAI API 定价指南AI API 价格对比

截至 2026 年 7 月 14 日核验的 OpenAI 官方来源:

相关文章