OpenAI API 价格 2026:GPT-5.6、GPT-5.5、GPT-5.4 与 Codex 成本
OpenAI API 每百万 Token 最新价格:GPT-5.6 Sol、Terra、Luna、GPT-5.5、GPT-5.4 和 Codex,含缓存写入、长上下文、Batch、Flex 与 Priority。
OpenAI 当前 API 主线已经切换到 GPT-5.6 系列:Sol 负责最高能力,Terra 平衡生产质量与价格,Luna 面向成本敏感的大流量。三个模型于 2026 年 7 月 9 日发布,都支持 105 万 Token 上下文和 12.8 万最大输出。
OpenAI API 最新价格
以下为美元 / 百万 Token 的标准价格。
| 模型 | 输入 | 缓存读取 | 缓存写入 | 输出 | 上下文 |
|---|---|---|---|---|---|
| GPT-5.6 Sol | $5.00 | $0.50 | $6.25 | $30.00 | 1.05M |
| GPT-5.6 Terra | $2.50 | $0.25 | $3.125 | $15.00 | 1.05M |
| GPT-5.6 Luna | $1.00 | $0.10 | $1.25 | $6.00 | 1.05M |
| GPT-5.5 | $5.00 | $0.50 | - | $30.00 | 1.05M |
| GPT-5.5 Pro | $30.00 | - | - | $180.00 | 1.05M |
| GPT-5.4 | $2.50 | $0.25 | - | $15.00 | 1.05M |
| GPT-5.4 mini | $0.75 | $0.075 | - | $4.50 | 400K |
| GPT-5.4 nano | $0.20 | $0.02 | - | $1.25 | 400K |
| GPT-5.3-Codex | $1.75 | $0.175 | - | $14.00 | 400K |
gpt-5.6 是 gpt-5.6-sol 的别名。OpenAI 没有提供单独的 gpt-5.6-pro 模型 ID,Pro 是 Sol 上的推理模式。
GPT-5.6 长上下文价格
请求超过 27.2 万输入 Token 后,整次请求按输入 2 倍、输出 1.5 倍计费。
| 模型 | 长上下文输入 | 长缓存读取 | 长缓存写入 | 长上下文输出 |
|---|---|---|---|---|
| GPT-5.6 Sol | $10.00 | $1.00 | $12.50 | $45.00 |
| GPT-5.6 Terra | $5.00 | $0.50 | $6.25 | $22.50 |
| GPT-5.6 Luna | $2.00 | $0.20 | $2.50 | $9.00 |
GPT-5.6 也改变了提示词缓存口径:缓存读取仍享受 90% 折扣,显式缓存写入则按普通未缓存输入的 1.25 倍计费。详细算例见 GPT-5.6 API 价格指南。
Batch、Flex 与 Priority
| 处理模式 | 相对 Standard 价格 | 适合场景 |
|---|---|---|
| Batch | 50% | 可在 24 小时内完成的异步任务 |
| Flex | 50% | 可接受可变延迟的低优先级任务 |
| Standard | 100% | 普通实时流量 |
| Priority | GPT-5.6 为 200% | 对延迟敏感的生产请求 |
例如 GPT-5.6 Terra 在 Batch/Flex 下为 $1.25/M 输入、$7.50/M 输出;Priority 为 $5/M 输入、$30/M 输出。2026 年 3 月 5 日及以后发布且支持区域处理的模型,regional processing 加价 10%。
月度成本示例
以下按短上下文 Standard 价格估算每月 300 万输入和 150 万输出 Token,不计缓存命中:
| 模型 | 月费 |
|---|---|
| GPT-5.4 nano | $2.48 |
| GPT-5.6 Luna | $12.00 |
| GPT-5.4 | $30.00 |
| GPT-5.6 Terra | $30.00 |
| GPT-5.5 | $60.00 |
| GPT-5.6 Sol | $60.00 |
Terra 与 GPT-5.4 单价完全相同,Sol 与 GPT-5.5 单价完全相同。因此升级判断应该基于任务成功率、Token 效率和迁移风险,而不只是标价。
OpenAI 模型怎么选
- **GPT-5.6 Sol:**高难代码、研究、安全、复杂工具调用和高影响 Agent 任务。
- **GPT-5.6 Terra:**默认生产代码、助手、文档工作和均衡 Agent 工作流。
- **GPT-5.6 Luna:**抽取、分类、仓库搜索、摘要和高频路由。
- **GPT-5.4 mini/nano:**在尚未完成 5.6 迁移评测时继续承担成熟低价路由。
- **GPT-5.3-Codex:**官方当前价目表仍说明 Codex Code Review 使用该模型。
更完整的选型见 GPT-5.6 Sol、Terra、Luna 对比。
Codex 限制与 API 限流不是一回事
直接 API 按量付费,并受组织/项目 RPM、TPM 限制。ChatGPT 套餐内 Codex 会换算成积分和产品额度。OpenAI 当前 Codex 页面仍说明有 5 小时窗口,而且可能有额外周限制。
Enterprise/Edu 管理员正在把旧工作区周度积分控制迁移为月度 Usage limits。这项管理迁移不代表所有个人 Codex 周额度已经消失。详细解释见 GPT-5.6 Codex 限制指南。
成本控制清单
- 日常任务先用 Luna,普通生产任务用 Terra,必要时再升级 Sol。
- 保持可复用提示词前缀稳定,提高缓存读取比例。
- 单独预算 GPT-5.6 的显式缓存写入成本。
- 把超过 27.2 万输入 Token 的请求作为独立成本档。
- 不要求即时返回的任务使用 Batch 或 Flex。
- 从 OpenAI Dashboard 读取当前 RPM、TPM 和用量限制。
可以用 AI 模型价格计算器代入自己的 Token 比例。