DevTk.AI
OpenAI API 定价GPT-6 定价GPT-6 AstraGPT-6.1 SolGPT-6 LunaAPI 成本

OpenAI API 定价 2026:GPT-6、GPT-5.6 与 Codex 成本

GPT-6 Astra、GPT-6.1 Sol、Luna、GPT-5.6 和 Codex 最新 API 价格,包括缓存写入、长上下文、Batch、Flex 和 Fast mode。

DevTk.AI 2026-02-24 更新于 2026-10-02 5 分钟阅读

OpenAI 当前通用 API 主线是 GPT-6:Astra 面向最高能力,Sol 面向高要求编程与 Agent,Luna 面向高效的大规模任务。GPT-5.6 仍然可用,其中 GPT-5.6 Sol 的 $4/$20 促销价至少持续至 2026 年 11 月 21 日。

2026 年 9 月 29 日发布的 GPT-6.1 Sol 是当前均衡档,输入/输出仍为 $2/$10,缓存读取从 GPT-6 Sol 的 $0.20/M 降到 $0.10/M。旧 gpt-6-sol 的模型 ID 和 $0.20/M 缓存价仍独立保留。

当前 OpenAI API 价格

下表为短上下文 Standard 价格,单位为美元/百万 Token。

模型输入缓存读取缓存写入输出上下文
GPT-6 Astra$10.00$1.00$12.50$50.00105 万
GPT-6.1 Sol$2.00$0.10$2.50$10.00105 万
GPT-6 Luna$0.10$0.01$0.125$0.50105 万
GPT-5.6 Sol$4.00$0.40$5.00$20.00105 万
GPT-5.6 Terra$2.00$0.20$2.50$12.00105 万
GPT-5.6 Luna$0.20$0.02$0.25$1.20105 万
GPT-5.5$5.00$0.50-$30.00105 万
GPT-5.4$2.50$0.25-$15.00105 万
GPT-5.4 mini$0.75$0.075-$4.50400K
GPT-5.4 nano$0.20$0.02-$1.25400K
GPT-5.3-Codex$1.75$0.175-$14.00400K

GPT-6.1 Sol 缓存读取为普通输入价的 5%,Astra 和 Luna 为 10%,显式缓存写入为普通输入价的 1.25 倍。三款 GPT-6 均支持文本和图片输入、最高 128K 输出、函数调用、结构化输出,以及 Responses API 内置工具。

GPT-6 长上下文价格

提示词超过 272K 输入 Token 后,较高价格作用于整个请求。

模型长上下文输入长上下文缓存读取长上下文缓存写入长上下文输出
GPT-6 Astra$20.00$2.00$25.00$75.00
GPT-6.1 Sol$4.00$0.20$5.00$15.00
GPT-6 Luna$0.20$0.02$0.25$0.75

详细示例和迁移建议见 GPT-6 API 定价指南。

Batch、Flex、Standard 与 Fast mode

处理模式相对价格用途
Batch50%24 小时窗口内异步任务
Flex50%可接受延迟的低优先级工作
Standard100%普通生产流量
Fast mode200%延迟敏感流量
Ultrafast(仅 Astra)600%极低延迟输出

2026 年 3 月 5 日及以后发布且符合条件的模型,区域处理加价 10%。Web Search 等托管工具另行计费。

Astra 的 Ultrafast 短上下文输入/输出为 $60/$300/M,超过 272K 输入后为 $120/$450/M;它与 Fast mode 是不同计费档。

成本示例

短上下文 Standard 下,按 300 万未缓存输入 + 150 万输出 Token 计算:

模型总成本
GPT-6 Luna$1.05
GPT-5.6 Luna$2.40
GPT-6.1 Sol$21.00
GPT-5.6 Terra$24.00
GPT-5.6 Sol$42.00
GPT-6 Astra$105.00

该组合下 GPT-6.1 Sol 比 GPT-5.6 Terra 更便宜,GPT-6 Luna 又把已降价的 GPT-5.6 Luna 成本砍半以上。Astra 是高端升级档,必须通过任务完成质量证明其成本合理。

如何选择?

  • GPT-6 Astra: 失败、重试或人工修复成本很高的高价值任务。
  • GPT-6.1 Sol: 高要求生产编程、工具调用、推理和 Agent 工作流。
  • GPT-6 Luna: 路由、提取、分类、搜索、摘要和高吞吐自动化。
  • GPT-5.6: 已评测的生产系统可继续保留;新部署应先测试 GPT-6.1 Sol 和 Luna。
  • GPT-5.3-Codex: 既有工作流明确需要专用 Codex API 模型时使用。

可用 AI 模型定价计算器计算实际流量。直接 API 限流与 ChatGPT/Codex 订阅额度属于不同体系。

官方来源

相关文章