Claude API 定价Claude Opus 5.5Claude Fable 5.1Claude Sonnet 5.5Anthropic
Anthropic Claude API 定价 2026:Opus 5.5、Fable 5.1、Sonnet 5.5
Claude Opus 5.5、Fable 5.1、Sonnet 5.5、Opus 5 和 Haiku 4.5 最新 API 价格,包括提示缓存、Batch 和 Fast mode。
DevTk.AI 2026-02-23 更新于 2026-10-02 5 分钟阅读
Anthropic 当前 Claude API 主线包括:能力最高且广泛开放的 Claude Fable 5.1、大多数高要求任务的默认选择 Claude Opus 5.5、均衡生产流量使用的 Claude Sonnet 5.5,以及速度和成本优先的 Claude Haiku 4.5。
Claude API 每百万 Token 价格
| 模型 | 输入 | 缓存读取 | 5 分钟缓存写入 | 1 小时缓存写入 | 输出 | 上下文 |
|---|---|---|---|---|---|---|
| Claude Fable 5.1 | $10.00 | $0.25 | $12.50 | $20.00 | $50.00 | 100 万 |
| Claude Opus 5.5 | $4.00 | $0.20 | $5.00 | $8.00 | $20.00 | 100 万 |
| Claude Sonnet 5.5 | $2.00 | $0.20 | $2.50 | $4.00 | $10.00 | 100 万 |
| Claude Sonnet 5 | $2.00 | $0.20 | $2.50 | $4.00 | $10.00 | 100 万 |
| Claude Fable 5 | $10.00 | $1.00 | $12.50 | $20.00 | $50.00 | 100 万 |
| Claude Opus 5 | $5.00 | $0.50 | $6.25 | $10.00 | $25.00 | 100 万 |
| Claude Opus 4.8 | $5.00 | $0.50 | $6.25 | $10.00 | $25.00 | 100 万 |
| Claude Haiku 4.5 | $1.00 | $0.10 | $1.25 | $2.00 | $5.00 | 200K |
Anthropic 取消了 Sonnet 5 原计划 9 月执行的涨价,发布时的 $2/$10 已成为永久标准价。Fable 5.1 的缓存读取仅为基础输入价的 0.025 倍,是 Fable 5 缓存读取成本的四分之一。
Sonnet 5.5 于 2026 年 9 月 28 日发布,沿用 Sonnet 5 的 $2/$10 标准价格、$0.20/M 缓存读取与 $2.50/M 五分钟缓存写入;整个 1M 上下文窗口均使用标准价格。
Batch 与 Fast mode
Message Batches API 的输入和输出价格均为标准价的 50%:
| 模型 | Batch 输入 | Batch 输出 |
|---|---|---|
| Fable 5.1 | $5.00 | $25.00 |
| Opus 5.5 | $2.00 | $10.00 |
| Sonnet 5.5 | $1.00 | $5.00 |
| Haiku 4.5 | $0.50 | $2.50 |
Opus 5.5 Fast mode 为 $8/M 输入、$40/M 输出,生成速度最高约为普通模式的 2.5 倍。仅美国推理和符合条件的合作云区域端点加价 10%。
月度成本示例
按 200 万未缓存输入 + 50 万输出 Token 计算:
| 模型 | Standard 成本 |
|---|---|
| Claude Haiku 4.5 | $4.50 |
| Claude Sonnet 5.5 | $9.00 |
| Claude Opus 5.5 | $18.00 |
| Claude Opus 5 | $22.50 |
| Claude Fable 5.1 | $45.00 |
在不使用缓存的 Token 组合中,Opus 5.5 比 Opus 5 低 20%。在 Agent 循环中,它的优势会更大,因为缓存读取价格低 60%。
如何选择 Claude 模型?
- Fable 5.1: 当 Opus 5.5 的评测仍不达标时,用于最困难的长程 Agent、研究、编程和文档任务。
- Opus 5.5: 长程编程 Agent 与专业知识工作的默认高端模型。
- Sonnet 5.5: 编程、工具调用、助手和均衡生产流量的首个基线。
- Haiku 4.5: 提取、分类、路由、短回答和延迟敏感任务。
可阅读 Opus 5.5 性价比分析对比 GPT-6,或用 AI 模型定价计算器计算自己的流量。