Grok API 价格 2026:Grok 4.6、4.5、长上下文与工具费用
Grok 4.6 最新 API 价格、200K 长上下文阈值、相对 Grok 4.5 的缓存涨价、Priority Processing、工具费用、上下文限制和迁移建议。
Grok 4.6 是 xAI 最新的生产推理模型,于 2026 年 8 月 12 日发布,API ID 为 grok-4.6。它提供 500K 上下文、文本和图片输入、函数调用、结构化输出,以及 low、medium、high、xhigh 推理档。
xAI 没有为 Grok 4.6 公布独立的文字输出上限,不能把 500K 上下文误写成最大输出。
Grok 最新 API 价格
美元价格,单位为每百万 Token:
| 模型 | 上下文 | 短输入 | 短缓存 | 短输出 | 长输入 | 长缓存 | 长输出 |
|---|---|---|---|---|---|---|---|
| Grok 4.6 | 500K | $2.00 | $0.50 | $6.00 | $4.00 | $1.00 | $12.00 |
| Grok 4.5 | 500K | $2.00 | $0.30 | $6.00 | $4.00 | $0.60 | $12.00 |
| Grok 4.3 | 1M | $1.25 | $0.20 | $2.50 | $2.50 | $0.40 | $5.00 |
| Grok 4.20 各端点 | 1M | $1.25 | $0.20 | $2.50 | $2.50 | $0.40 | $5.00 |
| Grok Build 0.1 | 256K | $1.00 | $0.20 | $2.00 | $2.00 | $0.40 | $4.00 |
Prompt 达到 200K Token 后进入长上下文价。xAI 会把请求里的全部 Token 都按长价收费,而不只是超过 200K 的部分;缓存 Token 也计入阈值。
Grok 4.6 vs 4.5 价格
Grok 4.6 的普通输入和输出价格与 4.5 相同。缓存输入上涨 66.7%:短上下文从 $0.30 增至 $0.50,长上下文从 $0.60 增至 $1.00。
这对缓存密集 Agent 是迁移风险。xAI 报告了更强的编程和 Agent 结果,并新增 xhigh,但生产升级应该比较单次成功任务成本。Grok 4.5 仍在官方价格表中,没有标记为退役。
200K 成本悬崖
单次请求 199K 输入 + 20K 输出时,Grok 4.6 约为 $0.518。把输入增加到 200K、输出不变,会触发长价,成本变为 $1.04。很小的上下文变化就可能让账单接近翻倍。
可以拆分互相独立的上下文、压缩对话历史,并收紧检索文档;但如果拆分降低成功率并带来重试,未必真的省钱。
Priority Processing 与 Batch
Priority Processing 对输入、缓存输入、输出和推理 Token 收取 2 倍标准价。只有响应确认 "service_tier": "priority" 时才按 Priority 计费。
Grok 4.6 和 4.5 当前没有 Batch 折扣。xAI 为 Grok 4.3 与 Grok 4.20 端点列出 20% Batch 折扣。
服务端工具费用
模型 Token 价格不包含 xAI 托管工具调用:
| 工具 | 每 1,000 次价格 |
|---|---|
| Web Search | $5.00 |
| X Search | $5.00 |
| Code Execution | $5.00 |
| 附件搜索 | $10.00 |
| 集合搜索 | $2.50 |
| Remote MCP | 只计 Token,无独立调用费 |
例如 10 次 Web Search 会在模型 Token 之外增加 $0.05,小请求里工具费可能反而占主要部分。
成本算例
假设请求均低于 200K,且没有缓存命中:
| 每日用量 | Grok 4.6 | Grok 4.3 / 4.20 | Grok Build 0.1 |
|---|---|---|---|
| 100K 输入 + 50K 输出 | $15/月 | $7.50/月 | $6/月 |
| 1M 输入 + 500K 输出 | $150/月 | $75/月 | $60/月 |
| 10M 输入 + 5M 输出 | $1,500/月 | $750/月 | $600/月 |
同样的短上下文、无缓存 Token 总量下,Grok 4.5 账单与 4.6 相同。只有出现缓存输入或启用 Priority 时,4.6 才会更贵。
应该选择哪个 Grok?
- 困难编程与 Agent 任务,评测确认收益后选 Grok 4.6。
- 4.6 的能力提升不足以覆盖缓存涨价时,保留 Grok 4.5。
- 低价通用 Agent 与 1M 上下文选 Grok 4.3。
- 需要固定推理行为或 Multi-Agent Beta 时选 Grok 4.20 端点。
- 低价编程公测模型选 Grok Build 0.1。
进一步阅读 Grok 4.6 vs Gemini 3.7 Flash,并用 AI 价格计算器估算当前模型成本。
官方来源核验于 2026 年 8 月 17 日:xAI 价格、Grok 4.6 文档、发布记录和 Priority Processing。