Grok API 价格 2026:Grok 4.7、长上下文与工具费用
Grok 4.7 最新 API 价格、200K 长上下文阈值、缓存输入、Priority Processing、工具费用、上下文限制和迁移建议。
Grok 4.7 是 xAI 当前用于编程、对话和 Agent 工具调用的旗舰模型,于 2026 年 9 月 21 日发布,API ID 为 grok-4.7。它提供 500K 上下文、文本和图片输入、函数调用、结构化输出与可配置推理。
xAI 没有为 Grok 4.7 公布独立的文字输出上限,不能把 500K 上下文误写成最大输出。
Grok 最新 API 价格
美元价格,单位为每百万 Token:
| 模型 | 上下文 | 短输入 | 短缓存 | 短输出 | 长输入 | 长缓存 | 长输出 |
|---|---|---|---|---|---|---|---|
| Grok 4.7 | 500K | $2.00 | $0.50 | $6.00 | $4.00 | $1.00 | $12.00 |
| Grok 4.6 | 500K | $2.00 | $0.50 | $6.00 | $4.00 | $1.00 | $12.00 |
| Grok 4.5 | 500K | $2.00 | $0.30 | $6.00 | $4.00 | $0.60 | $12.00 |
| Grok 4.3 | 1M | $1.25 | $0.20 | $2.50 | $2.50 | $0.40 | $5.00 |
| Grok 4.20 各端点 | 1M | $1.25 | $0.20 | $2.50 | $2.50 | $0.40 | $5.00 |
| Grok Build 0.1 | 256K | $1.00 | $0.20 | $2.00 | $2.00 | $0.40 | $4.00 |
Prompt 达到 200K Token 后进入长上下文价。xAI 会把请求里的全部 Token 都按长价收费,而不只是超过 200K 的部分;缓存 Token 也计入阈值。
Grok 4.7 vs 4.6 价格
Grok 4.7 沿用 Grok 4.6 的输入、缓存输入和输出价格,标准档升级没有 Token 单价溢价。此前 Grok 4.6 相对 4.5 已把缓存输入提高 66.7%:短上下文从 $0.30 增至 $0.50,长上下文从 $0.60 增至 $1.00。
从 4.6 迁移到 4.7 的主要风险是行为回归,而不是 Token 涨价。应在贴近生产的评测集上比较单次成功任务成本、推理 Token、延迟和工具调用行为。
200K 成本悬崖
单次请求 199K 输入 + 20K 输出时,Grok 4.7 约为 $0.518。把输入增加到 200K、输出不变,会触发长价,成本变为 $1.04。很小的上下文变化就可能让账单接近翻倍。
可以拆分互相独立的上下文、压缩对话历史,并收紧检索文档;但如果拆分降低成功率并带来重试,未必真的省钱。
Priority Processing 与 Batch
Priority Processing 对输入、缓存输入、输出和推理 Token 收取 2 倍标准价。只有响应确认 "service_tier": "priority" 时才按 Priority 计费。
Grok 4.7、4.6 和 4.5 当前没有 Batch 折扣。xAI 为 Grok 4.3 与 Grok 4.20 端点列出 20% Batch 折扣。
服务端工具费用
模型 Token 价格不包含 xAI 托管工具调用:
| 工具 | 每 1,000 次价格 |
|---|---|
| Web Search | $5.00 |
| X Search | $5.00 |
| Code Execution | $5.00 |
| 附件搜索 | $10.00 |
| 集合搜索 | $2.50 |
| Remote MCP | 只计 Token,无独立调用费 |
例如 10 次 Web Search 会在模型 Token 之外增加 $0.05,小请求里工具费可能反而占主要部分。
成本算例
假设请求均低于 200K,且没有缓存命中:
| 每日用量 | Grok 4.7 | Grok 4.3 / 4.20 | Grok Build 0.1 |
|---|---|---|---|
| 100K 输入 + 50K 输出 | $15/月 | $7.50/月 | $6/月 |
| 1M 输入 + 500K 输出 | $150/月 | $75/月 | $60/月 |
| 10M 输入 + 5M 输出 | $1,500/月 | $750/月 | $600/月 |
Grok 4.7 与 4.6 的公开 Token 单价相同,所以相同 Token 结构的账单一致;工具调用和 Priority Processing 仍需另计。
应该选择哪个 Grok?
- 新的编程、对话和 Agent 接入,在回归评测后选 Grok 4.7。
- 需要固定旧行为时可暂留 Grok 4.6,但它没有价格优势。
- 只有 4.5 更低的缓存输入足以抵消旧模型行为时,才保留 Grok 4.5。
- 低价通用 Agent 与 1M 上下文选 Grok 4.3。
- 需要固定推理行为或 Multi-Agent Beta 时选 Grok 4.20 端点。
- 低价编程公测模型选 Grok Build 0.1。
进一步阅读 Grok 4.7 vs Gemini 3.8 Flash,并用 AI 价格计算器估算当前成本。
官方来源核验于 2026 年 9 月 25 日:xAI 价格、Grok 4.7 文档、发布记录和 Priority Processing。