Grok API 价格 2026:Grok 4.5、4.3、4.20 与 Build 最新定价
xAI Grok 4.5、Grok 4.3、三个 Grok 4.20 端点和 Grok Build 0.1 最新 API 价格,包含缓存输入、长上下文价格、限额与迁移说明。
xAI 当前语言模型 API 产品线有 6 个 canonical model ID:Grok 4.5、Grok 4.3、3 个 Grok 4.20 端点,以及 Grok Build 0.1。官网首页展示的是标准价;当单次请求超过 20 万上下文 Token 后,输入、缓存输入和输出价格都会翻倍。
当前 Grok API 标准价格
下表价格均为美元 / 百万 Token,适用于不超过 200K 长上下文阈值的请求。
| 模型 | Canonical API ID | 输入 | 缓存输入 | 输出 | 上下文 | 状态 |
|---|---|---|---|---|---|---|
| Grok 4.5 | grok-4.5 | $2.00 | $0.30 | $6.00 | 500K | 已上线;8 月 1 日刷新缓存价 |
| Grok 4.3 | grok-4.3 | $1.25 | $0.20 | $2.50 | 1M | 可用 |
| Grok 4.20 Reasoning | grok-4.20-0309-reasoning | $1.25 | $0.20 | $2.50 | 1M | 可用 |
| Grok 4.20 Non-Reasoning | grok-4.20-0309-non-reasoning | $1.25 | $0.20 | $2.50 | 1M | 可用 |
| Grok 4.20 Multi-Agent | grok-4.20-multi-agent-0309 | $1.25 | $0.20 | $2.50 | 1M | Beta |
| Grok Build 0.1 | grok-build-0.1 | $1.00 | $0.20 | $2.00 | 256K | Public Beta |
3 个 Grok 4.20 端点的 Token 单价相同,但执行方式不同。需要固定版本和可复现行为时,应使用带日期的 canonical ID,而不是会移动的 -latest 别名。
超过 200K 上下文后的价格
单次请求超过 20 万上下文 Token 后,xAI 使用以下长上下文价格:
| 模型 | 输入 | 缓存输入 | 输出 | 最大上下文 |
|---|---|---|---|---|
| Grok 4.5 | $4.00 | $0.60 | $12.00 | 500K |
| Grok 4.3 | $2.50 | $0.40 | $5.00 | 1M |
| Grok 4.20 Reasoning | $2.50 | $0.40 | $5.00 | 1M |
| Grok 4.20 Non-Reasoning | $2.50 | $0.40 | $5.00 | 1M |
| Grok 4.20 Multi-Agent | $2.50 | $0.40 | $5.00 | 1M |
| Grok Build 0.1 | $2.00 | $0.40 | $4.00 | 256K |
这个阈值按单次请求判断,不按每日或每月累计用量判断。把 100 万输入 Token 分成 10 次 100K 请求,使用标准价;一次请求放入超过 200K 的上下文,则该次请求进入长上下文价格档。
每个 Grok 模型适合什么场景
Grok 4.5
Grok 4.5 是 xAI 当前面向编程、Agent 和知识工作的最强模型。它接受文本和图片输入,支持函数调用、结构化输出,以及 low、medium、high 三档推理强度,API 默认使用 high。上下文窗口为 500K,并且它已经成为 Grok Build 的默认模型。
Grok 4.3
Grok 4.3 是成本更低的通用模型,上下文窗口为 1M。它支持 none、low、medium、high 四档可配置推理强度,可以同时覆盖快速非推理请求和更复杂的深度推理任务。
Grok 4.20 Reasoning 与 Non-Reasoning
Grok 4.20 的两个单 Agent 端点直接在 model ID 层区分推理与非推理行为。两者都支持文本和图片输入、函数调用与结构化输出,1M 上下文和 Token 单价与 Grok 4.3 相同。
Grok 4.20 Multi-Agent
Multi-Agent Beta 会并行组织多个 Agent,用于深度研究和多步骤分析。它的单位 Token 价格与另外两个 Grok 4.20 端点相同,但一次多 Agent 运行可能消耗更多总 Token。调用 xAI 提供的网页搜索、X 搜索、代码执行等服务端工具时,还要另付工具调用费。
Grok Build 0.1
Grok Build 0.1 是针对 Agent 软件工程、Web 开发、调试和 MCP 工作流训练的编程模型,上下文窗口为 256K。xAI 当前模型文档明确列出文本和图片输入、推理、函数调用与结构化输出能力。它目前仍是 Public Beta API 模型。
上下文窗口不等于最大输出
xAI 公布了这 6 个端点的上下文窗口,但当前模型页面没有公布最大输出 Token 数。500K 或 1M 上下文不能写成最大输出长度。应用应主动设置输出预算;任何没有出现在 xAI 官方文档里的最大输出数字,都应该标记为未经核验。
成本示例
以下假设每日用量分布在单次上下文不超过 200K 的请求中,且没有缓存命中:
| 每日用量 | Grok 4.5 | Grok 4.3 / Grok 4.20 | Grok Build 0.1 |
|---|---|---|---|
| 10 万输入 + 5 万输出 | $15/月 | $7.50/月 | $6/月 |
| 100 万输入 + 50 万输出 | $150/月 | $75/月 | $60/月 |
| 1000 万输入 + 500 万输出 | $1,500/月 | $750/月 | $600/月 |
作为长上下文对照,一次包含 210K 输入和 20K 输出的请求已经越过阈值。在不计算工具调用费时,Grok 4.5 约为 $1.08,Grok 4.3 或 Grok 4.20 约为 $0.63,Grok Build 0.1 约为 $0.50。
Prompt Caching 最适合重复的系统提示词、工具 Schema 和稳定的仓库上下文。缓存 Token 虽然计费更低,但仍然计入每分钟 Token 限额。
当前 API 速率限制
xAI 当前使用基于累计消费的 API Tier,不再使用一个固定的免费模型限额。Tier 0 是默认等级,不代表 Token 可以免费使用。
| 模型 | Tier 0 RPS | Tier 0 TPM |
|---|---|---|
| Grok 4.5 | 150 | 50M |
| Grok 4.3、两个单 Agent Grok 4.20 端点、Grok Build 0.1 | 37 | 10M |
| Grok 4.20 Multi-Agent | 9 | 2.5M |
自 2026 年 1 月 1 日起,API 累计消费达到 $50、$250、$1,000 和 $5,000 时,会依次解锁 Tier 1 到 Tier 4。xAI 当前没有公布一个保证提供的 $25 API 注册额度;这个优惠属于截至 2024 年底的 API 公测政策,不能继续用于当前成本规划。
已退役的 Grok ID
xAI 的 2026 年 5 月 15 日退役说明明确包含 grok-3、grok-4-0709、Grok 4 Fast 与 Grok 4.1 Fast 的推理/非推理端点,以及 grok-code-fast-1。退役的语言模型请求会重定向到 Grok 4.3,旧编程端点会重定向到 Grok Build 0.1,并按替代模型价格计费。因此,旧模型历史价格已经不能描述真实请求路径。
新集成应从本文当前价格表里的 6 个 canonical ID 中选择,不要再用退役 ID 作为价格锚点。
应该选择哪个模型?
- 最复杂的编程、Agent 和知识工作选择 Grok 4.5。
- 需要更低成本通用 Agent、可配置推理和 1M 上下文时选择 Grok 4.3。
- 希望 model ID 直接固定推理行为时,选择对应的单 Agent Grok 4.20 端点。
- 深度研究任务能够承担更高总 Token 消耗时,选择 Grok 4.20 Multi-Agent。
- 需要更低成本、编程专用的 Public Beta 模型时,选择 Grok Build 0.1。
Grok 默认不能访问当前事件,只有开启服务端搜索工具后才能获得实时网页和 X 数据。实时检索可以提高信息新鲜度,但预算里必须加入工具调用费。
可以使用 AI 模型价格计算器 对比当前使用美元定价的模型。
官方来源核对日期为 2026 年 7 月 14 日:xAI 定价、模型目录、Grok 4.5 模型页面、Grok 4.20 Multi-Agent 文档、API 速率限制、发布记录和5 月 15 日退役说明。