DevTk.AI
Grok 4.7Gemini 3.8 FlashxAI APIGemini API模型对比

Grok 4.7 vs Gemini 3.8 Flash:API 价格、编程与 200K 成本悬崖

对比 Grok 4.7 与 Gemini 3.8 Flash 的最新 API 价格、缓存输入、上下文、多模态、编程 Agent 和长上下文计费。

DevTk.AI 2026-08-17 更新于 2026-09-25 5 分钟阅读

Grok 4.7 与 Gemini 3.8 Flash 都是面向编程和 Agent 的当前生产模型,但两者的计费曲线完全不同。Grok 更强调旗舰编程、推理和 xAI 服务端工具;Gemini 提供 1M 上下文、更广的原生输入类型,以及持续到 2026 年底的引导价。

对大多数高吞吐任务,Gemini 3.8 Flash 的 API 成本明显更低。只有当 Grok 4.7 的编程与 Agent 行为能明显提高任务完成率时,它的 Token 溢价才有机会收回。

当前 API 价格

美元价格,单位为每百万 Token:

模型输入缓存输入输出上下文长上下文规则
Grok 4.7,prompt 少于 200K$2.00$0.50$6.00500K无
Grok 4.7,prompt 达到 200K$4.00$1.00$12.00500K整个请求全部按长上下文价
Gemini 3.8 Flash,至 12 月 31 日$0.75$0.075$3.751,048,576没有 200K 阶梯
Gemini 3.8 Flash,2027 年起$1.50$0.15$7.501,048,576标准价

Google 同时列出了 2026 年 Batch/Flex 价格:输入 $0.375/M、缓存输入 $0.0375/M、输出 $1.875/M。Grok 4.7 当前没有 Batch 折扣。xAI Priority Processing 是另一种低延迟档,Token 价格为标准价 2 倍。

三个工作负载算例

工作负载Grok 4.7Gemini 3.8 Flash 当前价
100K 输入 + 20K 输出$0.32$0.15
单次 300K 输入 + 30K 输出$1.56$0.34
300K 缓存输入 + 30K 输出$0.66$0.135,另加缓存存储

Gemini 第三个例子若把 300K Token 存储一小时,需要再加 $0.15,合计 $0.285,仍低于 Grok 的 $0.66。

第二行体现了 Grok 的 200K 成本悬崖。Prompt 达到 200K 后,xAI 会把该请求的全部输入、缓存输入和输出按长上下文价格计费。Gemini 没有这一阈值,而且上下文上限超过 Grok 两倍。

Grok 4.7 vs Grok 4.6

Grok 4.7 的输入、缓存输入和输出价都与 4.6 相同:

上下文档位Grok 4.6 缓存Grok 4.7 缓存涨幅
少于 200K$0.50$0.500%
达到 200K$1.00$1.000%

因此从 4.6 升级在 Token 单价上是中性的。生产环境仍应回归测试推理 Token、延迟、工具行为和任务完成率。

能力差异

维度Grok 4.7Gemini 3.8 Flash
原生输入文本、图片文本、图片、视频、音频、PDF
输出文本;xAI 未设独立文字输出上限文本,最多 65,536 Token
上下文500K1,048,576
推理控制可配置low、medium、high
内置工具Web、X 搜索、代码执行、文件/集合搜索、Maps、代码执行、文件搜索、URL context、Computer Use 预览
异步折扣Grok 4.7 无 Batch 折扣支持 Batch 和 Flex

工具调用可能比 Token 更贵。xAI 的 Web Search、X Search 和 Code Execution 为 $5/千次,附件搜索 $10/千次,集合搜索 $2.50/千次;这些费用不包含在模型 Token 单价中。

应该选谁?

在困难代码修改、自主工具循环、X 数据研究或高推理任务中,如果评测显示明显优势,选择 Grok 4.7。尽量把 Prompt 控制在 200K 以下,并测量缓存 Token 占比。

高吞吐、超长上下文、音视频/PDF、Google grounding 或 Batch/Flex 流量,选择 Gemini 3.8 Flash。它的引导价在 12 月 31 日后结束,因此 2027 年预算还要用 $1.50/$7.50 做压力测试。

结论

Gemini 3.8 Flash 赢在 API 成本和上下文容量;Grok 4.7 是能力导向的购买,只有更高任务成功率或 xAI 原生工具能覆盖更高 Token 与缓存账单时才值得。实用架构是 Gemini 承担大流量,Grok 作为经过评测的升级路由。

官方来源核验于 2026 年 9 月 25 日:Grok 4.7 文档、xAI 价格、Gemini 3.8 Flash 模型页、Gemini 价格。

更多模型见 AI 价格计算器和 Grok API 价格指南。

相关文章