DevTk.AI
Gemini API 定价Gemini 3.8 FlashGemini 3.7 FlashGoogle AI模型对比

Gemini API 价格 2026:Gemini 3.8 Flash 最新引导价

Gemini 3.8 Flash 当前 API 价格、2027 年计划恢复价、Batch/Flex 折扣、缓存、上下文和模型选型。

DevTk.AI 2026-02-24 更新于 2026-09-25 6 分钟阅读

Gemini 3.8 Flash 是 Google 最新的 GA Flash 模型,于 2026 年 9 月 2 日发布,面向长周期软件工程、自主 Agent 和复杂企业工作流。Google 为它提供持续到 2026 年 12 月 31 日的引导价,与 Gemini 3.7 和 3.6 Flash 相同。

当前标准同步价格为 输入 $0.75/M、缓存输入 $0.075/M、输出 $3.75/M。从 2027 年 1 月 1 日起,计划恢复为 $1.50/$0.15/$7.50。

Gemini 当前 API 价格

标准同步调用,美元/百万 Token:

模型输入缓存输入输出上下文最大输出
Gemini 3.8 Flash,至 12 月 31 日$0.75$0.075$3.751,048,57665,536
Gemini 3.7 Flash,至 12 月 31 日$0.75$0.075$3.751,048,57665,536
Gemini 3.6 Flash,至 12 月 31 日$0.75$0.075$3.751,048,57665,536
Gemini 3.5 Flash-Lite$0.30$0.03$2.501,048,57665,536
Gemini 3.5 Flash$1.50$0.15$9.001,048,57665,536
Gemini 3.1 Pro Preview,不超过 200K$2.00$0.20$12.001,048,57665,536
Gemini 2.5 Flash$0.30$0.03$2.501M65,536
Gemini 2.5 Flash-Lite$0.10$0.01$0.401M65,536

Gemini 3.8、3.7 和 3.6 在引导期的缓存存储费为 $0.50/百万 Token/小时,2027 年 1 月 1 日增至 $1.00。

Gemini 3.8 vs 3.7 Flash

两者当前 Token 价格、上下文、最大输出、原生输入类型和内置工具套件相同。Google 把 3.8 定位为面向长周期工程与自主 Agent 的最强 Flash 模型。

新生产接入应从 gemini-3.8-flash 开始评测。只有回归测试、提示词行为或灰度发布需要旧版本时,才保留 gemini-3.7-flash。

引导价与 2027 年价格

模型时段输入缓存输入输出
Gemini 3.8 / 3.7 / 3.6 Flash至 2026-12-31$0.75$0.075$3.75
Gemini 3.8 / 3.7 / 3.6 Flash2027-01-01 起$1.50$0.15$7.50

不要把 2026 引导价当成长期价格。预算应同时包含当前账单和已经公布的 2027 恢复价。

Batch 与 Flex

模型当前 Batch/Flex 输入缓存输入输出
Gemini 3.8 Flash$0.375$0.0375$1.875
Gemini 3.7 Flash$0.375$0.0375$1.875
Gemini 3.6 Flash$0.375$0.0375$1.875
Gemini 3.5 Flash-Lite$0.15$0.02$1.25
Gemini 3.5 Flash$0.75$0.075-$0.08$4.50

Batch/Flex 适合离线抽取、索引、评测和排队 Agent。Priority 更贵,应留给真正对延迟敏感的流量。

Gemini 3.8 支持什么

字段Gemini 3.8 Flash
模型 IDgemini-3.8-flash
状态GA
输入文本、图片、视频、音频、PDF
输出文本
Thinking 档low、medium、high
工具搜索、Maps、代码执行、文件搜索、URL context、函数调用、Computer Use 预览
消费档Standard、Batch、Flex、Priority

最新 Gemini 已弃用 temperature、top_p 和 top_k 采样参数。迁移时 Google 建议使用 thinking_level,而不是旧的 thinking_budget。

成本算例

按当前引导期同步价、无缓存:

每日用量Gemini 3.8 Flash 月成本Gemini 3.5 Flash-Lite 月成本
100K 输入 + 50K 输出$7.88$4.65
1M 输入 + 500K 输出$78.75$46.50
10M 输入 + 5M 输出$787.50$465.00

2027 年计划价生效后,同样 Gemini 3.8 流量成本翻倍。符合条件的异步任务可以用 Batch/Flex 把 Token 费减半。

应该选择哪个 Gemini?

  • 当前编程、Agent、多模态和 Google grounding 生产任务选 Gemini 3.8 Flash。
  • 只有兼容或灰度需要时选 Gemini 3.7 Flash,它已经没有价格优势。
  • 低价、高吞吐多模态路由选 Gemini 3.5 Flash-Lite。
  • 兼容旧工作负载且追求最低价时,可评测 Gemini 2.5 Flash-Lite,但要先核对生命周期和质量。
  • 只有特定 Pro 行为足以覆盖预览和长上下文限制时,才用 Gemini 3.1 Pro Preview。

进一步阅读 Grok 4.7 vs Gemini 3.8 Flash,并用 AI 价格计算器代入当前 Token 结构。

官方来源核验于 2026 年 9 月 25 日:Gemini 价格、Gemini 3.8 Flash 模型页、最新模型指南和 Gemini API 更新日志。

相关文章