先给结论,省得你翻到最后:截至 2026 年 9 月 18 日,Gemini 4 和 Gemini 4 Pro 都没有发布,也没有官方确认的规格、价格或发布日期。 谷歌官方 Gemini API 模型目录(页面更新日期 2026-09-17)里,最高编号是 Gemini 3.8 Flash,而且它在 9 月 2 日就已经 GA(正式可用); 旗舰 Pro 档仍然是 2026 年 2 月 19 日发布、至今挂着 Preview 标签的 Gemini 3.1 Pro;至于从 6 月就跳票的 Gemini 3.5 Pro,官方页面写的仍是"coming soon"。 换句话说,如果你此刻想"用上谷歌最新最强的 Gemini",你能买到的天花板就是 3.8 Flash + 3.1 Pro 这个组合,而不是任何叫"4"的东西。 本文把这条产品线按"真实规格 / 真实价格 / 真实时间 / 真实接法"四件事拆开,并回答本站读者最关心的那个问题:国内中转站现在能不能接、接哪个模型 ID。

一、Gemini 4 Pro 到底是什么状态:官方说了什么,以及为什么"10月发布"的说法不可信

这一节必须写在最前面,因为网上关于 Gemini 4 的信息噪声极大,而本站的规矩是:只写能核实的,不写听着爽的。

我们逐个查了谷歌的三个官方出口。第一,Gemini API 官方模型目录(ai.google.dev/gemini-api/docs/models,页面标注最后更新 2026-09-17):完整型号清单里没有 Gemini 4、没有 Gemini 4 Pro,也没有任何编号为 4 的条目;页面顶部横幅写的是"Gemini 3.8 Flash is now available"。第二,Gemini API 官方变更日志(changelog):2026 年全部条目里,编号最高的模型是 9 月 2 日 GA 的 gemini-3.8-flash,没有任何 Gemini 4 相关记录。第三,Google DeepMind 的 Gemini 模型页:全部模型的横向对比表里同样没有 Gemini 4,唯一的前瞻性文字是"3.5 Pro coming soon"——注意,是 3.5 Pro,不是 4 代。此外 blog.google 的产品页与站内搜索也对"Gemini 4"零命中。

那"谷歌在搞 Gemini 4"这件事本身是不是真的?是真的,但仅限一句官方表态。2026 年 7 月 26 日,谷歌 CEO 桑达尔·皮查伊在接受 9to5Google 采访时确认,公司正在训练"体量远大于以往"的基座模型 Gemini 4,目标是"在它发布的那一刻,仍然处在当时的前沿水平";他同时表示谷歌在 TPU 算力分配上的"首要任务是确保满足在 AGI 研发前沿保持竞争力所需的资源"。这段话里没有任何日期、没有任何规格、没有任何价格。所谓"预计 11 月或 12 月推出",是媒体参照谷歌过往发布节奏做出的推测,不是谷歌的承诺。

关于"Gemini 4 Pro 将于 10 月发布"这个说法

这轮传播中唯一给出"10 月"这个具体月份的中文与外文报道,源头是 2026 年 9 月 9 日 Geeky Gadgets 的一篇文章,而它引用的又是一段 YouTube 视频。 该文出现了两处硬错误:把 Anthropic 写成"Enthropic",把 Grok 说成 SpaceX 的产品。一家连竞争对手名字和归属都写错的媒体,它给出的时间表不值得当作发布依据—— 而且该说法在谷歌官方渠道中零印证。本文因此不采用它。判断"要不要现在等 Gemini 4",请以官方模型目录和变更日志为准,而不是二手报道。

二、一张表看懂谷歌当前真实的 Gemini 产品线

与其对着一个不存在的型号许愿,不如先看清谷歌此刻真实的产品矩阵。下表全部来自谷歌官方模型目录与定价页(核实于 2026-09-17/18):

模型模型 ID状态定位
Gemini 3.8 Flashgemini-3.8-flashStable(2026-09-02 GA)最新最强 Flash,长周期软件工程与 Agent
Gemini 3.8 Flash Cyber(未公开)限量开放(Fairwind 计划)网络安全:漏洞发现 + 自动修补
Gemini 3.8 Livegemini-3.8-liveStable(2026-09-15 GA)低延迟语音 Agent 默认选择
Gemini 3.8 Live Extended Thinkinggemini-3.8-live-extended-thinkingStable(2026-09-15 GA)实时语音 + 后台推理
Gemini 3.7 Flashgemini-3.7-flashStable(2026-08-13 GA)上一代编码/Agent 主力
Gemini 3.6 Flashgemini-3.6-flashStable上上代 Flash
Gemini 3.5 Flashgemini-3.5-flashStable(旧代)高吞吐常规任务
Gemini 3.5 Flash-Litegemini-3.5-flash-liteStable3.5 家族最快最便宜
Gemini 3.1 Flash-Litegemini-3.1-flash-liteStable以低成本对标更大模型
Gemini 3.1 Progemini-3.1-pro-previewPreview当前在售最高 Pro 档,复杂推理与 Vibe Coding
Gemini Omni Flashgemini-omni-1.1-flashStable(2026-08-27 GA)视频生成/编辑/续写
Nano Banana Progemini-3-pro-imageStable顶级图像生成与编辑
Nano Banana 2gemini-3.1-flash-imageStable走量图像生成
Veo 3.1 / Lyria 3.5veo-3.1-* / lyria-3.5Preview / Stable视频生成 / 音乐生成
Gemini 3.5 Pro—未发布官方页面标注 "coming soon",仍在与伙伴测试
Gemini 4 / Gemini 4 Pro—未发布、未公布规格官方仅确认"正在训练"

这张表最值得注意的一点是:谷歌的 Pro 档出现了罕见的长达七个多月的空窗。3.1 Pro 是 2026 年 2 月 19 日发布的,到 9 月中旬仍未被任何更新的 Pro 型号取代,而且至今挂着 Preview;原本被寄予厚望的 3.5 Pro 从 6 月起一再延后。8 月 5 日谷歌 DeepMind 的架构调整(哈萨比斯转任 DeepMind 董事长兼 Alphabet 首席科学家,原 CTO 卡武科格鲁接任高级副总裁、直接向皮查伊汇报并统管 Gemini 研发)也从侧面说明了这段时间谷歌在前沿模型上的压力。真正撑住产品线的,是 Flash 档近乎每月一次的迭代。

三、Gemini 3.8 Flash:2026年9月2日 GA,官方跑分与规格全解

这是谷歌目前最新、也最值得接的一款 Gemini。官方变更日志写明:2026 年 9 月 2 日,gemini-3.8-flash 正式 GA,官方描述是"我们最智能的 Flash 模型",面向长周期软件工程、Agent 与企业工作流。

规格(官方模型目录):输入上下文 1,048,576 token(约 100 万),最大输出 65,536 token(64K);输入模态覆盖文本、图像、视频、音频、PDF,输出仅文本;工具能力包括函数调用(function calling)、以搜索为工具(search as a tool)与 Computer Use。可用渠道包括 Gemini App、Gemini Enterprise Agent Platform、Google AI Studio、Gemini API、Google AI Mode 与 Google Antigravity。状态为 general availability(正式可用),不是预览版。

官方跑分(Google 自报口径,来自 DeepMind 模型页):

基准Gemini 3.8 Flash对照
DeepSWE v1.1(长周期软件工程)73.7%官方称在极低单任务成本下超过多数更大规模前沿模型
Terminal-bench 2.189.4%—
Terminal-bench 4.019.1%更难的下一代版本,全行业普遍低分
HLE-Verified(人类最后考试·验证集)54.9%GPT-5.6 Sol 54.5%、Claude Opus 5 54.4%、3.7 Flash 53.6%
Vals Finance Agent v261.4%3.7 Flash 59.0%、Claude Opus 5 58.6%、GPT-5.6 Terra 54.4%
Harvey's Legal Agent(全通过率)10.0%领先第二名 8.8%
OSWorld-2.0(电脑操作 Agent)59.0%—
GDPVal-AA v21545 Elo—
GDP.PDF / CharXiv Reasoning35.0% / 86.2%文档与图表理解
LVBench(长视频理解,Agentic)87.8%—
LABBench2 / BioMysteryBench86.2% / 88.8%(人类可解)科研场景

怎么读这组数字?第一,编码与终端能力是这代最硬的提升:DeepSWE v1.1 从 3.7 Flash 的水平推到 73.7%,Terminal-bench 2.1 的 89.4% 已经是同级里很高的位置。第二,它在两个"专业 Agent"基准上直接反超了更大的对手——Vals Finance Agent v2 的 61.4% 领先 Claude Opus 5 的 58.6%,Harvey 法律 Agent 的 10.0% 也排在第一。第三,也是最该克制的一点:以上全部是谷歌自报口径,各厂商评测方法论不同,横向对比要留出余量;把"官方自报"和"第三方榜单"当成两套数据分开看,是本站一贯的建议。

另外一个容易被漏掉的更新:2026 年 9 月 1 日,谷歌为 3.7 Flash、3.6 Flash 与 3.5 Flash-Lite 上线了Agent 式视频理解(agentic video understanding),官方称处理长视频时最多可减少 88% 的 token 消耗。这对做视频内容分析、长会议纪要的开发者是实打实的成本项优化,而且它下放到了 3.5 Flash-Lite 这种最便宜的档位。

四、Gemini 3.8 Flash Cyber:专攻漏洞挖掘与自动修补,但不公开卖

这是谷歌 2026 年在"垂直模型"方向上最认真的一次投入,也是很少被中文报道讲清的一款。DeepMind 对它的描述是"我们最强的网络安全模型",具备前沿水平的漏洞检测与自动化修补能力,基于 Flash 线,因此保留了速度与低成本,可以快速迭代。

能力上,它能在横跨 20 种编程语言的大型代码库中自主发现隐藏缺陷,找到之后自动生成经过验证的高质量修复代码,官方定位是"专为防御方设计"。官方跑分如下:

基准Gemini 3.8 Flash Cyber对照
CyberGym Pass@1(漏洞发现)86.2%GPT-5.5-Cyber 85.6%、Mythos 5 83.8%、GPT-5.6 Sol 83.6%、3.5 Flash Cyber 77.5%
内部真实世界发现基准(20 种语言)71.0%3.7 Flash 58.9%、3.5 Flash Cyber 46.6%
CWE-Bench Pass@1(第三方 Collinear 运行)47.2%略低于 Fable 5 的 47.8%,但单次 rollout 成本约 $3.60,落在帕累托前沿
Gray Swan IPI(提示注入攻击成功率,越低越好)6.0%—

关键限制在于获取方式:3.8 Flash Cyber 不公开售卖,只通过谷歌的 Fairwind 计划向一组经过审核的防御方开放,目的是让合作方在 AI 驱动的网络攻击面前拿到"关键的先手"。官方页面没有给出任何标价或全面开放日期。对国内读者来说,现实结论是:短期内基本不可能通过中转站买到它,任何声称提供"Gemini 3.8 Flash Cyber"的中转站都值得高度警惕。如果你关心的是这类能力,本站此前拆解过的 GLM-5.3(CyberGym 84.5%)走的是同一套"可信访问"分级逻辑,可以参考。

五、Gemini 3.8 Live 与 Live Extended Thinking:9月15日 GA 的语音 Agent 双雄

2026 年 9 月 15 日,谷歌把两款音频到音频的 Live API 模型推上 GA,距离 3.8 Flash 发布不到两周:

  • gemini-3.8-live —— 官方定位是"大多数低延迟语音 Agent 场景的默认选择",不做推理等待,追求即时响应;
  • gemini-3.8-live-extended-thinking —— 在实时语音的同时支持后台推理,适合需要在对话中"想一下再答"的复杂场景。

定价上,两款都有免费额度;付费档输入为文本 $0.75/M、音频 $3.00/M(或 $0.005/分钟)、图像与视频 $1.00/M(或 $0.002/分钟),输出为文本 $4.50/M、音频 $12.00/M(或 $0.018/分钟)。这套"按分钟计价"的结构说明谷歌想把它推向电话客服、实时翻译、语音助手这类持续在线、按通话时长结算的业务。作为参照,3.1 Flash Live Preview 已被官方建议迁移到 3.8 Live。

如果你的产品涉及实时语音,这是谷歌当前唯一推荐的接入点;但要注意 Live API 走的是 WebSocket 长连接,与传统 HTTP 中转站的兼容性差异较大——接生产前务必确认你选的中转站是否支持音频流式透传,很多站只透传文本 chat completions。

六、Gemini 3.1 Pro:当前唯一在售的 Pro 档,为什么一直挂着 Preview

如果你确实需要"谷歌的旗舰智能",那答案不是 Gemini 4 Pro,而是已经上线七个多月、但至今仍是 Preview 状态的 Gemini 3.1 Pro(模型 ID gemini-3.1-pro-preview,2026 年 2 月 19 日发布)。

规格:输入上下文 1M token,最大输出 64K;输入支持文本、图像、视频、音频、PDF,输出仅文本;工具支持函数调用、结构化输出、以搜索为工具、代码执行。官方定位是"我们迄今最智能的模型",适合复杂任务与深度工作,在 Vibe Coding 与 Agentic Coding 上表现突出,擅长工具调用与多步并行任务。可用渠道与 3.8 Flash 一致(Gemini App、AI Studio、Gemini API、Gemini Enterprise Agent Platform、AI Mode、Antigravity)。

官方跑分:Humanity's Last Exam 44.4%(无工具)、ARC-AGI-2 77.1%(ARC Prize Verified)、GPQA Diamond 94.3%、Terminal-Bench 2.0 68.5%、SWE-Bench Verified 80.6%(略低于 Opus 4.6 的 80.8%)、LiveCodeBench Pro 2887 Elo、MMMLU 92.6%、MRCR v2 @128k 84.9%。

这组数字里有一个容易被忽略的对比:3.1 Pro 的 SWE-Bench Verified 是 80.6%,而 3.8 Flash 在更新的 DeepSWE v1.1 上是 73.7%——两个基准不可直接比较,但方向很清楚:谷歌在"主力档追上旗舰档"这件事上推进得很快,而在"旗舰档本身换代"这件事上停滞了很久。这也正是 3.5 Pro 迟迟不来所造成的后果。

关于 3.5 Pro:官方口径始终是"与合作伙伴测试中、准备就绪后尽快发布",DeepMind 模型页至今写着"3.5 Pro coming soon",没有任何定价或上线日期。它原本的目标是 6 月,目前已延后数月。至于 Gemini 4,请回到第一节——只有一句"正在训练"。

七、Gemini Omni 1.1 Flash:8月27日 GA,视频生成补上了"续写"和"首尾帧"

如果说前面几款是"文本线",那 Omni 1.1 Flash 是谷歌在生成式视频上的最新落子。2026 年 8 月 27 日,gemini-omni-1.1-flash 正式 GA,相比 6 月 30 日进入公开预览的 gemini-omni-flash-preview,它补上了三件事:

  • 视频续写(extend):通过 extend 任务,每次调用可延长 10 秒,最多叠加到 40 秒连续视频——这是 API 侧首次支持的能力;
  • 首尾帧插值:用户给出起始帧与结束帧,模型自动生成中间过程视频(keyframe interpolation);
  • 分辨率参数:支持 resolution 指定 360p、720p(默认)、1080p 与 4K;官方另提供一个更便宜的 360p 草稿模式,官方称相较 720p 吞吐最多提升 60%、成本约为三分之一。需要提醒的是,1080p 与 4K 属于超采样输出,并非原生分辨率。

定价上,Omni Flash 的输入为 $1.50/M(文本/图像/视频/音频),输出为文本 $9.00/M、视频 $17.50/M;官方定价页同时给出按秒口径:360p $0.03/秒、720p $0.10/秒、1080p $0.15/秒、4K $0.30/秒。它没有免费额度,且不支持上下文缓存。旧的 gemini-omni-flash-preview 端点将于 2026 年 9 月 30 日弃用,仍在使用预览版的开发者需要尽快迁移。

八、官方定价逐项拆解:促销价、标准价、Batch/Priority 三档怎么算

以下价格全部来自谷歌官方 Gemini API 定价页(核实于 2026-09-18),单位是"每百万 token / 美元"。最需要记住的一件事是:Flash 线的促销价在 2026 年 12 月 31 日结束,2027 年 1 月 1 日起翻倍。

模型输入(标准 / Batch·Flex / Priority)输出(标准 / Batch·Flex / Priority)免费额度
Gemini 3.8 Flash$0.75→$1.50 / $0.375→$0.75 / $1.35→$2.70$3.75→$7.50 / $1.875→$3.75 / $6.75→$13.50有
Gemini 3.7 Flash同上同上有
Gemini 3.6 Flash同上同上有
Gemini 3.5 Flash$1.50 / $0.75 / $2.70$9.00 / $4.50 / $16.20有
Gemini 3.5 Flash-Lite$0.30 / $0.15 / $0.54$2.50 / $1.25 / $4.50有
Gemini 3.1 Flash-Lite$0.25 / $0.125 / $0.45$1.50 / $0.75 / $2.70有
Gemini 3.1 Pro (Preview)$2.00(≤200K)/ $4.00(>200K)$12.00(≤200K)/ $18.00(>200K)无
Gemini Omni Flash$1.50文本 $9.00 / 视频 $17.50无
Nano Banana Pro(图像)$2.00文本 $12.00 / 图像 $120.00无
Nano Banana 2(图像)$0.50文本 $3.00 / 图像 $60.00无
Gemini 3 Flash (Preview)$0.50(文本/图/视频),音频 $1.00$3.00有
Gemini 2.5 Pro$1.25(≤200K)/ $2.50(>200K)$10.00 / $15.00有

三个必须点破的定价细节。第一,"$0.75/$3.75"不是 3.8 Flash 独享,而是整条 Flash 走量线的促销——3.6、3.7、3.8 三代 Flash 用的是同一组促销价,同样在 2026-12-31 后恢复到 $1.50/$7.50。谷歌是在用半价窗口把开发者流量吸进来,而不是给某一代开小灶。第二,Flash 档的输出促销价已包含思考(thinking)token,估算成本时不需要再叠加一档推理费用,这和某些把思考单独计费的模型有本质区别。第三,Pro 档与视频/图像模型没有免费额度,想试 3.1 Pro 只能直接充值;而 3.x 全线共享每月 5,000 次免费的 Google 搜索 Grounding 额度,超出后按 $14 / 1,000 次计费。

算一笔账让"$0.75/M"更直观:假设你要跑一个 20 万 token 代码库、输出约 1 万 token 的整仓重构任务(促销期内,3.8 Flash),输入成本约 $0.75 × 0.2 ≈ $0.15,输出约 $3.75 × 0.01 ≈ $0.038,单任务合计不到 $0.19;若进一步走 Batch 档,输入输出再各打五折,约 $0.094。同样任务若用 3.1 Pro(≤200K 档),输入 $2.00 × 0.2 = $0.40、输出 $12.00 × 0.01 = $0.12,合计约 $0.52——3.8 Flash 促销期内大约是 3.1 Pro 的三分之一强。而当 2027 年 1 月促销结束、Flash 回到 $1.50/$7.50 后,这个差距会收窄到约六成。想用促销价,就趁年内;想评估长期成本,请按标准价算。

九、2026年完整发布时间线:谷歌到底按什么节奏在发模型

把官方变更日志里的日期排成一列,谷歌这一年的节奏一目了然:

日期事件
2026-02-19gemini-3.1-pro-preview 发布(当前唯一在售 Pro 档,至今 Preview)
2026-03-09Gemini 3 Pro Preview 关停,gemini-3-pro-preview 指向 3.1 Pro
2026-06-30gemini-omni-flash-preview 公开预览(3–10 秒、720p 视频生成)
2026-07-26皮查伊确认正在训练 Gemini 4("体量远大于以往",无日期)
2026-08-05DeepMind 高层调整:哈萨比斯任董事长、卡武科格鲁统管 Gemini;首席科学家 Jeff Dean 离职
2026-08-13gemini-3.7-flash GA
2026-08-27gemini-omni-1.1-flash GA(视频续写、首尾帧插值、分辨率参数)
2026-09-01Agent 式视频理解上线(3.7 Flash / 3.6 Flash / 3.5 Flash-Lite,最多省 88% token)
2026-09-02gemini-3.8-flash GA
2026-09-03Lyria 3.5 GA
2026-09-15gemini-3.8-live 与 gemini-3.8-live-extended-thinking GA
2026-09-17antigravity-preview-09-2026 替换 05-2026 版;官方模型目录更新

这张表本身就是对"Gemini 4 要来了吗"最有力的回答:2026 年 8 月到 9 月,谷歌一共发了五个东西(3.7 Flash、Omni 1.1 Flash、视频理解、3.8 Flash、3.8 Live 双款),全部是 3.x 世代,没有一个是 4 代。Flash 线的迭代周期已经压缩到约三周;而 Pro 线在 3.1 Pro 之后整整七个月没有更新,3.5 Pro 仍未落地。合理的推断是:谷歌把"旗舰换代"这件事押在了 3.5 Pro 和 Gemini 4 上,而在此之前,用 Flash 线的高频迭代维持市场存在感。至于 Gemini 4 会不会在 11~12 月出现,官方没说,本文也不猜。

十、怎么接入:官方 API 的坎,与国内中转站的 Gemini 接入现状

对国内读者来说,接入 Gemini 的第一道坎从来不是价格,而是网络:Google 的 Gemini API(ai.google.dev / generativelanguage.googleapis.com)在大陆无法直连,官方渠道既需要科学上网、也基本不接受人民币充值。这正是国内 AI API 中转站的核心价值——用一条国内可直连的 base_url 加一个人民币充值的 Key,把谷歌等海外模型"搬"回来。

先讲最诚实的一句:截至 2026 年 9 月 18 日,本站已收录的 153 家中转站里,没有任何一家在模型清单中明确列出 gemini-3.8-flash。 原因很直接:3.8 Flash 在 9 月 2 日才 GA,而站内这批供应商资料的核实日期普遍是 2026 年 8 月 16 日——早于它的发布。这不代表永远接不到,只代表"现在别指望某篇文章给你一个已验证的 3.8 上架名单",充值前请务必自行在控制台核对。

当前能核实的 Gemini 覆盖情况是这样的:

  • Gemini 3.7 Flash(当前中转站能买到的最新 Flash):ProAI API(proaiapi.tech)在定价说明中明确标注"gemini-3.7-flash 已上线",是唯一一家把具体型号 ID 写进官方说明的;MKEAI(tagline 标注 Gemini 3.7,模型覆盖 Gemini 3.5–3.7,注意其新用户注册暂关闭)、NodAPI(545+ 模型,覆盖 Gemini 3.7/3.6/3.5)、全智API Quanzil(454+ 模型,覆盖 Gemini 3.7/3.6/3.5)在模型覆盖中列出 Gemini 3.7 系列。
  • Gemini 3.1 Pro(当前在售最高 Pro 档):覆盖明显更广。站内资料中在 supportedModels 明确列入 gemini-3.1-pro 的共 14 家:ProAI API、神马中转API、一叶知秋API、No.1-API、TokenMix、UniAPI、AIFast.club、V-API、XycAi(星道智能)、NoneLinear、智惠API、Nio API、XJAI(猎人API)、Poe API。
  • Gemini 3.8 Flash / 3.8 Live / Omni 1.1 Flash / 3.8 Flash Cyber:暂无任何一家站内收录供应商明确列出。3.8 Flash Cyber 因走 Fairwind 限量计划,短期内基本不可能出现在中转站,见到即存疑。

接入模式与本站此前写过的所有 OpenAI 兼容中转完全一致,只需把模型名换成对应的 Gemini 模型 ID。以 OpenAI SDK 为例:

from openai import OpenAI

client = OpenAI(
    api_key="你的中转站API Key",
    base_url="https://你的中转站域名/v1"  # 以各中转站控制台实际地址为准
)

# 主力档:当前中转站能买到的最新 Flash
response = client.chat.completions.create(
    model="gemini-3.7-flash",
    messages=[
        {"role": "system", "content": "你是一个资深全栈工程师"},
        {"role": "user", "content": "请对这段代码做整仓级重构,并补全测试"},
    ],
)
print(response.choices[0].message.content)

# 旗舰档:当前在售最高的 Pro 模型
pro = client.chat.completions.create(
    model="gemini-3.1-pro-preview",
    messages=[{"role": "user", "content": "请对这份研究报告做深度审阅并给出反驳意见"}],
)
print(pro.choices[0].message.content)

如果你用 LiteLLM 这类网关聚合层,逻辑一样,把 model 指向即可:

model_list:
  - model_name: gemini-3.7-flash
    litellm_params:
      model: gemini/gemini-3.7-flash
      api_key: os.environ/GEMINI_API_KEY
  - model_name: gemini-3.1-pro
    litellm_params:
      model: gemini/gemini-3.1-pro-preview
      api_key: os.environ/GEMINI_API_KEY

务必提醒三件事。第一,gemini-3.7-flash 是官方习惯写法,不代表每一家中转站都已上架,个别站可能用 google/gemini-3.7-flash 之类的变体,请以各站控制台实际列出的模型 ID 为准。第二,中转站通常会在官方价上叠加汇率与加价——谷歌官方促销价 $0.75/$3.75 是首方价格,你在中转站看到的人民币单价未必等比。第三,如果你用的是 Claude Code、Cursor 或 Gemini CLI 这类 AI 编程工具,接入逻辑同样是"改 base_url + 换 Key":Claude Code 走 ANTHROPIC_BASE_URL 与 ANTHROPIC_AUTH_TOKEN(需中转站支持 Anthropic 兼容格式),Cursor 在模型 Provider 设置里把 base_url 指向中转站并填模型名,Gemini CLI 官方支持 GEMINI_API_KEY 配合自定义端点。不是每家中转站都对这三个工具透传同一套协议,接生产前先小流量验证。

十一、选型结论与结论

  • 你在等 Gemini 4 Pro → 别等了,它不存在,也没有发布日期。官方唯一表态是 7 月 26 日皮查伊说的"正在训练体量远大于以往的基座模型"。任何给出具体月份的说法,目前都没有官方支撑。
  • 你需要"谷歌最新最强、且真能买到" → 走中转站接 gemini-3.7-flash(ProAI API 明确上架,MKEAI/NodAPI/Quanzil 覆盖 Gemini 3.7);3.8 Flash 虽然更强(DeepSWE v1.1 73.7%),但目前没有一家站内收录的中转站列出它,需要你自己去控制台确认。
  • 你需要旗舰级推理与深度分析 → 用 gemini-3.1-pro-preview,14 家中转站已覆盖。价格 $2/$12(≤200K),比 Flash 促销价贵约 3 倍,且没有免费额度。注意它仍是 Preview,不是正式版。
  • 你在做编码 / Agent / 多步工具调用 → 这是 Flash 线的主场。约 1M 上下文能吞整仓代码,函数调用、搜索 Grounding、Computer Use 都是现成的;8 月 13 日之后的 3.7 Flash 与 9 月 2 日的 3.8 Flash 都属这一档。
  • 你在做实时语音 → gemini-3.8-live(低延迟)或 gemini-3.8-live-extended-thinking(带后台推理),9 月 15 日 GA。但请先确认中转站是否支持 Live API 的音频流式透传。
  • 你在做视频生成 → gemini-omni-1.1-flash,支持续写与首尾帧插值;注意旧预览端点 9 月 30 日弃用,且按秒计价(720p $0.10/秒)成本不低。
  • 一个时间提醒:Flash 全线(3.6/3.7/3.8)的 $0.75/$3.75 促销价在 2026-12-31 结束,2027 年 1 月 1 日起恢复 $1.50/$7.50。想用促销价,趁年内。

把 2026 年 9 月的谷歌看清楚,会发现一个有点反直觉的事实:这家公司当前最重要的产品动作,几乎全部发生在 Flash 档,而不是旗舰档。 9 月 2 日的 3.8 Flash、9 月 15 日的双款 3.8 Live、8 月 27 日的 Omni 1.1 Flash——三周之内五款模型上线,全部是 3.x 世代,没有一款编号为 4。而在 Pro 档,3.1 Pro 从 2 月起就没有被取代过,3.5 Pro 一再延后,Gemini 4 只有皮查伊一句"正在训练"。

这不是谷歌"藏牌",而是前沿模型研发的真实周期使然:基座模型的换代远比后训练迭代昂贵和缓慢,而 Flash 档的"近乎每月一更"正好能在旗舰空窗期维持开发者黏性、抢占编码与 Agent 这个最吃量的赛道。对国内开发者的实际含义很明确:你不需要等 Gemini 4 Pro,你现在就有两个能用的谷歌模型档位——主力档 3.7 Flash(中转站可接)与旗舰档 3.1 Pro(14 家可接);而 3.8 Flash 更强,但需要你亲自去控制台确认是否已上架。至于 Gemini 4 什么时候来,本文的态度很简单:官方说了我们才写,没说之前,一个具体月份都不编。

合在一起看,这意味着

  • Gemini 4 Pro 不存在:官方模型目录(2026-09-17 更新)与变更日志中均无 Gemini 4 条目;官方仅有皮查伊 7 月 26 日"正在训练体量远大于以往的基座模型"一句表态,无日期、无规格、无价格。
  • 当前真实在售:主力档 gemini-3.8-flash(9 月 2 日 GA,DeepSWE v1.1 73.7%、约 1M 上下文、$0.75/$3.75 促销至 12/31);旗舰档 gemini-3.1-pro-preview($2/$12 起、HLE 44.4%、SWE-Bench Verified 80.6%,仍是 Preview)。
  • 中转站接入:ProAI API 明确上架 gemini-3.7-flash,MKEAI/NodAPI/Quanzil 覆盖 Gemini 3.7 系列;14 家覆盖 gemini-3.1-pro;暂无一家列出 gemini-3.8-flash,充值前请自行核对控制台。
  • 一个时间提醒:Flash 全线促销价 2026-12-31 结束,明年 1 月恢复 $1.50/$7.50;Omni Flash 旧预览端点 9 月 30 日弃用。