先给结论,省得你翻到最后:截至 2026 年 9 月 18 日,Gemini 4 和 Gemini 4 Pro 都没有发布,也没有官方确认的规格、价格或发布日期。 谷歌官方 Gemini API 模型目录(页面更新日期 2026-09-17)里,最高编号是 Gemini 3.8 Flash,而且它在 9 月 2 日就已经 GA(正式可用); 旗舰 Pro 档仍然是 2026 年 2 月 19 日发布、至今挂着 Preview 标签的 Gemini 3.1 Pro;至于从 6 月就跳票的 Gemini 3.5 Pro,官方页面写的仍是"coming soon"。 换句话说,如果你此刻想"用上谷歌最新最强的 Gemini",你能买到的天花板就是 3.8 Flash + 3.1 Pro 这个组合,而不是任何叫"4"的东西。 本文把这条产品线按"真实规格 / 真实价格 / 真实时间 / 真实接法"四件事拆开,并回答本站读者最关心的那个问题:国内中转站现在能不能接、接哪个模型 ID。
目录
- 一、Gemini 4 Pro 到底是什么状态:官方说了什么,以及为什么"10月发布"的说法不可信
- 二、一张表看懂谷歌当前真实的 Gemini 产品线
- 三、Gemini 3.8 Flash:2026年9月2日 GA,官方跑分与规格全解
- 四、Gemini 3.8 Flash Cyber:专攻漏洞挖掘与自动修补,但不公开卖
- 五、Gemini 3.8 Live 与 Live Extended Thinking:9月15日 GA 的语音 Agent 双雄
- 六、Gemini 3.1 Pro:当前唯一在售的 Pro 档,为什么一直挂着 Preview
- 七、Gemini Omni 1.1 Flash:8月27日 GA,视频生成补上了"续写"和"首尾帧"
- 八、官方定价逐项拆解:促销价、标准价、Batch/Priority 三档怎么算
- 九、2026年完整发布时间线:谷歌到底按什么节奏在发模型
- 十、怎么接入:官方 API 的坎,与国内中转站的 Gemini 接入现状
- 十一、选型结论与结论
一、Gemini 4 Pro 到底是什么状态:官方说了什么,以及为什么"10月发布"的说法不可信
这一节必须写在最前面,因为网上关于 Gemini 4 的信息噪声极大,而本站的规矩是:只写能核实的,不写听着爽的。
我们逐个查了谷歌的三个官方出口。第一,Gemini API 官方模型目录(ai.google.dev/gemini-api/docs/models,页面标注最后更新 2026-09-17):完整型号清单里没有 Gemini 4、没有 Gemini 4 Pro,也没有任何编号为 4 的条目;页面顶部横幅写的是"Gemini 3.8 Flash is now available"。第二,Gemini API 官方变更日志(changelog):2026 年全部条目里,编号最高的模型是 9 月 2 日 GA 的 gemini-3.8-flash,没有任何 Gemini 4 相关记录。第三,Google DeepMind 的 Gemini 模型页:全部模型的横向对比表里同样没有 Gemini 4,唯一的前瞻性文字是"3.5 Pro coming soon"——注意,是 3.5 Pro,不是 4 代。此外 blog.google 的产品页与站内搜索也对"Gemini 4"零命中。
那"谷歌在搞 Gemini 4"这件事本身是不是真的?是真的,但仅限一句官方表态。2026 年 7 月 26 日,谷歌 CEO 桑达尔·皮查伊在接受 9to5Google 采访时确认,公司正在训练"体量远大于以往"的基座模型 Gemini 4,目标是"在它发布的那一刻,仍然处在当时的前沿水平";他同时表示谷歌在 TPU 算力分配上的"首要任务是确保满足在 AGI 研发前沿保持竞争力所需的资源"。这段话里没有任何日期、没有任何规格、没有任何价格。所谓"预计 11 月或 12 月推出",是媒体参照谷歌过往发布节奏做出的推测,不是谷歌的承诺。
关于"Gemini 4 Pro 将于 10 月发布"这个说法
这轮传播中唯一给出"10 月"这个具体月份的中文与外文报道,源头是 2026 年 9 月 9 日 Geeky Gadgets 的一篇文章,而它引用的又是一段 YouTube 视频。 该文出现了两处硬错误:把 Anthropic 写成"Enthropic",把 Grok 说成 SpaceX 的产品。一家连竞争对手名字和归属都写错的媒体,它给出的时间表不值得当作发布依据—— 而且该说法在谷歌官方渠道中零印证。本文因此不采用它。判断"要不要现在等 Gemini 4",请以官方模型目录和变更日志为准,而不是二手报道。
二、一张表看懂谷歌当前真实的 Gemini 产品线
与其对着一个不存在的型号许愿,不如先看清谷歌此刻真实的产品矩阵。下表全部来自谷歌官方模型目录与定价页(核实于 2026-09-17/18):
| 模型 | 模型 ID | 状态 | 定位 |
|---|---|---|---|
| Gemini 3.8 Flash | gemini-3.8-flash | Stable(2026-09-02 GA) | 最新最强 Flash,长周期软件工程与 Agent |
| Gemini 3.8 Flash Cyber | (未公开) | 限量开放(Fairwind 计划) | 网络安全:漏洞发现 + 自动修补 |
| Gemini 3.8 Live | gemini-3.8-live | Stable(2026-09-15 GA) | 低延迟语音 Agent 默认选择 |
| Gemini 3.8 Live Extended Thinking | gemini-3.8-live-extended-thinking | Stable(2026-09-15 GA) | 实时语音 + 后台推理 |
| Gemini 3.7 Flash | gemini-3.7-flash | Stable(2026-08-13 GA) | 上一代编码/Agent 主力 |
| Gemini 3.6 Flash | gemini-3.6-flash | Stable | 上上代 Flash |
| Gemini 3.5 Flash | gemini-3.5-flash | Stable(旧代) | 高吞吐常规任务 |
| Gemini 3.5 Flash-Lite | gemini-3.5-flash-lite | Stable | 3.5 家族最快最便宜 |
| Gemini 3.1 Flash-Lite | gemini-3.1-flash-lite | Stable | 以低成本对标更大模型 |
| Gemini 3.1 Pro | gemini-3.1-pro-preview | Preview | 当前在售最高 Pro 档,复杂推理与 Vibe Coding |
| Gemini Omni Flash | gemini-omni-1.1-flash | Stable(2026-08-27 GA) | 视频生成/编辑/续写 |
| Nano Banana Pro | gemini-3-pro-image | Stable | 顶级图像生成与编辑 |
| Nano Banana 2 | gemini-3.1-flash-image | Stable | 走量图像生成 |
| Veo 3.1 / Lyria 3.5 | veo-3.1-* / lyria-3.5 | Preview / Stable | 视频生成 / 音乐生成 |
| Gemini 3.5 Pro | — | 未发布 | 官方页面标注 "coming soon",仍在与伙伴测试 |
| Gemini 4 / Gemini 4 Pro | — | 未发布、未公布规格 | 官方仅确认"正在训练" |
这张表最值得注意的一点是:谷歌的 Pro 档出现了罕见的长达七个多月的空窗。3.1 Pro 是 2026 年 2 月 19 日发布的,到 9 月中旬仍未被任何更新的 Pro 型号取代,而且至今挂着 Preview;原本被寄予厚望的 3.5 Pro 从 6 月起一再延后。8 月 5 日谷歌 DeepMind 的架构调整(哈萨比斯转任 DeepMind 董事长兼 Alphabet 首席科学家,原 CTO 卡武科格鲁接任高级副总裁、直接向皮查伊汇报并统管 Gemini 研发)也从侧面说明了这段时间谷歌在前沿模型上的压力。真正撑住产品线的,是 Flash 档近乎每月一次的迭代。
三、Gemini 3.8 Flash:2026年9月2日 GA,官方跑分与规格全解
这是谷歌目前最新、也最值得接的一款 Gemini。官方变更日志写明:2026 年 9 月 2 日,gemini-3.8-flash 正式 GA,官方描述是"我们最智能的 Flash 模型",面向长周期软件工程、Agent 与企业工作流。
规格(官方模型目录):输入上下文 1,048,576 token(约 100 万),最大输出 65,536 token(64K);输入模态覆盖文本、图像、视频、音频、PDF,输出仅文本;工具能力包括函数调用(function calling)、以搜索为工具(search as a tool)与 Computer Use。可用渠道包括 Gemini App、Gemini Enterprise Agent Platform、Google AI Studio、Gemini API、Google AI Mode 与 Google Antigravity。状态为 general availability(正式可用),不是预览版。
官方跑分(Google 自报口径,来自 DeepMind 模型页):
| 基准 | Gemini 3.8 Flash | 对照 |
|---|---|---|
| DeepSWE v1.1(长周期软件工程) | 73.7% | 官方称在极低单任务成本下超过多数更大规模前沿模型 |
| Terminal-bench 2.1 | 89.4% | — |
| Terminal-bench 4.0 | 19.1% | 更难的下一代版本,全行业普遍低分 |
| HLE-Verified(人类最后考试·验证集) | 54.9% | GPT-5.6 Sol 54.5%、Claude Opus 5 54.4%、3.7 Flash 53.6% |
| Vals Finance Agent v2 | 61.4% | 3.7 Flash 59.0%、Claude Opus 5 58.6%、GPT-5.6 Terra 54.4% |
| Harvey's Legal Agent(全通过率) | 10.0% | 领先第二名 8.8% |
| OSWorld-2.0(电脑操作 Agent) | 59.0% | — |
| GDPVal-AA v2 | 1545 Elo | — |
| GDP.PDF / CharXiv Reasoning | 35.0% / 86.2% | 文档与图表理解 |
| LVBench(长视频理解,Agentic) | 87.8% | — |
| LABBench2 / BioMysteryBench | 86.2% / 88.8%(人类可解) | 科研场景 |
怎么读这组数字?第一,编码与终端能力是这代最硬的提升:DeepSWE v1.1 从 3.7 Flash 的水平推到 73.7%,Terminal-bench 2.1 的 89.4% 已经是同级里很高的位置。第二,它在两个"专业 Agent"基准上直接反超了更大的对手——Vals Finance Agent v2 的 61.4% 领先 Claude Opus 5 的 58.6%,Harvey 法律 Agent 的 10.0% 也排在第一。第三,也是最该克制的一点:以上全部是谷歌自报口径,各厂商评测方法论不同,横向对比要留出余量;把"官方自报"和"第三方榜单"当成两套数据分开看,是本站一贯的建议。
另外一个容易被漏掉的更新:2026 年 9 月 1 日,谷歌为 3.7 Flash、3.6 Flash 与 3.5 Flash-Lite 上线了Agent 式视频理解(agentic video understanding),官方称处理长视频时最多可减少 88% 的 token 消耗。这对做视频内容分析、长会议纪要的开发者是实打实的成本项优化,而且它下放到了 3.5 Flash-Lite 这种最便宜的档位。
四、Gemini 3.8 Flash Cyber:专攻漏洞挖掘与自动修补,但不公开卖
这是谷歌 2026 年在"垂直模型"方向上最认真的一次投入,也是很少被中文报道讲清的一款。DeepMind 对它的描述是"我们最强的网络安全模型",具备前沿水平的漏洞检测与自动化修补能力,基于 Flash 线,因此保留了速度与低成本,可以快速迭代。
能力上,它能在横跨 20 种编程语言的大型代码库中自主发现隐藏缺陷,找到之后自动生成经过验证的高质量修复代码,官方定位是"专为防御方设计"。官方跑分如下:
| 基准 | Gemini 3.8 Flash Cyber | 对照 |
|---|---|---|
| CyberGym Pass@1(漏洞发现) | 86.2% | GPT-5.5-Cyber 85.6%、Mythos 5 83.8%、GPT-5.6 Sol 83.6%、3.5 Flash Cyber 77.5% |
| 内部真实世界发现基准(20 种语言) | 71.0% | 3.7 Flash 58.9%、3.5 Flash Cyber 46.6% |
| CWE-Bench Pass@1(第三方 Collinear 运行) | 47.2% | 略低于 Fable 5 的 47.8%,但单次 rollout 成本约 $3.60,落在帕累托前沿 |
| Gray Swan IPI(提示注入攻击成功率,越低越好) | 6.0% | — |
关键限制在于获取方式:3.8 Flash Cyber 不公开售卖,只通过谷歌的 Fairwind 计划向一组经过审核的防御方开放,目的是让合作方在 AI 驱动的网络攻击面前拿到"关键的先手"。官方页面没有给出任何标价或全面开放日期。对国内读者来说,现实结论是:短期内基本不可能通过中转站买到它,任何声称提供"Gemini 3.8 Flash Cyber"的中转站都值得高度警惕。如果你关心的是这类能力,本站此前拆解过的 GLM-5.3(CyberGym 84.5%)走的是同一套"可信访问"分级逻辑,可以参考。
五、Gemini 3.8 Live 与 Live Extended Thinking:9月15日 GA 的语音 Agent 双雄
2026 年 9 月 15 日,谷歌把两款音频到音频的 Live API 模型推上 GA,距离 3.8 Flash 发布不到两周:
gemini-3.8-live—— 官方定位是"大多数低延迟语音 Agent 场景的默认选择",不做推理等待,追求即时响应;gemini-3.8-live-extended-thinking—— 在实时语音的同时支持后台推理,适合需要在对话中"想一下再答"的复杂场景。
定价上,两款都有免费额度;付费档输入为文本 $0.75/M、音频 $3.00/M(或 $0.005/分钟)、图像与视频 $1.00/M(或 $0.002/分钟),输出为文本 $4.50/M、音频 $12.00/M(或 $0.018/分钟)。这套"按分钟计价"的结构说明谷歌想把它推向电话客服、实时翻译、语音助手这类持续在线、按通话时长结算的业务。作为参照,3.1 Flash Live Preview 已被官方建议迁移到 3.8 Live。
如果你的产品涉及实时语音,这是谷歌当前唯一推荐的接入点;但要注意 Live API 走的是 WebSocket 长连接,与传统 HTTP 中转站的兼容性差异较大——接生产前务必确认你选的中转站是否支持音频流式透传,很多站只透传文本 chat completions。
六、Gemini 3.1 Pro:当前唯一在售的 Pro 档,为什么一直挂着 Preview
如果你确实需要"谷歌的旗舰智能",那答案不是 Gemini 4 Pro,而是已经上线七个多月、但至今仍是 Preview 状态的 Gemini 3.1 Pro(模型 ID gemini-3.1-pro-preview,2026 年 2 月 19 日发布)。
规格:输入上下文 1M token,最大输出 64K;输入支持文本、图像、视频、音频、PDF,输出仅文本;工具支持函数调用、结构化输出、以搜索为工具、代码执行。官方定位是"我们迄今最智能的模型",适合复杂任务与深度工作,在 Vibe Coding 与 Agentic Coding 上表现突出,擅长工具调用与多步并行任务。可用渠道与 3.8 Flash 一致(Gemini App、AI Studio、Gemini API、Gemini Enterprise Agent Platform、AI Mode、Antigravity)。
官方跑分:Humanity's Last Exam 44.4%(无工具)、ARC-AGI-2 77.1%(ARC Prize Verified)、GPQA Diamond 94.3%、Terminal-Bench 2.0 68.5%、SWE-Bench Verified 80.6%(略低于 Opus 4.6 的 80.8%)、LiveCodeBench Pro 2887 Elo、MMMLU 92.6%、MRCR v2 @128k 84.9%。
这组数字里有一个容易被忽略的对比:3.1 Pro 的 SWE-Bench Verified 是 80.6%,而 3.8 Flash 在更新的 DeepSWE v1.1 上是 73.7%——两个基准不可直接比较,但方向很清楚:谷歌在"主力档追上旗舰档"这件事上推进得很快,而在"旗舰档本身换代"这件事上停滞了很久。这也正是 3.5 Pro 迟迟不来所造成的后果。
关于 3.5 Pro:官方口径始终是"与合作伙伴测试中、准备就绪后尽快发布",DeepMind 模型页至今写着"3.5 Pro coming soon",没有任何定价或上线日期。它原本的目标是 6 月,目前已延后数月。至于 Gemini 4,请回到第一节——只有一句"正在训练"。
七、Gemini Omni 1.1 Flash:8月27日 GA,视频生成补上了"续写"和"首尾帧"
如果说前面几款是"文本线",那 Omni 1.1 Flash 是谷歌在生成式视频上的最新落子。2026 年 8 月 27 日,gemini-omni-1.1-flash 正式 GA,相比 6 月 30 日进入公开预览的 gemini-omni-flash-preview,它补上了三件事:
- 视频续写(extend):通过
extend任务,每次调用可延长 10 秒,最多叠加到 40 秒连续视频——这是 API 侧首次支持的能力; - 首尾帧插值:用户给出起始帧与结束帧,模型自动生成中间过程视频(keyframe interpolation);
- 分辨率参数:支持
resolution指定 360p、720p(默认)、1080p 与 4K;官方另提供一个更便宜的 360p 草稿模式,官方称相较 720p 吞吐最多提升 60%、成本约为三分之一。需要提醒的是,1080p 与 4K 属于超采样输出,并非原生分辨率。
定价上,Omni Flash 的输入为 $1.50/M(文本/图像/视频/音频),输出为文本 $9.00/M、视频 $17.50/M;官方定价页同时给出按秒口径:360p $0.03/秒、720p $0.10/秒、1080p $0.15/秒、4K $0.30/秒。它没有免费额度,且不支持上下文缓存。旧的 gemini-omni-flash-preview 端点将于 2026 年 9 月 30 日弃用,仍在使用预览版的开发者需要尽快迁移。
八、官方定价逐项拆解:促销价、标准价、Batch/Priority 三档怎么算
以下价格全部来自谷歌官方 Gemini API 定价页(核实于 2026-09-18),单位是"每百万 token / 美元"。最需要记住的一件事是:Flash 线的促销价在 2026 年 12 月 31 日结束,2027 年 1 月 1 日起翻倍。
| 模型 | 输入(标准 / Batch·Flex / Priority) | 输出(标准 / Batch·Flex / Priority) | 免费额度 |
|---|---|---|---|
| Gemini 3.8 Flash | $0.75→$1.50 / $0.375→$0.75 / $1.35→$2.70 | $3.75→$7.50 / $1.875→$3.75 / $6.75→$13.50 | 有 |
| Gemini 3.7 Flash | 同上 | 同上 | 有 |
| Gemini 3.6 Flash | 同上 | 同上 | 有 |
| Gemini 3.5 Flash | $1.50 / $0.75 / $2.70 | $9.00 / $4.50 / $16.20 | 有 |
| Gemini 3.5 Flash-Lite | $0.30 / $0.15 / $0.54 | $2.50 / $1.25 / $4.50 | 有 |
| Gemini 3.1 Flash-Lite | $0.25 / $0.125 / $0.45 | $1.50 / $0.75 / $2.70 | 有 |
| Gemini 3.1 Pro (Preview) | $2.00(≤200K)/ $4.00(>200K) | $12.00(≤200K)/ $18.00(>200K) | 无 |
| Gemini Omni Flash | $1.50 | 文本 $9.00 / 视频 $17.50 | 无 |
| Nano Banana Pro(图像) | $2.00 | 文本 $12.00 / 图像 $120.00 | 无 |
| Nano Banana 2(图像) | $0.50 | 文本 $3.00 / 图像 $60.00 | 无 |
| Gemini 3 Flash (Preview) | $0.50(文本/图/视频),音频 $1.00 | $3.00 | 有 |
| Gemini 2.5 Pro | $1.25(≤200K)/ $2.50(>200K) | $10.00 / $15.00 | 有 |
三个必须点破的定价细节。第一,"$0.75/$3.75"不是 3.8 Flash 独享,而是整条 Flash 走量线的促销——3.6、3.7、3.8 三代 Flash 用的是同一组促销价,同样在 2026-12-31 后恢复到 $1.50/$7.50。谷歌是在用半价窗口把开发者流量吸进来,而不是给某一代开小灶。第二,Flash 档的输出促销价已包含思考(thinking)token,估算成本时不需要再叠加一档推理费用,这和某些把思考单独计费的模型有本质区别。第三,Pro 档与视频/图像模型没有免费额度,想试 3.1 Pro 只能直接充值;而 3.x 全线共享每月 5,000 次免费的 Google 搜索 Grounding 额度,超出后按 $14 / 1,000 次计费。
算一笔账让"$0.75/M"更直观:假设你要跑一个 20 万 token 代码库、输出约 1 万 token 的整仓重构任务(促销期内,3.8 Flash),输入成本约 $0.75 × 0.2 ≈ $0.15,输出约 $3.75 × 0.01 ≈ $0.038,单任务合计不到 $0.19;若进一步走 Batch 档,输入输出再各打五折,约 $0.094。同样任务若用 3.1 Pro(≤200K 档),输入 $2.00 × 0.2 = $0.40、输出 $12.00 × 0.01 = $0.12,合计约 $0.52——3.8 Flash 促销期内大约是 3.1 Pro 的三分之一强。而当 2027 年 1 月促销结束、Flash 回到 $1.50/$7.50 后,这个差距会收窄到约六成。想用促销价,就趁年内;想评估长期成本,请按标准价算。
九、2026年完整发布时间线:谷歌到底按什么节奏在发模型
把官方变更日志里的日期排成一列,谷歌这一年的节奏一目了然:
| 日期 | 事件 |
|---|---|
| 2026-02-19 | gemini-3.1-pro-preview 发布(当前唯一在售 Pro 档,至今 Preview) |
| 2026-03-09 | Gemini 3 Pro Preview 关停,gemini-3-pro-preview 指向 3.1 Pro |
| 2026-06-30 | gemini-omni-flash-preview 公开预览(3–10 秒、720p 视频生成) |
| 2026-07-26 | 皮查伊确认正在训练 Gemini 4("体量远大于以往",无日期) |
| 2026-08-05 | DeepMind 高层调整:哈萨比斯任董事长、卡武科格鲁统管 Gemini;首席科学家 Jeff Dean 离职 |
| 2026-08-13 | gemini-3.7-flash GA |
| 2026-08-27 | gemini-omni-1.1-flash GA(视频续写、首尾帧插值、分辨率参数) |
| 2026-09-01 | Agent 式视频理解上线(3.7 Flash / 3.6 Flash / 3.5 Flash-Lite,最多省 88% token) |
| 2026-09-02 | gemini-3.8-flash GA |
| 2026-09-03 | Lyria 3.5 GA |
| 2026-09-15 | gemini-3.8-live 与 gemini-3.8-live-extended-thinking GA |
| 2026-09-17 | antigravity-preview-09-2026 替换 05-2026 版;官方模型目录更新 |
这张表本身就是对"Gemini 4 要来了吗"最有力的回答:2026 年 8 月到 9 月,谷歌一共发了五个东西(3.7 Flash、Omni 1.1 Flash、视频理解、3.8 Flash、3.8 Live 双款),全部是 3.x 世代,没有一个是 4 代。Flash 线的迭代周期已经压缩到约三周;而 Pro 线在 3.1 Pro 之后整整七个月没有更新,3.5 Pro 仍未落地。合理的推断是:谷歌把"旗舰换代"这件事押在了 3.5 Pro 和 Gemini 4 上,而在此之前,用 Flash 线的高频迭代维持市场存在感。至于 Gemini 4 会不会在 11~12 月出现,官方没说,本文也不猜。
十、怎么接入:官方 API 的坎,与国内中转站的 Gemini 接入现状
对国内读者来说,接入 Gemini 的第一道坎从来不是价格,而是网络:Google 的 Gemini API(ai.google.dev / generativelanguage.googleapis.com)在大陆无法直连,官方渠道既需要科学上网、也基本不接受人民币充值。这正是国内 AI API 中转站的核心价值——用一条国内可直连的 base_url 加一个人民币充值的 Key,把谷歌等海外模型"搬"回来。
先讲最诚实的一句:截至 2026 年 9 月 18 日,本站已收录的 153 家中转站里,没有任何一家在模型清单中明确列出 gemini-3.8-flash。 原因很直接:3.8 Flash 在 9 月 2 日才 GA,而站内这批供应商资料的核实日期普遍是 2026 年 8 月 16 日——早于它的发布。这不代表永远接不到,只代表"现在别指望某篇文章给你一个已验证的 3.8 上架名单",充值前请务必自行在控制台核对。
当前能核实的 Gemini 覆盖情况是这样的:
- Gemini 3.7 Flash(当前中转站能买到的最新 Flash):ProAI API(proaiapi.tech)在定价说明中明确标注"gemini-3.7-flash 已上线",是唯一一家把具体型号 ID 写进官方说明的;MKEAI(tagline 标注 Gemini 3.7,模型覆盖 Gemini 3.5–3.7,注意其新用户注册暂关闭)、NodAPI(545+ 模型,覆盖 Gemini 3.7/3.6/3.5)、全智API Quanzil(454+ 模型,覆盖 Gemini 3.7/3.6/3.5)在模型覆盖中列出 Gemini 3.7 系列。
- Gemini 3.1 Pro(当前在售最高 Pro 档):覆盖明显更广。站内资料中在
supportedModels明确列入gemini-3.1-pro的共 14 家:ProAI API、神马中转API、一叶知秋API、No.1-API、TokenMix、UniAPI、AIFast.club、V-API、XycAi(星道智能)、NoneLinear、智惠API、Nio API、XJAI(猎人API)、Poe API。 - Gemini 3.8 Flash / 3.8 Live / Omni 1.1 Flash / 3.8 Flash Cyber:暂无任何一家站内收录供应商明确列出。3.8 Flash Cyber 因走 Fairwind 限量计划,短期内基本不可能出现在中转站,见到即存疑。
接入模式与本站此前写过的所有 OpenAI 兼容中转完全一致,只需把模型名换成对应的 Gemini 模型 ID。以 OpenAI SDK 为例:
from openai import OpenAI
client = OpenAI(
api_key="你的中转站API Key",
base_url="https://你的中转站域名/v1" # 以各中转站控制台实际地址为准
)
# 主力档:当前中转站能买到的最新 Flash
response = client.chat.completions.create(
model="gemini-3.7-flash",
messages=[
{"role": "system", "content": "你是一个资深全栈工程师"},
{"role": "user", "content": "请对这段代码做整仓级重构,并补全测试"},
],
)
print(response.choices[0].message.content)
# 旗舰档:当前在售最高的 Pro 模型
pro = client.chat.completions.create(
model="gemini-3.1-pro-preview",
messages=[{"role": "user", "content": "请对这份研究报告做深度审阅并给出反驳意见"}],
)
print(pro.choices[0].message.content) 如果你用 LiteLLM 这类网关聚合层,逻辑一样,把 model 指向即可:
model_list:
- model_name: gemini-3.7-flash
litellm_params:
model: gemini/gemini-3.7-flash
api_key: os.environ/GEMINI_API_KEY
- model_name: gemini-3.1-pro
litellm_params:
model: gemini/gemini-3.1-pro-preview
api_key: os.environ/GEMINI_API_KEY 务必提醒三件事。第一,gemini-3.7-flash 是官方习惯写法,不代表每一家中转站都已上架,个别站可能用 google/gemini-3.7-flash 之类的变体,请以各站控制台实际列出的模型 ID 为准。第二,中转站通常会在官方价上叠加汇率与加价——谷歌官方促销价 $0.75/$3.75 是首方价格,你在中转站看到的人民币单价未必等比。第三,如果你用的是 Claude Code、Cursor 或 Gemini CLI 这类 AI 编程工具,接入逻辑同样是"改 base_url + 换 Key":Claude Code 走 ANTHROPIC_BASE_URL 与 ANTHROPIC_AUTH_TOKEN(需中转站支持 Anthropic 兼容格式),Cursor 在模型 Provider 设置里把 base_url 指向中转站并填模型名,Gemini CLI 官方支持 GEMINI_API_KEY 配合自定义端点。不是每家中转站都对这三个工具透传同一套协议,接生产前先小流量验证。
十一、选型结论与结论
- 你在等 Gemini 4 Pro → 别等了,它不存在,也没有发布日期。官方唯一表态是 7 月 26 日皮查伊说的"正在训练体量远大于以往的基座模型"。任何给出具体月份的说法,目前都没有官方支撑。
- 你需要"谷歌最新最强、且真能买到" → 走中转站接
gemini-3.7-flash(ProAI API 明确上架,MKEAI/NodAPI/Quanzil 覆盖 Gemini 3.7);3.8 Flash 虽然更强(DeepSWE v1.1 73.7%),但目前没有一家站内收录的中转站列出它,需要你自己去控制台确认。 - 你需要旗舰级推理与深度分析 → 用
gemini-3.1-pro-preview,14 家中转站已覆盖。价格 $2/$12(≤200K),比 Flash 促销价贵约 3 倍,且没有免费额度。注意它仍是 Preview,不是正式版。 - 你在做编码 / Agent / 多步工具调用 → 这是 Flash 线的主场。约 1M 上下文能吞整仓代码,函数调用、搜索 Grounding、Computer Use 都是现成的;8 月 13 日之后的 3.7 Flash 与 9 月 2 日的 3.8 Flash 都属这一档。
- 你在做实时语音 →
gemini-3.8-live(低延迟)或gemini-3.8-live-extended-thinking(带后台推理),9 月 15 日 GA。但请先确认中转站是否支持 Live API 的音频流式透传。 - 你在做视频生成 →
gemini-omni-1.1-flash,支持续写与首尾帧插值;注意旧预览端点 9 月 30 日弃用,且按秒计价(720p $0.10/秒)成本不低。 - 一个时间提醒:Flash 全线(3.6/3.7/3.8)的 $0.75/$3.75 促销价在 2026-12-31 结束,2027 年 1 月 1 日起恢复 $1.50/$7.50。想用促销价,趁年内。
把 2026 年 9 月的谷歌看清楚,会发现一个有点反直觉的事实:这家公司当前最重要的产品动作,几乎全部发生在 Flash 档,而不是旗舰档。 9 月 2 日的 3.8 Flash、9 月 15 日的双款 3.8 Live、8 月 27 日的 Omni 1.1 Flash——三周之内五款模型上线,全部是 3.x 世代,没有一款编号为 4。而在 Pro 档,3.1 Pro 从 2 月起就没有被取代过,3.5 Pro 一再延后,Gemini 4 只有皮查伊一句"正在训练"。
这不是谷歌"藏牌",而是前沿模型研发的真实周期使然:基座模型的换代远比后训练迭代昂贵和缓慢,而 Flash 档的"近乎每月一更"正好能在旗舰空窗期维持开发者黏性、抢占编码与 Agent 这个最吃量的赛道。对国内开发者的实际含义很明确:你不需要等 Gemini 4 Pro,你现在就有两个能用的谷歌模型档位——主力档 3.7 Flash(中转站可接)与旗舰档 3.1 Pro(14 家可接);而 3.8 Flash 更强,但需要你亲自去控制台确认是否已上架。至于 Gemini 4 什么时候来,本文的态度很简单:官方说了我们才写,没说之前,一个具体月份都不编。
合在一起看,这意味着
- Gemini 4 Pro 不存在:官方模型目录(2026-09-17 更新)与变更日志中均无 Gemini 4 条目;官方仅有皮查伊 7 月 26 日"正在训练体量远大于以往的基座模型"一句表态,无日期、无规格、无价格。
- 当前真实在售:主力档
gemini-3.8-flash(9 月 2 日 GA,DeepSWE v1.1 73.7%、约 1M 上下文、$0.75/$3.75 促销至 12/31);旗舰档gemini-3.1-pro-preview($2/$12 起、HLE 44.4%、SWE-Bench Verified 80.6%,仍是 Preview)。 - 中转站接入:ProAI API 明确上架
gemini-3.7-flash,MKEAI/NodAPI/Quanzil 覆盖 Gemini 3.7 系列;14 家覆盖gemini-3.1-pro;暂无一家列出 gemini-3.8-flash,充值前请自行核对控制台。 - 一个时间提醒:Flash 全线促销价 2026-12-31 结束,明年 1 月恢复 $1.50/$7.50;Omni Flash 旧预览端点 9 月 30 日弃用。