2026 年 8 月 14 日,谷歌正式发布 Gemini 3.7 Flash。这不是又一款"PPT 模型"——它在发布当天就上线了 Google AI Studio、Gemini API、Android Studio,并把覆盖 160 多个国家的个人 AI 助手 Gemini Spark 直接升级为 3.7 Flash 驱动。官方给它的定位很直白:迄今"最智能的主力模型",专为复杂编码、Agent 工作流与可靠的多步执行设计。距离上一代 Gemini 3.6 Flash 只有约三周——谷歌已经把 Flash 系列的迭代节奏压缩到近乎每月一次,这次发布本身就是对"Flash 档才是谷歌主战场"这个判断的又一次确认。本文从规格、官方自报跑分、定价、同类对比四个维度拆开它,并回答本站读者最关心的:国内 AI API 中转站现在能不能接、接哪个模型 ID、成本到底怎样。
先交代本文的事实纪律与时效基准。本文信息核实截至 2026 年 8 月 19 日。Google 侧规格与定价,以官方 Gemini API 文档(模型目录与定价页)为准;官方自报跑分,转述自 Gadgets 360 等第三方报道对 Google 发布口径的整理;第三方独立评测(如 Artificial Analysis 的智能指数 AAII),截至发稿在公开榜单上尚未出现 Gemini 3.7 Flash 的可信得分——这不是"它没有分数",而是"还没有可信第三方分数",本文会明确标注,不会为了表格好看而编造。凡无法交叉验证的数字,本文会直接说"无法核实"。尤其要提醒:Gemini 3.7 Flash 距离发布仅几天,任何"第三方跑分已出、某某分领先"的说法,都需要你自行核对来源与评测版本。
目录
- 一、发布与定位:三周一更的"主力模型",谷歌把 Flash 档当成了主战场
- 二、规格与能力:约1M输入上下文、64K输出、原生多模态输入、思考档位与工具全家桶
- 三、跑分提升:DeepSWE 从 49.0% 到 65.3% 怎么读,以及第三方 AAII 为什么还没出现
- 四、定价:$0.75/$3.75 半年期促销,明年1月翻倍,缓存折扣与"全家桶促销"的真相
- 五、与同类模型的对比:Flash 档 vs 旗舰档,逐 token 成本到底谁便宜
- 六、国内中转站接入现状:谁已经在卖 gemini-3.7-flash,标准接入模式长什么样
- 七、选型结论:什么场景用它,什么场景别用
- 八、结论:3.7 Flash 真正的信号是什么
一、发布与定位:三周一更的"主力模型",谷歌把 Flash 档当成了主战场
先说清楚 Gemini 3.7 Flash 在谷歌产品线里的位置,因为这决定了后面所有比较的坐标。谷歌的 Gemini 产品线目前大致分两档:Flash 档(走量主力)与Pro 档(旗舰)。2026 年 7 月 26 日,谷歌 CEO 皮查伊在接受 9to5Google 采访时明确说过,公司在训练"体量远大于以往"的下一代基础模型 Gemini 4(预计 11~12 月发布),同时要保持 Flash 系列近乎每月一次的更新节奏,重点强化智能体编程能力。Gemini 3.7 Flash 就是这个节奏的产物:3.6 Flash 大约在 7 月下旬上线,3.7 Flash 在 8 月 14 日落地,中间只隔约三周。
值得注意的是它的官方定位。Gemini API 官方模型目录给 3.7 Flash 的描述是:"我们最新、最强的 Flash 模型,专为复杂编码、Agent 工作流与可靠的多步执行而构建";发布报道则用了一个更情绪化的词——"迄今最智能的主力模型"。也就是说,谷歌并不想把它包装成"旗舰的平替",而是光明正大地把"编码 + Agent + 高吞吐走量"这个最拥挤、最吃量的赛道,当成 Flash 档的主场。这和 DeepSeek V4 Flash、GLM-5.3 等开源"编程主力模型"的打法是同一套逻辑:旗舰负责立品牌,Flash 负责抢开发者与走量。
还有一个背景需要交代:谷歌的旗舰档目前处于一个相当尴尬的窗口。Gemini 3.5 Pro 从 6 月起就一再跳票,截至本文发稿(8 月 19 日)官方口径仍是"与合作伙伴测试中、准备就绪后尽快发布",没有任何定价与上线日期;实际在售的最高档仍是 Gemini 3.1 Pro (Preview)。在旗舰空窗期,Flash 档被推得更靠前,3.7 Flash 事实上承担了"谷歌当前最能打、且真能买到的模型"这个角色——这一点对中转站选型很重要,因为它意味着:如果你在 2026 年 8 月想通过中转站用上"最新的谷歌模型",你能买到的几乎只有 Flash 档。
二、规格与能力:约1M输入上下文、64K输出、原生多模态输入、思考档位与工具全家桶
先摆硬规格(均来自 Google 官方 Gemini API 模型文档,截至发稿已核实):
| 规格 | Gemini 3.7 Flash |
|---|---|
| 模型 ID | gemini-3.7-flash(官方另有 gemini-3.7-flash@stable 等别名习惯) |
| 输入上下文 | 1,048,576 token(约 100 万) |
| 最大输出 | 65,536 token |
| 输入模态 | 文本、图像、视频、音频、PDF(原生多模态输入) |
| 输出模态 | 仅文本(不支持音频/图像生成与 Live API) |
| 思考模式 | 支持 low / medium / high 三档;minimal 档会报错 |
| 工具/能力 | 函数调用、代码执行、缓存、文件搜索、结构化输出、URL 上下文、Google 搜索/地图 Grounding、Computer Use(预览) |
| 推理档位 | Batch / Flex / Priority(优先级)三档并存,对应不同价格与速度 |
从规格上看,3.7 Flash 延续了 Flash 档"旗舰级上下文 + 多模态输入 + 只输出文本"的路线。约 1M 的输入上下文让它能直接吞下整仓级代码库或长文档;65,536(64K)的最大输出,对生成完整测试套件、重构多个文件这类 Agent 任务够用,但和 DeepSeek V4 Pro 那类 38 万 token 的"超长输出"相比,长输出是它的边界。多模态输入(文本/图像/视频/音频/PDF)是谷歌 Flash 档一直以来的强项——在"看得懂截图、UI 稿、扫描件"这类场景里,Flash 档比不少同价位的开源模型有明显优势;但输出只有文本,这意味着它不能替代视频/图像生成模型。
"思考模式"(Thinking)是理解 3.7 Flash 成本的关键之一:它支持 low/medium/high 三档推理强度,且官方定价里输出价格是"包含思考 token"的(输出价 $3.75/M 已含思考,见第四节),不像某些模型把思考单独计费、变相加价。而"Computer Use(预览)"意味着谷歌在把"能操作电脑的 Agent"下放到 Flash 档——这对做自动化/浏览器 Agent 的开发者是一个信号,但既然是预览功能,稳定性与中转站是否透传都要另行验证。另外,官方文档明确 minimal 思考档不支持(会报错),接生产前最好确认你的调用方式不会踩到这个档位。
三、跑分提升:DeepSWE 从 49.0% 到 65.3% 怎么读,以及第三方 AAII 为什么还没出现
这一节需要打起精神,因为这里最容易踩坑:以下跑分均为 Google 官方自报口径(转述自发布报道),截至发稿尚无大规模第三方复测。本文把它们当作"官方宣称"来转述,并明确标注来源,不当作独立事实。
| 基准 | Gemini 3.6 Flash | Gemini 3.7 Flash | 变化 |
|---|---|---|---|
| DeepSWE v1.1(软件工程) | 49.0% | 65.3% | +16.3pp |
| FrontierCode 1.1(编码) | 34.4% | 43.6% | +9.2pp |
| AutomationBench(自动化工作流) | 17.0% | 30.4% | +13.4pp |
这三个数字有三个读法。第一,绝对提升幅度很大:DeepSWE v1.1 一年前还是大多数模型"及格线附近"的基准,3.7 Flash 一举从 49.0% 跳到 65.3%,AutomationBench 更是几乎翻倍(17.0%→30.4%)。这不是挤牙膏式的迭代,而是后训练能力的一次实质拉升。第二,它已经在编码跑分上咬住了同级闭源模型:官方口径下 FrontierCode 1.1 的 43.6% 小幅超过 Claude Sonnet 5 的 42.7% 与 GPT-5.6 Terra 的 41.3%——注意这是"小幅超过同级模型",不是超过旗舰。第三,这些数字是"官方自报",且各厂商自报口径与方法论不同,直接横向比较要格外小心。
那第三方怎么看?截至发稿,Artificial Analysis 的智能指数(AAII)榜单上还没有 Gemini 3.7 Flash 的可信得分——它发布才几天,独立评测需要时间。作为参照,当前 AAII 第一梯队(第三方口径,本站此前已核实)是:Claude Opus 5 (max) 63 分、Claude Fable 5 62 分、GPT-5.6 Sol (max) 61 分、Kimi K3 (max) 60 分(开源第一);DeepSeek V4 Pro 0813 为 53 分。也就是说,即便 3.7 Flash 的官方跑分看着很猛,它在第三方统一口径下大概率仍属于"主力档",和 Opus 5/Fable 5/GPT-5.6 Sol 这类旗舰之间有真实差距——这是 Flash 档的定位决定的,不是 3.7 Flash 的缺陷。等 Artificial Analysis 或 LMSYS 这类第三方榜单更新后,本文的判断才有第三方数据可以对照;在那之前,请把"3.7 Flash 超过旗舰"的一切说法当作未经独立验证的厂商宣传。
怎么理性看待这轮跑分
官方自报的 DeepSWE 65.3、FrontierCode 43.6 说明"3.7 Flash 比 3.6 Flash 大幅进步、并追平同级闭源模型",这是可信的方向;但它不能替代第三方统一口径。当前 AAII 前五仍是 Opus 5 / Fable 5 / GPT-5.6 Sol / Kimi K3 这类旗舰或次旗舰。把"官方自报"和"第三方榜单"当成两套数据并存,别混着用,是这篇文章最想传达的一条。
四、定价:$0.75/$3.75 半年期促销,明年1月翻倍,缓存折扣与"全家桶促销"的真相
定价是 3.7 Flash 最值得单独讲的部分,因为这里藏着一个多数报道没说透的细节。先看官方价目(Gemini API 官方定价页,Standard 档,每百万 token):
| 项目 | 促销价(至 2026-12-31) | 标准价(2027-01-01 起) |
|---|---|---|
| 输入 | $0.75 | $1.50 |
| 输出(含思考) | $3.75 | $7.50 |
| 上下文缓存命中 | $0.075 | $0.15 |
| 缓存存储 | $0.50 / 百万token/小时 | $1.00 / 百万token/小时 |
这里有两个必须点破的细节。第一,"半价促销"不是 3.7 Flash 独享,而是 Gemini 3.7 与 3.6 两个 Flash 的"全家桶促销":官方定价页上 gemini-3.6-flash 的促销价同样是 $0.75/$3.75、明年 1 月同样恢复 $1.50/$7.50。也就是说,"输入 $0.75、较上代原价减半"是谷歌给整个 Flash 走量线开的促销窗口,目的是在年底前用低价把开发者流量吸进来;如果你在 2026 年 12 月 31 日之后才读到这篇文章,记得 3.7 与 3.6 都已回到 $1.50/$7.50。第二,3.7 Flash 的输出促销价 $3.75 "已包含思考 token"——这是和某些把思考单独计费、或强制思考后单价变贵的模型的重要区别,估算成本时不用再额外加一档思考费用。
一个值得注意的定价怪象:Gemini 3.5 Flash(上一代)官方价是 $1.50/$9.00,输出比 3.6/3.7 的标准价 $7.50 还贵——也就是说,Flash 档的输出单价在 3.5 → 3.6 → 3.7 的迭代里是被谷歌主动往下压的。这与"Flash 档负责走量"的定位完全吻合,也和本站此前在 2026 年 8 月价格横评里记录的谷歌"批处理 API 全线 5 折、缓存输入约未命中价 10%"的打法一脉相承。至于旗舰档:Gemini 3.1 Pro (Preview) 仍为 ≤200K 上下文 $2/$12、超 200K $4/$18;3.5 Pro 未发布、无定价;Gemini 4 仍在训练中。
算一笔账,让"$0.75/M"更直观。假设你要做一个基于 20 万 token 代码库、输出约 1 万 token 的整仓重构任务(促销期内):输入成本约 $0.75 × 0.2 ≈ $0.15,输出约 $3.75 × 0.01 ≈ $0.038,单任务合计不到 $0.19;如果代码库前缀被大量复用,缓存命中输入价 $0.075/M 会让这个数字进一步下降。作为对比,同样任务在 Claude Sonnet 5(促销 $2/$10)约 $0.40 + $0.10 = $0.50,在 GPT-5.6 Terra($2/$12)约 $0.40 + $0.12 = $0.52——3.7 Flash 促销期内大概只有这两个同级对手的 1/3 左右。这,才是"走量定价"真正想要的效果。
五、与同类模型的对比:Flash 档 vs 旗舰档,逐 token 成本到底谁便宜
把 3.7 Flash 放进 2026 年 8 月的大模型价格表里看(下表价格为官方首方定价,促销价标注到期时间;DeepSeek/GLM 为官方人民币或美元口径,均换算为美元):
| 模型 | 上下文 | 输入 $/M | 缓存命中 $/M | 输出 $/M |
|---|---|---|---|---|
| Gemini 3.7 Flash(促销至12/31) | 约1M | $0.75 | $0.075 | $3.75(含思考) |
| Gemini 3.7 Flash(标准,明年1月起) | 约1M | $1.50 | $0.15 | $7.50 |
| Gemini 3.6 Flash(促销至12/31) | — | $0.75 | $0.075 | $3.75 |
| Gemini 3.5 Flash(官方,无促销) | — | $1.50 | $0.15 | $9.00 |
| Gemini 3.1 Pro(Preview,≤200K) | 200K阶梯 | $2.00 | $0.20 | $12.00 |
| Claude Sonnet 5(促销至8/31) | 1M | $2.00(标准$3.00) | — | $10.00(标准$15.00) |
| GPT-5.6 Terra | 1.05M | $2.00 | 读$0.20 | $12.00 |
| DeepSeek V4 Flash(0731) | 1M | $0.14 | ≈$0.0028 | $0.28 |
| DeepSeek V4 Pro(0813) | 1M | $0.435 | ≈$0.0036 | $0.87 |
| Kimi K3 | 1M | $3.00 | $0.30 | $15.00 |
| GLM-5.3(API未上线,参考5.2定价) | 1M | 约$1.40 | 约$0.26 | 约$4.40 |
| Qwen3.8-Max | 1M | $2.00 | — | $6.00 |
这张表能读出几个关键结论。第一,促销期内 3.7 Flash 是"闭源同级模型里最便宜的一档":输入 $0.75 只有 Claude Sonnet 5(促销 $2)与 GPT-5.6 Terra($2)的约 1/3,输出 $3.75 更只有它们的约 1/3~1/3.2;对比同门的 3.1 Pro($2/$12),3.7 Flash 促销价便宜了约 2/3。第二,它仍然打不过开源走量王 DeepSeek:DeepSeek V4 Flash($0.14/$0.28)与 V4 Pro($0.435/$0.87)在绝对单价上仍是全场最低一档——3.7 Flash 促销价的输入是 V4 Flash 的 5 倍以上,输出是 13 倍以上。如果"极致便宜 + 国内直连"是你的第一诉求,DeepSeek 仍然更极端;3.7 Flash 的差异化在于"谷歌生态 + 原生多模态输入 + 接近同级的编码跑分"。第三,不要忽略明年 1 月回归标准价:一旦促销结束,3.7 Flash 回到 $1.50/$7.50,它在"逐 token 便宜"这个维度上就基本失去对 Sonnet 5 / Terra 的价格优势(输入持平、输出仍略低),只靠生态与多模态差异立足——所以"想用促销价就趁年内"不是营销话术,是定价结构决定的。
定位上要再划一条诚实的界线:3.7 Flash 是"主力档",不是"旗舰档"。它的对手是 Claude Sonnet 5、GPT-5.6 Terra、DeepSeek V4 Pro、GLM-5.3、Kimi K3 这些"次旗舰/主力"模型;真正要跟 Claude Opus 5($5/$25)、GPT-5.6 Sol($5/$30)、Claude Fable 5($10/$50)比的是旗舰档的事,Flash 档不参与。如果只是"想要便宜又要谷歌",3.7 Flash 促销期内是闭源里的甜点位;如果想要地表最强智能,请回到旗舰档去看,别拿一个 Flash 模型的官方跑分去碰旗舰。
六、国内中转站接入现状:谁已经在卖 gemini-3.7-flash,标准接入模式长什么样
对国内读者来说,接入 Gemini 3.7 Flash 的第一道坎不是价格,而是网络:Google 的 Gemini API(ai.google.dev / generativelanguage.googleapis.com)在大陆无法直连,官方渠道既需要科学上网、也基本不接受人民币充值——这正是国内 AI API 中转站的核心价值:用一条国内可直连的 base_url + 一个人民币充值的 Key,把谷歌等海外模型"搬"回来。所以"3.7 Flash 怎么接进中转站"本质上是两个问题:哪家中转站已经上架了这个模型 ID,以及接入代码长什么样。
从本站已收录、且最近核实(lastVerified 2026-08-16)的供应商信息看,已有多家中转站把 Gemini 3.7 列进了模型覆盖,其中 ProAI API(proaiapi.tech)明确标注 gemini-3.7-flash 已上线(其定价说明里写的是"新模型同步快(grok-4.6/gemini-3.7-flash/qwen3.8-max 已上线)");MKEAI 的 tagline 与模型覆盖里标注了 Gemini 3.7;NoDAPI(545+ 模型)与 JENIYA(454+ 模型)的模型覆盖里也列出了 Gemini 3.7/3.6/3.5。需要特别提醒的是:这些是各中转站自报的模型覆盖,不等于每个站都已稳定透传 3.7 Flash 的全部能力(尤其是 Computer Use 预览与思考档位)。选型时请以各中转站控制台实际列出的模型与价格为准,充值前先小额测试。
接入模式与本站此前写过的所有 OpenAI 兼容中转完全一致,只需把模型名换成 gemini-3.7-flash。以 OpenAI SDK 为例:
from openai import OpenAI
client = OpenAI(
api_key="你的中转站API Key",
base_url="https://你的中转站域名/v1" # 以各中转站控制台实际地址为准
)
response = client.chat.completions.create(
model="gemini-3.7-flash",
messages=[
{"role": "system", "content": "你是一个资深全栈工程师"},
{"role": "user", "content": "请对这段代码做整仓级重构,并补全测试"},
],
)
print(response.choices[0].message.content) 如果你用 LiteLLM / 网关类聚合层,逻辑也一样,把 model 指向即可:
model_list:
- model_name: gemini-3.7-flash
litellm_params:
model: gemini/gemini-3.7-flash
api_key: os.environ/GEMINI_API_KEY 务必提醒:gemini-3.7-flash 是官方/主流网关的习惯写法,不代表每一家中转站都已上线。 个别站可能用 google/gemini-3.7-flash 或 gemini-3.7-flash@stable 之类的变体;3.7 Flash 刚发布几天,各家是否跟进、价格怎么定(官方促销 $0.75/$3.75 在中转站通常会叠加一层汇率与加价),需要你逐个核对各站控制台,别因为本文写了 ID 就直接上生产流量。另外提醒:官方 Batch API 是全线 5 折,如果你的中转站支持 Batch/Flex 档位,批量任务可以进一步压成本。
如果你用的是 Claude Code / Cursor / Gemini CLI 这类 AI 编程工具,接入逻辑同样是"改 base_url + 换 Key":Claude Code 通过 ANTHROPIC_BASE_URL 与 ANTHROPIC_AUTH_TOKEN 指向中转站(走 Anthropic 兼容格式的站),Cursor 在模型 Provider 设置里把 base_url 指向中转站、模型名填 gemini-3.7-flash;Gemini CLI 官方也支持 GEMINI_API_KEY 配合自定义端点。具体支持与否以各工具与各中转站的文档为准——不是每一家中转站都对这三个工具透传同一套协议,接生产前先在一个工具里小流量验证。
七、选型结论:什么场景用它,什么场景别用
- 国内开发者 + 想要"最新的谷歌模型" + 预算敏感 → 促销期内直接上
gemini-3.7-flash。它是目前你能在中转站买到的最新的谷歌模型(旗舰 3.5 Pro 仍未发布),$0.75/$3.75 在闭源同级里最便宜,先小额充值实测再放量。 - 编码 / Agent / 多步工具调用为主 → 3.7 Flash 的官方定位就在这。约 1M 上下文能吞整仓代码,函数调用、代码执行、搜索 Grounding、Computer Use(预览)都是现成的;但 Computer Use 属预览,接生产前要单独验证中转站是否透传。
- 需要"看得懂截图/UI/PDF"的多模态输入 → 这是 Flash 档相对开源走量模型的差异化优势;但记住输出只有文本。
- 极致便宜 + 国内直连 + 不在乎生态 → DeepSeek V4 Flash/Pro 仍是绝对单价最低的一档,3.7 Flash 打不过;如果预算紧张且任务偏纯文本,DeepSeek 更极端。
- 要地表最强智能 / 旗舰跑分 → 去看 Claude Opus 5 / GPT-5.6 Sol / Fable 5,别拿 Flash 档比旗舰。
- 重度长文档 + 批量任务 → 3.7 Flash 的缓存命中价 $0.075/M(促销)在闭源里很低,且官方 Batch 5 折;但如果你的命中率极高、又要极致省钱,DeepSeek 的缓存价(约 $0.0028/M)仍然便宜一个数量级。
八、结论:3.7 Flash 真正的信号是什么
Gemini 3.7 Flash 是一次"低调试探、高调走量"的发布。它没有发布会、没有"吊打旗舰"的通稿,只是把一款规格扎实、官方跑分大幅进步、定价狠到 $0.75/M 的 Flash 模型推上线,并让它立即成为 160 多个国家 Gemini Spark 的驱动内核。真正值得记住的信号有三条。
第一,谷歌把 Flash 档当成了主战场。 旗舰 3.5 Pro 一再跳票、Gemini 4 还在训练,谷歌当前"真能买到的最新模型"就是 Flash 档——3.6、3.7 两代在一个月内连发,配合"近乎每月一更"的节奏,谷歌在用 Flash 线抢"编码 + Agent + 走量"这个最拥挤的赛道。第二,"$0.75/$3.75"是 Flash 全线的半年期促销,不是 3.7 独享。 3.6 Flash 同样促销到 2026 年 12 月 31 日,明年 1 月一起回到 $1.50/$7.50。想用促销价,就趁年内;想评估长期成本,请按标准价算。第三,它改变了"闭源主力档"的价格参照系。 促销期内它的逐 token 成本约为 Claude Sonnet 5 / GPT-5.6 Terra 的 1/3,把"闭源也能便宜"这个叙事的门槛又压低了一档——虽然它仍打不过 DeepSeek 这类开源走量王,但对"既要谷歌生态又要预算可控"的国内开发者来说,这是 2026 年 8 月性价比最顺的谷歌入口。
最后给中转站读者一句提醒:3.7 Flash 发布才几天,第三方跑分(AAII)尚未出炉、各中转站是否已稳定透传也需逐个核实。本文的规格与官方价目是 8 月 19 日已核实的,官方自报跑分是"厂商口径、存疑但转述",第三方数字一律待更新后再对照。接入前,先去你选中的中转站控制台确认 gemini-3.7-flash 是否真的列在模型清单里,再小额充值实测——这比任何文章都可靠。
合在一起看,这意味着
- 想用最新谷歌模型 + 预算敏感 → 促销期内接
gemini-3.7-flash,中转站已有多家上架(ProAI API 明确标注已上线,MKEAI/NoDAPI/JENIYA 覆盖 Gemini 3.7)。 - 编码/Agent/多模态输入为主 → 这是它的主场,约 1M 上下文 + 工具全家桶;但输出仅文本、Computer Use 仍是预览。
- 纯文本极致省钱 → DeepSeek V4 系列仍是绝对最低价,3.7 Flash 促销价约是 V4 Flash 输入的 5 倍。
- 一个时间提醒:$0.75/$3.75 促销到 2026-12-31 结束,3.6/3.7 明年 1 月一起回到 $1.50/$7.50;第三方 AAII 与中转站透传质量,请以发稿后的实测为准。