大模型圈的价格战又添了一把火。当地时间 2026 年 8 月 13 日,谷歌发布 Gemini 3.7 Flash——距离 7 月下旬的 3.6 Flash 只有约三周,迭代节奏快得反常。按照谷歌官方博客的说法,这次更新"直接源于开发者的反馈",目标非常聚焦:编程、Agent、Web 开发与复杂知识工作,官方甚至把它定义为"迄今为止用于编码和智能体领域最智能的 Flash 级主力模型"。
更狠的是价格:2026 年 12 月 31 日之前,Gemini 3.7 Flash 以首发优惠价 $0.75 / 百万输入 token、$3.75 / 百万输出 token 提供,只有 3.6 Flash 原价的一半(3.6 Flash 同期也跟进降价)。在 GPT-5.6 Luna 降价 80%、DeepSeek 涨价的大背景下,谷歌显然选择了"用价格换开发者"。对日常使用 API 做编程辅助、搭 Agent 工作流的人来说,这是今年下半年最值得立刻试试的模型之一。本文把上手过程一次走通。
一、3.7 Flash 到底变了什么
先把关键事实摆上桌:
| 项目 | Gemini 3.6 Flash | Gemini 3.7 Flash |
|---|---|---|
| 发布时间 | 2026 年 7 月下旬 | 2026-08-13 |
| 定位 | 通用轻量主力 | 编程 / Agent / Web 开发特化 |
| 上下文窗口 | 1M tokens | 1M tokens |
| 输入价格(优惠期) | $0.75 / 1M tokens | $0.75 / 1M tokens |
| 输出价格(优惠期) | $3.75 / 1M tokens | $3.75 / 1M tokens |
| 优惠截止 | 2026-12-31 | 2026-12-31 |
几个要点:
- 能力侧重变了。3.7 的提升集中在软件工程、知识工作和 Web 开发工作流上,基准测试显示它在编码和 Agent 类任务上明显更强,但谷歌自己的数据也承认它并没有在所有维度碾压更贵的旗舰模型——它的定位是"更低价格档里最能打的"。
- 上下文维持 1M token,长文档、大仓库级代码审查的场景不受影响。
- 价格减半是限时策略,年底之后大概率回调,所以现在是锁定低成本工作流的窗口期。
二、开通 API 并跑通最小调用
Gemini 3.7 Flash 通过 Gemini API(Google AI Studio)和 Vertex AI 两条路提供。个人开发者走 AI Studio 最快:
- 打开 Google AI Studio,用 Google 账号登录。
- 左侧菜单进入 Get API key,创建一个 API Key(免费额度足够做本文所有测试)。
- 本地保存为环境变量:
export GEMINI_API_KEY="你的key"。
用 curl 发一个最小请求验证连通性:
curl -s "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.7-flash:generateContent" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"contents": [{"parts": [{"text": "用一句话解释什么是幂等接口"}]}]
}' | jq -r '.candidates[0].content.parts[0].text'
Python 项目里推荐官方 SDK:
pip install google-genai
from google import genai
client = genai.Client() # 自动读取 GEMINI_API_KEY
resp = client.models.generate_content(
model="gemini-3.7-flash",
contents="给这段 Python 函数补上类型标注和 docstring:def calc(xs): return sum(xs)/len(xs)",
)
print(resp.text)
模型 ID 以 AI Studio 页面里列出的为准(通常是 gemini-3.7-flash);如果你走 Vertex AI,注意模型名和鉴权方式(服务账号而非 API Key)都不同。
三、编程与 Agent 场景怎么用出差距
模型特化了,用法也要跟上。这几类prompt结构在 3.7 Flash 上收益最明显:
- 仓库级改造任务:把目录树 + 相关文件贴进上下文(1M 窗口够用),明确要求"先输出修改计划,确认后逐文件给 diff"。3.7 在多文件一致性上比 3.6 稳。
- 工具调用 / Function Calling:Agent 场景的核心。在 SDK 里声明
tools后,3.7 的参数填充准确率和多轮工具链的跟随能力是本次升级重点,适合接进你自己的 Agent 框架。 - Web 开发脚手架:直接给设计稿描述或组件清单,让它输出可运行的 React/Tailwind 组件,这是官方点名的提升项。
- 代码审查:配合
thinking配置让它先推理再给结论,审 diff 时的漏报率明显低于闭眼直答。
一个实用建议:把 3.7 Flash 设为 Agent 工作流里的默认执行模型(大量工具调用、读写代码),只在规划和高难度推理节点调用旗舰模型——这正是"Flash 级主力"设计之初想承接的流量。
四、成本测算:半价意味着什么
按优惠期价格粗算一笔账。假设一个典型的编程 Agent 每天处理 200 个任务,每个任务平均消耗 30K 输入 + 8K 输出 token:
- 每日成本:200 × (30K × $0.75/1M + 8K × $3.75/1M) = 200 × ($0.0225 + $0.03) = $10.5/天
- 同等负载放在 3.6 Flash 原价($1.50 / $7.50)上是 $21/天,放在旗舰级模型上通常是这个数字的 5-10 倍。
也就是说,一个中小团队的内部 Agent 工具,月 API 成本可以压到 $300 出头。再叠加谷歌的批处理(Batch API,通常再减半)和上下文缓存(重复的系统提示词按缓存价计费),实际账单还能再低三成以上。
五、从 3.6 Flash 迁移的注意事项
迁移本身近乎无痛——API 接口完全兼容,多数情况下只需把模型 ID 从 gemini-3.6-flash 改成 gemini-3.7-flash。但有三件事建议做:
- 跑一遍回归:用你积累的 20-50 个代表性 prompt 对比新旧模型输出,特别关注格式稳定性(JSON 输出、Markdown 结构)。
- 检查 thinking 预算参数:如果你之前为 3.6 调过思考预算,3.7 的推理效率变了,原来的数值未必是最优解。
- 盯紧 12 月 31 日:优惠期结束后价格大概率回调,现在就该把"价格变了怎么办"写进你的模型路由配置里,而不是年底再救火(我们之前写过多模型备胎方案,可以配套食用)。
常见问题
Q:AI Studio 的免费额度能用到 3.7 Flash 吗? 能,新模型通常同步进入免费层级,但有每分钟请求数限制,做压力测试请切付费档。
Q:3.7 Flash 能取代旗舰模型吗? 不能全面取代。官方数据显示它在编码和 Agent 负载上"显著更有竞争力",但高难度推理、复杂规划仍建议留给旗舰档。正确的姿势是分层路由,而不是一刀切替换。
Q:国内直连 API 不通怎么办? Google AI API 在国内不可直连,需要通过合规的代理网关或聚合平台中转,注意把数据合规要求纳入选型(我们站内有专门的 API 中转选型文章)。
小结
Gemini 3.7 Flash 是谷歌"三周一迭代"节奏下交出的编程特化答卷:编码与 Agent 能力明显增强、1M 上下文不变、年底前半价。上手路径很短——AI Studio 拿 Key、改模型 ID、跑回归,半天就能完成迁移。真正值得花心思的是借这个机会把模型路由和成本监控搭起来,毕竟年底优惠一收,账单会替你记住今天的选择。
