谷歌于 2026 年 8 月 13 日发布了 Gemini 3.7 Flash,这距离 3.6 Flash 发布仅过去三周,而 Gemini 3.5 Pro 依然处于延迟状态。官方称其为“我们最智能的实用主力模型”,且官方公告通过在编程和 Agent 任务中 10 到 16 点的基准测试得分跃升支持了这一说法。如果你正基于 Gemini API 进行开发,这就是你在未来几个月里将要锁定的模型。
本页是参考卡片。我们在一分钟内即可扫读的表格中,汇总了所有的规格参数、价格、基准测试变化以及接入通道。当你准备开始编写代码时,Gemini 3.7 Flash API 快速入门将逐步引导你使用 cURL、Python 和 Node。而在编写任何代码之前,Apifox 都能为你提供一个工作区,用于在代码实现前向接口发送测试请求。
建议收藏本页。当促销定价窗口于 2027 年 1 月 1 日关闭时,以下数据将会发生变化,我们将持续更新这些表格。
AI Coding 交流群
如果你也在用 AI 写代码,或者正在研究 Cursor、Claude Code 这些工具,欢迎加入以下交流群。群里平时会聊一些 AI 编程的实际用法、开发工作流,还有各种新工具和新玩法。
TL;DR
- 模型 ID 为
gemini-3.7-flash,已于 2026 年 8 月 13 日在 Gemini API 中上线,并在 160 多个国家/地区可用。 - 规格:1M Token 输入上下文,64k Token 输出限制,多模态输入(文本、图像、视频、音频、PDF),文本输出。
- 工具:支持 function calling、search as a tool 和 computer use。
- 促销价格:在 2026 年 12 月 31 日前,每 100 万输入 Token 的价格为 0.75 美元,每 100 万输出 Token 的价格为 3.75 美元。2027 年 1 月 1 日起,标准费率将翻倍至 1.50 美元和 7.50 美元。
- 相比 3.6 Flash 的基准测试提升:DeepSWE v1.1 从 49.0% 提升至 65.3%,AutomationBench 从 17.0% 提升至 30.4%,WebDev Arena Elo 从 1538 提升至 1588。
- 可通过 Gemini API、Google AI Studio、Gemini 应用、Gemini Spark、Google Antigravity、Android Studio 和 Gemini Enterprise 进行访问。
Gemini 3.7 Flash 规格表
核心数据,直接源自谷歌的 Gemini Flash 模型页面和发布材料。
| 规格 | 数值 |
|---|---|
| 模型 ID | gemini-3.7-flash |
| 发布日期 | 2026 年 8 月 13 日 |
| 输入上下文窗口 | 1,000,000 个 Token |
| 输出 Token 限制 | 64,000 个 Token |
| 输入模态 | 文本、图像、视频、音频、PDF |
| 输出模态 | 文本 |
| Function calling | 是 |
| Search as a tool | 是 |
| Computer use | 是 |
| 长上下文检索 (128k needle) | 97.0% |
| 安全性 | 更新了 CBRN 和网络安全保障措施 |
| 可用性 | 160 多个国家/地区 |
| API 接口 | generativelanguage.googleapis.com (AI Studio 密钥) 或 aiplatform.googleapis.com (Vertex, OAuth) |
有两行内容值得格外关注。对于 Flash 级别的模型来说,64k 的输出限制非常慷慨;这意味着完整的文件重写和超长结构化输出都可以放在单次响应中完成。此外,对 computer use 的支持使 3.7 Flash 跻身少数可以直接驱动浏览器的模型行列,尽管对于大多数生产环境下的自动化任务,结构化的 API 调用仍然是更好的选择。我们将在“computer use 对比结构化 API”中详细介绍其权衡取舍。
价格一览
Google 推出的 3.7 Flash 首发价格仅为 3.6 Flash 的一半,但该优惠是有有效期的。
| 档位 | 输入(每 1M Token) | 输出(每 1M Token) | 有效期 |
|---|---|---|---|
| 推广价 | $0.75 | $3.75 | 截至 2026 年 12 月 31 日 |
| 标准价 | $1.50 | $7.50 | 自 2027 年 1 月 1 日起 |
这意味着在元旦那天,两端价格都将翻倍。如果你的工作负载非常消耗 Token,那么在推广期内是进行基准测试、调整 prompt 以及锁定缓存策略的最佳时机,因为此时试错成本只有一半。如需查看具体计费示例、真实工作负载下的 Token 换算,以及在标准资费生效前削减开支的策略,请参阅《Gemini 3.7 Flash 定价详解》(Gemini 3.7 Flash pricing explained)。最新最准确的价格信息请参考 Gemini API 定价页面。
基准测试:3.6 Flash vs 3.7 Flash
Google 公布了 3.7 Flash 相比于 3.6 Flash 在代码编写、Web 开发、文档理解以及 Agent 自动化方面的提升数据。对于一个在前作发布仅三周后就推出的次版本而言,这一差距是相当巨大的,9to5Google 的发布报道也指出了这一点。
| 基准测试 | Gemini 3.6 Flash | Gemini 3.7 Flash | 增幅 |
|---|---|---|---|
| DeepSWE v1.1 (Agent 编码) | 49.0% | 65.3% | +16.3 |
| FrontierCode 1.1 Main | 34.4% | 43.6% | +9.2 |
| WebDev Arena (Elo) | 1538 | 1588 | +50 |
| GDP.pdf (文档理解) | 22.0% | 34.0% | +12.0 |
| AutomationBench (Agent 自动化) | 17.0% | 30.4% | +13.4 |
| Harvey LAB-AA (法律) | n/a | 90.7% | n/a |
| 128k 大海捞针检索 | n/a | 97.0% | n/a |
从表格中可以看出一个规律:Agent 工作负载的提升最为显著。这与 Google 声称的改进相吻合,包括更好的调试、更具可部署性的首版代码、在多步规划和工具调用上更周密的思考,以及更严格的指令遵循。至于这些数据与 Anthropic 和 OpenAI 模型相比如何,则是另一个问题,答案在《Gemini 3.7 Flash vs Claude vs GPT》中有所阐述。
在哪里可以使用 Gemini 3.7 Flash
发布时共提供七种接入渠道。请根据角色进行选择。
| 渠道 | 用途 | 适用人群 |
|---|---|---|
| Gemini API | 通过 AI Studio 密钥进行编程访问 | 发布应用的开发者 |
| Google AI Studio | 浏览器 Playground、Prompt 迭代、密钥管理 | 进行原型设计的开发者 |
| Gemini 应用 | 面向 Web 和移动端消费者的聊天服务 | 终端用户 |
| Gemini Spark | Agent 编码环境 | AI Pro 和 Ultra 订阅用户 |
| Google Antigravity | Agent 优先的开发平台 | 构建自主 Agent 的团队 |
| Android Studio | 用于 Android 开发的 IDE 集成 | 移动端开发者 |
| Gemini Enterprise | 带有管理员控制的托管部署 | 企业 IT 人员 |
对于 API 开发工作,通过 AI Studio 密钥的方式可以在几分钟内让你跑通一个可用的请求。而在需要生产环境控制时,Vertex AI 在 OAuth 之后提供了相同的模型,并带有 IAM、审计日志和区域接口。
一个最简的可用请求
从 AI Studio 获取密钥,将其导出,然后发送一个请求。
export GEMINI_API_KEY="AIza..."
curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.7-flash:generateContent" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"contents": [{
"parts": [{ "text": "List the HTTP status codes an idempotent retry layer should handle." }]
}],
"generationConfig": {
"temperature": 0.4,
"maxOutputTokens": 1024
}
}'
流式传输需要将相同路径上的方法替换为 :streamGenerateContent?alt=sse。响应会返回一个包含文本部分的 candidates 数组,以及一个包含计费 Token 数量的 usageMetadata 块。
如果你不想在终端中手动编辑 JSON,Apifox 可以导入 Generative Language API 接口定义/规范,将 GEMINI_API_KEY 作为环境变量绑定到 x-goog-api-key header 上,并实时渲染 SSE 流。只需保存一次成功的响应作为示例,即可针对该固定数据运行测试,而无需请求付费的接口。
速率限制与层级
Google 针对每个模型和每个层级(免费、按需付费和预留层级)设置了速率限制,这些数值变化频繁,因此这里列出的任何表格都很容易过时。请查看官方 Gemini API 接口文档以获取 gemini-3.7-flash 当前的每分钟请求数和每分钟 Token 数限制。
两个放之四海而皆准的经验法则:首先,通过 AI Studio 提供的免费层级配额足够用于原型开发,但不足以发布上线。其次,带有 RESOURCE_EXHAUSTED 状态的 429 响应意味着你已达到每分钟或每天的上限;请使用带抖动的退避策略、尽可能进行批量处理,或者将项目迁移到付费层级。
快速链接
- 官方发布公告:包含 Google 官方声明和基准测试图表的发布博客
- Gemini API 接口文档:接口参考、SDK 指南、速率限制
- 价格页面:实时的每 Token 资费
- 模型页面:规格和模态细节
- 获取 API 密钥:只需点击两下即可获取 AI Studio 密钥
常见问题
一句话概括 Gemini 3.7 Flash 的规格是什么?
1M Token 的输入上下文窗口、64k Token 的输出限制,支持文本、图像、视频、音频和 PDF 的多模态输入以及文本输出,支持函数调用、搜索工具和电脑操作能力,在 Gemini API 中可通过 gemini-3.7-flash 进行调用。
Gemini 3.7 Flash 的费用是多少?
截至 2026 年 12 月 31 日,价格为每 1M 输入 Token 0.75 美元,每 1M 输出 Token 3.75 美元。自 2027 年 1 月 1 日起,将恢复标准资费:输入 1.50 美元,输出 7.50 美元。此促销价格仅为 3.6 Flash 发布时价格的一半。
从 3.6 Flash 升级,我需要修改代码吗?
切换本身只需一行代码:将模型 ID 修改为 gemini-3.7-flash。真正的难点在于行为的变化,因为 3.7 在多步工具调用上的思考时间更长,且遵循指令更加严格。3.6 到 3.7 Flash 迁移指南涵盖了在切分流量之前需要进行哪些回归测试。
为什么 Google 在发布 Gemini 3.5 Pro 之前先推出了 3.7 Flash?
Gemini 3.5 Pro 仍然推迟发布,据 Axios 报道,Google 正在其下一个旗舰模型发布前率先推出 Flash 的更新,而不是压着改进不发。3.6 和 3.7 Flash 之间仅隔三周的时间正符合这一节奏。
有免费的体验方式吗?
是的。AI Studio 的免费层级包含了 gemini-3.7-flash 的每日配额,足够用于 prompt 测试和小型原型开发,并且在您需要更高的频率限制之前不需要绑定账单账户。免费的 Gemini API 接入指南涵盖了免费层级的额度范围以及达到上限时的应对措施。
3.7 Flash 在您的技术栈中的定位
可以将 3.7 Flash 作为 Agent 循环、编程助手、文档流水线以及任何在单个会话中需要进行大量工具调用的默认 Gemini 模型。基准测试的提升正好体现在这些工作负载上,而且其首发价格使得接下来的四个半月成为最便宜的构建窗口期。在 Gemini 3.5 Pro 发布之前,请保留对旗舰级推理能力的评价;对于其他一切任务,它确实如 Google 所说,是一个强有力的主力工具。
在将模型 ID 写入生产代码之前,请先对接口进行测试。下载 Apifox 即可在同一个工作区中管理您的 Gemini 请求、环境、流式传输检查以及保存的响应数据,同时还可以管理您正在评估的其他服务商的集合。
开发必备:API 全流程管理神器 Apifox
介绍完上文的内容,我想额外介绍一个对开发者同样重要的效率工具 —— Apifox。作为一个集 API 文档、调试、设计、测试、Mock、自动化测试于一体的工具,Apifox 是目前提升研发效率的首选。
如果你正在开发项目,不妨试试其极其友好的界面设计,它完全兼容 Postman 和 Swagger 数据格式,导入数据非常方便,,即使是新手也能很快上手,点击这里即可注册使用。

值得一提的是,除了个人和常规团队使用,针对有高安全合规要求、或需要在内网环境协作的企业,Apifox 还提供了深度定制的私有化部署方案。
获取专属报价与部署方案
详细的私有化部署系统架构与安全白皮书
针对您公司规模的专属报价单
免费的 1v1 专属产品演示 (Demo) 机会