Gemini 3.7 Flash 是 Google 的稳定多模态 workhorse,适合日常编码、工具调用和智能体流程。需要速度与可预估 API 价格时可以先试,但事实任务和长流程代码仍应保留人工复核。
截至 2026 年 9 月 20 日,Google 稳定模型页列出 gemini-3.7-flash、1,048,576 token 输入上限、65,536 token 输出上限,以及 low、medium、high thinking。Google 模型卡称它基于 Gemini 3.6;Gemini 3.8 Flash 是独立的相邻入口,不是每个 3.7 客户端都会自动升级的版本。先看 Gemini 3.7 模型页,再确认实际产品和账户。
先给结论
需要多模态输入、结构化输出、编码协助和工具调用时,可把 3.7 作为效率优先候选。
基准分数属于特定日期、提供商和 harness 的快照,不代表你的仓库或智能体循环。
Google 模型卡列出幻觉、越狱抵抗仍在改进、偶发变慢或超时等限制,应保留复核步骤。
API 计费、Google 订阅与 Tabbit 可用性是三件事,不能合并判断。
规格速览
| 项目 | 当前信息 | 使用含义 |
|---|---|---|
| 稳定 ID | gemini-3.7-flash | 在产品选择器或 API 请求中确认完整 ID。 |
| 输入与输出 | 文本、图片、视频、音频、PDF 输入;文本输出 | 支持清单不代表每个客户端开放全部输入。 |
| token 上限 | 输入 1,048,576;输出 65,536 | API 上限不保证浏览器或订阅提供相同窗口。 |
| thinking | low、medium、high | minimal 不支持;更高档位可能消耗更多 token。 |
| 工具 | 缓存、代码执行、Computer Use 预览、文件搜索、函数调用、grounding、结构化输出和 URL context | 还要确认账户与客户端是否暴露这些工具。 |
| 知识截止 | 模型卡给出 2026 年 3 月 | 当前事实仍应搜索或查来源。 |
官方提示资源和评测来源可帮助复现任务,但不会改变上述 API 限制。
与 Gemini 3.6 的变化
Google 将 3.7 描述为 3.6 系列的演进。Eesel 讨论的 Google 对比表中,3.7 在 Terminal-Bench 2.1 为 85.8、3.6 为 78.0;DeepSWE 为 65.3 对 48.6;Code Arena Elo 为 1588 对 1538。但 CharXiv with tools 是 88.7 对 89.4,说明不是所有任务都提升。
BenchLM 页面在 2026 年 9 月 20 日检查时列出 Terminal-Bench 2.1 85.8%、AutomationBench 30.4%、OSWorld 2.0 47.9%、MRCR 64K-128K 97% 和 GPQA Diamond 93.9%。提供商、harness 和样本都很重要,不应把单一数字写成产品保证。需要设计验收方案时可看智能体推理指南。
| 判断点 | 3.6 Flash | 3.7 Flash | 实际解读 |
|---|---|---|---|
| 基线 | 较早一代 Flash | 基于 3.6 系列 | 比较时保持同一任务和验收标准。 |
| 编码与智能体证据 | 对比表中若干分数较低 | Terminal-Bench、DeepSWE、Code Arena 较高 | 是有用信号,不是总排名。 |
| 多模态证据 | 对比表中的 CharXiv with tools 略高 | 该行略低 | 不要推断所有视觉任务都变好。 |
| 2026 年底前价格 | Google 列出相同引入价 | 输入 $0.75、输出 $3.75 / 百万 token | 标价相同不代表 token 用量相同。 |
3.7 与 3.8:相邻入口,不是同一条升级链
本文不重复 Gemini 3.8 总览、3.8 评测和3.8 定价的深度内容。Google 把 3.8 定位为更长流程、更主动规划的版本。社区一份项目记录估计 3.7 用时约 30 分钟,3.8 约 1 小时,但 3.7 需要更多复核;另一份重复任务记录认为 3.8 更慢却更周全。这些是单项目观察。
比较时固定四件事:记录模型 ID、客户端、thinking 和日期;给两个版本同一份输入和验收标准;记录用时、token、工具调用与返工;只有复核负担没有抵消节省的时间时,才保留更快的版本。
AI 浏览器指南解释了浏览器客户端为什么可能与 API 暴露不同控件。Google AI Pro 或 Ultra 订阅不等于 API 计费账户,也不等于 Tabbit 已开放 3.7。
获取、价格与产品边界
| 入口 | 需要核对 | 本文不推断 |
|---|---|---|
| Google AI Studio | 模型选择器、地区、配额和密钥设置 | 免费层拥有付费层隐私或额度。 |
| Gemini API | 稳定 ID、账单层级、速率限制和 token 统计 | 浏览器客户端提供同样工具。 |
| Google Antigravity、Android Studio | 产品 rollout 和账户资格 | API key 对 IDE 一定充分。 |
| Gemini Enterprise | 合同、地区和管理员控制 | 消费者订阅条款适用。 |
| Spark 与 Google AI 订阅 | 计划、国家和 rollout | 消费者入口包含 API 额度。 |
Google 价格页列出:2026 年 12 月 31 日前,标准 API 输入 $0.75、输出 $3.75 / 百万 token;2027 年起为 $1.50 和 $7.50。缓存、grounding、Batch 和 Flex 另有规则,输出统计可能包含 thinking token。3.8 价格分析可作结构参考,但不要把 3.8 任务成本直接套给 3.7。
身份与场景自检
开始任务前写下模型 ID、客户端、账户或计划、地区、日期和 thinking 档位;同时记录输入模态、文件大小、启用的工具、输出 schema 和验收测试。事实回答要留来源,代码要跑本地测试并检查 diff,文档抽取要固定 schema 并允许缺失值,智能体要记录工具调用并设置预算。遇到超时、工具不支持、旧事实或坏 JSON,要有明确的失败路径。
本文没有用已登录账户在 Tabbit Browser 实测 3.7,因此不声称 Tabbit 当前选择器、有效上下文、延迟、订阅资格或费用。若你的选择器出现该模型,请先做一个低风险抽取,记录可见模型名和结果,再用已知答案重复一次。Tabbit AI 浏览器说明解释的是产品边界,不是 API 基准。
Verdict
Gemini 3.7 Flash 适合把多模态编码和工具调用放在效率优先的工作流中。现有证据支持它在若干编码和计算机使用测量上超过 3.6,但不支持“所有任务都更好”。先用固定验收测试;需要更长规划且可接受更多时间或 token 时,再比较 3.8;高风险任务和工具暴露不明确时保留其他模型。
来源与常见问题
主要来源是 Google 的模型文档、发布说明、DeepMind 模型卡和API 价格,以及 BenchLM、Eesel。社区来源、日期和局限已在上文对应段落说明。
Gemini 3.7 Flash 是稳定模型吗?
Google API 页列出稳定 ID gemini-3.7-flash,但实际产品仍可能有 rollout、配额或地区限制。
每个应用都能读取一百万 token 吗?
不能。一百万是 API 输入上限,客户端、计划或包装层可能提供更小的有效上下文。
应选 3.7 还是 3.8?
给两个版本相同任务和验收标准。3.7 偏效率,3.8 是更长流程的相邻路线。
API 价格包含 Google AI 订阅吗?
不包含。API token 计费、消费者订阅和企业合同是不同产品。
模型知识是最新的吗?
模型卡给出 2026 年 3 月知识截止。当前或高影响事实仍需要搜索、引用和本地测试。
能在 Tabbit 使用吗?
本文没有核验已登录的 3.7 Tabbit 会话。查看自己的实时选择器,并把结果当作单任务观察,不要当作平台保证。
常见问题
Gemini 3.7 Flash 是什么?
Gemini 3.7 Flash 是 Google 面向编码、工具调用和日常智能体流程的稳定多模态 workhorse 模型。API 接受文本、图片、视频、音频和 PDF,输出文本。
Gemini 3.7 Flash 有哪些限制?
Google 列出的输入上限是 1,048,576 token,输出上限是 65,536 token。API 支持 low、medium 和 high thinking,minimal 不支持。
Gemini 3.7 Flash 如何计费?
2026 年 12 月 31 日前,标准 API 输入为每百万 token 0.75 美元,输出为 3.75 美元;2027 年 1 月 1 日起,官方列为 1.50 和 7.50 美元。
在哪里可以使用 Gemini 3.7 Flash?
Google 列出 AI Studio、Gemini API、Google Antigravity、Android Studio、Gemini Enterprise 和 Spark 等入口。产品、地区和账户资格并不相同。
它与 Gemini 3.6 和 3.8 有什么关系?
Google 模型卡说明 3.7 基于 3.6;独立对比显示它在若干编码和智能体基准上提升。3.8 是面向更长流程的相邻独立入口。
Gemini 3.7 Flash 能在 Tabbit 使用吗?
本文没有用已登录账户实测 Tabbit 的 3.7,因此不声称可用性、延迟或费用。请查看自己的模型选择器并验证一个小任务。