Tabbit博客

Gemini 3.8 Flash:有哪些变化,如何获取

以官方资料说明 Gemini 3.8 Flash 的定位、与 3.7 的变化、获取方式、限制、价格时点和适用场景。

本文目录
  1. 要看清的数字:1,048,576
  2. 关键结论
  3. Gemini 3.8 Flash 规格速览
  4. 与 Gemini 3.7 Flash 的变化
  5. 如何获取
  6. 在 Tabbit Browser 中完成一个小任务
  7. 谁适合尝试
  8. 社区原声:有条件的好评,也有反例
  9. 来源与下一步

Gemini 3.8 Flash 是 Google 于 2026 年 9 月 2 日发布的稳定版 Flash 模型,重点面向长期软件工程、自主智能体和复杂企业工作流。同日发布的 Gemini 3.8 Flash Cyber 是独立的安全变体。想判断它是否适合你的工作,先要确认使用入口:API、AI Studio、企业产品和消费者订阅的权限与计费并不相同。 (Google)

要看清的数字:1,048,576

Google 列出的 1,048,576 输入 token 是 Gemini API 上限,不是每个浏览器、订阅或账户的额度。先确认模型名称和实际入口,再用测评与定价指南决定交给它什么任务。 (Google)

Google 对 3.8 的核心描述是“在复杂任务上投入更多工作”:模型可能增加推理步骤并迭代调用工具。这种设计可能改善长流程任务的完成度,也可能带来更多输出 token 和等待时间。社区任务演示不能证明模型在所有任务上普遍领先。更细的质量判断留给完整测评

Google 官方模型页,截图于 2026-09-20;展示产品规格,不是 Tabbit 推理实测。
Google 官方模型页,截图于 2026-09-20;展示产品规格,不是 Tabbit 推理实测。

你现在真的能用 Gemini 3.8 Flash 吗?

选择最接近你的场景。这是访问自检,不承诺你的账户一定拥有模型权限。

Google 在 Gemini API 中列出了稳定模型 ID。

开始开发前,先核对 API 项目、计费层级、地区和配额。

依据 Google 访问页面与 2026 年 9 月 20 日的 Tabbit 账户测试核对。

关键结论

  • 稳定模型 ID 是 gemini-3.8-flash,支持文本、图片、视频、音频和 PDF 输入,输出为文本。

  • 输入上限是 1,048,576 token,输出上限是 65,536 token。thinking 支持 low、medium、high,minimal 不支持。

  • 与 3.7 的主要差异是复杂任务会进行更深入的推理和更多工具迭代,因此不能只按每百万 token 的标价判断成本。

  • Google 列出 AI Studio、Gemini API、Android Studio、Google Antigravity、Stitch、Gemini Enterprise 和部分消费者订阅入口。这些入口不可互换。

  • 2026 年 12 月 31 日前,标准 API 价格为输入 $0.75、输出(含 thinking)$3.75 / 百万 token;2027 年起官方列出的标准价格上调为 $1.50 和 $7.50。订阅与 Tabbit 费用不包含在内。 (Google API)

Gemini 3.8 Flash 规格速览

官方模型文档是限制和能力的首要来源。Google 发布说明解释了版本定位;Artificial Analysis提供特定时间和评测版本下的独立快照。它们不是同一套测试。

项目当前信息对使用的影响
模型状态Stable gemini-3.8-flash仍需确认目标产品是否开放这个稳定 ID。
输入 / 输出文本、图片、视频、音频、PDF / 文本多模态输入范围较广;官方页没有把图片或音频生成列为输出。
token 上限输入 1,048,576;输出 65,536API 上限不保证每个客户端都提供相同窗口。
thinkinglow、medium、highminimal 不支持并会报错;更高档位可能使用更多 token。
工具能力缓存、代码执行、Computer Use 预览、文件搜索、函数调用、搜索与地图 grounding、结构化输出、URL context这是 API 支持清单,不是每个客户端的可用性证明。
标准 API 价格2026-12-31 前输入 $0.75、输出 $3.75 / 百万 token输出价格已含 thinking;缓存、批量与 Flex 按官方规则另行计算。

Artificial Analysis 在 2026 年 9 月 20 日检查的页面列出 Intelligence Index 41、v4.3.2、high thinking、305 output tokens/s 和每项指数任务 $1.24。页面没有公开 TTFT。它只能帮助读者理解某一评测快照,不能直接当作你的延迟、成本或成功率保证。

与 Gemini 3.7 Flash 的变化

Google 称 3.8 在软件工程、智能体任务和专业领域多步推理上取得提升,并说明模型通过长期智能体循环反复评估和改进。在复杂任务上,3.8 可能比旧版本执行更多推理和工具调用。Google 也明确表示,较低 effort 可以减少 token 开销,3.7 仍适合效率优先的工作。因此 3.8 是有条件的升级,而不是所有任务都必须迁移。

维度Gemini 3.7 FlashGemini 3.8 Flash选择提示
定位快速、高效的日常编码和智能体模型面向长期编码和自主工作的 Flash workhorse需要持续规划和迭代时优先试 3.8。
工作方式公开资料没有给出同等程度的描述复杂任务可能增加推理和工具调用预算应允许输出量和等待时间变化。
thinking 档位取决于使用的客户端low、medium、high不要假定存在 minimal fallback。
价格Google 表示 3.8 延续 3.7 的引入价2026 年底前输入 $0.75、输出 $3.75 / 百万 token标价相同不代表单任务成本相同。
Cyber 变体不在本文范围独立且受限的防御安全模型普通 3.8 访问不等于 Cyber 计划资格。

Google 发布页中的 benchmark、客户案例和产品演示都是厂商报告。更细的任务和证据边界可以在Gemini 3.8 Flash 模型资源中查看。

如何获取

开发者可以在 Google AI Studio 中试用,或在 Gemini API 中使用稳定模型 ID。Google 还列出 Android Studio、Google Antigravity 和 Stitch 作为开发入口。企业客户可以通过 Gemini Enterprise 获取,消费者则可能在 Gemini 应用、Google Search 的 AI Mode 和 Gemini in Sheets 中通过 Google AI Pro 或 Ultra 使用。具体资格、区域、配额和计费方式必须在实际产品中确认。

同一个模型名称不代表同一种控制方式。消费者订阅不是 API 计费账户,API 能用也不证明浏览器客户端已经开放该模型。计划上线工作流前,先检查产品的实时模型选择器和配额。

在 Tabbit Browser 中完成一个小任务

2026 年 9 月 20 日的编辑验证通过自动化辅助操作,在 Tabbit Browser Dev 测试站的已登录账户中新建对话,选择 Gemini-3.8-Flash。输入五条虚构付款记录,要求返回币种、已付合计、逾期 ID 与状态缺失 ID。实际返回 USD、145、B、D,四个字段符合预期;没有把缺失状态擅自补齐。

这只是一次抽取样例,不是生产性能测试。虽然提示词要求不用工具,界面仍显示 Google 搜索标记,实际工具执行未单独核验。思考档位、token 用量、费用与耗时均未测量。先检查截图中的任务和结果,再确认自己的模型选择器并尝试一个小任务。

Tabbit 测试账户,2026-09-20:一次正确的结构化抽取,界面可见 Google 搜索标记。
Tabbit 测试账户,2026-09-20:一次正确的结构化抽取,界面可见 Google 搜索标记。

谁适合尝试

需要多模态输入、大上下文、结构化输出或长期智能体循环,并能接受 token 用量波动的人,可以优先试 3.8。它尤其适合把复杂编码、资料分析和工具调用放在同一个长流程里的团队。

如果首要约束是固定预算、低等待时间或客户端工具支持,应保留 3.7 或其他模型作为对照。下方 Hacker News 原声只反映个人场景,不能替代自己的任务测试。费用见定价分析,质量见测评,其他选择见替代品

社区原声:有条件的好评,也有反例

Hacker News 用户 handzhiev 说 Gemini 3.7 是快速、够用的工作模型,并表示愿意测试 3.8(原评论;个人经验,Gemini 3.7,2026 年 9 月 2 日)。simonw 分享了 Gemini 3.8 Flash 在个人编码代理中完成 HTML 渲染的经历(原评论;个人经验,Gemini 3.8 Flash,2026 年 9 月 2 日)。

关于 Gemini 3.7 工作模型的 Hacker News 评论

Hacker News:simonw 描述用 Gemini 3.8 Flash 修改 HTML 渲染器。
Hacker News:simonw 描述用 Gemini 3.8 Flash 修改 HTML 渲染器。

反向信号来自获取和成本:robertwt7 表示 Plus 用户仍停留在 3.6 Flash,并询问澳大利亚能否使用 3.7(原评论;个人经验,Gemini 网页版,2026 年 9 月 3 日)。wyrdcurt 认为 Gemini 的 HTML 结果是快速的“cool HTML toy”,并与更便宜的模型比较(原评论;个人比较,评论中列出的模型版本,2026 年 9 月 2 日)。这些是场景经验,不是统一基准或权限证明。本轮 Reddit 出现人机验证,X 搜索未返回可用正文,未采用其内容。

关于访问不确定性和成本比较的 Hacker News 评论

Hacker News:wyrdcurt 质疑生成的 HTML 演示的实用性。
Hacker News:wyrdcurt 质疑生成的 HTML 演示的实用性。

来源与下一步

先阅读官方模型文档,再在你计划使用的产品中确认账号、地区和配额。若成本是主要约束,继续阅读Gemini 3.8 Flash 定价分析;若质量是主要约束,查看完整测评;若当前入口或预算不合适,查看替代品文章

复现任务可看 任务指南 ,核对证据可看 测评来源 ,选择浏览器工作环境可看 浏览器迁移指南

浏览器中的 AI 工作方式

Tabbit Browser

常见问题

Gemini 3.8 Flash 是什么?

Gemini 3.8 Flash 是 Google 面向长期软件工程、自主智能体和复杂企业工作流的稳定版 Flash 模型。API 支持文本、图片、视频、音频和 PDF 输入,并输出文本。

它比 Gemini 3.7 Flash 变化了什么?

Google 将 3.8 定位为更强的推理和编码版本。复杂任务可能执行更多推理步骤并反复调用工具,因此也可能消耗更多 token。

Gemini 3.8 Flash 的上下文和输出上限是多少?

官方模型页列出的输入上限为 1,048,576 token,输出上限为 65,536 token。具体客户端可能暴露更小的有效窗口。

它支持哪些 thinking 档位?

API 支持 low、medium 和 high。minimal 不受支持,调用会返回错误。

在哪里可以使用 Gemini 3.8 Flash?

Google 列出了 AI Studio、Gemini API、Android Studio、Google Antigravity、Stitch、Gemini Enterprise,以及 Google AI Pro 和 Ultra 的部分消费者入口。资格和地区条件会因入口不同而变化。

Gemini 3.8 Flash 已经能在 Tabbit 中使用吗?

2026 年 9 月 20 日,Tabbit Browser Dev 的一个测试账户完成了预期 JSON 抽取。这一个样本不证明正式版账户权限、性能或费用;请检查自己的模型选择器和实际结果。

下一步

让 Tabbit 与你并肩工作。

跨标签页调研、自动化重复的浏览器工作,让每一处上下文都触手可及。