Tabbit部落格

Gemini 3.6 Flash:變化、價格,以及為什麼驗證比榜單重要

Gemini 3.6 Flash 提供 100 萬 token 上下文、更少輸出 token 與多模態工具,但配額、驗證和版本遷移仍決定實際價值。

本文目錄
  1. 快速判斷
  2. 規格一覽
  3. 從 3.5 到 3.6,3.7 又代表什麼
  4. 官方結果要連同口徑閱讀
  5. 獨立與社群回饋
  6. 價格、配額與風險
  7. 場景自檢與 Tabbit 邊界
  8. 結論
  9. 來源

Gemini 3.6 Flash 適合做多模態程式碼、文件與邊界清楚的 Agent 試點。它的價值不只在 benchmark:Google 表示它比 3.5 Flash 使用更少輸出 token,而社群經驗說明,只有在結果容易複核時,節省才會變成實際收益。

本文時間錨點是 Google 2026 年 7 月 21 日發布,以及 9 月 20 日重新查看的模型卡:gemini-3.6-flash、輸入 1,048,576 token、輸出 65,536 token、文字/圖片/影片/音訊/PDF 輸入,以及輸入/輸出每百萬 1.50/7.50 美元的付費 Standard 行。3.7 和 3.8 是相鄰路線,不是自動替代。先看 Gemini 3.6 模型頁 (简体中文),再確認實際客戶端和帳戶。

快速判斷

  • 需要多模態輸入、快速 Agent 迴圈和較低輸出帳單時可試用 3.6。

  • 「少 17% 輸出 token」是有日期的比較,不是每個任務都省錢的保證。

  • Google 列出幻覺、偶發逾時和知識截點,因此必須獨立驗證。

  • Gemini API、AI Studio/Antigravity、企業條款和 Tabbit 配額要分開看。

  • 可寫入 Agent 必須同時提供 diff、測試結果和停止條件。

規格一覽

項目2026-09-20 查看內容實際邊界
模型 ID穩定版 gemini-3.6-flash仍應檢查選擇器與請求中的精確 ID。
輸入輸出文字、圖片、影片、音訊、PDF 輸入;文字輸出客戶端可能只開放一部分。
token 上限輸入 1,048,576;輸出 65,536產品或方案可能提供更小窗口。
工具快取、程式執行、電腦使用預覽、檔案搜尋、函式呼叫、接地、結構化輸出、URL 上下文API 支援不等於帳戶和客戶端都開放。
付費價格輸入 $1.50 / 輸出 $7.50 每百萬 token免費層、快取、工具與重試另計。
知識截點模型卡列出 2026 年 3 月當前事實仍需搜尋和引用。

先讀 什麼是 Agent 瀏覽器,再看 AI 瀏覽器比較Tabbit Browser 實務

從 3.5 到 3.6,3.7 又代表什麼

Google 將 3.6 定位為 3.5 Flash 之後的工作模型:程式碼、知識工作和多模態表現更好,引用的 Artificial Analysis 比較中輸出 token 少 17%。發布文也列出 DeepSWE 49% 對 37%、MLE-Bench 63.9% 對 49.7%、OSWorld-Verified 83.0% 對 78.4%、GDPval-AA v2 Elo 1421 對 1349。這些是發布方選出的比較,不能當獨立審計。

3.7 和 3.8 改變的是選擇,而不是讓 3.6 立即失效。如果 3.6 能用較少迴圈完成容易驗收的工作,效率就有意義;若任務需要更長自主規劃,應固定任務與驗收條件比較新路線。Agent 深度研究指南可幫助記錄努力等級、工具和修正次數。

官方結果要連同口徑閱讀

Google 模型卡列出 SWE-Bench Pro 58.7%、DeepSWE 49%、Terminal-Bench 2.1 78.0%、MLE-Bench 63.9%、OSWorld-Verified 83.0%、CharXiv 無工具 85.2%、GDM-MRCR 1M 54.0%。這些行分別測試程式碼、電腦使用、圖表和長上下文,不是綜合分。1M 行是點測,不表示每個百萬 token 請求都便宜或穩定。任務條件可在 Gemini prompts (简体中文)Gemini reviews (简体中文)查看,不要複製第三方長提示詞。

獨立與社群回饋

Promptslove 記錄 24 小時 OpenCode、high thinking、四個任務的比較:前端、瀏覽器遊戲、表單建構和 Instagram 影片分析。作者稱表單、CSV 匯出、編輯與影片分析可用,但前端缺少滾動指標、數字動畫、響應式和視覺精度。這是具體小樣本,不是官方 benchmark 的替代品。

r/google_antigravity 的一篇帖子認為,工作範圍清楚、先做 instrument 再按通過/失敗判斷時,3.6 快而有能力;但「驗證」可能只是看起來合理,且有一次不可逆操作風險。另一位半天使用者稱迴圈和 token 更少,但後續功能開發漏跑測試和 Firebase 規則。r/SillyTavernAI 使用者在 temperature 1 與指定 preset 下稱讚寫作,回覆則提到 400 錯誤、拒答和長上下文重複。這些觀察說明監督成本也是價格的一部分。

價格、配額與風險

Google 付費 Standard 行為輸入/輸出每百萬 1.50/7.50 美元,輸出包含 thinking token。免費層表示提交內容可能用於改善 Google 產品,付費層則表示不會;傳送敏感資料前要核對目前地區條款。快取、Search grounding、工具、重試和消費者訂閱不能藏在 token 單價裡。

AI Studio、Gemini API、Antigravity、Android Studio 與 Gemini Enterprise 可能有不同配額和合同。某個產品跑得快,不證明 API 或另一個產品有相同條款。Tabbit 是獨立路線;可參考 瀏覽器自動化設計任務,但不能把 Tabbit 會話換成 Gemini API 帳單。

Google 也列出幻覺、偶發逾時、持續加強越獄防護和 2026 年 3 月知識截點。社群補充漏測、錯誤驗證、配額壓力、供應商錯誤和長會話重複。它們不是失敗率,而是驗收清單。

場景自檢與 Tabbit 邊界

小型程式碼補丁使用固定儲存庫、diff 和測試;文件或圖表任務使用有日期輸入與缺失值欄位;電腦使用在可丟棄頁面記錄工具;長文比較短長續寫和重複率;生產 Agent 設定預算與人工檢查點。

本文沒有執行已登入的 Gemini 3.6 Flash Tabbit 任務,也沒有 4–8 張合格截圖,因此不聲稱選擇器、有效上下文、延遲、配額、訂閱或價格。若帳戶出現該模型,先從公開文件抽取五項事實與連結,人工核對後再重複已知答案。第一次不要上傳機密資料或授予寫入權限。

Tabbit Browser

結論

Gemini 3.6 Flash 是多模態程式碼和邊界清楚 Agent 的可信效率型候選。Google 結果支持 token 效率和相對 3.5 的多項提升,但獨立與社群資料提醒:監督、配額和驗證可能吃掉帳面節省。用固定任務試點;只有新能力或更長自主性足以抵消路線與複核成本時,才遷移 3.7 或 3.8。高影響任務保留備用模型。

來源

常見問題

Gemini 3.6 Flash 是什麼?

Gemini 3.6 Flash 是 Google 面向程式碼、知識工作和 Agent 的穩定多模態 Flash 模型。Google 列出文字、圖片、影片、音訊和 PDF 輸入,輸入上限 1,048,576 token,輸出上限 65,536 token。

它比 Gemini 3.5 Flash 改變了什麼?

Google 引用的 Artificial Analysis 比較顯示輸出 token 少 17%,同時程式碼、知識工作和多模態表現提升。這是有日期與口徑的供應商資料,不代表每個任務都會降低成本。

Gemini 3.6 Flash 的價格是多少?

2026 年 9 月 20 日查看的 Google 付費 Standard 價格為輸入每百萬 token 1.50 美元、輸出 7.50 美元。免費層資料使用條款不同,工具和重試也可能增加成本。

它適合程式 Agent 嗎?

Google 模型卡列出 SWE-Bench Pro 58.7%、Terminal-Bench 2.1 78.0% 和 OSWorld-Verified 83.0%。獨立與社群回饋更支持邊界清楚、有人複核的任務。

Gemini 3.6 Flash 有哪些限制?

Google 列出幻覺、偶發變慢或逾時、持續加強的越獄防護,以及 2026 年 3 月知識截點。社群還提到配額、漏測和長上下文重複。

可以在 Tabbit 使用 Gemini 3.6 Flash 嗎?

本文沒有執行已登入的 Gemini 3.6 Flash Tabbit 任務。請查看即時選擇器和帳戶條款,不要從 Gemini API 推斷 Tabbit 的可用性、延遲、配額或帳單。

下一步

讓 Tabbit 與你並肩工作。

跨分頁調研、自動化重複的瀏覽器工作,讓每一處上下文都觸手可及。