Gemini 3.8 Flash 值得留在候選名單。Google 公開多模態輸入、1,048,576 個輸入 token、65,536 個輸出 token,以及 low、medium、high 三種 thinking。離開的理由應來自具體限制:客戶端或地區沒有該路線、工具不合用,或完成任務成本不合適。
關鍵事實是同價:Google 公布的 2026 Standard 費率中,Gemini 3.7 與 3.8 Flash 都是每百萬輸入 token 0.75 美元、輸出 3.75 美元。退回前代本身不降低單價;任務用量、重試與適配才決定實際價值。 (Google)
Gemini 3.8 總覽說明模型本身;本文只討論是否切換。
關鍵結論
我用四項標準篩選替代方案:完成任務成本、可接受的回應路徑、供應商與部署適配、可核對的一手證據。社群評論只代表個人經驗,不證明價格、效能或模型優劣。
Gemini 3.7 Flash 適合小幅遷移。
GPT-5.6 Luna 適合先測 API 標價。
Claude Sonnet 5 適合 Anthropic 工具路線。
DeepSeek V4.1 Flash 適合 1M 上下文、雙思考模式和峰谷價格。
我如何篩選
我用四項標準篩選替代方案:完成任務成本、可接受的回應路徑、供應商與部署適配、可核對的一手證據。社群評論只代表個人經驗,不證明價格、效能或模型優劣。
四個候選一覽
| 候選 | 適用場景 | 官方路線 | 公開價格 | 主要取捨 |
|---|---|---|---|---|
| Gemini 3.7 Flash | Gemini 生態最小遷移 | gemini-3.7-flash;1,048,576 / 65,536 | $0.75 / $3.75 每百萬 token | 上一代模型 |
| GPT-5.6 Luna | 高頻 API 價格試驗 | gpt-5.6-luna;1.05M / 128K | $0.20 / $1.20 每百萬 token | 大輸入有倍率 |
| Claude Sonnet 5 | 自適應思考與 Anthropic 工具 | claude-sonnet-5;1M / 128K | $2 / $10 每百萬 token | 標價較高 |
| DeepSeek V4.1 Flash | 大上下文與時段價格 | deepseek-flash;1M / 384K | 非高峰 $0.003/$0.15/$0.60;高峰 $0.006/$0.30/$1.20 | 需核對時段與駐留 |
Gemini 3.7 Flash:最少改動
適用場景: 保留 Gemini 多模態輸入與 thinking 控制。
優點: Google 列出文字、圖片、影片、音訊和 PDF 輸入、函式呼叫、程式執行、檔案搜尋與電腦使用預覽。handzhiev 的英文評語是 “my workhorse”,可譯為「我的主力模型」;這是 3.7 的回饋,不是 3.8 benchmark。

缺點: 上一代;與 3.8 同價不代表任務適配相同。
價格: 2026-12-31 前每百萬 token 輸入 $0.75、輸出 $3.75。
結論: 相容性優先時先選;複雜任務仍與 3.8 做同任務對照。
GPT-5.6 Luna:價格優先
適用場景: 高頻工作流的價格優先 API 試驗。
優點: OpenAI 公開 1.05M 上下文、128K 輸出、函式、網頁/檔案搜尋、電腦使用與 $0.20/$1.20 基礎價。gundmc 稱它是主力,這是個人偏好。

缺點: 超過 272K 輸入有倍率;refactor_master 回報某次程式編輯需要大量指導。

價格: 另計輸出、長輸入、工具、重試與人工監督。
結論: API 經濟性最重要且監督預算通過時選擇。
Claude Sonnet 5:自適應思考
適用場景: Anthropic 的 adaptive thinking 與工具路線。
優點: Anthropic 列出 1M 上下文、128K 輸出、視覺、多語和工具。doctoboggan 與 jsnell 對 effort 成本曲線看法不同;都是主觀評論。


缺點: API $2/$10 高於 Luna,且與訂閱分開。
價格: 每百萬 token 輸入 $2、輸出 $10。
結論: Anthropic 路線更貼合任務時選擇。
DeepSeek V4.1 Flash:按時段計價
適用場景: 1M 上下文、顯式 thinking/non-thinking、視覺和時段價格。
優點: 目前官方價格頁列出 deepseek-flash / DeepSeek-V4.1-Flash、384K 最大輸出、JSON、工具呼叫、Responses API、Anthropic API 和視覺。eli 的英文回饋說預覽端點「good and very fast」,只是預覽體驗,不是 benchmark。

缺點: UTC 工作日 01:00–04:00、06:00–10:00 為高峰,中國公眾假期除外;aftbit 談的是舊 Pro 路由,不是目前 Flash 價格。

價格: 非高峰快取命中/未命中/輸出為 $0.003/$0.15/$0.60;高峰為 $0.006/$0.30/$1.20。
結論: 時段、地區、駐留和價格變化都能接受時選擇。
| 約束 | 第一候選 | 驗證 |
|---|---|---|
| 保留 Gemini 多模態 | Gemini 3.7 | SDK、工具、地區 |
| 降低 API 標價 | Luna | 完成任務成本 |
| 自適應思考 | Sonnet 5 | API 功能與遷移 |
| 1M 上下文與時段價格 | DeepSeek V4.1 Flash | 高峰、快取、駐留 |
Tabbit Browser:一次有限測試
一次合成抽取回傳預期四個欄位:currency 為 USD、paid_total 為 145、overdue_ids 為 B、unknown_status_ids 為 D。介面同時顯示 Google 搜尋標記。樣本數為 1,未測量 thinking、token、費用或 TTFT,也未獨立核驗是否實際發出搜尋請求;這是正確性抽查,不是效能測試。

Tabbit Browser、什麼是 agentic browser、瀏覽器自動化、AI 瀏覽器選項 可用於驗證瀏覽器上下文。模型資源:Gemini 3.7 (简体中文)、Luna (简体中文)、Sonnet 5 (简体中文)。
用同一任務試驗
凍結輸入、指令、工具、輸出契約、重試預算和計費路線,記錄首 token、總時間、token、工具錯誤、人工修改和完成任務成本。重複執行後再決定。
結論
Gemini 3.8 Flash 值得留在候選名單。Google 公開多模態輸入、1,048,576 個輸入 token、65,536 個輸出 token,以及 low、medium、high 三種 thinking。離開的理由應來自具體限制:客戶端或地區沒有該路線、工具不合用,或完成任務成本不合適。 不宣布全局冠軍。
常見問題
Gemini 3.8 Flash 最接近的替代模型是哪一個?
Gemini 3.7 Flash 是同系列中最接近的候選,Google 公開了相近的輸入類型、token 上限與思考層級。它仍是不同模型,切換前應使用同一任務驗證。
哪個候選的 API 標價最低?
沒有始終最低的路線。DeepSeek V4.1 Flash 離峰未快取輸入/輸出為每百萬 token 0.15/0.60 美元,低於 Luna 基礎價 0.20/1.20;尖峰為 0.30/1.20,此時 Luna 未快取輸入較低。快取、長輸入倍率、重試與工具會改變任務成本。
四個替代模型支援相同工具嗎?
不支援。四家供應商公開的工具與思考說明不同。請在實際 API、客戶端和帳戶中逐項確認。
可以直接比較 API 價格和聊天訂閱嗎?
不可以。API token、消費者訂閱、團隊席位與瀏覽器客戶端使用不同的計費單位。預算應分開記錄,再比較相同成功任務的成本。
Gemini 3.8 的 benchmark 能直接與其他模型比較嗎?
不能只靠本文資料直接比較。Artificial Analysis 快照是在 2026 年 9 月 20 日查看的 v4.3.2,並按思考層級呈現,其他候選沒有同條件資料。
Gemini 3.8 Flash 在 Tabbit Browser 可用嗎?
一次測試選單顯示 Gemini-3.8-Flash,單次合成抽取回傳預期的四個 JSON 欄位,介面同時顯示 Google 搜尋標記。這不是效能測試,不能據此確認生產可用性、延遲、費用或工具行為。