GEMINI 2.5 FLASH-LITE × SILLYTAVERN

先填對模型 ID

SillyTavern 可以透過 Google AI Studio 連接 Gemini 2.5 Flash-Lite。真正容易出錯的地方通常更小:provider、準確模型名稱、Key、每輪傳送的上下文,以及 429 或空回覆代表什麼。

查看接入步驟
Tabbit 桌面瀏覽器展示帶聊天入口的簡潔新分頁工作區。

先核對模型

穩定、快速,也很容易配錯

Google 將 Gemini 2.5 Flash-Lite 列為適合高頻輕量多模態任務的穩定模型。它接受文字、圖片、影片、音訊和 PDF 輸入,並輸出文字。上下文上限很大,不代表 provider 或配額檢查會消失。

01

使用準確 ID

填寫 gemini-2.5-flash-lite。預覽別名 gemini-2.5-flash-lite-preview-09-2025 已關閉。不要因名稱相似就換成更新的 Flash 模型。

02

先看限額

官方記錄的輸入上限是 1,048,576 tokens,輸出上限是 65,536 tokens。實際 RPM、TPM、RPD 取決於 Google 專案和使用層級。

03

支援 thinking

模型支援 thinking、函式呼叫、結構化輸出、URL context、Search grounding、程式碼執行、快取和檔案搜尋。計費時 thinking tokens 計入輸出用量。

04

免費不等於無限

Google AI Studio 免費層提供有限模型存取和免費輸入輸出 tokens。付費層提供更高限額。高頻角色扮演前先查看 AI Studio 即時配額。

SILLYTAVERN 接入

先跑通一條乾淨請求,再調預設

SillyTavern 官方 Google 指南使用 Chat Completion。先在 Google AI Studio 建立 Key,再讓 SillyTavern 取得模型清單。第一輪保持請求短小,才分得清 Key 錯誤、配額問題和格式問題。

01

在 Google AI Studio 建立 Key

開啟 API key 頁面並登入,選擇 Get API Key,接受條款,建立 Key 後複製。把 Key 當成密碼,不要放進角色卡或公開截圖。

02

選擇對應 provider

在 SillyTavern 開啟 API Connections,選擇 Chat Completion,再選擇 Google AI Studio。將 Key 貼到 API Key 欄位並按 Connect。

03

選擇穩定模型

如果模型清單出現 gemini-2.5-flash-lite,就選擇它。手動輸入時使用準確穩定 ID。預覽 ID 已關閉,調 temperature 無法修復。

04

用短提示開始

用精簡角色卡傳送一則短訊息。測試時保持 streaming 開關一致,記錄模型、provider、上下文大小和回覆狀態。

05

最後再加角色格式

普通請求成功後,再加入 system prompt、指令格式和 lore。如果控制標記出現在回覆中,先檢查 template 和訊息格式。

Google 限額按 RPM、TPM、RPD 衡量,並套用於專案,而不只是 API Key。預覽模型的限制可能更嚴格。

TABBIT 的位置

讓網頁資料留在 RP 聊天旁邊

Tabbit 不是 SillyTavern 前端、本地 Gemma runner,也不是 Google AI Studio Key 管理器。它適合處理角色 wiki、設定資料、PDF、截圖和模型比較等聊天周邊上下文。

  1. 1

    開啟資料頁

    把 canon 筆記、設定 wiki 或文件頁面留在可見分頁。Tabbit 可以在側邊欄總結頁面。

  2. 2

    用 @ 引用上下文

    用 @ 把開啟的頁面、截圖或本機檔案加入提示,讓模型檢查連貫性或整理場景狀態,不必複製每一段。

  3. 3

    只使用實際列出的模型

    目前國際版生產快照列出並啟用 gemini-2.5-flash-lite,但帳號、edition、配額和未來部署可能不同,請以 SillyTavern 即時模型選擇器為準。Tabbit 仍不接受 SillyTavern provider 或 Google AI Studio API Key,也不能取代 SillyTavern 的這條連線。

Tabbit Agent 模式操作 Google Sheets,右側顯示指令面板和執行步驟。

選對工作面

API 控制與瀏覽器上下文解決不同問題

需要角色卡、訊息格式和生成設定時使用 SillyTavern。資料散落在網頁和檔案中,需要放在瀏覽器原生助手旁時使用 Tabbit。

需求SillyTavern + Google AI StudioTabbit
Gemini 2.5 Flash-Lite endpoint使用準確模型 ID 連接,並以即時選擇器為準不是 Tabbit 連線,請留在 SillyTavern
API Key 與配額在 Google AI Studio 管理沒有貼上此 Key 的入口
角色卡和 lore完整 RP 控制引用 wiki 或檔案
網頁上下文貼上或自行整合@ 開啟的分頁、截圖和檔案
Agent 操作取決於你的 ST 設定瀏覽器原生 Agent 模式

官方來源

免費不等於無限

Google AI Studio 免費層提供有限模型存取和免費輸入輸出 tokens。付費層提供更高限額。高頻角色扮演前先查看 AI Studio 即時配額。

Tabbit 新分頁工作區,顯示提示輸入框與模型選擇器。

常見問題

Gemini 2.5 Flash-Lite 與 SillyTavern

該填寫哪個模型 ID?+

穩定模型使用 gemini-2.5-flash-lite。Google 將 gemini-2.5-flash-lite-preview-09-2025 列為已關閉,不要再使用這個預覽 ID。

Key 放在 SillyTavern 哪裡?+

開啟 API Connections,選擇 Chat Completion,選擇 Google AI Studio,貼上 API Key 並連接。SillyTavern 官方指南記錄了這條路徑。

429 RESOURCE_EXHAUSTED 是什麼?+

它表示超出了速率或支出限額。在 AI Studio 查看專案的 RPM、TPM、RPD 使用情況,然後等待、降低請求頻率或減少上下文和輸出。同一專案中新建 Key 不一定改變配額。

為什麼回覆是空的?+

檢查 SillyTavern 控制台和回應詳情,再用短提示、穩定模型 ID 測試,並嘗試關閉 streaming。如果請求成功但文字為空,檢查格式、安全回饋和 finish 詳情,再考慮角色卡。

它有百萬 token 上下文嗎?+

Google 記錄的輸入上限是 1,048,576 tokens,最大輸出是 65,536 tokens。這是上限,不保證角色對話能同樣取回開頭的每個細節。

可以在 SillyTavern 開啟 thinking 嗎?+

Google 將 thinking 列為支援能力。SillyTavern 是否暴露開關取決於目前 connector 和設定。介面沒有該項時不要自行編造參數,先使用 provider 預設值。

Gemini 2.5 Flash-Lite 免費嗎?+

Google AI Studio 有免費層,提供有限模型存取和免費輸入輸出 tokens。配額因專案和層級而異。付費、批量和優先級價格以 Google 即時價格頁為準。

Tabbit 能執行我的 SillyTavern 連線嗎?+

不能。Tabbit 目前不接受 SillyTavern provider 連線,也不接收你的 Google AI Studio Key。用 Tabbit 處理瀏覽器上下文和其實際列出的模型,把這個 Gemini 連線留在 SillyTavern。

把 Key 放在正確的地方

用 SillyTavern 連接 Gemini API。需要處理聊天周邊的網頁、檔案和瀏覽器動作時,再使用 Tabbit。

支援 macOS 和 Windows。Tabbit 的模型清單與 provider 支援可能變化。

© 2026 Tabbit Browser. 理解你上下文的 AI 原生瀏覽器。