使用準確 ID
填寫 gemini-2.5-flash-lite。預覽別名 gemini-2.5-flash-lite-preview-09-2025 已關閉。不要因名稱相似就換成更新的 Flash 模型。
GEMINI 2.5 FLASH-LITE × SILLYTAVERN
SillyTavern 可以透過 Google AI Studio 連接 Gemini 2.5 Flash-Lite。真正容易出錯的地方通常更小:provider、準確模型名稱、Key、每輪傳送的上下文,以及 429 或空回覆代表什麼。

先核對模型
Google 將 Gemini 2.5 Flash-Lite 列為適合高頻輕量多模態任務的穩定模型。它接受文字、圖片、影片、音訊和 PDF 輸入,並輸出文字。上下文上限很大,不代表 provider 或配額檢查會消失。
填寫 gemini-2.5-flash-lite。預覽別名 gemini-2.5-flash-lite-preview-09-2025 已關閉。不要因名稱相似就換成更新的 Flash 模型。
官方記錄的輸入上限是 1,048,576 tokens,輸出上限是 65,536 tokens。實際 RPM、TPM、RPD 取決於 Google 專案和使用層級。
模型支援 thinking、函式呼叫、結構化輸出、URL context、Search grounding、程式碼執行、快取和檔案搜尋。計費時 thinking tokens 計入輸出用量。
Google AI Studio 免費層提供有限模型存取和免費輸入輸出 tokens。付費層提供更高限額。高頻角色扮演前先查看 AI Studio 即時配額。
SILLYTAVERN 接入
SillyTavern 官方 Google 指南使用 Chat Completion。先在 Google AI Studio 建立 Key,再讓 SillyTavern 取得模型清單。第一輪保持請求短小,才分得清 Key 錯誤、配額問題和格式問題。
開啟 API key 頁面並登入,選擇 Get API Key,接受條款,建立 Key 後複製。把 Key 當成密碼,不要放進角色卡或公開截圖。
在 SillyTavern 開啟 API Connections,選擇 Chat Completion,再選擇 Google AI Studio。將 Key 貼到 API Key 欄位並按 Connect。
如果模型清單出現 gemini-2.5-flash-lite,就選擇它。手動輸入時使用準確穩定 ID。預覽 ID 已關閉,調 temperature 無法修復。
用精簡角色卡傳送一則短訊息。測試時保持 streaming 開關一致,記錄模型、provider、上下文大小和回覆狀態。
普通請求成功後,再加入 system prompt、指令格式和 lore。如果控制標記出現在回覆中,先檢查 template 和訊息格式。
Google 限額按 RPM、TPM、RPD 衡量,並套用於專案,而不只是 API Key。預覽模型的限制可能更嚴格。
TABBIT 的位置
Tabbit 不是 SillyTavern 前端、本地 Gemma runner,也不是 Google AI Studio Key 管理器。它適合處理角色 wiki、設定資料、PDF、截圖和模型比較等聊天周邊上下文。
把 canon 筆記、設定 wiki 或文件頁面留在可見分頁。Tabbit 可以在側邊欄總結頁面。
用 @ 把開啟的頁面、截圖或本機檔案加入提示,讓模型檢查連貫性或整理場景狀態,不必複製每一段。
目前國際版生產快照列出並啟用 gemini-2.5-flash-lite,但帳號、edition、配額和未來部署可能不同,請以 SillyTavern 即時模型選擇器為準。Tabbit 仍不接受 SillyTavern provider 或 Google AI Studio API Key,也不能取代 SillyTavern 的這條連線。

選對工作面
需要角色卡、訊息格式和生成設定時使用 SillyTavern。資料散落在網頁和檔案中,需要放在瀏覽器原生助手旁時使用 Tabbit。
| 需求 | SillyTavern + Google AI Studio | Tabbit |
|---|---|---|
| Gemini 2.5 Flash-Lite endpoint | 使用準確模型 ID 連接,並以即時選擇器為準 | 不是 Tabbit 連線,請留在 SillyTavern |
| API Key 與配額 | 在 Google AI Studio 管理 | 沒有貼上此 Key 的入口 |
| 角色卡和 lore | 完整 RP 控制 | 引用 wiki 或檔案 |
| 網頁上下文 | 貼上或自行整合 | @ 開啟的分頁、截圖和檔案 |
| Agent 操作 | 取決於你的 ST 設定 | 瀏覽器原生 Agent 模式 |
官方來源
Google AI Studio 免費層提供有限模型存取和免費輸入輸出 tokens。付費層提供更高限額。高頻角色扮演前先查看 AI Studio 即時配額。

常見問題
穩定模型使用 gemini-2.5-flash-lite。Google 將 gemini-2.5-flash-lite-preview-09-2025 列為已關閉,不要再使用這個預覽 ID。
開啟 API Connections,選擇 Chat Completion,選擇 Google AI Studio,貼上 API Key 並連接。SillyTavern 官方指南記錄了這條路徑。
它表示超出了速率或支出限額。在 AI Studio 查看專案的 RPM、TPM、RPD 使用情況,然後等待、降低請求頻率或減少上下文和輸出。同一專案中新建 Key 不一定改變配額。
檢查 SillyTavern 控制台和回應詳情,再用短提示、穩定模型 ID 測試,並嘗試關閉 streaming。如果請求成功但文字為空,檢查格式、安全回饋和 finish 詳情,再考慮角色卡。
Google 記錄的輸入上限是 1,048,576 tokens,最大輸出是 65,536 tokens。這是上限,不保證角色對話能同樣取回開頭的每個細節。
Google 將 thinking 列為支援能力。SillyTavern 是否暴露開關取決於目前 connector 和設定。介面沒有該項時不要自行編造參數,先使用 provider 預設值。
Google AI Studio 有免費層,提供有限模型存取和免費輸入輸出 tokens。配額因專案和層級而異。付費、批量和優先級價格以 Google 即時價格頁為準。
不能。Tabbit 目前不接受 SillyTavern provider 連線,也不接收你的 Google AI Studio Key。用 Tabbit 處理瀏覽器上下文和其實際列出的模型,把這個 Gemini 連線留在 SillyTavern。
用 SillyTavern 連接 Gemini API。需要處理聊天周邊的網頁、檔案和瀏覽器動作時,再使用 Tabbit。
支援 macOS 和 Windows。Tabbit 的模型清單與 provider 支援可能變化。