Usa este ID exacto
Escribe gemini-2.5-flash-lite. El alias de preview gemini-2.5-flash-lite-preview-09-2025 está cerrado. No cambies a otro Flash por un nombre parecido.
GEMINI 2.5 FLASH-LITE × SILLYTAVERN
SillyTavern puede conectar con Gemini 2.5 Flash-Lite mediante Google AI Studio. Los fallos suelen estar en detalles concretos: proveedor, nombre exacto, clave, contexto enviado y el significado real de un 429 o una respuesta vacía.

COMPRUEBA EL MODELO
Google presenta Gemini 2.5 Flash-Lite como un modelo estable para tareas multimodales ligeras y frecuentes. Acepta texto, imagen, vídeo, audio y PDF, y devuelve texto. Un contexto grande no elimina los controles del proveedor ni la cuota.
Escribe gemini-2.5-flash-lite. El alias de preview gemini-2.5-flash-lite-preview-09-2025 está cerrado. No cambies a otro Flash por un nombre parecido.
El límite documentado es 1.048.576 tokens de entrada y 65.536 de salida. El RPM, TPM y RPD efectivo depende del proyecto y nivel de uso de Google.
Admite thinking, function calling, salidas estructuradas, URL context, Search grounding, ejecución de código, caché y búsqueda de archivos. Los tokens de thinking cuentan como salida cuando hay cobro.
Google AI Studio ofrece un nivel gratuito con acceso limitado y tokens de entrada y salida gratuitos. Los niveles de pago elevan los límites. Revisa la cuota antes de una sesión intensa.
CONFIGURACIÓN DE SILLYTAVERN
La guía de Google de SillyTavern usa Chat Completion. Crea la clave en Google AI Studio y deja que SillyTavern cargue los modelos. Empieza con una solicitud corta para separar clave, cuota y formato.
Abre la página de API keys, inicia sesión, elige Get API Key, acepta los términos, crea la clave y cópiala. Trátala como un secreto y no la pongas en una tarjeta pública.
En SillyTavern abre API Connections. Selecciona Chat Completion y después Google AI Studio. Pega la clave y pulsa Connect.
Selecciona gemini-2.5-flash-lite cuando aparezca. Si lo escribes manualmente, usa el ID exacto. Un ID cerrado no se arregla cambiando temperature.
Envía un mensaje breve con una tarjeta compacta. Mantén igual el streaming mientras pruebas y anota modelo, proveedor, contexto y estado.
Cuando funcione una solicitud simple, añade system prompt, formato instruct y lore. Si los marcadores aparecen en el texto, revisa la plantilla.
Google mide los límites por RPM, TPM y RPD y los aplica al proyecto, no solo a la clave. Los modelos preview pueden tener límites más estrictos.
DÓNDE ENCAJA TABBIT
Tabbit no es un frontend de SillyTavern, un runner local de Gemma ni un gestor de claves de Google AI Studio. Sirve para el contexto alrededor de la sesión: wikis, referencias, PDF, capturas y comparación de modelos.
Mantén notas canon, una wiki o una página de documentación en pestañas visibles. Tabbit puede resumirlas en su panel lateral.
Usa @ para incluir una página, captura o archivo en un prompt. Pide una revisión de continuidad sin copiar cada párrafo.
El snapshot de producción internacional actual lista y habilita gemini-2.5-flash-lite, pero la cuenta, la edición, la cuota y el despliegue futuro pueden variar: comprueba el selector de modelos en vivo de SillyTavern. Tabbit sigue sin aceptar un proveedor de SillyTavern ni una clave de Google AI Studio, y no puede sustituir a SillyTavern para esta conexión.

ELIGE LA SUPERFICIE
Usa SillyTavern para tarjetas, formato y generación. Usa Tabbit cuando las referencias están repartidas por la web y deben quedar junto a un asistente del navegador.
| Necesidad | SillyTavern + Google AI Studio | Tabbit |
|---|---|---|
| Endpoint Gemini 2.5 Flash-Lite | Conectar con el ID exacto; comprueba el selector en vivo | No es una conexión de Tabbit; mantenla en SillyTavern |
| Clave y cuota | Gestionadas en Google AI Studio | No hay campo para esta clave |
| Tarjetas y lore | Controles RP detallados | Referenciar una wiki o archivo |
| Contexto web | Pegar o integrar | @ pestañas, capturas y archivos |
| Acciones Agent | Depende de tu configuración ST | Modo Agent del navegador |
Fuentes oficiales
Google AI Studio ofrece un nivel gratuito con acceso limitado y tokens de entrada y salida gratuitos. Los niveles de pago elevan los límites. Revisa la cuota antes de una sesión intensa.

LEE LAS FUENTES
PREGUNTAS FRECUENTES
Usa gemini-2.5-flash-lite para el modelo estable. Google marca gemini-2.5-flash-lite-preview-09-2025 como cerrado.
Abre API Connections, elige Chat Completion, selecciona Google AI Studio, pega la clave y conecta.
Se superó un límite de velocidad o gasto. Revisa RPM, TPM y RPD del proyecto en AI Studio, espera, reduce la frecuencia o acorta contexto y salida. Otra clave del mismo proyecto puede no cambiar la cuota.
Revisa consola y detalles de respuesta. Prueba con streaming desactivado, un prompt corto y el ID estable. Si la solicitud funciona pero no hay texto, mira formato, feedback de seguridad y finish details.
Google documenta 1.048.576 tokens de entrada y 65.536 de salida. Es un límite, no una garantía de recuperar cada detalle de una conversación larga.
Google indica que es compatible. El control depende del conector y versión de SillyTavern. Si no aparece, no inventes un parámetro.
AI Studio tiene nivel gratuito con acceso limitado y tokens gratuitos. Las cuotas dependen del proyecto y nivel. Consulta la página de precios para el estado actual.
No. Tabbit no acepta una conexión de SillyTavern ni tu clave de Google AI Studio. Usa Tabbit para contexto web y sus modelos listados.
Conecta Gemini API en SillyTavern. Usa Tabbit cuando el prompt dependa de páginas, archivos y acciones del navegador alrededor del chat.
Disponible para macOS y Windows. El catálogo y los proveedores pueden cambiar.