GEMINI API × SILLYTAVERN

Conecta la API sin adivinar

Usa el modelo estable Gemini 2.5 Flash-Lite en SillyTavern mediante Google AI Studio. Comprueba el proveedor, la clave, el ID exacto, la primera petición, thinking y los errores que hacen que una conexión válida parezca rota.

Ver la configuración
Espacio de trabajo de Tabbit en escritorio con marca naranja, entrada de chat y pestañas visibles.

COMPRUEBA EL MODELO

El nombre importa más que el preset

Google describe Gemini 2.5 Flash-Lite como un modelo multimodal estable y rápido. Acepta texto, imágenes, vídeo, audio y PDF, y devuelve texto. Un contexto grande no elimina las cuotas del proyecto ni las comprobaciones del proveedor.

01

ID estable

Usa `gemini-2.5-flash-lite`. Google marca `gemini-2.5-flash-lite-preview-09-2025` como cerrado. Cambiar la temperatura no arregla un ID retirado.

02

Límites documentados

La página del modelo indica 1.048.576 tokens de entrada y 65.536 de salida. Tus límites reales de RPM, TPM y RPD dependen del proyecto y nivel de uso.

03

Thinking disponible

Google indica soporte para thinking, llamadas a funciones, salida estructurada, URL context, Search grounding, ejecución de código, caché y búsqueda de archivos. SillyTavern puede mostrar menos controles.

04

La disponibilidad es dinámica

El acceso gratuito y el de pago tienen límites distintos. Revisa uso y precios en AI Studio antes de planear una sesión larga. Gratis no significa ilimitado.

Selector de modelos de Tabbit junto a una entrada para referenciar páginas o subir archivos.

CONFIGURACIÓN DE SILLYTAVERN

Haz funcionar una petición corta primero

La guía oficial de SillyTavern coloca Google AI Studio bajo Chat Completion. Mantén pequeña la primera petición. Después añade formato de personaje, lore y más contexto, un cambio cada vez.

  1. 01

    Crea una clave en Google AI Studio

    Abre las claves API de Google AI Studio, inicia sesión, elige Get API Key, acepta los términos, crea la clave y cópiala. Guárdala como una contraseña. No la pongas en una tarjeta de personaje ni en una captura pública.

  2. 02

    Elige el proveedor correcto

    En SillyTavern abre API Connections. Selecciona Chat Completion, elige Google AI Studio, pega la clave en API Key y pulsa Connect. Vertex AI usa otro proveedor y otra autenticación.

  3. 03

    Elige el modelo estable

    Selecciona `gemini-2.5-flash-lite` en la lista devuelta. Si escribes el modelo a mano, usa el ID exacto y estable. No uses el alias de preview cerrado.

  4. 04

    Envía una prueba simple

    Usa un mensaje corto y una tarjeta compacta. Mantén streaming igual durante la prueba y anota proveedor, modelo, tamaño de contexto y estado de respuesta.

  5. 05

    Añade controles de RP al final

    Cuando el texto simple funcione, añade la instrucción de sistema, el formato y el lore. Si aparecen marcadores en la respuesta, revisa la plantilla del conector antes de cambiar samplers.

Google aplica RPM, TPM y RPD al proyecto. Otra clave del mismo proyecto no crea una cuota nueva.

FORMA DE LA PETICIÓN

Separa lo que pertenece a la API

El ejemplo REST oficial de Google usa una cabecera de clave y JSON. SillyTavern construye su propia petición de proveedor, así que esto sirve para entender la API, no para inventar campos de la interfaz.

POST https://generativelanguage.googleapis.com/v1beta/interactions
Headers: x-goog-api-key: $GEMINI_API_KEY
         Content-Type: application/json
Body: {
  "model": "gemini-2.5-flash-lite",
  "input": "Responde en una frase corta."
}

Forma REST mínima de la documentación de Google

System instruction

Cuando el conector lo permita, separa la instrucción de sistema del turno del usuario. No supongas que cada campo de Chat Completion coincide con el JSON REST de Google.

Thinking y salida

Google indica soporte para thinking y una salida máxima de 65.536 tokens. Usa solo los controles que el conector actual documente.

Streaming

Google documenta streaming con `stream: true` y SSE. Si la respuesta queda vacía, repite la prueba corta con streaming desactivado para aislar un problema de pantalla o parseo.

SOLUCIÓN DE PROBLEMAS

Lee el estado antes de cambiar el preset

Empieza por el código, proveedor y modelo de la petición. Cambia una variable cada vez y protege la clave.

SeñalComprueba primeroSiguiente paso
400 INVALID_ARGUMENTNombre del modelo, JSON, orden de mensajes y ajustes no admitidos.Vuelve al prompt mínimo. Quita un ajuste opcional y añádelo de nuevo después.
401 UNAUTHENTICATEDValor de la clave, cabecera, espacios y proveedor.Copia o crea la clave de nuevo en AI Studio, reconecta Google AI Studio y no mezcles credenciales de Vertex.
403 PERMISSION_DENIEDAcceso del proyecto, estado de la API, región o respuesta de policy.Comprueba el proyecto y el estado de AI Studio. No intentes eludir controles de seguridad.
404 NOT_FOUNDID exacto del modelo y endpoint del proveedor.Usa `gemini-2.5-flash-lite`, elimina el alias preview cerrado y actualiza la lista.
429 RESOURCE_EXHAUSTEDRPM, TPM, RPD y nivel de facturación del proyecto.Espera, reduce frecuencia, contexto u output y consulta las cuotas. Otra clave del mismo proyecto puede no servir.
200 pero vacíoParser de streaming, detalles de finalización, feedback de seguridad, formato y campo de texto.Prueba con streaming desactivado y revisa consola y respuesta antes de editar la tarjeta.

TABBIT COMO CONTEXTO

Deja la investigación junto a SillyTavern

Tabbit no ejecuta tu proveedor de SillyTavern ni acepta una clave de Google AI Studio. Sirve para el trabajo alrededor: páginas fuente, referencias, capturas, PDF y tareas del navegador.

  1. 1

    Abre las páginas de referencia

    Deja una wiki, documentación o nota de ambientación en una pestaña visible. Tabbit puede resumirla en el panel lateral.

  2. 2

    Usa @ para el contexto

    Referencia una página, captura o archivo local con @ para pedir un resumen o comprobar continuidad, sin pegar cada párrafo.

  3. 3

    Comprueba el selector activo

    La instantánea internacional actual lista y habilita `gemini-2.5-flash-lite`. La cuenta, edición, cuota y despliegues futuros pueden variar, así que manda el selector activo. Tabbit no es la conexión de SillyTavern.

Modo Agent de Tabbit operando una hoja de Google Sheets con un panel de instrucciones y pasos.

DOS TRABAJOS DISTINTOS

El control de la API queda en SillyTavern

SillyTavern gestiona la tarjeta y la petición al proveedor. Tabbit gestiona el contexto del navegador y su asistencia nativa. Esta frontera evita convertir un campo inexistente en un paso falso.

Espacio de respuestas de varios modelos de Tabbit con columnas y una zona de prompt compartida.
NecesidadSillyTavern + Google AI StudioTabbit
Clave de GeminiCréala en AI Studio y pégala en el proveedor Google AI Studio.No hay entrada para esta clave.
ID estableElige `gemini-2.5-flash-lite` en la lista activa.Usa los modelos que Tabbit liste realmente.
Tarjetas y loreUsa controles, plantillas y contexto de RP.Referencia una wiki, nota o archivo desde una pestaña.
Investigación webAñade contexto con tu flujo de ST.Usa @ con páginas, capturas y archivos.
Acciones AgentDependen de tu configuración de SillyTavern.Usa su modo Agent para tareas web compatibles.

PREGUNTAS FRECUENTES

Respuestas cortas para una primera conexión frágil

¿Qué ID de modelo debo usar?+

Usa `gemini-2.5-flash-lite`. Google marca `gemini-2.5-flash-lite-preview-09-2025` como cerrado.

¿Qué proveedor elijo?+

Abre API Connections, elige Chat Completion, selecciona Google AI Studio, pega la clave de AI Studio y conecta. Vertex AI es otro proveedor.

¿Puedo usar el endpoint compatible con OpenAI?+

Google publica una guía de compatibilidad, pero el comportamiento del proveedor de SillyTavern puede variar. Empieza con el proveedor Google AI Studio documentado y usa compatibilidad solo si los documentos y el conector actuales la admiten.

¿Por qué recibo 429 con pocos mensajes?+

Los límites RPM, TPM y RPD de Google son del proyecto. Revisa uso y nivel en AI Studio, espera o reduce frecuencia, contexto y salida.

¿Por qué la respuesta está vacía?+

Prueba un prompt corto con streaming desactivado y revisa consola, finalización, seguridad y formato del conector. No asumas que cambiar la tarjeta arreglará un problema de parseo o cuota.

¿El límite de un millón de tokens permite chats enormes?+

Google documenta 1.048.576 tokens de entrada y 65.536 de salida. Son techos, no una garantía de recuperación uniforme de cada detalle antiguo.

¿Puedo activar thinking?+

Google lo lista como compatible. El conector actual de SillyTavern puede mostrar otros controles. Si un campo no está documentado, conserva el valor predeterminado.

¿Tabbit puede usar mi proveedor de SillyTavern?+

No. Tabbit no acepta ese proveedor ni tu clave de Google AI Studio. Mantén esta conexión en SillyTavern.

Pon cada pieza en su herramienta

Conecta Gemini 2.5 Flash-Lite en SillyTavern. Usa Tabbit cuando la conversación dependa de páginas, archivos o acciones del navegador.

Disponible para macOS y Windows. La disponibilidad de modelos y proveedores de Tabbit puede cambiar.

© 2026 Tabbit Browser. El navegador nativo de IA que entiende tu contexto.