Gemma 4 uncensored × SillyTavern

Gemma 4 uncensored en SillyTavern

Uncensored no es una variante oficial de Google. Puede ser un ajuste comunitario, un checkpoint modificado, una etiqueta del proveedor o solo un informe de roleplay. Comprueba la ficha, el modelo base, la licencia, la plantilla y la política del proveedor antes de atribuir un rechazo al modelo.

Ficha de Google
Comprobar los datos oficiales
Navegador de escritorio Tabbit con pestañas verticales, campo de consulta central y panel de chat a la derecha.

Nombre y hardware primero

26B A4B es MoE, no solo un número

Google usa el nombre Gemma 4 26B A4B. La ficha indica 25,2B de parámetros totales, 3,8B activos, 30 capas, entrada de imágenes y contexto de 256K. Los sufijos IT, Q4 o el nombre de un autor en un GGUF describen una distribución.

01

Usa el ID exacto

La ficha de Hugging Face identifica el checkpoint de instrucciones como `google/gemma-4-26B-A4B-it`. Q4, Q5 y Q6 son cuantizaciones, no nuevas familias de Google.

02

Cuenta contexto y runtime

Los parámetros activos ayudan a explicar la velocidad, pero no convierten todos los archivos en modelos de 4 GB. Pesos, buffers, el encoder visual de unos 550M, KV cache y contexto cambian el consumo.

03

No copies la receta de 31B

31B es un modelo denso de unos 30,7B parámetros. 26B A4B enruta cada token a expertos. Una estimación de memoria para 31B puede fallar aquí.

Orden de verificación

Comprueba el reclamo antes de la tarjeta

Una secuencia limpia separa una plantilla rota, un sampler inestable, un ajuste comunitario y una tarjeta de personaje débil.

  1. 01

    1. Confirma el checkpoint y el autor

    Guarda el ID completo, el checkpoint base, la variante, el archivo cuantizado y el enlace de la ficha. Un nombre uncensored no prueba que sea una variante oficial.

  2. 02

    2. Selecciona el modo API

    KoboldCpp, llama.cpp, LM Studio y los proveedores compatibles con OpenAI tienen endpoints distintos. Si existe, empieza con Chat Completions; Text Completion exige más control manual.

  3. 03

    3. Alinea tokenizer y plantilla

    El formato de Google usa `system`, `user`, `model`, `<|turn>` y `<turn|>`. Utiliza la plantilla Gemma 4 o Gemini que indique el backend, no una plantilla antigua de Gemma 3.

  4. 04

    4. Prueba thinking a propósito

    Google documenta `<|think|>` al inicio del system prompt para activar el pensamiento. Haz una prueba corta, después añade la tarjeta y el preset. En el historial normal conserva solo la respuesta final.

La comunidad menciona SillyTavern 1.17, `--jinja` en KoboldCpp, el tokenizer Gemma4/Gemini y `<|think|>`. Son pistas de diagnóstico, no valores universales de Google.

Cuando falla la respuesta

Repara la capa que falló

CASE 01

Los marcadores aparecen como texto

Revisa tokenizer, plantilla y modo de generación del backend. Si el servidor ya aplica la plantilla, añadir tokens manuales puede mostrarlos literalmente. Compara thinking activado y desactivado.

CASE 02

Piensa solo a veces

Comprueba que tu versión de SillyTavern y el loader soporten Gemma 4. Una solución comunitaria puede usar `--jinja` o `<|think|>`, pero depende del servidor.

CASE 03

El personaje repite o pierde detalles

Reduce el contexto duplicado antes de tocar la temperatura. Revisa el límite y prueba temperature 1.0, top-p 0.95 y top-k 64 como punto de partida.

Ruta desde el navegador

Deja abierta la wiki del personaje y pregunta al lado

Tabbit no es un runner local de GGUF ni un gestor de tarjetas de SillyTavern. Sirve para mantener una wiki, notas o un hilo de diagnóstico visible mientras conversas con un modelo disponible en el navegador.

  1. 1

    Instala Tabbit

    Descarga el navegador basado en Chromium para macOS o Windows. No necesitas un archivo Gemma local, una clave de proveedor ni un servidor SillyTavern.

  2. 2

    Elige solo un modelo listado

    Abre el selector de modelos después de instalar. El código actual lista GPT-5.4, Gemini-3.1-Pro, Claude-Sonnet-4.6 y DeepSeek-V4-Flash, entre otros. Gemma 4 no está en ese mapping actual, así que esta página no promete ejecutarlo.

  3. 3

    Cita la fuente en el chat

    Deja la wiki o las notas en una pestaña. Escribe `@` para referenciar una página, captura o archivo y pide un esquema de escena, una comprobación de coherencia o un resumen.

Selector de modelos de Tabbit con GPT-5.4, GPT-5.2-Chat, Gemini-3.1-Pro, Gemini-3-Flash y Claude-Sonnet-4.6. Gemma 4 no aparece en esta captura.

Elige el cliente

SillyTavern para la tarjeta, Tabbit para la fuente

Cada uno resuelve un cuello de botella distinto. Conserva los controles de RP cuando los necesites y usa el navegador cuando el contexto esté repartido entre páginas y archivos.

SillyTavernTabbit
Tarjetas y lorebooksFlujo principalReferenciar la fuente
Checkpoint local Gemma 4Preparas el backendUsar un modelo del selector
Plantilla y samplerControl detalladoLo gestiona el modelo
Contexto webPegar o usar extensionesReferenciar pestaña o archivo con @
Primera respuesta útilEndpoint + plantilla + presetInstalar + elegir un modelo
Selector de modelos de Tabbit con GPT-5.4, GPT-5.2-Chat, Gemini-3.1-Pro, Gemini-3-Flash y Claude-Sonnet-4.6. Gemma 4 no aparece en esta captura.

Cita la fuente en el chat

Deja la wiki o las notas en una pestaña. Escribe `@` para referenciar una página, captura o archivo y pide un esquema de escena, una comprobación de coherencia o un resumen.

Selector de modelos de Tabbit con GPT-5.4, GPT-5.2-Chat, Gemini-3.1-Pro, Gemini-3-Flash y Claude-Sonnet-4.6. Gemma 4 no aparece en esta captura.

Contexto web

Referenciar pestaña o archivo con @

Preguntas frecuentes

Gemma 4 uncensored y SillyTavern

¿Cuál es el nombre oficial de Gemma 4 26B?+

La ficha de Google lo llama Gemma 4 26B A4B. El checkpoint de instrucciones de Hugging Face es `google/gemma-4-26B-A4B-it`; los distribuidores pueden añadir sufijos.

¿26B A4B es igual que Gemma 4 31B?+

No. 26B A4B es MoE, con 25,2B totales y unos 3,8B activos. Gemma 4 31B es denso y tiene unos 30,7B parámetros.

¿Cuánta VRAM necesito?+

No hay una cifra única. Influyen los pesos cuantizados, KV cache, contexto, buffers y encoder visual. Mide el GGUF o build concreta con el contexto que quieras usar.

¿Por qué veo `<|think|>` en la respuesta?+

El tokenizer o la plantilla pueden no coincidir con el backend, o el servidor puede exponer el token como texto. Comprueba formato y thinking antes de cambiar el muestreo.

¿Tabbit puede ejecutar Gemma 4 26B?+

No lo des por hecho. El mapping actual de Tabbit no incluye Gemma 4. Tras instalarlo, usa solo un modelo que aparezca en el selector.

Verifica el modelo antes que el preset

Para un modelo comunitario uncensored, comprueba checkpoint, ficha, licencia, memoria, tokenizer y plantilla en ese orden. Para conversar junto a una wiki, instala Tabbit y revisa el selector actual.

Disponible para macOS y Windows. La disponibilidad puede cambiar.

© 2026 Tabbit Browser. El navegador nativo de IA que entiende tu contexto.