Coherencia del personaje
Pregunta por una decisión que solo responde la historia del personaje.
¿Usa sus valores y recuerdos sin repetir toda la tarjeta?
Gemma 4 × roleplay
Una sesión puede empezar bien y romperse tras una escena larga. El personaje cambia, la respuesta se repite y una ventana de contexto enorme no arregla una tarjeta confusa ni una plantilla incorrecta. Empieza con una prueba breve y ajusta una capa cada vez.
Comprobar los datos del modelo ↗
Una prueba de cinco minutos
Repite los mismos prompts después de cada cambio. Puntúa la respuesta, no el benchmark. Mantén fija la tarjeta, el contexto y el sampler al comparar.
Pregunta por una decisión que solo responde la historia del personaje.
¿Usa sus valores y recuerdos sin repetir toda la tarjeta?
Pide la siguiente escena con una restricción poco común.
¿Añade un detalle concreto sin perder la voz del personaje?
Genera una escena breve y regénérala dos veces.
Cuenta frases, expresiones y finales que se repiten.
Tras varios turnos, pide el estado de la escena en cuatro líneas.
Compara nombres, objetivos y hechos pendientes con la transcripción.
Pon un hecho al principio, añade una escena larga y pregunta por él.
Anota si el hecho sobrevive y si baja la calidad de la prosa.
Una capa por cambio
La calidad del roleplay depende de una cadena. Un bucle puede venir del modelo, de una plantilla antigua, de una tarjeta ruidosa o de un sampler que repite la misma ruta de tokens.
Separa Gemma 4 31B denso de 26B A4B MoE. Q4, Q5 y Q6 describen archivos cuantizados, no modelos oficiales nuevos. Copia el checkpoint o model slug exacto.
Usa la plantilla y el tokenizer de Gemma 4 que indique tu backend. Google documenta system prompts nativos y thinking opcional. Si los marcadores aparecen como texto, arregla esta capa.
Empieza con temperature 1.0, top-p 0.95 y top-k 64, la base oficial. Cambia un valor, guarda el resultado y repite la prueba. DRY es un experimento de la comunidad.
Quita lore duplicado, rasgos vagos e instrucciones que chocan. Guarda un estado de escena compacto y resume turnos antiguos antes de llenar el contexto.
Queen, Equinox y los GGUF de un distribuidor son publicaciones de la comunidad, no valores de Google. Mantén las reglas de seguridad y las políticas locales.
Higiene de la tarjeta
Da al modelo menos reglas que reconciliar. Escribe qué hace, qué quiere y qué recuerda el personaje, y deja espacio para que la escena cambie.
Usa dos o tres diálogos breves con el ritmo buscado. Diez ejemplos con la misma frase solo añaden ruido.
Separa hechos fijos, objetivos actuales y detalles temporales. Cuando cambie un hecho, edita una fuente en lugar de añadir correcciones.
Indica qué decide el personaje y qué pertenece al usuario. Así el modelo escribe menos por el usuario y fuerza menos el final.
En una pausa natural, guarda lugar, relaciones, hilos abiertos y última acción. Un resumen corto se recupera mejor que una transcripción duplicada.

La fuente junto al chat
Tabbit no es un runner local de Gemma ni un gestor de tarjetas de SillyTavern. Ayuda cuando el contexto vive en una wiki, un documento de ambientación, pestañas de investigación y varias respuestas.
Deja las notas canon o la fuente en una pestaña. Tabbit puede resumirla en el panel lateral sin copiar cada párrafo.
Usa @ para añadir una página, captura o archivo al prompt. Pide una revisión de continuidad, un resumen de escena o hechos pendientes.
El selector muestra modelos como GPT-5.4, GPT-5.2-Chat, Gemini-3.1-Pro, Gemini-3-Flash y Claude-Sonnet-4.6. La disponibilidad cambia y Gemma 4 no aparece en esta captura.


Elige la superficie
Cada flujo resuelve un cuello de botella. Conserva el frontend local para tarjetas y samplers. Usa el navegador cuando la información está repartida entre páginas y archivos.
| Frontend local | Tabbit | |
|---|---|---|
| Tarjetas y lorebooks | Control detallado | Referenciar la fuente |
| Checkpoint Gemma 4 | Preparas el backend | Elegir un modelo listado |
| Plantilla y sampler | Revisar y ajustar | Lo gestiona el modelo |
| Contexto web y archivos | Pegar o integrar | @ pestañas y archivos |
| Comparación de modelos | Cambiar endpoint o preset | Preguntar a varios modelos |
Preguntas frecuentes
Puede funcionar, pero depende de la variante, la plantilla, el sampler, la tarjeta y el contexto. Prueba coherencia y repetición con tus propios prompts.
Google describe 31B como denso y 26B A4B como MoE con unos 3,8B parámetros activos. Compara los archivos y la memoria que realmente puedes usar.
Revisa plantilla y tokenizer, quita contexto duplicado y establece la base oficial del sampler. Cambia un valor cada vez.
No. Google documenta hasta 256K para 12B, 26B A4B y 31B, pero la recuperación y la prosa pueden cambiar cuando crece el prompt.
No lo des por hecho. Abre el selector actual después de instalar y usa un modelo que aparezca allí. Esta página no promete soporte de Gemma 4.
Sigue las reglas del proveedor, la ley local y la política del producto. Esta guía no ofrece jailbreaks ni formas de saltarse filtros.
Haz una prueba breve, corrige la cadena de plantilla y deja el canon a mano. Instala Tabbit para leer esas fuentes y comparar modelos disponibles en un mismo espacio.
Disponible para macOS y Windows. La lista de modelos puede cambiar.