Small Instruct oficial
`mistralai/Mistral-Small-3.2-24B-Instruct-2506` es una actualización de 3.1. Su tarjeta indica mejor seguimiento de instrucciones y menos repeticiones. No afirma que tenga una voz de personaje superior.
MISTRAL 24B · GUÍA DE ROLEPLAY
Mistral 24B es una etiqueta de tamaño, no un único modelo de roleplay. El checkpoint Instruct oficial, un fine-tune, un merge y un archivo Q4 o Q6 pueden producir escenas muy distintas. Anota el repositorio exacto y prueba voz, autonomía, avance y repetición antes de iniciar una conversación larga.
Los informes de la comunidad son pistas para tus propias pruebas. Esta guía no incluye jailbreaks ni métodos para eludir controles de seguridad.

IDENTIFICA EL CHECKPOINT
Los consejos de roleplay pierden precisión cuando varios repositorios se llaman “Mistral 24B”. Mantén separadas estas capas.
`mistralai/Mistral-Small-3.2-24B-Instruct-2506` es una actualización de 3.1. Su tarjeta indica mejor seguimiento de instrucciones y menos repeticiones. No afirma que tenga una voz de personaje superior.
Las páginas Roleplay V2, V3, V5 y V6 son fine-tunes o merges distintos. Revisa objetivo, formato, licencia y sampler del autor. El tamaño compartido no justifica copiar ajustes.
Un modelo base y uno instruct esperan prompts diferentes. Una tarjeta de personaje para chat puede comportarse mal en un base si el servidor y el formato no fueron preparados para ello.
Los archivos GGUF Q4, Q5, Q6 e i1 cambian la memoria y pueden cambiar la velocidad o fidelidad. No son versiones nuevas de Mistral. Guarda nombre, límite de contexto, backend y offload.
DISEÑO DEL PROMPT
SillyTavern combina instrucciones del sistema, personaje, persona, mundo, historial y mensaje actual en un solo prompt. Ese prompt final pesa más que una frase ingeniosa de la tarjeta.
Indica que debe escribir la siguiente respuesta del personaje, respetar la autonomía del usuario y hacer avanzar la escena. Separa voz, límites y formato en bloques breves.
Un diálogo de ejemplo enseña ritmo, punto de vista y formato. Elimina ejemplos que hagan que el modelo narre al usuario, repita una muletilla o escriba ambos lados.
Separa hechos fijos, objetivos actuales y estado temporal. El lore largo o duplicado puede hacer que el modelo repita datos en lugar de reaccionar.
Usa Prompt Itemization, logs o Prompt Inspector. Si ya hay un rol incorrecto o marcadores duplicados, ningún sampler arreglará esa entrada.
UNA PRUEBA PEQUEÑA Y JUSTA
Usa una tarjeta, un inicio, un límite de contexto y un máximo de respuesta. Compara tres turnos y cambia una variable cada vez.
Escribe objetivo, rasgos de voz, lugar, cambio inmediato, límite del usuario y longitud. Pide una consecuencia concreta, no una continuación genérica.
Comienza con la plantilla y el sampler de la tarjeta. Guarda la primera respuesta antes de regenerar. Luego haz un único cambio deliberado.
Da de 0 a 2 puntos a voz, autonomía, avance y repetición en cada turno. Añade una nota como “decisión nueva” para sostener el juicio.
Corrige ID y plantilla primero. Después revisa contexto y longitud. Solo entonces compara temperature, min-p, DRY, XTC u otra cuantización.
SÍNTOMA → CAPA → SIGUIENTE COMPROBACIÓN
Una escena floja puede ser un problema de ensamblaje, servidor o muestreo. Esta tabla mantiene acotada la investigación.
| Lo que ves | Capa probable | Siguiente paso |
|---|---|---|
| Prosa seca o repetitiva | Checkpoint, ejemplos o sampler | Ejecuta la base, elimina lore duplicado y cambia un valor. |
| Habla por el usuario | Prompt principal, persona o diálogo | Declara la autonomía del usuario e inspecciona el prompt. |
| Marcadores de rol visibles | Dos dueños de la plantilla | Aplica la plantilla Mistral una sola vez desde tokenizer o backend. |
| Bucle o escena detenida | Contexto, límite de respuesta o repetición | Revisa la composición, acorta lore viejo y exige una consecuencia. |
| Salida vacía o truncada | Endpoint, stop strings o slug | Envía un prompt corto, verifica el ID y quita stops de otro modelo. |
| Se vuelve lento | Cuantización, contexto u offload de CPU | Compara memoria y contexto con tu equipo y registra tokens por segundo. |
TABBIT COMO MESA DE INVESTIGACIÓN
Tabbit no ejecuta un checkpoint Mistral local ni reemplaza SillyTavern. Sirve para reunir tarjetas, cuantizaciones, documentación y discusiones. El selector real de tu cuenta es la comprobación de disponibilidad.
Abre la tarjeta oficial, el repositorio RP, su página de cuantización y la documentación de SillyTavern en un mismo espacio.
Usa @ para incluir una página, captura o nota local. Pide una lista que conserve los ID y marque lo desconocido.
Usa el chat multimodelo para comparar dos fuentes. Compara sus afirmaciones e instrucciones, no un párrafo aislado.
Aplica la plantilla verificada en SillyTavern o tu servidor. Si Mistral no aparece en el selector de Tabbit, no concluyas que ejecuta el modelo local.



CADA HERRAMIENTA EN SU LUGAR
SillyTavern y Tabbit resuelven partes distintas. Mantén la generación en el frontend RP y usa el navegador para manejar fuentes.
| SillyTavern + backend | Tabbit | |
|---|---|---|
| Ejecutar Mistral 24B local | Sí, con un servidor compatible | No prometido |
| Tarjetas, lore y samplers | Controles RP detallados | Referencias a notas y páginas |
| Leer fuentes oficiales y comunitarias | Cambiar pestaña o copiar | Reunir fuentes y usar @ |
| Evaluación RP controlada | Generar y guardar ramas | Comparar afirmaciones y borradores |
| Disponibilidad | Lista del backend | Selector activo de la cuenta |
MANTÉN PRECISAS LAS AFIRMACIONES
Temperature, min-p, DRY y XTC interactúan con el checkpoint y backend. Un ajuste puede ayudar a una tarjeta y endurecer otra.
Las puntuaciones de instrucciones o código no miden voz, ritmo, humor ni memoria de promesas. Usa una prueba de escena repetible.
El roleplay legítimo puede definir límites ficticios y autonomía. No debe enseñar a evadir controles de seguridad.
Catálogos, proveedores y acceso de Tabbit cambian. Comprueba la tarjeta exacta y el selector actual.
ABRE LAS FUENTES
Estos enlaces separan hechos oficiales, experiencia de la comunidad y documentación del frontend.
FAQ
Depende del checkpoint, tarjeta, plantilla, contexto y sampler. El informe de Reddit encontró buen seguimiento de instrucciones, pero escritura seca y repetitiva. Haz una prueba de tres turnos.
Empieza por el ID completo y elige un archivo que quepa en tu memoria y licencia. Small 3.2 Instruct y los fine-tunes RP son opciones distintas.
La tarjeta oficial 3.2 muestra 0.15 para uso general. Un fine-tune RP puede recomendar otra base. Registra el valor y cambia una sola cosa.
Puede ser el checkpoint, lore duplicado, ejemplos, contexto, plantilla o sampler. Inspecciona primero el prompt final.
No necesariamente. Q6 suele consumir más memoria que Q4, pero hardware y velocidad del backend también importan. Compara archivos con la misma escena.
No lo des por hecho. Aquí Tabbit es un espacio de investigación en el navegador. Tras instalarlo, revisa el selector de modelos de tu cuenta.
Confirma el repositorio, aclara la plantilla, ejecuta una comparación breve y conserva las fuentes cerca al ajustar.
Disponible para macOS y Windows. El acceso puede variar por edición, región y despliegue.