SKYFALL 31B × SILLYTAVERN

Encuentra primero el archivo correcto

Skyfall 31B puede referirse a varias versiones y formatos. Esta guía usa TheDrummer/Skyfall-31B-v4.2. Comprueba el ID, el modelo base, la plantilla Mistral v7 y la cuantización antes de ajustar una tarjeta.

Leer la ficha v4.2
Navegador de escritorio Tabbit con pestañas verticales y una barra lateral de investigación.

COMPRUEBA EL ID DEL REPOSITORIO

31B es el tamaño, no el checkpoint

Guarda el nombre completo del repositorio. Así separas v4.2 de v4.1, versiones anteriores y resultados con nombres parecidos.

01

El modelo de esta guía

`TheDrummer/Skyfall-31B-v4.2` es el repositorio safetensors. La ficha atribuye el modelo a TheDrummer y lista Mistral v7 Tekken.

02

El modelo base

Los metadatos indican `mistralai/Magistral-Small-2509` como base. No lo sustituyas por otra versión Mistral Small de nombre similar.

03

Los parámetros

La API de HF indica 31.352.980.480 parámetros BF16, arquitectura Mistral y una posición máxima de 131.072. Es metadata, no una garantía sobre tu contexto real.

04

La licencia

La metadata API consultada no mostraba un campo de licencia. Lee la ficha y los términos upstream antes de redistribuir o usar comercialmente.

CUANTIZACIÓN Y HARDWARE

Elige un archivo que tu equipo pueda cargar

El repositorio oficial es grande. GGUF ofrece varios intercambios. El tamaño sirve para filtrar, pero no equivale a la VRAM final.

01

Empieza con Q4_K_M

El árbol GGUF muestra Q4_K_M con unos 18,98 GB. Reserva espacio para el runtime, el contexto y el sistema. Una GPU de 24 GB no siempre permite una carga cómoda completa.

02

Las cuantizaciones grandes exigen margen

Q5_K_M ocupa unos 22,25 GB, Q6_K unos 25,73 GB y Q8_0 unos 33,32 GB. El offload a CPU o RAM puede funcionar, pero puede ser mucho más lento.

03

Las pequeñas cambian calidad

Q2_K ocupa unos 11,73 GB y Q3_K_M unos 15,20 GB. Prueba la misma escena breve después de cambiar de cuantización.

04

Elige una capa de servicio

La ficha GGUF documenta llama.cpp y Ollama. Descarga el archivo exacto, inicia el backend y copia su endpoint e ID en SillyTavern.

CONFIGURACIÓN RP EN SILLYTAVERN

Primero la plantilla, después el sampler

Skyfall v4.2 usa una plantilla Mistral v7 Tekken personalizada. Deja que una sola capa controle el formato y prueba dos turnos antes de cambiar valores.

01

Usa Mistral v7 Tekken

Deja que el tokenizer o backend aplique la plantilla. Si SillyTavern también envuelve el prompt, busca marcadores de rol duplicados.

02

Decide si quieres pensar

La plantilla busca `/think` en el mensaje de sistema y puede añadir `[THINK]...[/THINK]`. Pruébalo de forma deliberada, no dentro de una tarjeta por accidente.

03

Guarda una línea base

Para la primera prueba RP, empieza con temperature 0.7, top_p 0.9 y una respuesta máxima moderada. Cambia solo un valor cada vez.

04

Protege la agencia del usuario

Indica qué voz controla el modelo. Mantén breves los ejemplos y elimina instrucciones que le pidan escribir por el usuario y el personaje.

La comunidad describe diálogos naturales, coherencia de personaje y buen seguimiento de tono. También aparecen quejas sobre respuestas largas, narración irregular, hablar por el usuario y errores repetidos tras hacer swipe. No son benchmarks controlados.

SÍNTOMA → COMPROBACIÓN → SOLUCIÓN

Depura la capa que falló

Repite un prompt corto y cambia una sola cosa. Así separas un problema de plantilla de uno de modelo o hardware.

SíntomaCompruebaSiguiente paso
Respuesta vacía o marcadores visiblesEndpoint, dueño de la plantilla Mistral, `/think` y stop strings.Envía un prompt de una línea, deja un único dueño de plantilla y elimina los marcadores filtrados.
El modelo habla por {{user}}Ejemplos de la tarjeta, system prompt y último mensaje assistant.Declara el límite de voz, acorta ejemplos y prueba una escena con dos opciones.
Respuesta larga y repetitivaContexto, lore duplicado, max tokens y sampler.Recorta la tarjeta, baja el presupuesto y cambia un sampler cada vez.
Lento o se cierraTamaño del archivo, offload, margen de RAM/VRAM y contexto.Prueba una cuantización menor o menos contexto y compara tokens/sec.
No coincide con la fichav4.2 frente a v4.1, safetensors frente a GGUF y el ID completo.Copia de nuevo el ID y sigue la ficha del archivo exacto.

TABBIT COMO MESA DE INVESTIGACIÓN

Mantén tarjetas, cuantizaciones y notas a la vista

Tabbit no ejecuta Skyfall ni sustituye SillyTavern. Sirve para reunir la ficha, el árbol GGUF y los hilos de la comunidad.

  1. 1

    Abre las fuentes

    Coloca la ficha oficial, el árbol GGUF y la documentación de SillyTavern juntos. Pide extraer solo IDs, tamaños e instrucciones de plantilla.

  2. 2

    Usa @ para el contexto

    Cita una página, captura o nota local con @ y pide una lista que marque hechos confirmados y preguntas abiertas.

  3. 3

    Compara antes de cambiar

    Compara explicaciones con el chat multimodelo. Tabbit organiza la evidencia; el backend local sigue siendo donde corre Skyfall.

Vista Deep Research de Tabbit con resultados y pasos de ejecución.
Tabbit mostrando un artículo junto a un resumen generado por IA.
Chat multimodelo de Tabbit con varias respuestas a la misma pregunta.
Modo Agent de Tabbit operando una hoja de Google Sheets con pasos de ejecución.

USA LA SUPERFICIE ADECUADA

SillyTavern ejecuta el chat; Tabbit ordena la evidencia

Resuelven partes distintas. Deja los controles de generación en SillyTavern y usa Tabbit para evitar saltos entre pestañas.

SillyTavern + backendTabbit
Ejecutar Skyfall localmenteSí, con backend compatibleNo se promete
Tarjetas y samplersControles detalladosNotas de referencia
Leer fichas y cuantizacionesCambiar de pestaña o app@ páginas, archivos y capturas
Comparar explicacionesCambiar preset o endpointComparar modelos disponibles
Diagnóstico de hardwareVer VRAM, offload y velocidadReunir la evidencia

PREGUNTAS

Skyfall 31B y SillyTavern

¿De qué Skyfall 31B habla esta guía?+

De TheDrummer/Skyfall-31B-v4.2. v4.1 y otros proyectos con Skyfall pueden tener plantillas y comportamientos distintos.

¿En qué se basa v4.2?+

La metadata de la ficha lista mistralai/Magistral-Small-2509 como base. Usa el ID completo.

¿Qué cuantización descargo?+

Q4_K_M, de unos 18,98 GB en el árbol GGUF oficial, es un punto de partida. Comprueba el margen del runtime y prueba Q3 o Q5 según tus necesidades.

¿Qué chat template usa?+

La ficha indica Mistral v7 Tekken. La plantilla también comprueba /think en el system prompt.

¿Tabbit ejecuta Skyfall 31B?+

No se promete. Tabbit reúne fichas, archivos y comparaciones. Ejecuta el modelo en un backend local compatible y conecta ese backend a SillyTavern.

Haz del model ID tu primer ajuste

Confirma v4.2, elige una cuantización, asigna un único dueño al formato Mistral y prueba una escena breve. Usa Tabbit cuando la evidencia esté repartida.

Disponible para macOS y Windows. La disponibilidad de modelos puede cambiar.

© 2026 Tabbit Browser. El navegador nativo de IA que entiende tu contexto.