SKYFALL 31B × SILLYTAVERN

Encontre o arquivo certo primeiro

Skyfall 31B pode indicar várias versões e formatos. Este guia usa TheDrummer/Skyfall-31B-v4.2. Confira ID, modelo base, template Mistral v7 e quantização antes de ajustar um cartão de personagem.

Ler o card v4.2
Navegador Tabbit para desktop com abas verticais e painel de pesquisa.

CONFIRA O ID DO REPOSITÓRIO

31B é o tamanho, não o checkpoint

Anote o nome completo do repositório para separar v4.2, v4.1, versões antigas e resultados com o mesmo nome.

01

O modelo deste guia

`TheDrummer/Skyfall-31B-v4.2` é o repositório safetensors. O card indica TheDrummer como autor e Mistral v7 Tekken como template.

02

O modelo base

Os metadados listam `mistralai/Magistral-Small-2509` como base. Não substitua por outra versão Mistral Small parecida.

03

Os parâmetros

A API do HF informa 31.352.980.480 parâmetros BF16, arquitetura Mistral e posição máxima 131.072. Isso não garante o mesmo contexto no seu runtime.

04

A licença

Os metadados da API consultados não exibiam licença. Leia o card e os termos upstream antes de redistribuir ou usar comercialmente.

QUANTIZAÇÃO E HARDWARE

Escolha um arquivo que sua máquina consiga carregar

O repositório oficial é grande. O GGUF oferece opções diferentes. O tamanho filtra as opções, mas não é a VRAM final.

01

Comece com Q4_K_M

A árvore GGUF mostra Q4_K_M com cerca de 18,98 GB. Reserve espaço para runtime, contexto e sistema. Uma GPU de 24 GB nem sempre permite carga confortável na GPU.

02

Quantizações maiores precisam de margem

Q5_K_M tem cerca de 22,25 GB, Q6_K 25,73 GB e Q8_0 33,32 GB. Offload para CPU ou RAM pode funcionar, mas fica bem mais lento.

03

As menores trocam qualidade

Q2_K tem cerca de 11,73 GB e Q3_K_M 15,20 GB. Depois de mudar a quantização, teste a mesma cena curta.

04

Escolha uma camada de serviço

O card GGUF documenta caminhos com llama.cpp e Ollama. Baixe o arquivo exato, inicie o backend e copie endpoint e model ID para o SillyTavern.

CONFIGURAÇÃO RP NO SILLYTAVERN

Template primeiro, sampler depois

O Skyfall v4.2 usa um template Mistral v7 Tekken personalizado. Deixe uma camada cuidar da formatação e faça um teste de duas mensagens.

01

Use Mistral v7 Tekken

Deixe o tokenizer ou backend aplicar o template quando possível. Se o SillyTavern também envolver o prompt, procure role markers duplicados.

02

Decida sobre thinking

O template procura `/think` na mensagem de sistema e pode inserir `[THINK]...[/THINK]`. Teste de propósito e não coloque isso no cartão por acidente.

03

Guarde uma linha de base

Para o primeiro RP, comece com temperature 0.7, top_p 0.9 e um limite moderado de resposta. Mude apenas um valor por vez.

04

Proteja a agência do usuário

Diga qual voz o modelo controla. Mantenha exemplos curtos e retire instruções conflitantes.

Comentários da comunidade citam diálogo natural, consistência de personagem e bom seguimento de tom. Também aparecem verbosidade, narração irregular, fala pelo usuário e repetição após swipe. Isso não é benchmark controlado.

SINTOMA → CHECAGEM → CORREÇÃO

Isole a camada que falhou

Repita um prompt curto e mude uma coisa por vez para separar problemas de template, modelo e hardware.

SintomaConfiraPróximo passo
Resposta vazia ou marcadores visíveisEndpoint, responsável pelo template Mistral, `/think` e stop strings.Envie uma linha, deixe um único responsável pelo template e remova os marcadores.
O modelo fala por {{user}}Exemplos do card, system prompt e último assistant.Defina o limite de voz, encurte exemplos e teste duas opções.
Respostas longas e repetidasContexto, lore duplicado, max tokens e sampler.Encurte o cartão, reduza o orçamento e mude um sampler por vez.
Lento ou instávelTamanho, offload, margem de RAM/VRAM e contexto.Tente uma quantização menor ou menos contexto e compare tokens/sec.
Comportamento diferente do cardv4.2/v4.1, safetensors/GGUF e model ID completo.Copie o ID novamente e siga o card do arquivo correto.

TABBIT COMO MESA DE PESQUISA

Deixe cards, quantizações e notas à vista

O Tabbit não executa Skyfall nem substitui o SillyTavern. Use-o para reunir card, árvore GGUF e discussões.

  1. 1

    Abra as fontes

    Coloque card oficial, árvore GGUF e docs do SillyTavern lado a lado. Peça somente IDs, tamanhos e instruções de template.

  2. 2

    Use @ para o contexto

    Cite uma página, captura ou nota local com @ e separe fatos confirmados de perguntas abertas.

  3. 3

    Compare antes de mudar

    Compare explicações no chat multimodelo. O Tabbit organiza as evidências; o backend local executa Skyfall.

Deep Research do Tabbit com resultados e etapas lado a lado.
Tabbit exibindo artigo e resumo gerado por IA.
Chat multimodelo do Tabbit com várias respostas.
Agente do Tabbit operando Google Sheets com etapas.

USE A SUPERFÍCIE CERTA

SillyTavern executa o chat; Tabbit organiza as evidências

Os papéis são diferentes. Mantenha os controles de geração no SillyTavern e reduza a troca de abas com o Tabbit.

SillyTavern + backendTabbit
Executar Skyfall localmenteSim, com backend compatívelNão prometido
Cards e samplersControles detalhadosNotas de referência
Ler cards e quantizaçõesTrocar abas ou apps@ páginas, arquivos e capturas
Comparar explicaçõesMudar preset ou endpointComparar modelos disponíveis
Diagnóstico de hardwareVer VRAM, offload e velocidadeReunir evidências

FAQ

Skyfall 31B e SillyTavern

Qual Skyfall 31B este guia cobre?+

TheDrummer/Skyfall-31B-v4.2. v4.1 e outros projetos Skyfall podem usar template e comportamento diferentes.

Qual é a base do v4.2?+

Os metadados do card listam mistralai/Magistral-Small-2509 como base. Use o ID completo.

Qual quantização devo baixar?+

Q4_K_M, com cerca de 18,98 GB na árvore GGUF oficial, é um começo prático. Confira a margem do runtime e teste Q3 ou Q5 conforme necessário.

Qual chat template usar?+

O card indica Mistral v7 Tekken. O template personalizado também verifica /think no system prompt.

O Tabbit executa Skyfall 31B?+

Não há essa promessa. O Tabbit reúne cards, arquivos e comparações. Execute em um backend local compatível e conecte-o ao SillyTavern.

Faça do model ID seu primeiro ajuste

Confirme v4.2, escolha a quantização, deixe um único responsável pelo formato Mistral e teste uma cena curta. Use o Tabbit quando as evidências estiverem espalhadas.

Disponível para macOS e Windows. A disponibilidade de modelos pode mudar.

© 2026 Tabbit Browser. O navegador nativo de IA que entende o seu contexto.