MISTRAL 24B × SILLYTAVERN

Acerte a configuração do 24B

“Mistral 24B” pode significar Mistral Small 3.2, o checkpoint 3.1 ou um merge de RP como Magistry. Eles não usam o mesmo template ou sampler. Identifique o modelo exato antes de conectar ao SillyTavern.

Ver o card oficial 3.2
Navegador Tabbit no desktop com abas de pesquisa, campo de entrada e painel lateral de IA.

COMECE PELO MODEL ID

24B é tamanho, não nome de modelo

Anote o slug completo do repositório ou provedor antes de mudar as configurações. Isso evita aplicar template 3.2 a um arquivo 3.1 ou confundir merge comunitário com checkpoint oficial.

01

Instruct oficial 3.2

`mistralai/Mistral-Small-3.2-24B-Instruct-2506` é uma atualização menor do 3.1. O card cita melhorias em instruções, repetição e function calling.

02

Versão oficial anterior

`mistralai/Mistral-Small-3.1-24B-Instruct-2503` é outro checkpoint. Não deduza seu template ou comportamento a partir do 3.2.

03

Arquivos de RP da comunidade

Magistry, Cydonia e Magidonia são fine-tunes ou merges. Consulte cada card para licença, formato de prompt e sampler.

04

Base, instruct e quantização

Base e instruct são checkpoints diferentes. GGUF, AWQ e Q4/Q5/Q6 são formatos ou quantizações, não novos modelos oficiais.

CAMINHO DE CONFIGURAÇÃO

Escolha o servidor antes do SillyTavern

SillyTavern é a interface de chat. O modelo precisa de servidor local ou endpoint de provedor. Escolha de acordo com hardware e privacidade.

01

GPU local ou Mac

O card 3.2 indica cerca de 55 GB de memória GPU em BF16/FP16. GGUF menores trocam memória por velocidade e qualidade; confira o arquivo real.

02

Servidor vLLM

A Mistral recomenda vLLM 0.9.1 ou mais recente e `mistral_common` 1.6.2 ou mais recente. Use o formato Mistral e o ID exato.

03

Provedor ou API compatível com OpenAI

Copie o slug e endpoint exatos. O rótulo “Mistral 24B” sozinho não define o template do SillyTavern.

04

Conecte o SillyTavern

Use Chat Completion quando o backend aceitar mensagens por função. Use Text Completion só quando a documentação pedir e confira chave, modelo e contexto.

AJUSTE DE ROLEPLAY

Template antes do sampler

Um template errado parece um modelo fraco. Corrija formato e contexto antes de mexer na geração com um teste curto e repetível.

01

Use o formato Mistral do backend

Deixe o tokenizer ou servidor aplicar a chat template quando possível. Se `<s>` ou marcadores de função aparecerem, corrija o formato.

02

Mantenha o cartão compacto

Separe fatos fixos, objetivos atuais e estado da cena. Remova lore duplicado e instruções que fazem o modelo escrever pelo usuário.

03

Registre uma base

Comece pelos valores do card do modelo ou fine-tune. O card oficial 3.2 sugere temperatura baixa, como 0,15, para uso geral; modelos de RP podem ser diferentes.

04

Stop strings são específicas

Uma stop string de Llama ou ChatML pode cortar a resposta Mistral ou mostrar marcadores. Copie a recomendação do checkpoint e teste dois turnos.

A comunidade relata falar pelo usuário, resposta vazia, repetição e quantizações lentas. São sintomas, não uma regra para todos os arquivos.

SINTOMA → CHECAGEM → AÇÃO

Encontre a camada com problema

Mude uma variável por vez, repita o mesmo prompt curto e registre o resultado. Comece por nome, endpoint e template.

SintomaConfiraPróximo passo
Resposta vaziaEndpoint, slug, template de contexto e stop strings.Envie um prompt curto e use o template Mistral exato do backend.
Marcadores no textoQuem aplica o template: SillyTavern, servidor ou tokenizer?Mantenha um só responsável pelo formato e veja o prompt bruto.
Escreve pelo usuárioCartão e exemplos de diálogo.Defina a autonomia do usuário e remova exemplos conflitantes.
Repetição ou loopLore duplicado, contexto, sampler e quantização.Reduza o ruído, volte à base e mude um valor por vez.
Muito lentoQuantização, offload, RAM/VRAM e contexto.Compare o arquivo com o hardware. Offload parcial de CPU pode ser bem mais lento.
Comportamento inesperadoBase/instruct, 3.1/3.2, oficial/comunidade.Anote o ID completo e reaplique o card do repositório.

ESPAÇO DE PESQUISA, NÃO RUNNER

Deixe o model card perto do chat

Tabbit não substitui o SillyTavern nem executa este checkpoint local. Na verificação desta página, Mistral não aparecia no diretório público. Use o navegador para reunir cards, quantizações, notas e discussões.

  1. 1

    Abra o card e a página de quantização

    Mantenha ID, hardware e instruções de template visíveis. Adicione um card comunitário depois de separar o checkpoint oficial.

  2. 2

    Referencie abas e arquivos com @

    Use @ para incluir página, captura ou nota local e pedir uma checklist que preserve os IDs.

  3. 3

    Compare o que está listado

    Tabbit compara os modelos visíveis no seletor e resume fontes. A lista muda, então confira após instalar.

Tela Deep Research do Tabbit com resultados do Google e passos de execução.
Seletor do Tabbit com GPT-5.4, GPT-5.2-Chat, Gemini-3.1-Pro, Gemini-3-Flash e Claude-Sonnet-4.6; Mistral não aparece.
Chat multimodelo do Tabbit mostrando respostas ao mesmo prompt.
Navegador Tabbit mostrando um artigo ao lado de um resumo gerado por IA.
Navegador Tabbit no desktop com abas verticais, campo de entrada e painel lateral de IA.

ESCOLHA A SUPERFÍCIE

Controle local de RP ou contexto do navegador?

As ferramentas resolvem problemas diferentes. Use SillyTavern para cards, samplers e backend; use Tabbit para páginas e arquivos.

SillyTavern + backendTabbit
Executar Mistral 24B localmenteSim, com servidor compatívelNão prometido
Cards e samplersControle detalhadoReferenciar notas
Fontes oficiais e comunitáriasColar ou trocar de app@ abas, arquivos e páginas
Comparar modelosTrocar endpoint ou presetComparar modelos do seletor
Diagnóstico de hardwareVRAM, offload, tokens/secOrganizar evidências

FAQ

Perguntas sobre Mistral 24B e SillyTavern

O que significa Mistral 24B?+

Geralmente é um checkpoint Mistral Small de 24 bilhões de parâmetros, mas também pode significar 3.1, 3.2, quantizações e merges de RP. Use o ID completo.

Qual modelo oficial devo escolher?+

A página oficial desta guia é `mistralai/Mistral-Small-3.2-24B-Instruct-2506`, uma atualização menor do 3.1. Use a versão oferecida pelo seu servidor.

Cabe em uma GPU?+

O anúncio do 3.1 cita uma RTX 4090 ou Mac de 32 GB; o card 3.2 indica cerca de 55 GB de memória GPU em BF16/FP16. Confira a quantização real.

Chat Completion ou Text Completion?+

Siga o backend e o card. No SillyTavern, a escolha trata de como as mensagens viram prompt, não de local versus nuvem.

Por que repete ou fala pelo usuário?+

Confira ID, template, cartão duplicado e sampler. Um frontend mal configurado pode produzir os mesmos sintomas.

O Tabbit executa Mistral 24B?+

Não presuma. Mistral não aparecia no diretório público do Tabbit durante a verificação. Use-o aqui para reunir e comparar fontes.

Mantenha checkpoint, template e evidências juntos

Confirme o ID Mistral, conecte o servidor e ajuste o SillyTavern com um teste curto. Use o Tabbit quando cards, quantizações e discussões estiverem espalhados.

Disponível para macOS e Windows. A lista de modelos pode mudar.

© 2026 Tabbit Browser. O navegador nativo de IA que entende o seu contexto.