MISTRAL 24B PRESET

Um preset reúne suposições

Um preset Mistral 24B pode guardar o modelo, as notas do autor, o chat template, o system prompt e os samplers. Se a fonte, a versão ou a quantização mudar, podem surgir respostas vazias, marcadores visíveis, loops ou texto falando pelo usuário. Confira cada camada antes de importar.

Abrir o card 3.2
O navegador Tabbit mostra uma página de pesquisa ao lado de um painel de etapas de execução.

COMECE PELO MODEL ID

24B é tamanho, não nome de modelo

Anote o slug completo do repositório ou provedor antes de mudar as configurações. Isso evita aplicar template 3.2 a um arquivo 3.1 ou confundir merge comunitário com checkpoint oficial.

01

Instruct oficial 3.2

`mistralai/Mistral-Small-3.2-24B-Instruct-2506` é uma atualização menor do 3.1. O card cita melhorias em instruções, repetição e function calling.

02

Versão oficial anterior

`mistralai/Mistral-Small-3.1-24B-Instruct-2503` é outro checkpoint. Não deduza seu template ou comportamento a partir do 3.2.

03

Arquivos de RP da comunidade

Magistry, Cydonia e Magidonia são fine-tunes ou merges. Consulte cada card para licença, formato de prompt e sampler.

04

Base, instruct e quantização

Base e instruct são checkpoints diferentes. GGUF, AWQ e Q4/Q5/Q6 são formatos ou quantizações, não novos modelos oficiais.

CAMINHO DE CONFIGURAÇÃO

Escolha o servidor antes do SillyTavern

SillyTavern é a interface de chat. O modelo precisa de servidor local ou endpoint de provedor. Escolha de acordo com hardware e privacidade.

01

GPU local ou Mac

O card 3.2 indica cerca de 55 GB de memória GPU em BF16/FP16. GGUF menores trocam memória por velocidade e qualidade; confira o arquivo real.

02

Servidor vLLM

A Mistral recomenda vLLM 0.9.1 ou mais recente e `mistral_common` 1.6.2 ou mais recente. Use o formato Mistral e o ID exato.

03

Provedor ou API compatível com OpenAI

Copie o slug e endpoint exatos. O rótulo “Mistral 24B” sozinho não define o template do SillyTavern.

04

Conecte o SillyTavern

Use Chat Completion quando o backend aceitar mensagens por função. Use Text Completion só quando a documentação pedir e confira chave, modelo e contexto.

AJUSTE DE ROLEPLAY

Template antes do sampler

Um template errado parece um modelo fraco. Corrija formato e contexto antes de mexer na geração com um teste curto e repetível.

01

Use o formato Mistral do backend

Deixe o tokenizer ou servidor aplicar a chat template quando possível. Se `<s>` ou marcadores de função aparecerem, corrija o formato.

02

Mantenha o cartão compacto

Separe fatos fixos, objetivos atuais e estado da cena. Remova lore duplicado e instruções que fazem o modelo escrever pelo usuário.

03

Registre uma base

Comece pelos valores do card do modelo ou fine-tune. O card oficial 3.2 sugere temperatura baixa, como 0,15, para uso geral; modelos de RP podem ser diferentes.

04

Stop strings são específicas

Uma stop string de Llama ou ChatML pode cortar a resposta Mistral ou mostrar marcadores. Copie a recomendação do checkpoint e teste dois turnos.

A comunidade relata falar pelo usuário, resposta vazia, repetição e quantizações lentas. São sintomas, não uma regra para todos os arquivos.

SINTOMA → CHECAGEM → AÇÃO

Encontre a camada com problema

Mude uma variável por vez, repita o mesmo prompt curto e registre o resultado. Comece por nome, endpoint e template.

SintomaConfiraPróximo passo
Resposta vaziaEndpoint, slug, template de contexto e stop strings.Envie um prompt curto e use o template Mistral exato do backend.
Marcadores no textoQuem aplica o template: SillyTavern, servidor ou tokenizer?Mantenha um só responsável pelo formato e veja o prompt bruto.
Escreve pelo usuárioCartão e exemplos de diálogo.Defina a autonomia do usuário e remova exemplos conflitantes.
Repetição ou loopLore duplicado, contexto, sampler e quantização.Reduza o ruído, volte à base e mude um valor por vez.
Muito lentoQuantização, offload, RAM/VRAM e contexto.Compare o arquivo com o hardware. Offload parcial de CPU pode ser bem mais lento.
Comportamento inesperadoBase/instruct, 3.1/3.2, oficial/comunidade.Anote o ID completo e reaplique o card do repositório.

ESPAÇO DE PESQUISA, NÃO RUNNER

Deixe o model card perto do chat

Tabbit não substitui o SillyTavern nem executa este checkpoint local. Na verificação desta página, Mistral não aparecia no diretório público. Use o navegador para reunir cards, quantizações, notas e discussões.

  1. 1

    Abra o card e a página de quantização

    Mantenha ID, hardware e instruções de template visíveis. Adicione um card comunitário depois de separar o checkpoint oficial.

  2. 2

    Referencie abas e arquivos com @

    Use @ para incluir página, captura ou nota local e pedir uma checklist que preserve os IDs.

  3. 3

    Compare o que está listado

    Tabbit compara os modelos visíveis no seletor e resume fontes. A lista muda, então confira após instalar.

Tela Deep Research do Tabbit com resultados do Google e passos de execução.
Seletor do Tabbit com GPT-5.4, GPT-5.2-Chat, Gemini-3.1-Pro, Gemini-3-Flash e Claude-Sonnet-4.6; Mistral não aparece.
Chat multimodelo do Tabbit mostrando respostas ao mesmo prompt.
Navegador Tabbit mostrando um artigo ao lado de um resumo gerado por IA.

ESCOLHA A SUPERFÍCIE

Controle local de RP ou contexto do navegador?

As ferramentas resolvem problemas diferentes. Use SillyTavern para cards, samplers e backend; use Tabbit para páginas e arquivos.

SillyTavern + backendTabbit
Executar Mistral 24B localmenteSim, com servidor compatívelNão prometido
Cards e samplersControle detalhadoReferenciar notas
Fontes oficiais e comunitáriasColar ou trocar de app@ abas, arquivos e páginas
Comparar modelosTrocar endpoint ou presetComparar modelos do seletor
Diagnóstico de hardwareVRAM, offload, tokens/secOrganizar evidências

FAQ

Perguntas sobre Mistral 24B e SillyTavern

O que significa Mistral 24B?+

Geralmente é um checkpoint Mistral Small de 24 bilhões de parâmetros, mas também pode significar 3.1, 3.2, quantizações e merges de RP. Use o ID completo.

Qual modelo oficial devo escolher?+

A página oficial desta guia é `mistralai/Mistral-Small-3.2-24B-Instruct-2506`, uma atualização menor do 3.1. Use a versão oferecida pelo seu servidor.

Cabe em uma GPU?+

O anúncio do 3.1 cita uma RTX 4090 ou Mac de 32 GB; o card 3.2 indica cerca de 55 GB de memória GPU em BF16/FP16. Confira a quantização real.

Chat Completion ou Text Completion?+

Siga o backend e o card. No SillyTavern, a escolha trata de como as mensagens viram prompt, não de local versus nuvem.

Por que repete ou fala pelo usuário?+

Confira ID, template, cartão duplicado e sampler. Um frontend mal configurado pode produzir os mesmos sintomas.

O Tabbit executa Mistral 24B?+

Não presuma. Mistral não aparecia no diretório público do Tabbit durante a verificação. Use-o aqui para reunir e comparar fontes.

Mantenha checkpoint, template e evidências juntos

Confirme o ID Mistral, conecte o servidor e ajuste o SillyTavern com um teste curto. Use o Tabbit quando cards, quantizações e discussões estiverem espalhados.

Disponível para macOS e Windows. A lista de modelos pode mudar.

© 2026 Tabbit Browser. O navegador nativo de IA que entende o seu contexto.