Mistral Small 3.2 24B
Checkpoint instruct oficial
Boa base para instruções precisas, chat multilíngue e Apache-2.0.
Pode parecer menos literário ou proativo do que um ajuste feito para RP.
Abrir o model card ↗MISTRAL 24B / GUIA DE RP
A escolha depende do seu cartão de personagem, do hardware e do estilo desejado. Anote o ID exato do repositório e compare voz, consistência, iniciativa, repetição, contexto e licença. Esta página separa fatos oficiais de relatos da comunidade.

VEREDITO CONDICIONAL
São pontos de partida verificáveis, não um ranking universal. Cards e comentários usam testes diferentes, então valide cada hipótese com seu próprio cartão.
Checkpoint instruct oficial
Boa base para instruções precisas, chat multilíngue e Apache-2.0.
Pode parecer menos literário ou proativo do que um ajuste feito para RP.
Abrir o model card ↗Ajuste RP da comunidade
Vale testar quando prosa, iniciativa e system prompts flexíveis são prioridade.
Tem template e recomendações próprias. Elogios citados não são benchmark padronizado.
Abrir o model card ↗Ajuste RP baseado no Mistral Small 3.2
Candidato para voz de personagem, grupos e desenvolvimento de cena.
O card cita pequenos erros ocasionais de física ou causalidade. A variante Heretic é outro artefato.
Abrir o model card ↗LoRA mesclado com foco em roleplay
Feito para narração imersiva, voz marcante e ritmo de cena.
O card lista repetição em gerações longas, controle do personagem do usuário e formato multi-personagem mais fraco.
Abrir o model card ↗Ajuste RP com arquivos GGUF
Prático para stacks locais que já usam llama.cpp ou GGUF e precisam escolher o tamanho do arquivo.
Q4, Q6 e Q8 trocam memória, velocidade e fidelidade. Não é um novo lançamento oficial.
Abrir o model card ↗CRITÉRIOS DE ESCOLHA
Dê notas ao que muda suas sessões. Uma primeira resposta bonita pode ser pior para sua campanha se esquecer um personagem secundário em 16k.
| Critério | 3.2 oficial | RP da comunidade | Melhor uso |
|---|---|---|---|
| Consistência do personagem | Boa base para seguir instruções | Voz mais forte, confira entre 8 e 16k | Cartões longos |
| Prosa e iniciativa | Direta e controlada | Magidonia, Cydonia e Umbra buscam mais impulso criativo | Cenas literárias |
| Repetição | 3.2 relata duas vezes menos gerações infinitas que 3.1 | Depende do ajuste, quantização e sampler | Saídas longas |
| Contexto | A família 3.2 indica capacidade de 128k | A KV cache prática depende do backend e da quantização | Muito lore |
| Hardware | Cerca de 55GB de GPU em BF16/FP16 | GGUF de 13.6GB Q4_K_S a 25.2GB Q8_0 | Inferência local |
| Licença e atualização | Apache 2.0 e ID oficial claro | Confira card, base, data e variante | Compartilhar ou publicar |
Pontuação = 0,30 × ajuste ao cartão + 0,20 × voz + 0,20 × consistência + 0,15 × contexto + 0,10 × hardware + 0,05 × confiança na licença. Mude os pesos conforme o uso.
TESTE REPETÍVEL
Não compare base e ajuste RP com prompts diferentes. Mantenha personagem, cena, contexto e limite de saída. Guarde prompt e quantização junto ao resultado.
Use o mesmo cartão, cenário e ação inicial. Observe vocabulário, ponto de vista, iniciativa e respeito à agência do usuário.
Adicione um fato pequeno, uma emoção nova e outro personagem. Marque esquecimentos, repetições, mudanças de tom e ações não solicitadas.
Dê de 1 a 5 para consistência, prosa, agência, repetição e latência. Anote temperature, top_p, contexto, quantização e backend.
O candidato final deve caber no cartão e na máquina. Teste outro template ou quantização antes de descartá-lo.

VERIFICAÇÃO LOCAL
Uma resposta fraca pode falhar antes dos pesos. Confirme ID, formato e chat template antes de mexer na geração.
3.2, 3.1, base, instruct, Magidonia, Cydonia e Umbra são artefatos distintos. “Mistral 24B” sozinho não basta.
O card 3.2 indica cerca de 55GB de GPU para BF16/FP16. GGUF muda de tamanho e precisa de espaço para KV cache e contexto.
Os cards Mistral indicam tokenizer e formato de chat Mistral. Se `<s>` ou marcadores aparecerem, retire a formatação duplicada.
O card oficial sugere temperatura baixa para uso geral. Um ajuste RP pode ser diferente. Mude um valor mantendo o prompt.
TABBIT COMO MESA DE PESQUISA
Tabbit não executa Mistral 24B nem substitui seu frontend local de RP. Na verificação desta página, o diretório público de modelos do Tabbit não mostrava Mistral. Use-o para reunir cards, quantizações, notas do Reddit e resultados.
Mantenha IDs, licenças e datas em abas próximas. Separe evidência de preferência pessoal.
Inclua um card, captura ou nota local na pergunta e peça uma lista que preserve IDs e marque incógnitas.
Tabbit pode comparar respostas de vários modelos visíveis e resumir fontes. O seletor muda, então confira após instalar.


Mesa de modelos
IDs visíveis. Fontes próximas. O navegador vira seu caderno de laboratório.
Use os cards de fonte acima como registro do que foi conferido, não como promessa de que todo endpoint ou modelo continuará disponível.
FAQ
As fontes não sustentam um vencedor universal. Comece com Small 3.2 e teste Magidonia, Cydonia, Umbra ou Roleplay V3 com seu cartão.
Os resultados o identificam como um upscale de 36B e como um modelo comunitário de 31B. Pode vir do Mistral Small 24B, mas não é um checkpoint 24B.
Cards da comunidade relatam boa consistência em Magidonia e Cydonia, enquanto Umbra enfatiza voz e ritmo. São relatos qualitativos, então faça o teste de dois turnos.
Use a melhor qualidade que caiba com seu contexto. A página GGUF do Roleplay V3 lista Q4_K_S 13.6GB, Q4_K_M 14.4GB, Q6_K 19.4GB e Q8_0 25.2GB.
Não presuma. Mistral não aparecia no diretório público do Tabbit quando esta página foi verificada. Aqui ele é recomendado para reunir e comparar fontes.
Guarde checkpoint, quantização, prompt e resultado juntos. Assim você compara lançamentos novos e diagnostica uma sessão ruim mais rápido.
Disponível para macOS e Windows. A disponibilidade de modelos pode mudar.