Small Instruct officiel
`mistralai/Mistral-Small-3.2-24B-Instruct-2506` est une mise à jour de 3.1. Sa fiche décrit un meilleur suivi des instructions et moins de répétitions, sans garantir une voix de personnage.
MISTRAL 24B · GUIDE ROLEPLAY
Mistral 24B est une taille, pas un modèle de roleplay unique. Le checkpoint Instruct officiel, un fine-tune, un merge et un fichier Q4 ou Q6 peuvent produire des scènes très différentes. Notez le dépôt exact, puis testez la voix, l’autonomie, l’avancement et les répétitions.
Les retours de la communauté servent de pistes pour vos tests. Ce guide ne propose ni jailbreak ni contournement de la sécurité.

IDENTIFIER LE CHECKPOINT
Quand plusieurs dépôts s’appellent « Mistral 24B », les conseils de roleplay perdent leur contexte. Séparez ces niveaux.
`mistralai/Mistral-Small-3.2-24B-Instruct-2506` est une mise à jour de 3.1. Sa fiche décrit un meilleur suivi des instructions et moins de répétitions, sans garantir une voix de personnage.
Roleplay V2, V3, V5 et V6 sont des fine-tunes ou merges différents. Consultez la fiche de l’auteur pour l’objectif, le format, la licence et le sampler conseillé.
Un modèle base et un modèle instruct attendent des prompts différents. Une carte de personnage prévue pour le chat peut mal fonctionner sur base si le serveur et le format ne correspondent pas.
Les fichiers GGUF Q4, Q5, Q6 et i1 changent la mémoire et parfois la vitesse ou la fidélité. Ce ne sont pas de nouvelles versions de Mistral. Notez fichier, contexte, backend et offload.
CONSTRUIRE LE PROMPT
SillyTavern assemble système, personnage, persona, monde, historique et message actuel en un prompt. Le prompt final compte plus qu’une phrase brillante dans la carte.
Indiquez que le modèle écrit la prochaine réponse du personnage, respecte l’autonomie de l’utilisateur et fait avancer la scène. Séparez voix, limites et format.
Un dialogue d’exemple enseigne rythme, point de vue et format. Retirez les exemples qui font parler à la place de l’utilisateur ou écrire les deux côtés.
Séparez faits fixes, objectifs présents et état temporaire. Un lore long ou dupliqué pousse le modèle à répéter au lieu de réagir.
Utilisez Prompt Itemization, les logs ou Prompt Inspector. Des marqueurs de rôle en double ne seront pas réparés par un sampler.
UN TEST COURT ET JUSTE
Fixez carte, ouverture, contexte et longueur de réponse. Comparez trois tours en ne changeant qu’une variable.
Notez objectif, voix, lieu, changement immédiat, limite utilisateur et longueur. Demandez une conséquence concrète.
Commencez avec le template et le sampler de la carte. Enregistrez la première réponse avant de régénérer, puis changez une seule chose.
Donnez 0 à 2 points à la voix, l’autonomie, l’avancement et la répétition à chaque tour. Ajoutez une justification courte.
Corrigez ID et template, puis contexte et longueur. Comparez temperature, min-p, DRY, XTC ou une autre quantification après stabilisation.
SYMPTÔME → COUCHE → VÉRIFICATION
Une scène faible peut venir du prompt, du serveur ou du sampling. Gardez le diagnostic ciblé.
| Ce que vous voyez | Couche probable | Prochaine action |
|---|---|---|
| Prose sèche ou répétitive | Checkpoint, exemples ou sampler | Lancez la base, supprimez le lore en double et changez une valeur. |
| Le modèle parle pour l’utilisateur | Prompt principal, persona ou exemples | Écrivez l’autonomie positivement et inspectez le prompt. |
| Marqueurs de rôle visibles | Template appliqué deux fois | Laissez le tokenizer ou le backend appliquer le template Mistral une seule fois. |
| Boucle ou scène immobile | Contexte, longueur ou répétition | Vérifiez la composition, raccourcissez l’ancien lore et exigez une conséquence. |
| Sortie vide ou tronquée | Endpoint, stop strings ou slug | Envoyez une ligne, vérifiez l’ID et retirez les stops d’un autre modèle. |
| Ralentissement après quelques tours | Quantification, contexte ou offload CPU | Comparez mémoire et contexte, puis mesurez les tokens par seconde. |
TABBIT COMME BUREAU DE RECHERCHE
Tabbit n’exécute pas un checkpoint Mistral local et ne remplace pas SillyTavern. Il sert à réunir fiches, quantifications, documentation et discussions. Vérifiez l’accès dans le sélecteur réel de votre compte.
Ouvrez la fiche officielle, le dépôt RP, sa page de quantification et la documentation SillyTavern dans le même espace.
Utilisez @ pour inclure une page, une capture ou une note locale, puis demandez une liste qui conserve les IDs et les inconnues.
Le chat multimodèle peut comparer deux sources. Comparez leurs affirmations et procédures, pas un paragraphe isolé.
Appliquez le template vérifié dans SillyTavern ou votre serveur. Si Mistral n’apparaît pas dans le picker Tabbit, n’en déduisez pas une exécution locale.



SÉPARER LES RÔLES
SillyTavern et Tabbit répondent à des besoins différents. Gardez la génération dans le frontend RP et les sources dans le navigateur.
| SillyTavern + backend | Tabbit | |
|---|---|---|
| Exécuter Mistral 24B localement | Oui, avec un serveur compatible | Non garanti |
| Cartes, lore et samplers | Contrôle RP détaillé | Référencer notes et pages |
| Sources officielles et communautaires | Changer d’onglet ou copier | Rassembler avec @ |
| Évaluation RP contrôlée | Générer et conserver des branches | Comparer affirmations et brouillons |
| Disponibilité | Liste du backend | Picker actif du compte |
GARDER DES PROMESSES PRÉCISES
Temperature, min-p, DRY et XTC dépendent du checkpoint et du backend. Un réglage peut aider une carte et raidir une autre.
Les scores d’instructions ou de code ne mesurent ni voix, ni rythme, ni humour, ni mémoire des promesses. Testez une scène répétable.
Le roleplay légitime peut définir des limites fictives et l’autonomie. Il ne doit pas apprendre à contourner la sécurité.
Catalogues, fournisseurs et accès Tabbit changent. Consultez la fiche exacte et le picker actuel.
OUVRIR LES SOURCES
Ces liens séparent faits officiels, expérience communautaire et documentation frontend.
FAQ
Cela dépend du checkpoint, de la carte, du template, du contexte et du sampler. Le rapport Reddit décrit un bon suivi des instructions, mais une écriture sèche et répétitive. Testez trois tours.
Commencez par l’ID complet, puis choisissez un fichier adapté à votre mémoire et à sa licence. Small 3.2 Instruct et les fine-tunes RP sont distincts.
La carte officielle 3.2 donne 0,15 comme exemple général. Un fine-tune RP peut recommander une autre base. Notez la valeur et changez une seule chose.
Le checkpoint, le lore en double, les exemples, le contexte, le template ou le sampler peuvent être en cause. Inspectez d’abord le prompt final.
Non. Q6 consomme souvent plus de mémoire que Q4, mais le matériel et la vitesse du backend comptent aussi. Comparez avec la même scène.
Ne le supposez pas. Tabbit est présenté ici comme un espace de recherche navigateur. Après installation, vérifiez le picker de votre compte.
Confirmez le dépôt, rendez le template explicite, lancez une comparaison courte et gardez les sources à portée de main.
Disponible pour macOS et Windows. L’accès varie selon l’édition, la région et le déploiement.