MISTRAL 24B / GUIDE RP

Il n’existe pas un meilleur modèle RP 24B pour tout le monde

Le bon choix dépend de votre fiche de personnage, de votre matériel et du style recherché. Notez l’identifiant complet du dépôt, puis comparez la voix, la cohérence, l’initiative, les répétitions, le contexte et la licence. Cette page sépare les faits officiels des retours communautaires.

Lire la card officielle 3.2
Sélecteur de modèles Tabbit avec un champ @ pour garder la recherche dans son contexte.

VERDICT CONDITIONNEL

Choisissez la scène que vous voulez écrire

Ce sont des points de départ vérifiables, pas un classement universel. Les cards et les commentaires ne reposent pas sur les mêmes tests. Validez chaque hypothèse avec votre propre fiche.

0124B

Mistral Small 3.2 24B

Checkpoint instruct officiel

Une base claire pour les consignes précises, le chat multilingue et Apache-2.0.

Son comportement généraliste peut sembler moins littéraire ou moins proactif qu’un tune RP.

Ouvrir la model card ↗
0224B

Magidonia 24B v4.3

Tune RP communautaire

À tester si la prose, l’initiative et un system prompt souple comptent le plus.

Ce modèle a son propre template et ses conseils de sampling. Les éloges cités ne sont pas un benchmark.

Ouvrir la model card ↗
0324B

Cydonia 24B v4.3

Tune RP basé sur Mistral Small 3.2

Un candidat pour la voix des personnages, les groupes et le développement des scènes.

Sa card mentionne des erreurs occasionnelles de physique ou de causalité. La variante Heretic est distincte.

Ouvrir la model card ↗
0424B

VoidAI Umbra

LoRA fusionné orienté roleplay

Conçu pour la narration immersive, une voix marquée et le mouvement de la scène.

La card signale des répétitions en longue génération, la prise de contrôle du personnage utilisateur et un format multi-personnage moins strict.

Ouvrir la model card ↗
0524B

Mistral Small 24B Roleplay V3

Tune RP avec fichiers GGUF

Pratique si votre stack local utilise déjà llama.cpp ou GGUF et si vous voulez choisir la taille du fichier.

Q4, Q6 et Q8 échangent mémoire, vitesse et fidélité. Ce n’est pas une nouvelle version officielle.

Ouvrir la model card ↗

GRILLE DE DÉCISION

Rendez les compromis visibles avant le téléchargement

Notez les dimensions qui changent vos sessions. Un beau premier tour qui oublie un personnage secondaire à 16k peut être moins utile qu’un modèle plus sobre mais stable.

Critère3.2 officielRP communautaireUsage conseillé
Cohérence du personnageBonne base de suivi des consignesVoix souvent plus forte, à vérifier entre 8 et 16kFiches longues
Prose et initiativeDirecte et contrôléeMagidonia, Cydonia et Umbra visent plus d’élan créatifScènes littéraires
RépétitionsLa 3.2 annonce deux fois moins de générations infinies que la 3.1Dépend du tune, de la quantification et du samplerLongues sorties
ContexteLa famille 3.2 annonce une capacité 128kLa KV cache pratique dépend du backend et de la quantificationBeaucoup de lore
MatérielEnviron 55GB de GPU en BF16/FP16GGUF de 13.6GB Q4_K_S à 25.2GB Q8_0Inférence locale
Licence et fraîcheurApache 2.0 et ID officiel clairVérifier card, base, date et variantePartager ou déployer

Score = 0,30 × adéquation à la fiche + 0,20 × voix + 0,20 × cohérence + 0,15 × contexte + 0,10 × matériel + 0,05 × confiance dans la licence. Changez les poids selon le cas.

TEST REPRODUCTIBLE

Une fiche, deux tours, une seule modification à la fois

Ne comparez pas un base model et un tune RP avec des prompts différents. Gardez personnage, scène, contexte et budget de sortie identiques. Archivez prompt et quantification avec chaque résultat.

  1. 1

    Tour 1 : installer la voix

    Donnez la même fiche, le même décor et la même action initiale. Vérifiez le vocabulaire, le point de vue, l’initiative et l’agence du personnage utilisateur.

  2. 2

    Tour 2 : tester la continuité

    Ajoutez un petit fait, une émotion nouvelle et un second personnage. Repérez les oublis, les répétitions, les changements de ton et les actions non demandées.

  3. 3

    Noter l’échec, pas seulement l’impression

    Notez cohérence, prose, agence, répétition et latence de 1 à 5. Gardez temperature, top_p, contexte, quantification et backend.

  4. 4

    Garder le compromis le moins pénible

    Le choix final doit convenir à la fiche et à la machine. Essayez un autre template ou une autre quantification avant de supprimer un candidat.

Chat multimodèle Tabbit montrant plusieurs réponses au même prompt pour les comparer.

VÉRIFICATION LOCALE

Le fichier, le template et le sampler changent le résultat

Une réponse faible peut venir d’une couche avant les poids. Confirmez ID, format et chat template avant de modifier la génération.

01

Confirmer l’ID complet

3.2, 3.1, base, instruct, Magidonia, Cydonia et Umbra sont des artefacts distincts. « Mistral 24B » ne suffit pas.

02

Planifier la mémoire avec le vrai fichier

La card 3.2 indique environ 55GB de GPU pour BF16/FP16. Les GGUF changent de taille et il faut de la marge pour la KV cache et le contexte.

03

Utiliser le template de la card

Les cards Mistral indiquent le tokenizer et le format de chat Mistral. Si `<s>` ou des marqueurs apparaissent, retirez le double formatage.

04

Prendre le sampler comme point de départ

La card officielle conseille une température basse en usage général. Un tune RP peut différer. Gardez le prompt fixe et changez une valeur.

TABBIT COMME BUREAU DE RECHERCHE

Gardez la model card près de la comparaison

Tabbit n’exécute pas Mistral 24B et ne remplace pas votre frontend RP local. Lors de la vérification, son répertoire public ne listait pas Mistral. Utilisez-le pour réunir cards, quantifications, notes Reddit et résultats.

  1. 1

    Ouvrir cards officielles et communautaires

    Gardez IDs, licences et dates dans des onglets voisins. Séparez la preuve d’une préférence personnelle.

  2. 2

    Référencer pages et fichiers avec @

    Ajoutez une card, une capture ou une note locale à votre question et demandez une liste qui conserve les IDs et marque les inconnues.

  3. 3

    Comparer les modèles réellement visibles

    Tabbit compare les réponses de plusieurs modèles visibles et résume les sources. Le sélecteur change, vérifiez-le après installation.

Vue Deep Research de Tabbit avec résultats Google et étapes d’exécution pour réunir les sources.
Navigateur Tabbit avec un article et un panneau de résumé IA pour garder des notes.

Bureau des modèles

Les ID restent visibles, les sources restent proches. Le navigateur devient votre carnet.

Les cards ci-dessus consignent ce qui a été vérifié, sans promettre que chaque endpoint ou modèle restera disponible.

FAQ

Avant de choisir un Mistral 24B pour le RP

Quel est le meilleur Mistral 24B pour le roleplay ?+

Les sources ne désignent pas un gagnant universel. Commencez par Small 3.2, puis testez Magidonia, Cydonia, Umbra ou Roleplay V3 avec votre fiche.

Skyfall est-il un modèle 24B ?+

Les résultats l’identifient comme un upscale 36B et comme un modèle communautaire 31B. Il peut venir de Mistral Small 24B, mais ce n’est pas un checkpoint 24B.

Quel modèle a la meilleure cohérence de personnage ?+

Les cards communautaires rapportent une bonne cohérence pour Magidonia et Cydonia, tandis qu’Umbra vise la voix et l’élan de scène. Ce sont des retours qualitatifs à tester.

Quelle quantification choisir ?+

Prenez la meilleure qualité qui tient avec votre contexte. La page GGUF de Roleplay V3 liste Q4_K_S 13.6GB, Q4_K_M 14.4GB, Q6_K 19.4GB et Q8_0 25.2GB.

Tabbit peut-il exécuter Mistral 24B ?+

Ne le supposez pas. Mistral n’apparaissait pas dans le répertoire public de Tabbit lors de la vérification. Tabbit est présenté ici pour rassembler et comparer les sources.

Choisissez avec des preuves que vous pourrez relire

Conservez checkpoint, quantification, prompt et résultat ensemble. Vous comparerez mieux les nouvelles versions et trouverez plus vite la cause d’une mauvaise session.

Disponible sur macOS et Windows. La disponibilité des modèles peut changer.

© 2026 Tabbit Browser. Le navigateur natif IA qui comprend votre contexte.