Gemma 4 × SillyTavern

Gemma 4 dans SillyTavern

Pour utiliser Gemma 4 en jeu de rôle, séparez d’abord les noms officiels des fichiers quantifiés de la communauté. Vérifiez ensuite, dans l’ordre, le backend, le template, le tokenizer et les marqueurs de réflexion. Ce guide ajoute une option navigateur quand l’installation locale vous ralentit.

Page officielle Gemma 4
Vérifier les noms sur Google DeepMind
Nouvel onglet Tabbit sur ordinateur, avec onglets verticaux, zone de saisie centrale et panneau de chat à droite.

Commencer par le modèle

Gemma 4 est une famille, pas un preset SillyTavern

Google cite E2B, E4B, 12B, 26B A4B et 31B. 26B A4B est un modèle mixture-of-experts, tandis que 31B est dense. Q4 et Q6 sont des versions quantifiées, pas de nouveaux noms officiels.

01

26B A4B ou 31B ?

Appuyez-vous sur le model card et votre matériel. 26B A4B peut être plus léger car seule une partie est active. 31B demande souvent plus de mémoire.

02

Local, fournisseur ou API

Ollama, LM Studio, KoboldCpp et llama.cpp gèrent les templates et le contexte différemment. Avec une API, utilisez l’identifiant fourni par le fournisseur.

03

Le roleplay teste vos réglages

La cohérence dépend de la carte, du system prompt, du sampler et du contexte autant que du checkpoint. DRY et les presets sont des points de départ communautaires.

Parcours SillyTavern

Connecter chaque couche dans l’ordre

Ne changez qu’une couche à la fois pour pouvoir expliquer une mauvaise réponse.

  1. 01

    1. Confirmer le endpoint

    Choisissez le connecteur adapté et vérifiez le checkpoint exact. Avec un fournisseur, copiez son model slug.

  2. 02

    2. Choisir Chat Completions

    Si le serveur le permet, commencez par Chat Completions. Text Completion laisse davantage de détails de template à gérer.

  3. 03

    3. Aligner tokenizer et template

    Utilisez le tokenizer et le template Gemma 4 ou Gemini indiqués par votre backend. Un ancien template peut mal placer les marqueurs de réflexion.

  4. 04

    4. Ajouter carte et preset

    Chargez la carte, ajoutez un system prompt simple, puis testez un preset communautaire à la fois. Notez vos changements.

FF et Moonlight viennent de discussions communautaires. Ce ne sont pas des valeurs Google et nous ne republions pas leurs fichiers.

Si la réponse est étrange

Réparer la couche qui a échoué

CASE 01

Le thinking apparaît comme du texte

Vérifiez template, tokenizer et réglage de réflexion. <|think|> dépend du backend et peut afficher des tokens littéraux si le format ne correspond pas.

CASE 02

Le modèle réfléchit parfois

Un fournisseur peut exposer le reasoning différemment d’une build locale. Comparez une courte requête avec et sans réflexion avant d’ajouter un marqueur.

CASE 03

Le personnage répète ou dérive

Réduisez les doublons du contexte avant de toucher à la température. Vérifiez la carte et la limite, puis testez DRY ou un sampler communautaire.

Parcours navigateur

Garder la page du personnage ouverte et demander à côté

Tabbit ne remplace pas les cartes ni les lorebooks de SillyTavern. Il sert à lire une wiki ou un document et à discuter avec un modèle visible dans le navigateur.

  1. 1

    Installer Tabbit

    Téléchargez le navigateur Chromium pour macOS ou Windows. Aucun fichier de modèle local ni serveur SillyTavern n’est requis.

  2. 2

    Choisir un modèle affiché

    Ouvrez le sélecteur après l’installation et choisissez un modèle réellement présent, comme GPT-5.4, GPT-5.2-Chat ou Gemini-3-Flash.

  3. 3

    Référencer la page

    Laissez la wiki ou le document dans un onglet. Avec @, référencez la page, une capture ou un fichier pour demander des notes de scène ou une seconde version.

Sélecteur de modèles Tabbit affichant GPT-5.4, GPT-5.2-Chat, Gemini-3.1-Pro, Gemini-3-Flash et Claude-Sonnet-4.6. Gemma 4 n’est pas visible dans cette capture.

Choisir l’outil

SillyTavern ou Tabbit ?

Choisissez selon votre blocage. Un navigateur ne gère pas les cartes, et un frontend local n’améliore pas automatiquement le modèle.

SillyTavernTabbit
Cartes et lorebooksIntégrésGarder la source ouverte
Checkpoint Gemma 4 localBackend à fournirChoisir dans la liste
Template et samplerContrôle précisGéré par le modèle
Contexte de pageColler ou extensions@ onglet ou fichier
Première réponse utileInstaller + endpoint + presetInstaller + choisir
Sélecteur de modèles Tabbit affichant GPT-5.4, GPT-5.2-Chat, Gemini-3.1-Pro, Gemini-3-Flash et Claude-Sonnet-4.6. Gemma 4 n’est pas visible dans cette capture.

Référencer la page

Laissez la wiki ou le document dans un onglet. Avec @, référencez la page, une capture ou un fichier pour demander des notes de scène ou une seconde version.

Sélecteur de modèles Tabbit affichant GPT-5.4, GPT-5.2-Chat, Gemini-3.1-Pro, Gemini-3-Flash et Claude-Sonnet-4.6. Gemma 4 n’est pas visible dans cette capture.

Contexte de page

@ onglet ou fichier

FAQ

Gemma 4 et SillyTavern

Gemma 4 26B et 31B sont-ils identiques ?+

Non. Google décrit 26B A4B comme mixture-of-experts et 31B comme dense.

Quelle quantification télécharger ?+

Adaptez Q4, Q5 ou Q6 à la mémoire, au contexte et au model card de l’éditeur.

Pourquoi les thinking tokens apparaissent-ils ?+

Le tokenizer, le template, le backend ou le fournisseur peuvent utiliser des formats différents. Vérifiez-les avant d’ajouter <|think|>.

Tabbit peut-il exécuter Gemma 4 ?+

Ne le supposez pas. Après l’installation, utilisez seulement un modèle présent dans le sélecteur actuel.

Tabbit remplace-t-il SillyTavern ?+

Non. Les cartes et lorebooks conviennent à SillyTavern. Tabbit sert à discuter à côté de pages et de fichiers.

Ne corrigez plus la mauvaise couche

Pour Gemma 4 en local, suivez le model card et la chaîne de templates. Pour discuter à côté d’une wiki, installez Tabbit et choisissez un modèle disponible.

Disponible sur macOS et Windows. La liste peut changer.

© 2026 Tabbit Browser. Le navigateur natif IA qui comprend votre contexte.