GEMINI API × SILLYTAVERN

Connecter l’API sans deviner

Utilisez le modèle stable Gemini 2.5 Flash-Lite dans SillyTavern via Google AI Studio. Vérifiez le provider, la clé, l’ID exact, la première requête, thinking et les erreurs qui font paraître une connexion valide défaillante.

Voir la configuration
Espace de travail Tabbit sur ordinateur avec marque orange, saisie de chat et onglets visibles.

VÉRIFIER LE MODÈLE

Le nom passe avant le preset

Google présente Gemini 2.5 Flash-Lite comme un modèle multimodal stable et rapide. Il accepte le texte, les images, la vidéo, l’audio et les PDF, puis renvoie du texte. Une grande fenêtre de contexte ne supprime pas les quotas du projet ni les contrôles du provider.

01

ID stable

Utilisez `gemini-2.5-flash-lite`. Google indique que `gemini-2.5-flash-lite-preview-09-2025` est arrêté. Changer la température ne répare pas un ID retiré.

02

Limites documentées

La page du modèle indique 1 048 576 tokens en entrée et 65 536 en sortie. Les limites RPM, TPM et RPD réelles dépendent du projet et du niveau d’utilisation.

03

Thinking pris en charge

Google indique thinking, les appels de fonctions, la sortie structurée, URL context, Search grounding, l’exécution de code, le cache et la recherche de fichiers. SillyTavern peut exposer moins de réglages.

04

Disponibilité à vérifier

L’accès gratuit et payant ont des limites différentes. Consultez l’usage et les prix dans AI Studio avant une longue session RP. Gratuit ne veut pas dire illimité.

Sélecteur de modèles Tabbit à côté d’une zone permettant de référencer des pages ou d’envoyer des fichiers.

CONFIGURATION SILLYTAVERN

Faites marcher une petite requête d’abord

Le guide officiel de SillyTavern place Google AI Studio sous Chat Completion. Gardez la première requête courte. Ajoutez ensuite le format du personnage, le lore et le contexte long, un changement à la fois.

  1. 01

    Créer une clé Google AI Studio

    Ouvrez les clés API Google AI Studio, connectez-vous, choisissez Get API Key, acceptez les conditions, créez la clé et copiez-la. Traitez-la comme un mot de passe. Ne la mettez pas dans une carte de personnage ou une capture publique.

  2. 02

    Choisir le bon provider

    Dans SillyTavern, ouvrez API Connections. Sélectionnez Chat Completion puis Google AI Studio, collez la clé dans API Key et cliquez sur Connect. Vertex AI est un autre provider avec une autre authentification.

  3. 03

    Choisir le modèle stable

    Sélectionnez `gemini-2.5-flash-lite` dans la liste renvoyée. En saisie manuelle, utilisez l’ID stable exact. N’utilisez pas l’alias preview arrêté.

  4. 04

    Envoyer un test simple

    Utilisez un message court et une carte compacte. Gardez streaming identique pendant le test et notez provider, modèle, taille du contexte et état de la réponse.

  5. 05

    Ajouter les réglages RP ensuite

    Après le texte simple, ajoutez l’instruction système, le format et le lore. Si des marqueurs apparaissent dans la réponse, vérifiez le template du connecteur avant les samplers.

Google applique les limites RPM, TPM et RPD au projet. Une autre clé du même projet ne crée pas de quota supplémentaire.

FORME DE LA REQUÊTE

Séparer ce qui relève de l’API

L’exemple REST officiel de Google utilise un en-tête de clé et du JSON. SillyTavern construit sa requête provider, donc ceci explique les concepts API et ne constitue pas une liste de champs à inventer.

POST https://generativelanguage.googleapis.com/v1beta/interactions
Headers: x-goog-api-key: $GEMINI_API_KEY
         Content-Type: application/json
Body: {
  "model": "gemini-2.5-flash-lite",
  "input": "Répondez en une phrase courte."
}

Forme REST minimale de la documentation Google

System instruction

Lorsque le connecteur le permet, séparez l’instruction système du tour utilisateur. Ne supposez pas que les champs Chat Completion correspondent exactement au JSON REST de Google.

Thinking et sortie

Google indique la prise en charge de thinking et une sortie maximale de 65 536 tokens. Utilisez uniquement les réglages documentés par le connecteur SillyTavern actuel.

Streaming

Google documente le streaming avec `stream: true` et SSE. En cas de réponse vide, refaites le test court sans streaming pour isoler un souci d’affichage ou de parsing.

DÉPANNAGE

Lire l’état avant de changer le preset

Commencez par le code, le provider et le modèle de la requête. Ne changez qu’une variable à la fois et protégez la clé.

SignalÀ vérifierÉtape suivante
400 INVALID_ARGUMENTNom du modèle, JSON, ordre des messages et réglages non pris en charge.Revenez au prompt minimal. Retirez un réglage optionnel puis réintroduisez-le seul.
401 UNAUTHENTICATEDValeur de clé, en-tête, espaces et provider sélectionné.Recopiez ou recréez la clé dans AI Studio, reconnectez Google AI Studio et ne mélangez pas les identifiants Vertex.
403 PERMISSION_DENIEDAccès du projet, état de l’API, région ou réponse de policy.Vérifiez le projet Google et l’état AI Studio. Ne contournez aucun contrôle de sécurité.
404 NOT_FOUNDID exact du modèle et endpoint du provider.Utilisez `gemini-2.5-flash-lite`, retirez l’alias preview arrêté et actualisez la liste.
429 RESOURCE_EXHAUSTEDRPM, TPM, RPD et niveau de facturation du projet dans AI Studio.Attendez, réduisez fréquence, contexte ou sortie et consultez les quotas. Une nouvelle clé du même projet peut ne rien changer.
200 mais videParser streaming, détails de fin, retour sécurité, format et champ de texte.Testez un prompt court sans streaming, puis vérifiez console et réponse avant de modifier la carte.

TABBIT POUR LE CONTEXTE

Garder la recherche près de SillyTavern

Tabbit n’exécute pas votre provider SillyTavern et n’accepte pas votre clé Google AI Studio. Il sert aux pages sources, références de personnages, captures, PDF et tâches du navigateur.

  1. 1

    Ouvrir les références

    Gardez une wiki canon, une documentation ou une note de décor dans un onglet visible. Tabbit peut résumer la page dans son panneau latéral.

  2. 2

    Utiliser @ pour le contexte

    Référencez une page, une capture ou un fichier local avec @ pour demander un résumé ou vérifier la continuité, sans coller chaque paragraphe.

  3. 3

    Vérifier le picker actif

    L’instantané de production international actuel liste et active `gemini-2.5-flash-lite`. Le compte, l’édition, le quota et les futurs déploiements peuvent différer : utilisez le picker en direct. Tabbit n’est pas la connexion SillyTavern.

Mode Agent de Tabbit opérant une feuille Google Sheets avec panneau d’instruction et étapes d’exécution.

DEUX TÂCHES DIFFÉRENTES

Le contrôle API reste dans SillyTavern

SillyTavern gère la carte et la requête provider. Tabbit gère le contexte du navigateur et son assistant natif. Cette limite évite de transformer un champ inexistant en fausse étape.

Espace de réponses multi-modèles Tabbit avec plusieurs colonnes et une zone de prompt partagée.
BesoinSillyTavern + Google AI StudioTabbit
Clé GeminiLa créer dans AI Studio et la coller dans le provider Google AI Studio.Aucun champ pour cette clé.
ID stableChoisir `gemini-2.5-flash-lite` dans la liste active.Utiliser les modèles réellement listés par Tabbit.
Cartes et loreUtiliser contrôles RP, templates et contexte.Référencer wiki, note ou fichier depuis un onglet.
Recherche webAjouter du contexte avec votre flux ST.Utiliser @ avec pages, captures et fichiers.
Actions AgentDépendent de votre configuration SillyTavern.Utiliser le mode Agent pour les tâches web compatibles.

FAQ

Réponses courtes pour une première connexion fragile

Quel ID de modèle saisir ?+

Utilisez `gemini-2.5-flash-lite`. Google indique que `gemini-2.5-flash-lite-preview-09-2025` est arrêté.

Quel provider choisir ?+

Ouvrez API Connections, choisissez Chat Completion puis Google AI Studio, collez la clé AI Studio et connectez. Vertex AI est un autre provider.

Puis-je utiliser l’endpoint compatible OpenAI ?+

Google publie un guide de compatibilité, mais le comportement du provider SillyTavern peut différer. Commencez par Google AI Studio documenté et utilisez la compatibilité seulement si les documents et le connecteur actuels la prennent en charge.

Pourquoi un 429 après quelques messages ?+

Les limites RPM, TPM et RPD de Google sont liées au projet. Vérifiez l’usage et le niveau dans AI Studio, attendez ou réduisez fréquence, contexte et sortie.

Pourquoi la réponse est-elle vide ?+

Testez un prompt court sans streaming, puis vérifiez console, fin, sécurité et format du connecteur. Ne changez pas d’abord la carte.

La limite d’un million de tokens permet-elle un RP très long ?+

Google documente 1 048 576 tokens en entrée et 65 536 en sortie. Ce sont des plafonds, pas une garantie de récupérer tous les anciens détails de façon uniforme.

Puis-je activer thinking ?+

Google le liste comme compatible. Le connecteur actuel de SillyTavern peut exposer d’autres commandes. Si un champ n’est pas documenté, gardez la valeur par défaut.

Tabbit peut-il utiliser mon provider SillyTavern ?+

Non. Tabbit n’accepte pas ce provider ni votre clé Google AI Studio. Gardez cette connexion dans SillyTavern.

Mettre chaque tâche dans le bon outil

Connectez Gemini 2.5 Flash-Lite dans SillyTavern. Utilisez Tabbit lorsque la conversation dépend de pages, fichiers ou actions du navigateur.

Disponible sur macOS et Windows. Les modèles et providers Tabbit peuvent changer.

© 2026 Tabbit Browser. Le navigateur natif IA qui comprend votre contexte.