CONFIGURER AVANT LE PRESET

Configurer Kimi K3 dans SillyTavern

Une connexion fiable commence par quatre éléments : le fournisseur actif, l’alias du modèle, le parcours Chat Completions et la conservation du raisonnement. Vérifiez-les avant de régler une carte de personnage.

Voir la checklist

Alias officiel : kimi-k3 · Base URL d’exemple : https://api.moonshot.ai/v1 · K3 garde toujours le thinking actif.

Nouvel onglet Tabbit avec onglets verticaux, champ central et panneau Chat.

LIRE LES SIGNAUX

Séparer les faits du modèle et le bruit de configuration

Kimi K3 peut bien écrire tout en ayant un endpoint incorrect ou un message reasoning incomplet. Commencez par ces trois contrôles.

01 / MODÈLE

Thinking reste actif

Moonshot décrit K3 comme un modèle qui raisonne toujours. L’API accepte reasoning_effort low, high ou max. Une réponse longue ne prouve pas que le preset est cassé.

02 / FOURNISSEUR

Les limites suivent le parcours

L’exemple officiel utilise https://api.moonshot.ai/v1 et kimi-k3. Les proxies peuvent changer alias, quotas, prix et paramètres.

03 / RETOURS

Les 429 sont des témoignages

Des discussions publiques sur X et Reddit évoquent lenteur, 429, réflexion excessive et reasoning blocks. Ce ne sont ni un SLA ni un benchmark.

CINQ CONTRÔLES

Connecter Kimi K3 couche par couche

Commencez avec un petit chat de test. Changez une option, envoyez un tour et notez le résultat.

Les faits K3 viennent du guide officiel Kimi. Les panneaux des fournisseurs et les extensions peuvent évoluer séparément.

  1. 01

    Vérifier fournisseur et modèle

    Choisissez Moonshot ou un fournisseur qui liste Kimi K3 maintenant. Contrôlez facturation, limites, slug et compatibilité OpenAI.

    L’entrée Kimi K3 ou kimi-k3 est visible chez le fournisseur.

  2. 02

    Choisir Chat Completions

    Le Quickstart officiel envoie la requête vers /chat/completions. Dans SillyTavern, utilisez Chat Completions, pas un template text completion.

    Le test atteint /v1/chat/completions sans erreur de template.

  3. 03

    Commencer par un system prompt court

    Utilisez un personnage, une scène et peu de contexte. Écrivez voix et limites une seule fois pour garder le diagnostic lisible.

    Le premier message garde le rôle avant l’ajout du preset.

  4. 04

    Mapper reasoning et conserver le tour

    Le streaming peut séparer reasoning_content et content. Vérifiez que l’interface les gère et renvoie le message assistant complet au tour suivant.

    La requête suivante ne perd ni raisonnement ni réponse finale.

  5. 05

    Ajouter prefill ou preset en dernier

    Les extensions prefill et preserved-thinking peuvent aider un comportement précis, mais ce sont des outils communautaires, pas des exigences Kimi.

    Vous pouvez relier l’amélioration à une seule modification.

PARTIR DU SYMPTÔME

Réparer la couche qui échoue

Faites le contrôle le plus ciblé. Ne changez pas des presets au hasard tant qu’une erreur d’authentification ou d’endpoint subsiste.

Réparer la couche qui échoue
SymptômeCouche probableProchain contrôle
401 ou clé invalideClé ou compteCréez une nouvelle clé, confirmez l’activation du compte et retirez les espaces.
404 ou modèle introuvableBase URL ou aliasComparez la liste actuelle avec kimi-k3. Gardez /v1 et laissez le connecteur ajouter /chat/completions.
429, timeout ou surchargeQuota ou limiteVérifiez concurrence, RPM/TPM, niveau du compte et état du fournisseur. Évitez une boucle de retry.
Réponse vide ou reasoning casséMapping de réponseSéparez reasoning_content et content, activez reasoning et conservez le message assistant complet.
Pensée longue, dérive ou répétitionPrompt et historiqueBaissez reasoning_effort si possible, raccourcissez les consignes et testez un chat propre avant prefill.

UN PARCOURS PLUS COURT

Utiliser Kimi K3 à côté de votre contexte

Pour lire une fiche, un wiki ou un brief en discutant, Tabbit évite le premier cycle de configuration d’endpoint. Vérifiez l’accès dans le sélecteur actuel.

01

Garder la source ouverte

Ouvrez la fiche, le lore ou le document dans un onglet. Tabbit peut utiliser pages, captures et fichiers comme contexte.

La source reste visible pendant la question.

Vue Agent de Tabbit dans Google Sheets avec une consigne et des étapes à droite.
02

Choisir Kimi-K3

Sélectionnez Kimi-K3 dans le sélecteur Chat ou nouvel onglet. La liste change ; fiez-vous à l’interface active.

Le modèle voulu apparaît dans le sélecteur.

Barre latérale Tabbit à côté d’un article avec résumé, Switch Model et champ de question.
03

Questionner et comparer

Utilisez la barre latérale ou comparez les réponses dans une vue. Tabbit ne remplace pas cards, lorebooks, extensions ou groupes ST.

La question conserve le contexte de la page ou du fichier.

Chat Tabbit à cinq colonnes, avec Kimi-K3 dans la colonne centrale.

FAQ DE CONFIGURATION

Avant de toucher au réglage suivant

Quel est l’alias API officiel de Kimi K3 ?+

Le Quickstart officiel utilise kimi-k3 et l’exemple de base URL est https://api.moonshot.ai/v1. Vérifiez la liste du fournisseur, car les alias peuvent changer.

Quelle connexion choisir dans SillyTavern ?+

Utilisez Chat Completions compatible OpenAI pour la route Moonshot. Text completion suit un autre format.

Pourquoi Kimi K3 réfléchit-il si longtemps ?+

Dans l’API Moonshot, thinking reste actif. Si le fournisseur le permet, baissez reasoning_effort, raccourcissez les consignes et vérifiez la conservation du message assistant complet.

Un preset ou une extension prefill est-il nécessaire ?+

Non pour commencer. Testez d’abord la connexion propre et ajoutez une méthode communautaire quand le comportement à changer est clair.

Que faire avec les erreurs 429 ?+

Contrôlez niveau du compte, concurrence, RPM/TPM, état du fournisseur et retries répétés de SillyTavern.

Tabbit remplace-t-il SillyTavern ?+

Non. Tabbit sert à utiliser Kimi K3 à côté d’une page ou d’un fichier. Cards, lorebooks, extensions et groupes restent les fonctions de SillyTavern.

Tester le modèle avant de régler toute la pile

Gardez SillyTavern pour son workflow de personnages. Pour démarrer avec moins de configuration, ouvrez Tabbit, choisissez Kimi-K3 et apportez le contexte de la page.

Disponible sur macOS et Windows. L’accès et les quotas peuvent varier selon l’édition et le forfait.

© 2026 Tabbit Browser. Le navigateur natif IA qui comprend votre contexte.