Kimi K3 n’est pas simplement un modèle à 3 dollars. La table API officielle affiche 3 $ par million de tokens d’entrée sans cache, 0,30 $ en cache et 15 $ en sortie. L’écriture du cache coûte 3 $ par million avec un TTL de cinq minutes et 6 $ avec un TTL d’une heure. Le chiffre qui change le budget est donc 5× : la sortie coûte cinq fois l’entrée non mise en cache.
Cette page explique le prix, pas la capacité du modèle. Pour les conditions de test, consultez la page Kimi K3 (English) et la collection de revues (English). Tabbit peut comparer les modèles visibles dans le compte actuel, mais ne transforme pas un abonnement en crédit API.
À retenir
API officielle en USD : 3 $/M en entrée, 0,30 $/M en cache, 15 $/M en sortie.
Un hit de cache est peu coûteux, mais la première écriture ne l’est pas.
Un abonnement est un quota de produit, pas un portefeuille de tokens.
K3 offre 1 048 576 tokens de contexte ; K2.6 en offre 262 144 à un tarif inférieur.
Les petites requêtes dépendent surtout de la sortie et des retries ; les longs contextes répétés dépendent du cache.
Tableau officiel
Carte tarifaire officielle de l’API
Cette carte concerne la facturation par token de l’API, pas l’abonnement Kimi. Il faut séparer entrée sans cache, hits, écriture et sortie. La fenêtre de contexte est une limite maximale, et non une consommation obligatoire à chaque requête ; les lignes K2.7 Code et K2.6 servent de comparaison dans la même table.
| Modèle | Entrée cache / 1M | Écriture 5 min / 1M | Écriture 1 h / 1M | Entrée / 1M | Sortie / 1M | Contexte |
|---|---|---|---|---|---|---|
| K3 | $0.30 | $3.00 | $6.00 | $3.00 | $15.00 | 1 048 576 |
| K2.7 Code | $0.19 | — | — | $0.95 | $4.00 | 262 144 |
| K2.6 | $0.16 | — | — | $0.95 | $4.00 | 262 144 |
Source : documentation tarifaire officielle, vérifiée le 20 septembre 2026. La page d’abonnement affiche Andante, Moderato, Allegretto et Allegro en CNY ; la formule annuelle est décrite comme plus avantageuse, avec jusqu’à ¥1 680 d’économie, et ce ne sont pas des tarifs API.page officielle
Offres grand public visibles aujourd’hui
| Offre | Mensuel | Ce que la page met en avant |
|---|---|---|
| Andante | ¥49 | Accès grand public et quota de produit |
| Moderato | ¥99 | Fonctions et quota supérieurs |
| Allegretto | ¥199 | Quota plus large pour un usage intensif |
| Allegro | ¥699 | Niveau personnel le plus élevé affiché |
Le chiffre important : 15 $ de sortie
Une longue réponse, une boucle d’Agent, une trace d’outil ou un retry augmentent la sortie. Utilisez les données usage du SDK lorsqu’elles existent :
Dire que la sortie est plus chère décrit le tarif, pas la répartition de chaque petite facture. Dans l’exemple de 10 000 tokens d’entrée et 2 000 de sortie, l’entrée et la sortie coûtent chacune 0,03 $. Le piège est de transformer 3 $/M en prix par tâche et d’oublier les sorties, retries, outils et boucles échouées.
coût = (entrée sans cache×3
+ entrée en cache×0,30
+ écriture×tarif
+ sortie×15) / 1 000 000
+ outils et taxesNe remplacez pas le nombre de tokens par le nombre de caractères visibles.
Pour un budget reproductible, conservez entrée sans cache, entrée en hit, tokens écrits, sortie, retries et outils. Vous pourrez ainsi distinguer une requête froide, une requête chaude et une boucle qui échoue au lieu de les mélanger dans un seul prix moyen.
Ce que dit la facturation officielle
La documentation tarifaire distingue les niveaux de facturation d’écriture de cinq minutes et d’une heure ; sans TTL indiqué, le niveau documenté par défaut est de cinq minutes. Le guide officiel de dépannage indique que l’API tente automatiquement la mise en cache : il n’est pas nécessaire d’envoyer un cache ID, un TTL ou un paramètre supplémentaire. La première écriture paie le tarif d’écriture ; un hit paie 0,30 $/M et renouvelle la durée de vie. Pour 500 000 tokens, la lecture froide coûte 1,50 $, le hit 0,15 $ et l’écriture d’une heure ajoute 3 $.règles API
Il n’est donc pas nécessaire de créer un cache ID ni d’activer manuellement le cache. Gardez le préfixe initial — prompt système, outils et documents — stable, puis vérifiez les données d’usage. Les TTL de la carte sont des niveaux de facturation et de conservation de l’écriture, pas des paramètres obligatoires pour chaque appel.
Trois budgets d’exemple
Ces exemples traduisent la carte officielle en calculs reproductibles ; ils excluent retries, outils, taxes et majorations du fournisseur.
Calcul local
Estimez le coût en tokens de l’API Kimi K3
Utilise les tarifs officiels en USD vérifiés le 20-09-2026. Les valeurs restent dans ce navigateur.
L’API tente la mise en cache automatiquement. Cette estimation sépare l’écriture des accès et exclut les nouvelles tentatives, outils, taxes et majorations. Vérifier les tarifs actuels
Le calcul se fait dans ce navigateur et n’envoie pas vos valeurs. Il sépare les hits automatiques de l’écriture du cache et exclut retries, outils, taxes et majorations ; vérifiez le tarif officiel avant de fixer un budget.
Petite entrée, courte réponse
10 000 tokens d’entrée et 2 000 de sortie donnent (10 000×3 + 2 000×15)/1 000 000 = 0,06 $ : l’entrée et la sortie apportent chacune 0,03 $. Pour une tâche unique, mesurez d’abord sortie et retries plutôt que de concevoir un cache rarement réutilisé.
Première lecture d’un long contexte
500 000 tokens sans cache et 20 000 de sortie coûtent 1,80 $. Si le préfixe est écrit, ajoutez le tarif d’écriture correspondant ; gardez le démarrage froid séparé des hits suivants.
Long contexte répété
Avec les mêmes 500 000 tokens en hit et 20 000 de sortie, le calcul descend à 0,45 $. L’économie porte sur l’entrée, tandis qu’une longue réponse ou une trace d’outil continue d’augmenter la sortie. Ce sont des exemples arithmétiques, pas une promesse de production.
Comparer la famille
K2.6 coûte moins cher, mais sa fenêtre est plus petite. Si la tâche tient dans 262k tokens, commencez par la guide des prompts API (English). Pour une boucle en plusieurs étapes, utilisez la guide de configuration Agent (English) et la revue de codage réel (English) afin de séparer planification, exécution et validation. Un tarif inférieur ne garantit pas un résultat interchangeable.
K2.7 Code affiche les mêmes tarifs que K2.6 dans cette table, mais son usage et son résultat doivent être testés séparément. Si la fenêtre de 262k oblige à tronquer, récupérer ou appeler de nouveau le modèle, le tarif par million ne représente plus tout le coût. Testez une réponse courte, une question sur un document long et une boucle avec outils avant de choisir uniquement sur le prix.
Abonnement, API ou navigateur
Les pages de membre, l’onglet API et la table développeur USD décrivent des surfaces différentes. Sur Reddit, certains trouvent les quotas trop serrés ; d’autres disent qu’un forfait cher permet des boucles d’Agent de plusieurs heures. Ce sont des expériences personnelles, pas des quotas vérifiés.retours communautaires (English)
L’abonnement convient aux fonctions et limites du produit ; l’API convient aux clés, données usage, politiques de retry et factures auditables ; le navigateur réunit pages, onglets et sélection de modèle. Ces surfaces ne partagent pas automatiquement leurs soldes. Un prix mensuel ne dit pas combien de boucles API sont possibles, et un tarif API ne définit pas les fonctions de l’abonnement.
u/thegodkingreal critique les limites. u/Timely_Impression_92 décrit des boucles de plusieurs heures, tandis que u/Moppmopp juge qu’un forfait de 200 dollars peut être consommé rapidement. u/the_stamp_collector dit utiliser Kimi pendant des heures sans problème. Web3 Wesley sur YouTube formule la question comme une alternative à Claude. Ce sont des témoignages personnels recueillis le 20 septembre 2026 ; la vidéo parle de trois mois avec l’offre Moonshot à 19 dollars aux côtés de Claude et Codex. Ils ne vérifient ni les quotas, ni la version actuelle, ni un ROI général.
Ce que la communauté observe
Le quota peut devenir le prix ressenti
Ces témoignages opposés décrivent des usages personnels, pas un quota publié.
u/thegodkingreal qualifie la limite de “ridiculous usage cap”, tandis que u/Moppmopp dit qu’un forfait de 200 dollars peut être consommé en une demi-journée. Ces messages parlent de boucles utiles, pas du tarif par token, et ne donnent ni quota vérifiable, ni contrat, ni preuve de version actuelle.
Le même forfait peut suffire à un autre usage
u/Timely_Impression_92 se dit satisfait d’un forfait de 200 dollars pour des boucles d’Agent de plusieurs heures ; u/the_stamp_collector dit utiliser Kimi pendant des heures chaque jour sans problème. Web3 Wesley pose la question du remplacement d’un abonnement Claude à 100 dollars et décrit trois mois avec l’offre Moonshot à 19 dollars aux côtés de Claude et Codex. Ce sont des expériences personnelles recueillies le 20 septembre 2026, pas un quota commun ni un ROI universel.
Une option pratique : comparer dans Tabbit
Si K3 est disponible dans le compte, ouvrez la page Kimi K3 de Tabbit (English) et la collection de prompts (English) pour comparer une même tâche.
Un protocole reproductible fixe le même prompt et les mêmes critères : réponse courte, question sur un long document, puis demande de code par étapes. Notez longueur, retries, corrections humaines et durée. Cela mesure l’adéquation de la tâche dans le navigateur ; ce n’est ni une facture Kimi ni une garantie d’accès pour tous les comptes.

L’article sur le contexte 1M de GPT-5.6 Sol offre un autre exemple, mais ce n’est pas une source de prix K3.
Tableau de décision
| Charge | Coût dominant | Point de départ | Limite |
|---|---|---|---|
| Petite entrée et réponse | Sortie et retries | API avec limite de sortie | La sortie vaut 5× l’entrée |
| Préfixe long répété | Écriture, TTL et hits | API avec journal des hits et écritures | Une écriture froide n’est pas un hit |
| Plus de 262k tokens | Contexte et appels | Comparer K3 au découpage | Le tarif élevé peut réduire les appels |
| Agent en arrière-plan | Sortie, quota et concurrence | Tester une boucle réelle | L’usage varie selon les personnes |
| Recherche ponctuelle | Fonctions et quota | Comparer la page actuelle | Abonnement ≠ API |
| Travail multimodèle dans le navigateur | Accès, adéquation et temps de configuration | Tester les modèles pris en charge dans Tabbit | Dépend du compte et de l’édition |
Verdict
Choisissez K3 quand son contexte d’un million de tokens et sa capacité justifient les 15 $/M de sortie. Sinon, testez un modèle moins cher avec les mêmes critères d’acceptation. Faites trois budgets — requête froide, hit de cache, boucle avec retry — puis relisez le tarif API officiel et la page d’abonnement.
Les chiffres sont une photographie vérifiée le 20 septembre 2026. Les tarifs USD, plans CNY, taxes, région, éligibilité, outils et disponibilité peuvent évoluer séparément. Conservez la date de chaque carte et l’usage réel ; les témoignages communautaires et un essai dans Tabbit servent à préparer un pilote, pas à remplacer les sources officielles.
Questions fréquentes
Quel est le tarif officiel de l’API Kimi K3 ?
La table officielle indique 3 dollars par million de tokens d’entrée non mis en cache, 0,30 dollar par million en cache et 15 dollars par million en sortie. Les écritures de cache sont facturées séparément selon le TTL.
L’entrée en cache est-elle dix fois moins chère ?
Oui pour cette ligne tarifaire : 0,30 dollar par million contre 3 dollars sans cache. La première écriture et les tokens de sortie doivent néanmoins être ajoutés au calcul.
L’écriture du cache Kimi K3 est-elle facturée ?
Oui. La table officielle sépare l’écriture de cinq minutes et celle d’une heure. L’API tente automatiquement la mise en cache et ne demande ni cache ID, ni TTL, ni paramètre supplémentaire ; l’écriture et le hit suivant ont des tarifs distincts.
Un abonnement Kimi donne-t-il du crédit API ?
Non. L’abonnement fournit des fonctions et des quotas de produit, tandis que l’API est facturée au token. La page personnelle actuelle affiche Andante à ¥49/mois, Moderato à ¥99, Allegretto à ¥199 et Allegro à ¥699 ; la facturation annuelle est seulement décrite comme plus avantageuse, avec jusqu’à ¥1 680 d’économie : vérifiez le montant exact en direct.
Kimi K3 est-il toujours le choix le moins cher ?
Non. K2.6 est moins cher dans la table officielle, mais sa fenêtre est de 262 144 tokens contre 1 048 576 pour K3. Il faut inclure le nombre d’appels et la qualité attendue.
Le prix de Kimi K3 peut-il changer ?
Oui. Les taxes, la région, l’éligibilité, les quotas et les outils peuvent évoluer séparément. Vérifiez les pages officielles avant l’achat.