Kimi K3 no es simplemente un modelo de 3 dólares. La tabla oficial muestra 3 $ por millón de entrada sin caché, 0,30 $ por millón de entrada en caché y 15 $ por millón de salida. La escritura de caché cuesta 3 $ por millón con TTL de cinco minutos y 6 $ con TTL de una hora. La cifra que cambia el presupuesto es 5×: la salida cuesta cinco veces la entrada sin caché.
Esta guía cubre precios, no vuelve a evaluar capacidades. Consulta la página del modelo Kimi K3 (English) y la colección de reseñas (English) para las condiciones de las pruebas. Tabbit puede servir para comparar modelos disponibles en la cuenta actual, pero no convierte una suscripción en crédito de API.
Resumen rápido
API oficial en USD: 3 $/M de entrada, 0,30 $/M en caché y 15 $/M de salida.
Una lectura en caché es barata, pero la primera escritura no es gratis.
La membresía es una cuota de producto, no una cartera de tokens.
K3 tiene 1.048.576 tokens de contexto; K2.6 aparece con 262.144 y tarifas menores.
En prompts cortos suelen pesar la salida y los reintentos; en contexto repetido pesa la caché.
Tarifas oficiales de Kimi K3
Tarjeta oficial de tarifas API
Esta tabla corresponde a la factura por tokens de la API, no a la cuota mensual de Kimi. Separa entrada sin caché, aciertos, escritura y salida; la ventana de contexto es un límite máximo, no el consumo obligatorio de cada solicitud. Las filas K2.7 Code y K2.6 sirven como referencia dentro de la misma tabla oficial.
| Modelo | Entrada en caché / 1M | Escritura 5 min / 1M | Escritura 1 h / 1M | Entrada / 1M | Salida / 1M | Contexto |
|---|---|---|---|---|---|---|
| K3 | $0.30 | $3.00 | $6.00 | $3.00 | $15.00 | 1,048,576 |
| K2.7 Code | $0.19 | — | — | $0.95 | $4.00 | 262,144 |
| K2.6 | $0.16 | — | — | $0.95 | $4.00 | 262,144 |
Fuente: documentación oficial de precios, comprobada el 20 de septiembre de 2026. La página de membresía muestra Andante, Moderato, Allegretto y Allegro en CNY; la anualidad se describe como más favorable, con un ahorro de hasta ¥1.680, y no debe convertirse directamente a tarifas de API.página oficial de membresía
Planes de consumo visibles hoy
| Plan | Mensual | Enfoque de la página |
|---|---|---|
| Andante | ¥49 | Acceso de consumo y cuota de producto |
| Moderato | ¥99 | Más funciones y cuota de producto |
| Allegretto | ¥199 | Cuota mayor para uso intensivo |
| Allegro | ¥699 | Nivel personal más alto visible |
La cifra que manda: 15 $ por millón de salida
El precio de entrada aparece en titulares, pero una respuesta larga, un bucle de Agent o un reintento aumenta la salida. Usa esta fórmula y guarda los campos de uso del SDK cuando existan:
“La salida domina” describe la diferencia de tarifas, no todos los totales. En el ejemplo de 10.000 tokens de entrada y 2.000 de salida, cada lado aporta 0,03 $. El error más común es convertir los 3 $/M de entrada en un precio por tarea y olvidar las respuestas, los retries, las herramientas y las vueltas fallidas.
coste = (entrada sin caché × 3
+ entrada en caché × 0,30
+ escritura × tarifa correspondiente
+ salida × 15) / 1.000.000
+ herramientas e impuestosNo sustituyas tokens por caracteres visibles. Si solo tienes una aproximación, etiquétala como tal.
Para un presupuesto reproducible guarda entrada sin caché, entrada con acierto, tokens escritos, salida, número de reintentos y herramientas. Con esos campos puedes separar una solicitud fría, una solicitud cálida y un bucle fallido en vez de esconderlos en un promedio único.
Qué dice la facturación oficial
La documentación de precios distingue niveles de facturación de escritura de cinco minutos y de una hora; si no se especifica TTL, el precio documentado toma cinco minutos como valor predeterminado. La guía oficial de troubleshooting dice que la API intenta usar la caché automáticamente: no hace falta enviar un cache ID, TTL ni parámetro adicional. La primera escritura paga la tarifa de escritura; un acierto posterior paga 0,30 $/M y renueva la vida sin otra escritura para ese acierto. Para 500.000 tokens, la lectura fría cuesta 1,50 $, el acierto 0,15 $ y una escritura de una hora añade 3 $.reglas de facturación
Por tanto, no hace falta crear un cache ID ni activar manualmente la función. Mantén estable el prefijo inicial —prompt del sistema, herramientas y documentos— y comprueba el uso real. Los TTL de la tabla son niveles de facturación y retención de la escritura, no parámetros que cada llamada deba enviar.
Tres presupuestos de ejemplo
Estos ejemplos convierten la tarjeta oficial en números que puedes recalcular; excluyen retries, herramientas, impuestos y recargos del proveedor.
Cálculo local
Estima el coste de tokens de la API Kimi K3
Usa las tarifas oficiales en USD verificadas el 20-09-2026. Los valores permanecen en este navegador.
La API intenta almacenar en caché automáticamente. La estimación separa la escritura de los aciertos y excluye reintentos, herramientas, impuestos y recargos. Ver tarifas actuales
El cálculo se ejecuta en este navegador y no envía tus valores. Separa los aciertos automáticos de la escritura de caché y excluye retries, herramientas, impuestos y recargos; comprueba la tarifa oficial antes de fijar un presupuesto.
Prompt corto y respuesta corta
10.000 tokens de entrada y 2.000 de salida cuestan (10.000×3+2.000×15)/1.000.000 = 0,06 $: entrada y salida aportan 0,03 $ cada una. En una tarea única, medir salida y retries suele ser más útil que diseñar una caché que casi nunca se reutiliza.
Primera lectura de un contexto largo
500.000 tokens sin caché y 20.000 de salida cuestan 1,80 $. Si el prefijo se escribe, añade la tarifa de escritura correspondiente; separa el arranque frío de las solicitudes posteriores.
Contexto largo repetido
Con los mismos 500.000 tokens en un acierto y 20.000 de salida, el cálculo baja a 0,45 $. El ahorro está en la entrada, pero una respuesta larga o una traza de herramientas sigue aumentando la salida. Son ejemplos matemáticos, no una garantía de producción.
Escalera de modelos
K2.6 es más barato en la tabla oficial, pero su contexto es menor. Si tus datos caben en 262k tokens, prueba primero una tarea con criterios de aceptación usando la guía de prompts de API (English). Para una secuencia de varios pasos, consulta la guía de configuración de Agent (English) y la evaluación de codificación real (English). Un precio menor no demuestra que el resultado sea intercambiable.
K2.7 Code comparte en esa tabla las tarifas de K2.6, pero la etiqueta, la ventana y el resultado práctico siguen necesitando una prueba separada. Si un límite de 262k obliga a truncar, recuperar o llamar otra vez, el precio por millón puede dejar de ser el coste total más importante. Prueba una respuesta corta, una pregunta sobre documentos largos y un loop con herramientas antes de elegir por precio.
Suscripción, API o navegador
Las páginas oficiales separan las membresías, la pestaña API y la tabla de desarrolladores. Además, muestran monedas y condiciones distintas. En Reddit, unos usuarios describen las cuotas como el problema principal; otros dicen que un plan caro sostiene bucles de Agent durante horas. Son experiencias personales, no cuotas verificadas.reseña comunitaria (English)
La membresía sirve para funciones y límites del producto; la API sirve para claves, usage, reintentos y una factura auditable; el navegador reúne páginas, pestañas y selección de modelo. Ninguna de esas superficies convierte automáticamente un saldo en otro. Un precio mensual no permite inferir cuántos loops de API caben, y una tarifa API no define las funciones de la membresía.
La publicación de u/thegodkingreal critica los límites. u/Timely_Impression_92 describe bucles de varias horas, mientras u/Moppmopp dice que un plan de 200 dólares puede agotarse rápidamente. u/the_stamp_collector informa de horas de uso sin problemas. Web3 Wesley en YouTube plantea la comparación con Claude. Son voces personales, recopiladas el 20 de septiembre de 2026; el vídeo habla de tres meses con el plan Moonshot de 19 dólares junto a Claude y Codex. No verifican cuotas, versión actual ni ROI general.
Lo que observa la comunidad
La cuota se puede sentir como el precio
Estos relatos muestran opiniones opuestas sobre la misma superficie de precio; no sustituyen una cuota publicada.
u/thegodkingreal califica el límite de uso de “ridiculous usage cap”, mientras u/Moppmopp dice que un plan de 200 dólares puede agotarse en medio día. Ambos relatos apuntan al número de loops útiles que una persona puede terminar, no a la tarifa por token. No incluyen una cuota verificable, un contrato o una prueba de versión actual.
El mismo plan puede bastar para otra carga
u/Timely_Impression_92 dice estar satisfecho con un plan de 200 dólares para loops de Agent de varias horas; u/the_stamp_collector afirma usar Kimi durante horas cada día sin problemas. Web3 Wesley plantea si Kimi Code puede sustituir una suscripción de Claude de 100 dólares y describe tres meses con el plan Moonshot de 19 dólares junto a Claude y Codex. Son testimonios fechados y personales, no una cuota común ni un ROI universal.
Una opción práctica: comparar en Tabbit
Si la cuenta actual permite usar K3, puedes abrir la página de Kimi K3 en Tabbit (English), revisar la colección de prompts (English) y comparar una misma tarea con varios modelos. La comparación ayuda a definir el trabajo; no revela una cuota oculta ni garantiza acceso.
Un flujo repetible fija el mismo prompt y la misma aceptación: primero una respuesta corta, después una pregunta sobre un documento largo y finalmente una solicitud de código por etapas. Registra longitud, retries, correcciones humanas y tiempo de finalización. Eso prueba la adecuación de la tarea en el navegador; no es una factura de Kimi ni garantiza que el modelo esté disponible en todas las cuentas.

Para otra discusión de contexto largo, consulta el artículo de GPT-5.6 Sol, que no es una fuente de precios de K3.
Tabla de decisión
| Carga | Coste dominante | Primer camino | Riesgo |
|---|---|---|---|
| Prompt y respuesta cortos | Salida y reintentos | API con límite de salida | La salida vale 5× la entrada |
| Prefijo largo repetido | Escritura, TTL y aciertos | API con registro de hits y escrituras | La escritura fría no es un acierto |
| Más de 262k tokens | Contexto y número de llamadas | Comparar K3 con truncamiento | El modelo caro puede reducir llamadas |
| Bucle de Agent | Salida, cuota y concurrencia | Probar un bucle representativo | La experiencia varía entre usuarios |
| Investigación ocasional | Funciones y cuota de membresía | Comparar la página actual | Membresía no es facturación de API |
| Trabajo multimodelo en navegador | Acceso, ajuste y tiempo de configuración | Probar modelos compatibles en Tabbit | Depende de la cuenta y la edición actuales |
Veredicto
Presupuesta K3 cuando su contexto de 1M y su capacidad compensen la línea de 15 $/M de salida. Si el trabajo cabe en K2.6 y pasa tus pruebas, mide primero la opción barata. Construye tres escenarios: solicitud fría, solicitud con caché y bucle con reintento; después vuelve a comprobar la tarifa API oficial y la página de membresía.
Las cifras son una instantánea comprobada el 20 de septiembre de 2026. Tarifas USD, planes CNY, impuestos, región, elegibilidad, herramientas y disponibilidad pueden cambiar por separado. Guarda la fecha de cada tarifa y el usage real; la comunidad y una prueba en Tabbit sirven para diseñar un piloto, no para reemplazar las fuentes oficiales.
Preguntas frecuentes
¿Cuál es el precio oficial de la API de Kimi K3?
La tabla oficial muestra 3 dólares por millón de tokens de entrada sin caché, 0,30 dólares por millón de entrada en caché y 15 dólares por millón de salida. Las escrituras de caché se cobran aparte según el TTL.
¿Cuánto ahorra una entrada en caché?
La entrada con caché cuesta 0,30 dólares por millón frente a 3 dólares sin caché. Es una diferencia de diez veces en esa línea, pero la primera escritura y la salida siguen contando.
¿Kimi K3 cobra la escritura de caché?
Sí. La tabla oficial separa la escritura de cinco minutos y de una hora. La API intenta usar caché automáticamente y no requiere cache ID, TTL ni parámetro extra; una escritura y un acierto posterior se cobran de forma distinta.
¿Una suscripción de Kimi incluye crédito de API?
No. La suscripción ofrece funciones y cuotas de producto, mientras que la API factura por tokens. La página personal actual muestra Andante a ¥49/mes, Moderato a ¥99, Allegretto a ¥199 y Allegro a ¥699; la facturación anual solo se describe como más favorable, con un ahorro de hasta ¥1.680, así que hay que comprobar el importe exacto en vivo.
¿Kimi K3 puede salir más caro que K2.6?
Sí. K2.6 aparece con tarifas menores y una ventana de 262.144 tokens, mientras que K3 ofrece una ventana de 1.048.576 tokens. La comparación debe incluir llamadas, truncamiento y calidad aceptable.
¿Puede cambiar el precio de Kimi K3?
Sí. Región, impuestos, elegibilidad, cuotas y herramientas pueden cambiar por separado. Comprueba las páginas oficiales antes de presupuestar o comprar.