El precio de Gemini 3.8 Flash depende del uso real. Hasta el 31 de diciembre de 2026, el API Standard cobra 0,75 USD por millón de tokens de entrada y 3,75 USD por millón de tokens de salida. La salida ya incluye thinking. La lectura de caché cuesta 0,075 USD y guardar la caché cuesta 0,50 USD por millón de tokens-hora. Desde el 1 de enero de 2027, Google publica el doble de esas tarifas Standard.
La fórmula es: (entrada sin caché×tarifa + lectura de caché×tarifa + salida con thinking×tarifa)/1.000.000 + almacenamiento. La suscripción de Gemini y el coste de Tabbit no son créditos del API.

Puntos clave
Thinking se cuenta una sola vez dentro de la salida.
Batch y Flex son modos separados; sus descuentos no se multiplican.
El presupuesto mensual incluye tareas, reintentos, herramientas y horas de almacenamiento.
Consulta la página oficial de precios y la página del modelo.
Tarifas
| Concepto | Hasta 2026-12-31 | Desde 2027-01-01 | Unidad |
|---|---|---|---|
| Entrada Standard | $0.75 | $1.50 | 1M tokens |
| Salida Standard, incluido thinking | $3.75 | $7.50 | 1M tokens |
| Lectura de caché | $0.075 | $0.15 | 1M tokens |
| Almacenamiento de caché | $0.50 | $1.00 | 1M tokens-hora |
| Entrada Batch | $0.375 | $0.75 | 1M tokens |
| Salida Batch | $1.875 | $3.75 | 1M tokens |
| Lectura Batch | $0.0375 | $0.075 | 1M tokens |
La tabla de Google separa Standard, Batch, Flex y Priority. Que el modelo admita Batch o Flex no cambia automáticamente una petición Standard.
Dos ejemplos reproducibles
Para 200.000 tokens de entrada sin caché y 20.000 tokens de salida total, en Standard 2026:
(0,2×$0,75) + (0,02×$3,75) = $0,225 por tarea100 tareas cuestan $22,50. Con un multiplicador de reintento de 1,2, el presupuesto es $22,50×1,2=$27,00, sin herramientas. En 2027, la misma tarea cuesta $0,45.
Para una caché de 900.000 tokens durante 10 horas, cada tarea lee 900.000 tokens, añade 100.000 sin caché y genera 30.000 de salida:
tokens = (0,1×$0,75)+(0,9×$0,075)+(0,03×$3,75) = $0,255
almacenamiento = 0,9×10×$0,50 = $4,50Con 20 tareas en esa ventana: $4,50+(20×$0,255)=$9,60. Leer la caché y almacenarla son cargos distintos.
Batch, Flex, herramientas y reintentos
Batch sirve para trabajos que pueden esperar. Flex es otro modo seleccionado por separado; comprueba su fila actual en la página oficial. Search grounding, Maps, URL context, Code execution y File Search tienen reglas adicionales. La sección de herramientas explica qué entra en tokens y qué tiene tarifa propia.
Usa tareas correctas×coste por tarea×multiplicador de reintento + herramientas + almacenamiento para el presupuesto mensual. No trates automáticamente una ejecución fallida como coste cero.
Tabbit como capa de navegador
Tabbit Browser puede ayudar a organizar páginas para una investigación; consulta AI browser, navegador agentic, automatización y recursos del modelo (English). En la prueba, el selector de un cliente mostró Gemini-3.8-Flash, pero una tarea nueva dio error de carga y no terminó ninguna inferencia. No es prueba de acceso en producción ni de un precio de Tabbit.
La guía general, la reseña y las alternativas cubren acceso, evidencia y selección. Compara también opciones de navegadores IA. Mantén API, suscripción y producto separados.
Comparación de cargas
| Carga | Estimación 2026 (USD) | No incluido |
|---|---|---|
| 100 tareas sin caché; 1,2 intentos por éxito | 27.00 | Herramientas y creación de caché cuando corresponda |
| 20 tareas con caché en 10 horas; sin reintentos | 9.60 | Herramientas y creación de caché cuando corresponda |
Qué aportan los creadores
NERD UP se centra en el consumo de tokens y el coste oculto; Bijan Bowen muestra tareas de código y navegador. Solo se usan los títulos y capítulos visibles, no facturas ni pruebas comparables. El presupuesto debe contar los reintentos y toda la salida.
C_tokens = (I_uncached × P_input + I_cached × P_cached + O_total × P_output) / 1,000,000
C_total = sum(C_tokens for ALL attempts) + C_storage + C_tools
C_success = C_total / N_success [N_success > 0]Cuente todos los intentos facturables, incluidos los fallidos; añada almacenamiento y herramientas una sola vez. Sin tareas exitosas no se define un coste por éxito.
Debate comunitario sobre el coste por tarea
En un debate del mismo día en Hacker News aparecen dos lecturas: gundmc defiende comparar coste por tarea, mientras bermudi y criley2 señalan que más tokens de salida y distintos niveles de esfuerzo pueden cambiar el orden. Son opiniones sobre vistas enlazadas de Artificial Analysis, no un ranking reproducido aquí.
Comentarios originales: gundmc (2 sep.), bermudi (2 sep.), criley2 (2 sep.) y criley2 (3 sep.).




La conclusión práctica es registrar el esfuerzo y la salida total antes de aplicar la tarifa oficial.
Escalera familiar, esfuerzo y límites de cobro
En la tabla Standard de 2026, Gemini 3.8 Flash, 3.7 Flash y 3.6 Flash aparecen con $0,75 de entrada, $3,75 de salida y $0,075 de lectura de caché por millón de tokens. La misma tarifa no significa la misma calidad, latencia o disponibilidad. El coste real depende de la proporción en caché, la salida total (incluido thinking), las rondas y los reintentos. Reducir el esfuerzo solo ahorra si reduce la salida sin perder un resultado útil.
Thinking está incluido en la salida; leer caché no es lo mismo que almacenarla. Batch y Flex son modos separados y sus tarifas de tokens publicadas para 2026 no se acumulan. Search, Maps, URL context y File Search tienen reglas propias. Un intento fallido puede consumir tokens facturables.
Dos cargas de trabajo con supuestos explícitos
Tarifas Standard de 2026. La salida incluye el razonamiento una sola vez; se excluyen almacenamiento, herramientas, reintentos e impuestos. Con las tarifas Standard de 2027 publicadas, los totales mensuales de tokens serían 30 y 36 dólares.
| Carga | Entrada por tarea | Porcentaje en caché | Salida total por tarea | Tareas al mes | Coste mensual de tokens |
|---|---|---|---|---|---|
| Extracción breve | 10,000 | 0% | 2,000 | 1,000 | $15 |
| Análisis repetido de documentos | 1,000,000 | 90% | 10,000 | 100 | $18 |
Cálculo local
Estima el coste mensual de tokens
Tarifas API Standard hasta el 31-12-2026. Incluye el razonamiento una sola vez en la salida. Los valores permanecen en el navegador.
Excluye almacenamiento, herramientas, reintentos e impuestos. Igual tarifa no implica igual consumo por tarea. Revisado: 20-09-2026. Consultar tarifas actuales
El cálculo ocurre localmente, compara tres modelos conocidos y no convierte datos desconocidos en cero. Excluye almacenamiento, herramientas, reintentos e impuestos. Comprueba la tabla oficial antes de cerrar un presupuesto.
Después del cálculo, elige dónde ejecutar el flujo
Tabbit Browser puede servir para organizar páginas y contexto; consulta su página del modelo Gemini 3.8 Flash (English). En Tabbit Browser Dev, con una cuenta autenticada del sitio de prueba, una tarea de extracción de registros de pago devolvió correctamente cuatro campos: currency, paid_total, overdue_ids y unknown_status_ids. La interfaz mostró la marca Google Search, pero no se verificó de forma independiente si se ejecutó una búsqueda; tampoco se midieron coste, tiempo o estabilidad.

Fuentes y siguiente paso
Verifica la tarifa de Gemini API y la documentación de Gemini 3.8 Flash. Si el trabajo cruza el 1 de enero de 2027, duplica las líneas Standard de tokens y caché antes de sustituir las hipótesis con tus registros.
Preguntas frecuentes
¿Cuánto cuesta Gemini 3.8 Flash antes del 31 de diciembre de 2026?
El precio Standard es de 0,75 USD por millón de tokens de entrada y 3,75 USD por millón de tokens de salida, incluido thinking. La lectura de caché cuesta 0,075 USD y el almacenamiento 0,50 USD por millón de tokens-hora.
¿Se cobra thinking aparte?
No. Google incluye los tokens de thinking en el precio de salida. Súmalos una sola vez al total de salida.
¿Qué cambia en 2027?
Desde el 1 de enero de 2027, las tarifas Standard pasan a 1,50 USD de entrada, 7,50 USD de salida, 0,15 USD de lectura de caché y 1,00 USD por millón de tokens-hora.
¿Se pueden combinar Batch y Flex?
No. Son modos distintos. Elige uno y aplica su propia tabla de precios.
¿Una suscripción de Gemini o Tabbit paga la API?
No. La suscripción de consumidor, la cuenta de Gemini Developer API y las condiciones de Tabbit son productos separados.
¿Cómo incluyo los reintentos?
Multiplica el coste de una ejecución correcta por el número esperado de intentos y añade herramientas y almacenamiento. Una llamada fallida también puede consumir tokens facturables.