Gemini 3.8 Flash merece seguir en la lista. Google publica entrada multimodal, 1.048.576 tokens de entrada, 65.536 de salida y tres niveles de pensamiento: low, medium y high. La razón para cambiar debe ser concreta: la ruta no está disponible, las herramientas no encajan o el coste por tarea no sirve.
El dato clave es el mismo precio: Google publica para 3.7 y 3.8 Flash tarifas Standard de 2026 de 0,75 dólares de entrada y 3,75 de salida por millón de tokens. Volver a la generación anterior no reduce por sí solo la tarifa; importan el volumen, los reintentos y el ajuste a la tarea. (Google)
El resumen de Gemini 3.8 cubre el modelo; aquí solo decidimos si conviene cambiar.
Decisiones rápidas
Uso cuatro criterios: coste de una tarea terminada, ruta de respuesta tolerable, ajuste del proveedor y del despliegue, y evidencia original verificable. Los comentarios son experiencias personales; no prueban precio, rendimiento ni superioridad.
Gemini 3.7 Flash reduce la migración.
GPT-5.6 Luna sirve para un piloto de precio.
Claude Sonnet 5 encaja con herramientas Anthropic.
DeepSeek V4.1 Flash ofrece contexto 1M, dos modos y precios horarios.
Cómo seleccioné las alternativas
Uso cuatro criterios: coste de una tarea terminada, ruta de respuesta tolerable, ajuste del proveedor y del despliegue, y evidencia original verificable. Los comentarios son experiencias personales; no prueban precio, rendimiento ni superioridad.
Cuatro candidatos
| Candidato | Mejor para | Ruta publicada | Precio | Principal límite |
|---|---|---|---|---|
| Gemini 3.7 Flash | Migración pequeña | gemini-3.7-flash; 1.048.576 / 65.536 | $0.75 / $3.75 por 1M | Generación anterior |
| GPT-5.6 Luna | Piloto API por precio | gpt-5.6-luna; 1,05M / 128K | $0.20 / $1.20 por 1M | Multiplicadores con entradas grandes |
| Claude Sonnet 5 | Pensamiento adaptativo | claude-sonnet-5; 1M / 128K | $2 / $10 por 1M | Precio de lista mayor |
| DeepSeek V4.1 Flash | Contexto amplio y precio horario | deepseek-flash; 1M / 384K | off-peak $0.003/$0.15/$0.60; peak $0.006/$0.30/$1.20 | Horario y residencia |
Gemini 3.7 Flash: cambio mínimo
Mejor para: conservar entradas multimodales y controles thinking de Gemini.
Ventajas: Google publica entrada de texto, imagen, vídeo, audio y PDF, funciones, ejecución de código, búsqueda de archivos y computer-use preview. handzhiev lo llamó “my workhorse”, es decir, “mi modelo de trabajo”; se refiere a 3.7 y no es benchmark.

Desventajas: es la generación anterior; tener el mismo precio público que 3.8 no garantiza el mismo ajuste.
Precio: $0.75 entrada / $3.75 salida por 1M hasta 2026-12-31.
Veredicto: elígelo para una migración pequeña; conserva 3.8 si la tarea necesita la generación nueva.
GPT-5.6 Luna: precio primero
Mejor para: un piloto API de alto volumen guiado por coste.
Ventajas: 1,05M de contexto, salida 128K, funciones, búsqueda web/archivos, computer use y precio base $0.20/$1.20. gundmc lo llama su modelo de trabajo; es una preferencia personal.

Desventajas: hay multiplicadores sobre 272K tokens de entrada; refactor_master describe una tarea de código que exigió demasiada guía.

Precio: calcula además salida, entradas largas, herramientas, reintentos y supervisión.
Veredicto: elígelo si la economía API domina y el piloto cabe en el presupuesto de supervisión.
Claude Sonnet 5: pensamiento adaptativo
Mejor para: adaptive thinking y herramientas de Anthropic.
Ventajas: 1M de contexto, salida 128K, visión, multilingüe y herramientas. doctoboggan y jsnell discrepan sobre las curvas de coste por effort; son opiniones, no benchmarks reproducidos.


Desventajas: $2/$10 cuesta más que Luna y la API es distinta de la suscripción.
Precio: $2 entrada / $10 salida por 1M.
Veredicto: elígelo cuando la ruta Anthropic encaje mejor.
DeepSeek V4.1 Flash: precio por horario
Mejor para: contexto 1M, modos thinking/non-thinking, visión y tarifas programadas.
Ventajas: la página actual lista deepseek-flash / DeepSeek-V4.1-Flash, salida máxima 384K, JSON, llamadas de herramientas, Responses API, Anthropic API y visión. eli dijo “good and very fast” sobre un endpoint preview temporal; es experiencia de preview, no benchmark.

Desventajas: peak es 01:00–04:00 y 06:00–10:00 UTC entre semana, salvo festivos chinos; aftbit habla de una transición antigua de Pro, no del precio actual de Flash.

Precio: off-peak cache hit/miss/salida $0.003/$0.15/$0.60; peak $0.006/$0.30/$1.20 por 1M.
Veredicto: elígelo si aceptas horario, región, residencia y posibles cambios de precio.
| Restricción | Primer piloto | Comprobación |
|---|---|---|
| Mantener multimodalidad Gemini | Gemini 3.7 | SDK, herramientas, región |
| Bajar precio API | Luna | Coste por tarea terminada |
| Pensamiento adaptativo | Sonnet 5 | Funciones y migración |
| Contexto 1M y tarifas horarias | DeepSeek V4.1 Flash | Peak, caché, residencia |
Tabbit Browser: una prueba limitada
Una extracción sintética devolvió cuatro campos esperados: currency USD, paid_total 145, overdue_ids B y unknown_status_ids D. La interfaz también mostró una marca de Google Search. La muestra fue de una tarea; no se midieron thinking, tokens, coste ni TTFT, ni se verificó si se envió una búsqueda. Es una comprobación de corrección, no una prueba de rendimiento.

Tabbit Browser, qué es un navegador agentic, automatización del navegador y opciones de navegadores IA ayudan a validar el contexto. Recursos: Gemini 3.7 (English), Luna (English), Sonnet 5 (English).
Piloto con la misma tarea
Congela entradas, instrucciones, herramientas, contrato de salida, reintentos y facturación. Registra primer token, tiempo total, tokens, errores, correcciones y coste de la tarea terminada. Repite antes de decidir.
Veredicto
Gemini 3.8 Flash merece seguir en la lista. Google publica entrada multimodal, 1.048.576 tokens de entrada, 65.536 de salida y tres niveles de pensamiento: low, medium y high. La razón para cambiar debe ser concreta: la ruta no está disponible, las herramientas no encajan o el coste por tarea no sirve. No hay un ganador universal.
Preguntas frecuentes
¿Cuál es la alternativa más cercana a Gemini 3.8 Flash?
Gemini 3.7 Flash es el sustituto de la misma familia más cercano: Google publica tipos de entrada, límites y niveles de pensamiento parecidos. Sigue siendo otro modelo, así que hay que probar la misma tarea.
¿Qué alternativa tiene el precio API publicado más bajo?
No hay una ruta siempre más barata. DeepSeek V4.1 Flash cobra 0,15/0,60 dólares por millón de tokens de entrada sin caché/salida fuera de hora punta, frente a 0,20/1,20 de Luna. En hora punta cobra 0,30/1,20, por lo que Luna tiene menor precio de entrada sin caché. Caché, entradas largas, reintentos y herramientas cambian el coste por tarea.
¿Los cuatro modelos tienen las mismas herramientas?
No. Google, OpenAI, Anthropic y DeepSeek publican capacidades distintas. Comprueba la API, el cliente, la región y la cuenta que realmente usarás.
¿Puedo comparar una suscripción de chat con precios API?
No directamente. Las suscripciones, los asientos de equipo, los tokens API y un cliente de navegador usan unidades distintas. Calcula el coste de la misma tarea completada.
¿El benchmark de Gemini 3.8 se puede comparar con los demás?
No con los datos de este artículo. La captura de Artificial Analysis es v4.3.2, consultada el 20 de septiembre de 2026, y está separada por nivel de pensamiento.
¿Gemini 3.8 Flash está disponible en Tabbit Browser?
Una prueba mostró Gemini-3.8-Flash en el selector y una extracción sintética devolvió los cuatro campos JSON esperados; la interfaz también mostró una marca de Google Search. No es una prueba de rendimiento ni confirma disponibilidad, latencia, coste o herramientas en producción.