TabbitBlog

Gemini 3.6 Flash: cambios, precio y por qué verificar importa más que el ranking

Gemini 3.6 Flash ofrece contexto de un millón de tokens, menos salida y herramientas multimodales, pero la cuota y la verificación definen el valor real.

En este artículo
  1. Decisión breve
  2. Ficha
  3. De 3.5 a 3.6, y la relación con 3.7
  4. Resultados y condiciones
  5. Precio, datos y autoevaluación
  6. Veredicto
  7. Fuentes

Gemini 3.6 Flash es un candidato razonable para un piloto multimodal de código, documentos y agentes acotados. Su valor no está solo en el benchmark: Google dice que usa menos tokens de salida que 3.5 Flash, mientras que la comunidad muestra que el ahorro solo aparece cuando el resultado se puede verificar barato.

El ancla es el lanzamiento de Google del 21-07-2026 y la tarjeta comprobada el 20-09: gemini-3.6-flash, entrada 1.048.576, salida 65.536, entrada de texto/imagen/vídeo/audio/PDF y fila Standard de pago de 1,50/7,50 dólares por millón. 3.7 y 3.8 son rutas vecinas, no sustituciones automáticas. Empieza por la página del modelo (English).

Decisión breve

  • Usa 3.6 cuando importen la multimodalidad, los ciclos rápidos y una menor salida.

  • El 17% menos de tokens es una comparación fechada, no un ahorro universal por tarea.

  • Mantén verificación independiente: Google lista alucinaciones, timeouts y corte de conocimiento.

  • Separa API, AI Studio/Antigravity, contratos empresariales y Tabbit.

  • Un agente con escritura necesita diff, tests y parada explícita antes de aceptar “verificado”.

Ficha

CampoEvidencia comprobadaLímite
IDgemini-3.6-flash estableConfirma el ID exacto en el cliente.
EntradasTexto, imagen, vídeo, audio y PDFEl cliente puede exponer menos.
Tokens1.048.576 entrada; 65.536 salidaUn plan puede ofrecer una ventana menor.
HerramientasCaché, código, computer use preview, búsqueda, funciones, grounding, JSON y URL contextEl soporte de API necesita cuenta y cliente compatibles.
Precio1,50 entrada / 7,50 salida por millónNivel gratuito, herramientas y retries tienen reglas propias.
CorteMarzo de 2026Los hechos actuales requieren fuentes.

Consulta qué es un navegador agéntico, la comparación de navegadores IA y las prácticas de Tabbit para separar producto y API.

De 3.5 a 3.6, y la relación con 3.7

Google presenta 3.6 como una mejora de 3.5: código, conocimiento y multimodalidad, con 17% menos salida en la comparación citada. El anuncio también muestra DeepSWE 49% frente a 37%, MLE-Bench 63,9% frente a 49,7%, OSWorld 83,0% frente a 78,4% y GDPval-AA Elo 1421 frente a 1349. Son comparaciones elegidas por el proveedor, no una auditoría independiente.

3.7 y 3.8 cambian la elección, pero no vuelven inútil a 3.6. Si termina una tarea acotada con menos bucles y una revisión rápida, la eficiencia importa. Para planificación autónoma larga, prueba una ruta posterior con el mismo fixture. Usa la guía de razonamiento agéntico para registrar esfuerzo, herramientas y correcciones.

Resultados y condiciones

La tarjeta de Google muestra SWE-Bench Pro 58,7%, DeepSWE 49%, Terminal-Bench 78,0%, MLE-Bench 63,9%, OSWorld-Verified 83,0%, CharXiv sin herramientas 85,2% y GDM-MRCR 1M 54,0%. Son familias de tareas distintas, no un índice único. La fila 1M es una medición puntual, no una promesa de que cada prompt enorme sea barato o estable. Conserva las condiciones en los prompts (English) y reviews (English), sin copiar prompts ajenos.

Promptslove describe 24 horas con OpenCode, high thinking y cuatro tareas: frontend, juego de navegador, constructor de formularios y vídeo de Instagram. El autor dice que funcionaron formularios, CSV, edición y vídeo, pero faltaron punteros de scroll, contadores, responsive y acabado visual en frontend. Es una muestra concreta, no un benchmark sustituto.

En Reddit, un usuario de Antigravity encontró velocidad y capacidad en tareas acotadas, pero señaló afirmaciones de verificación que no probaban el cambio y una acción peligrosa. Otro informó menos bucles y tokens, aunque una función omitió tests y reglas de Firebase. Un usuario de role-play elogió la escritura a temperatura 1; respuestas mencionan errores 400, rechazos y repetición en contexto largo. La supervisión también es coste. Consulta la colección de reseñas (English).

Precio, datos y autoevaluación

La fila Standard de pago era 1,50/7,50 dólares por millón; la salida incluye thinking. Google dice que el nivel gratuito puede usar el contenido para mejorar productos, mientras que el pagado no. Confirma región y términos antes de enviar datos sensibles. Caché, Search grounding, herramientas, reintentos y suscripciones son líneas distintas.

AI Studio, API, Antigravity, Android Studio y Enterprise pueden tener cuotas y controles distintos. Tabbit es otra ruta; automatización de navegador ayuda a diseñar la tarea, no convierte una sesión en una factura Gemini.

Google enumera alucinaciones, timeouts, trabajo de seguridad y corte de marzo de 2026. La comunidad añade tests omitidos, cuota y repetición. Para código usa repositorio, diff y tests; para documentos fecha y citas; para computer use una página desechable; para role-play compara continuaciones cortas y largas.

No se ejecutó una tarea autenticada en Tabbit ni se capturaron 4–8 pantallas aptas. Por tanto no afirmamos selector, contexto, latencia, cuota, suscripción o precio. Si el modelo aparece, extrae cinco hechos de una página pública y comprueba cada enlace antes de conceder escritura.

Tabbit Browser

Veredicto

Gemini 3.6 Flash es una opción de eficiencia para código multimodal y agentes acotados. Los datos de Google apoyan mejoras frente a 3.5, pero los informes independientes recuerdan que supervisión, cuota y verificación pueden borrar el ahorro. Haz un piloto con fixture fijo; pasa a 3.7 o 3.8 solo cuando la autonomía adicional compense la revisión.

Fuentes

Preguntas frecuentes

¿Qué es Gemini 3.6 Flash?

Es el modelo Flash multimodal estable de Google para código, conocimiento y agentes. Acepta texto, imágenes, vídeo, audio y PDF, con 1.048.576 tokens de entrada y 65.536 de salida.

¿Qué cambia frente a Gemini 3.5 Flash?

Google cita un 17% menos de tokens de salida en la comparación de Artificial Analysis y mejoras de código y multimodalidad. Es una comparación fechada, no una garantía de menor coste en cada tarea.

¿Cuánto cuesta?

El 20 de septiembre de 2026, la fila Standard de pago de Google mostraba 1,50 dólares por millón de tokens de entrada y 7,50 de salida. Herramientas, reintentos y las condiciones del nivel gratuito van aparte.

¿Sirve para agentes de código?

La tarjeta de Google indica 58,7% en SWE-Bench Pro, 78,0% en Terminal-Bench 2.1 y 83,0% en OSWorld-Verified. Los informes independientes favorecen tareas acotadas y supervisadas.

¿Qué limitaciones tiene?

Google menciona alucinaciones, lentitud o timeouts ocasionales, trabajo continuo de resistencia a jailbreaks y corte de conocimiento en marzo de 2026. La comunidad añade cuotas, tests omitidos y repetición.

¿Está disponible en Tabbit?

Este artículo no ejecutó una tarea autenticada de Gemini 3.6 Flash en Tabbit. Comprueba el selector y los términos de la cuenta; la API de Gemini no demuestra acceso de Tabbit.

Da el siguiente paso

Deja que Tabbit trabaje junto a ti.

Investiga entre pestañas, automatiza el trabajo repetitivo del navegador y mantén todo el contexto al alcance.