Gemini 3.8 Flash é o modelo Flash estável do Google, lançado em 2 de setembro de 2026 para engenharia de software de longa duração, agentes autónomos e fluxos empresariais complexos. Gemini 3.8 Flash Cyber é uma variante separada e restrita. API, AI Studio, produtos empresariais e subscrições têm regras diferentes. (Google)
O número que exige atenção: 1.048.576
Os 1.048.576 tokens de entrada publicados pelo Google são o limite do Gemini API. Não são a cota garantida de todo navegador, assinatura ou conta. Confirme o modelo e a rota; depois use a análise e o guia de preços para escolher a tarefa. (Google)

Você pode usar o Gemini 3.8 Flash de verdade?
Escolha a sua situação. Isto não garante permissões na sua conta.
Confirme projeto, faturamento, região e cota antes de desenvolver.
Conclusões principais
O ID estável é
gemini-3.8-flash; aceita texto, imagem, vídeo, áudio e PDF e produz texto.O limite de entrada é 1.048.576 tokens e o de saída é 65.536. Thinking suporta low, medium e high; minimal não é suportado.
Em tarefas difíceis, o modelo pode raciocinar mais e chamar ferramentas repetidamente, aumentando tokens e espera.
O Google lista AI Studio, Gemini API, Android Studio, Google Antigravity, Stitch, Gemini Enterprise e algumas entradas Google AI Pro/Ultra.
Até 31 de dezembro de 2026, o preço API padrão é $0,75 por milhão de tokens de entrada e $3,75 de saída, incluindo thinking.
Especificações e acesso
Use a documentação oficial, o anúncio e os preços. Artificial Analysis é um snapshot de v4.3.2 com high thinking, não uma garantia geral.
| Item | Informação atual | Implicação |
|---|---|---|
| Estado | Stable gemini-3.8-flash | Confirme se a rota escolhida disponibiliza o ID. |
| Entrada / saída | Texto, imagem, vídeo, áudio, PDF / texto | O suporte da API não garante as mesmas ferramentas em cada cliente. |
| Limites | 1.048.576 de entrada; 65.536 de saída | O cliente pode impor limites menores. |
| Thinking | low, medium, high | Minimal devolve erro. |
| Ferramentas | Cache, execução de código, Computer Use preview, pesquisa, funções, grounding e saídas estruturadas | É uma especificação API, não prova de acesso no Tabbit. |
| Preço padrão | Até ao fim de 2026: $0,75 entrada / $3,75 saída por milhão | Subscrição e Tabbit são custos separados. |
O snapshot consultado da Artificial Analysis mostra Intelligence Index 41, v4.3.2, high thinking, 305 tokens/s de saída e $1,24 por tarefa. TTFT não está publicado; estes valores não garantem a sua latência ou custo.
O que mudou desde o Gemini 3.7 Flash
O Google afirma melhorias em engenharia de software, tarefas agentic e raciocínio especializado de vários passos. Em tarefas difíceis, 3.8 pode pensar durante mais tempo e repetir chamadas a ferramentas. Para cargas em que a eficiência é prioridade, 3.7 continua a ser uma comparação válida.
| Dimensão | 3.7 Flash | 3.8 Flash | Critério |
|---|---|---|---|
| Posicionamento | Modelo diário rápido e eficiente | Workhorse para código longo e autonomia | Teste 3.8 quando o planeamento contínuo importa. |
| Método | Menos detalhes públicos | Mais raciocínio e chamadas de ferramentas possíveis | Reserve margem para saída e espera variáveis. |
| Níveis | Dependem do cliente | low, medium, high | Não presuma que existe minimal. |
| Preço | Mantém o preço introdutório | $0,75 / $3,75 até ao fim de 2026 | O mesmo preço nominal não garante o mesmo custo por tarefa. |
| Cyber | Fora do âmbito | Variante separada e restrita | Acesso normal não dá acesso Cyber. |
Benchmarks e demonstrações do Google são declarações do fornecedor. Para mais detalhes, consulte os recursos do modelo (English) e a análise.
Como obter acesso
Pode testar no AI Studio ou usar o ID estável na Gemini API. O Google também cita Android Studio, Google Antigravity e Stitch. Empresas devem verificar Gemini Enterprise; consumidores devem verificar Google AI Pro ou Ultra em Gemini, AI Mode e Sheets. Região, quota, conta e faturação devem ser confirmadas no produto real. Acesso à API não prova integração num navegador.
Uma pequena tarefa no Tabbit Browser
A verificação editorial de 20 de setembro de 2026 usou automação assistida no Tabbit Browser Dev, no site de testes e com uma conta conectada. Uma nova conversa com Gemini-3.8-Flash recebeu cinco pagamentos fictícios para extrair moeda, total pago, IDs vencidos e sem status. O JSON retornou USD, 145, B e D, os quatro campos esperados, sem inventar o status ausente.
Foi uma extração, não um benchmark de produção. A interface exibiu Google Search apesar da instrução sem ferramentas; a execução não foi verificada separadamente. Esforço, tokens, custo e tempo não foram medidos. Confira a tarefa e o resultado antes de testar com seu próprio seletor.

Para quem serve
Teste-o para entradas multimodais, documentos extensos e saídas estruturadas. Se orçamento, latência ou ferramentas do cliente forem decisivos, mantenha o 3.7 na comparação. Os relatos do Hacker News abaixo são experiências individuais, não garantias de desempenho.
O que a comunidade está dizendo
No Hacker News, handzhiev chamou o Gemini 3.7 de modelo de trabalho rápido e disse que estava disposto a testar o 3.8 (comentário; experiência pessoal, Gemini 3.7, 2 de setembro de 2026). simonw relatou uma tarefa de HTML concluída pelo Gemini 3.8 Flash em seu agente de código (comentário; experiência pessoal, Gemini 3.8 Flash, mesma data).


O contraponto é acesso e custo: robertwt7 ainda estava no 3.6 Flash como usuário Plus e perguntou sobre o 3.7 na Austrália (comentário; experiência pessoal, Gemini na web, 3 de setembro de 2026). wyrdcurt chamou o resultado de HTML de “cool HTML toy” rápido e comparou com modelos mais baratos (comentário; comparação pessoal, versões citadas, 2 de setembro de 2026). São experiências, não um benchmark comum nem prova de permissão.


Próximo passo
Comece pela documentação oficial, depois leia preços, a análise e as alternativas.
Consulte os guias de tarefas (English) para reproduzir o fluxo, as fontes das análises (English) para conferir evidências e o guia de migração de navegadorpara comparar o ambiente.
Perguntas frequentes
O que é o Gemini 3.8 Flash?
É um modelo estável do Google para desenvolvimento prolongado, agentes autônomos e tarefas empresariais complexas. A API aceita texto, imagens, vídeo, áudio e PDF e retorna texto.
O que mudou em relação ao 3.7 Flash?
O Google destaca melhorias em raciocínio, código e chamadas iterativas de ferramentas. Mais esforço pode consumir mais tokens; compare qualidade da conclusão e eficiência.
Quais são os limites de entrada e saída?
A API informa 1.048.576 tokens de entrada e 65.536 de saída. Isso não garante a mesma cota em todos os clientes.
Quais níveis de raciocínio são aceitos?
A API oferece low, medium e high. Segundo a documentação do Google, minimal não é compatível e retorna erro.
Onde posso usar o modelo?
O Google lista AI Studio, Gemini API, Android Studio, Antigravity, Stitch, Gemini Enterprise e assinaturas Pro/Ultra elegíveis. Região, cota e condições variam conforme a rota.
O modelo está disponível no Tabbit?
Uma conta de teste do Tabbit Browser Dev retornou o JSON esperado em 20 de setembro de 2026. Uma amostra não garante acesso em produção, desempenho ou custo; confira seu seletor e resultado.