TabbitBlog

Preço do Gemini 3.8 Flash: aumento de 2× em 2027 e custo por tarefa

Fórmulas e exemplos para calcular o custo do Gemini 3.8 Flash, incluindo thinking, cache, Batch e Flex.

Neste artigo
  1. Principais pontos
  2. Tabela de preços
  3. Dois exemplos
  4. Batch, Flex, ferramentas e tentativas
  5. A fronteira do Tabbit
  6. Comparação de cargas
  7. O que dizem os criadores
  8. Debate da comunidade sobre custo por tarefa
  9. Escada da família, effort e limites da cobrança
  10. Duas cargas de trabalho com premissas explícitas
  11. Depois de calcular, escolha onde executar o fluxo
  12. Fontes

O custo real do Gemini 3.8 Flash depende dos tokens usados por cada tarefa. Até 31 de dezembro de 2026, o API Standard cobra US$0,75 por milhão de tokens de entrada e US$3,75 por milhão de saída. A saída já inclui thinking. A leitura do cache custa US$0,075 e o armazenamento US$0,50 por milhão de tokens-hora. Em 1º de janeiro de 2027, o Google lista o dobro desses preços Standard.

A fórmula é (entrada sem cache×preço + leitura do cache×preço + saída com thinking×preço)/1.000.000 + armazenamento. Assinaturas e taxas do Tabbit não são créditos da API.

Página oficial do Google, capturada em 2026-09-20; especificações, sem teste de inferência no Tabbit.
Página oficial do Google, capturada em 2026-09-20; especificações, sem teste de inferência no Tabbit.

Principais pontos

  • Thinking entra uma vez no total de saída.

  • Batch e Flex são modos separados; descontos não se acumulam.

  • O orçamento mensal inclui tarefas, tentativas, ferramentas e horas de armazenamento.

  • Confira a página oficial de preços e a página do modelo.

Tabela de preços

ItemAté 31-12-2026A partir de 01-01-2027Unidade
Entrada Standard$0.75$1.501M tokens
Saída Standard, incluindo thinking$3.75$7.501M tokens
Leitura do cache$0.075$0.151M tokens
Armazenamento do cache$0.50$1.001M tokens-hora
Entrada Batch$0.375$0.751M tokens
Saída Batch$1.875$3.751M tokens
Leitura Batch$0.0375$0.0751M tokens

Standard, Batch, Flex e Priority aparecem como modos separados. O suporte do modelo a um modo não transforma automaticamente uma chamada Standard em chamada com desconto.

Dois exemplos

Com 200.000 tokens de entrada sem cache e 20.000 tokens de saída incluindo thinking:

(0,2×$0,75) + (0,02×$3,75) = $0,225

100 tarefas custam US$22,50. Com fator de tentativa 1,2, reserve $22,50×1,2=$27,00, sem ferramentas. Em 2027, a mesma tarefa custa US$0,45.

Para um documento de 900.000 tokens armazenado por 10 horas, lendo 900.000 em cache, acrescentando 100.000 sem cache e gerando 30.000 de saída:

tokens = (0,1×$0,75)+(0,9×$0,075)+(0,03×$3,75) = $0,255
armazenamento = 0,9×10×$0,50 = $4,50

Com 20 tarefas nessa janela: $4,50+(20×$0,255)=$9,60. Leitura e armazenamento são cobranças diferentes.

Batch, Flex, ferramentas e tentativas

Batch serve para trabalhos que podem esperar. Flex é outro modo de inferência; use a linha atual da página oficial. Search grounding, Maps, URL context, Code execution e File Search têm regras próprias. Consulte a seção de ferramentas. A estimativa mensal é tarefas bem-sucedidas×custo de tokens por tentativa×tentativas por sucesso + ferramentas + armazenamento.

A fronteira do Tabbit

Tabbit Browser pode ajudar a organizar páginas de pesquisa; veja AI browser, navegador agentic, automação e recursos do modelo (English). O cliente de teste mostrou Gemini-3.8-Flash no seletor, mas uma tarefa nova falhou ao carregar e nenhuma inferência foi concluída. Isso não comprova acesso em produção nem preço do Tabbit.

Consulte também a visão geral, a avaliação e as alternativas, além da comparação de navegadores IA, mantendo API, assinatura e produto separados.

Comparação de cargas

CargaEstimativa 2026 (USD)Fora do cálculo
100 tarefas sem cache, 1,2 tentativa por sucesso27.00Ferramentas e criação do cache quando aplicável
20 tarefas com cache em 10 horas, sem novas tentativas9.60Ferramentas e criação do cache quando aplicável

O que dizem os criadores

NERD UP aborda o consumo de tokens e custos ocultos; Bijan Bowen apresenta tarefas de código e navegador. Citamos apenas os títulos e capítulos visíveis, não faturas ou testes comparáveis. O orçamento deve contar as novas tentativas e toda a saída.

C_tokens = (I_uncached × P_input + I_cached × P_cached + O_total × P_output) / 1,000,000
C_total = sum(C_tokens for ALL attempts) + C_storage + C_tools
C_success = C_total / N_success   [N_success > 0]

Conte todas as tentativas cobradas, incluindo falhas; acrescente armazenamento e ferramentas uma única vez. Sem sucessos, o custo por sucesso é indefinido.

Debate da comunidade sobre custo por tarefa

Em uma discussão do mesmo dia no Hacker News, gundmc defende o custo por tarefa, enquanto bermudi e criley2 observam que tokens de saída e níveis de effort diferentes podem mudar a ordem. São leituras de links do Artificial Analysis, não um ranking reproduzido aqui.

Comentários originais: gundmc (2 de set.), bermudi (2 de set.), criley2 (2 de set.) e criley2 (3 de set.).

Comentário de gundmc sobre custo por tarefa no Hacker News
gundmc: custo por tarefa pode mudar a comparação; opinião da comunidade, não medição independente do Tabbit.
Comentário de bermudi sobre tokens de saída por tarefa
bermudi: mais tokens de saída podem apagar uma vantagem de preço; não é ranking verificado.
Comentário de criley2 questionando comparação de custos
criley2 questiona a comparação conforme o nível de effort; o desacordo continua aberto.
Comentário de criley2 comparando custo por effort
Continuação de criley2: o custo muda com o effort; discussão do mesmo dia, não teste reproduzido.

Na prática, registre o effort e a saída total antes de aplicar o preço oficial.

Escada da família, effort e limites da cobrança

Na tabela Standard de 2026, Gemini 3.8 Flash, 3.7 Flash e 3.6 Flash aparecem com US$0,75 de entrada, US$3,75 de saída e US$0,075 de leitura de cache por milhão de tokens. A mesma tarifa não prova a mesma qualidade, latência ou disponibilidade. O custo real depende da proporção em cache, da saída total (incluindo thinking), das rodadas e das tentativas. Reduzir o effort só economiza quando reduz a saída sem prejudicar o resultado.

Thinking já está incluído na saída; leitura e armazenamento de cache são linhas diferentes. Batch e Flex são modos separados e as tarifas de tokens de 2026 não se acumulam. Search, Maps, URL context e File Search têm regras próprias. Uma chamada que falha ainda pode consumir tokens.

Duas cargas de trabalho com premissas explícitas

Tarifas Standard de 2026. A saída inclui o raciocínio uma vez; armazenamento, ferramentas, tentativas e impostos ficam de fora. Nas tarifas Standard de 2027 publicadas, os totais mensais de tokens seriam 30 e 36 dólares.

CargaEntrada por tarefaParte em cacheSaída total por tarefaTarefas por mêsCusto mensal de tokens
Extração curta10,0000%2,0001,000$15
Análise repetida de documentos1,000,00090%10,000100$18

Cálculo local

Estime o custo mensal de tokens

Tarifas API Standard até 31-12-2026. Inclua o raciocínio uma única vez na saída. Os valores ficam no navegador.

Gemini 3.8 Flash$0.4500 / tarefa$45.00 / mês
Gemini 3.7 Flash$0.4500 / tarefa$45.00 / mês
Gemini 3.6 Flash$0.4500 / tarefa$45.00 / mês

Exclui armazenamento, ferramentas, tentativas e impostos. Tarifas iguais não significam uso igual. Verificado em 20-09-2026. Ver tarifas atuais

O cálculo é local e compara três modelos conhecidos. Preços desconhecidos não viram zero. Armazenamento, ferramentas, tentativas e impostos ficam fora. Confira a tabela oficial antes de fechar o orçamento.

Depois de calcular, escolha onde executar o fluxo

O Tabbit Browser pode organizar páginas e contexto; veja a página do modelo Gemini 3.8 Flash (English). No Tabbit Browser Dev, com uma conta autenticada no site de teste, uma tarefa de extração de registros de pagamento devolveu corretamente quatro campos: currency, paid_total, overdue_ids e unknown_status_ids. A interface mostrou a marca Google Search, mas não verificamos de forma independente se uma busca foi executada; custo, tempo e estabilidade também não foram medidos.

Tabbit Browser
Tabbit Browser exibindo um resultado de extração estruturada com Gemini 3.8 Flash
Uma amostra devolveu o JSON esperado; não inferimos custo, latência ou estabilidade.

Fontes

Verifique os preços da Gemini API e a documentação do Gemini 3.8 Flash. Para trabalhos que atravessam 1º de janeiro de 2027, dobre as linhas Standard de tokens e cache antes de substituir as hipóteses pelos seus logs.

Perguntas frequentes

Quanto custa o Gemini 3.8 Flash até 31 de dezembro de 2026?

O Standard custa US$0,75 por milhão de tokens de entrada e US$3,75 por milhão de tokens de saída, incluindo thinking. A leitura do cache custa US$0,075 e o armazenamento US$0,50 por milhão de tokens-hora.

Thinking é cobrado à parte?

Não. O Google inclui esses tokens no preço de saída. Some-os uma vez ao total de saída.

O que muda em 2027?

A partir de 1º de janeiro de 2027, os preços Standard passam a US$1,50 de entrada, US$7,50 de saída, US$0,15 de leitura e US$1,00 de armazenamento.

Batch e Flex podem ser combinados?

Não. São modos diferentes. Escolha um e use somente a tabela correspondente.

Uma assinatura Gemini ou uma taxa do Tabbit paga a API?

Não. Assinatura de consumidor, conta Developer API e condições do Tabbit são separadas.

Como incluir novas tentativas no orçamento?

Multiplique o custo de uma execução bem-sucedida pelo número esperado de tentativas e acrescente ferramentas e armazenamento. Uma chamada que falha também pode consumir tokens faturáveis.

Dê o próximo passo

Deixe o Tabbit trabalhar ao seu lado.

Pesquise entre abas, automatize o trabalho repetitivo do navegador e mantenha todo o contexto ao alcance.