GPT-5.4 é o modelo de fronteira da OpenAI lançado em março de 2026 para trabalho profissional, código, ferramentas e agentes que operam computadores. Ele é candidato para fluxos que atravessam arquivos, aplicativos e sites, mas o caminho de acesso e a cobrança importam tanto quanto o nome do modelo.
O ponto de decisão é separar o teto do produto. A página da API lista 1.050.000 tokens de contexto, mas entradas acima de 272K recebem 2x na entrada e 1,5x na saída durante toda a sessão. Isso é uma regra da API, não uma promessa para ChatGPT, Codex, provedores de nuvem ou Tabbit. Comece pelo recurso do modelo GPT-5.4 (English) e confirme o produto e a conta que serão usados.
Principais conclusões
GPT-5.4 leva capacidades de código do GPT-5.3-Codex para um modelo geral com trabalho profissional e uso nativo do computador.
A API lista
gpt-5.4, contexto de 1.050.000, saída máxima de 128.000 e reasoning effort de none a xhigh.A OpenAI relata 75,0% no OSWorld-Verified, 67,3% no WebArena-Verified, 92,8% no Online-Mind2Web e 47% menos tokens em 250 tarefas MCP Atlas com busca de ferramentas.
O preço da API é US$ 2,50 na entrada, US$ 0,25 na entrada em cache e US$ 15 na saída por milhão de tokens. Créditos de assinatura são separados.
Usar o computador nativamente amplia as ações possíveis, mas não substitui permissões, confirmações, registros, testes e revisão humana.
Especificações e mudanças
| Questão | Instantâneo da API | Limite |
|---|---|---|
| ID do modelo | gpt-5.4 | Registre o ID completo; ChatGPT e Codex são superfícies diferentes. |
| Contexto / saída máxima | 1.050.000 / 128.000 tokens | Teto da API; o cliente pode ser menor. |
| Esforço | none, low, medium, high, xhigh | A interface ou plano pode oferecer menos. |
| Entrada longa | >272K: 2x entrada, 1,5x saída | Regra de cobrança, não de assinatura. |
| Corte de conhecimento | 31 de agosto de 2025 | Fatos atuais exigem recuperação. |
A OpenAI descreve três mudanças: API e Codex podem operar um computador com capturas e mouse/teclado; a busca de ferramentas carrega definições MCP sob demanda; ChatGPT Thinking pode apresentar um plano e receber instruções durante a execução. Fast mode é uma rota mais rápida do mesmo modelo. Benchmarks usam esforços, ferramentas e ambientes diferentes e não devem ser somados em uma nota única.
A coleção de prompts do GPT-5.4 (English), a coleção de reviews (English) e o guia de raciocínio agêntico separam material original e avaliações. Reddit, ORCFLO e LayerLens têm amostras e métodos próprios.
API, ChatGPT, Codex, provedores de nuvem e Tabbit não compartilham automaticamente preços, cotas, aliases ou ferramentas. Compare uma tarefa reversível: cliques e confirmações no navegador, testes e diff no código, fórmulas em planilhas, busca de ferramentas e falhas em MCP. Registre ID, rota, esforço, contexto, ferramentas, tokens, latência, tentativas e correções. Compare também com GPT-5.6 Terra, GPT-5.6 Sol e o guia Sol 1M.
Sinais da comunidade e limite do Tabbit
Um tópico do Reddit descreve o 5.4 como mais rápido que o 5.3-Codex e relata um 5.4 high executando uma refatoração antes de uma revisão por 5.3-Codex. Outro experimento usou o mesmo projeto Express em 16 worktrees, mas Claude Opus julgou a qualidade e parte dos resumos foi subjetiva. Há também relatos de que é preciso um plano mais rigoroso. São observações dependentes do cliente, tarefa e amostra. O guia de navegador de IA ajuda a separar capacidade do modelo e permissões do cliente.
Este rascunho não executou GPT-5.4 em uma sessão autenticada do Tabbit Browser. Portanto, não afirma visibilidade do seletor, contexto efetivo, latência, roteamento, cota, permissões ou custo. Se o modelo aparecer, comece com uma tarefa pública e reversível e registre o rótulo visível e o critério de aceitação.
Segurança, desconhecidos e veredito
A OpenAI classifica o GPT-5.4 como capacidade cibernética High no Preparedness Framework e usa monitoramento, controles de confiança e bloqueio assíncrono em algumas superfícies ZDR. O uso nativo do computador pode escrever, clicar e navegar; ações irreversíveis precisam de confirmação, permissões limitadas, registros, testes e aprovação humana. Um contexto de 1M não garante qualidade de 1M.
GPT-5.4 merece um primeiro teste para documentos profissionais, agentes de código e tarefas de computador. A fronteira prática está entre o teto do modelo e o produto real: multiplicador >272K, contexto efetivo, permissões e cotas. Fixe rota e esforço, use uma fixture reversível e meça separadamente resultado aceito, custo, tentativas, latência e correções. O resumo do Tabbit Browser não fornece créditos de API.
Fontes e perguntas
Fontes primárias: anúncio do GPT-5.4 pela OpenAI, página do modelo na API e material de segurança. Fontes independentes: LayerLens, ORCFLO e Tom's Guide.
Ele é igual no ChatGPT, Codex e API?
Não. A API usa gpt-5.4, o ChatGPT mostra GPT-5.4 Thinking e o Codex adiciona seus próprios controles de contexto, esforço, cota e ferramentas.
A API realmente aceita contexto de 1,05M?
A página da API lista 1.050.000 tokens, mas isso é um teto do modelo. O cliente pode compactar antes e entradas acima de 272K têm outro multiplicador.
Qual esforço devo escolher?
Comece pelo menor esforço que passa no seu teste de aceitação. Um esforço maior pode aumentar qualidade, custo, tempo e consumo de cota.
O uso nativo do computador é seguro?
Não. Ele amplia ações; confirmações, permissões, registros, testes e revisão humana continuam necessários.
A busca de ferramentas sempre reduz a conta?
A OpenAI observou redução de 47% em tokens em 250 tarefas MCP Atlas. Suas definições, servidores, falhas e rota podem produzir outro resultado.
Posso usar GPT-5.4 no Tabbit?
Este rascunho não verificou uma sessão autenticada do Tabbit. Confira o seletor e trate um sucesso como observação local, não como garantia da plataforma.
Perguntas frequentes
O que é o GPT-5.4?
GPT-5.4 é o modelo de fronteira da OpenAI lançado em março de 2026 para trabalho profissional, código, ferramentas e agentes que operam computadores. Seu ID de API é gpt-5.4 e ChatGPT e Codex o apresentam como GPT-5.4 Thinking.
Quais são os limites de contexto e saída?
A página do modelo na API informa 1.050.000 tokens de contexto e 128.000 tokens de saída máxima. Um cliente ou plano pode expor menos, e entradas acima de 272K têm outro multiplicador de preço.
Quanto custa o GPT-5.4?
A API cobra US$ 2,50 por milhão de tokens de entrada, US$ 0,25 por entrada em cache e US$ 15 por saída. Acima de 272K, a sessão inteira usa 2x para entrada e 1,5x para saída.
O que mudou?
A OpenAI combina o código do GPT-5.3-Codex com trabalho profissional, uso nativo do computador, busca de ferramentas e raciocínio orientável.
Onde posso usá-lo?
A OpenAI lista API, ChatGPT Thinking e Codex. O ID do modelo, região, organização, plano, versão do aplicativo e permissões determinam o caminho real.
Posso usar o GPT-5.4 no Tabbit Browser?
Este rascunho não executou uma tarefa GPT-5.4 em uma conta autenticada do Tabbit. Confira o seletor ao vivo e teste uma tarefa reversível antes de concluir.