Claude Opus 4.8 é o modelo da Anthropic para código complexo, agentes de navegador, ferramentas e trabalho com contexto longo. Ainda é uma opção para um piloto controlado, mas o catálogo de 20 de setembro de 2026 o marca como Legacy e recomenda considerar o Opus 5.
Esse é o ponto de decisão. O preço normal continua o do Opus 4.7: 5 dólares por milhão de tokens de entrada e 25 de saída, com contexto de 1M, saída de 128K e thinking adaptativo. Uma integração nova deve medir a capacidade e o horizonte de suporte. Comece pelo recurso Claude Opus 4.8 (English) e confirme a rota real.
Decisão rápida
É o sucessor do 4.7, com controle de effort, Fast Mode e Dynamic Workflows no Claude Code.
O catálogo lista
claude-opus-4-8, contexto de 1M, saída de 128K, effort high e corte de conhecimento em janeiro de 2026.Um índice independente o colocou no topo, mas Terminal-Bench 2.1 favoreceu GPT-5.5 no harness citado.
Effort, thinking, contexto longo e tentativas mudam o custo por tarefa; 5/25 não é orçamento final.
Continua disponível, mas compare o Opus 5 antes de uma integração nova.
Especificações e acesso
| Item | Instantâneo do catálogo | Limite |
|---|---|---|
| ID da API | claude-opus-4-8 | Fixe nos logs; alias de provedores podem mudar. |
| Estado | 28-05-2026; Active (legacy) | Disponível não significa atual. |
| Contexto / saída | 1M / 128K | Cliente e provedor podem oferecer menos. |
| Entrada / saída | Texto, imagens / texto | Ferramentas dependem da rota. |
| Thinking / effort | Adaptive, high, extra/xhigh, max | Compare com a tarefa. |
| API padrão | $5 / $25 por MTok | Cache, Batch, Fast Mode e planos são separados. |
| Aposentadoria | Não antes de 28-05-2027 | Projetos novos devem revisar o Opus 5. |
Os recursos de prompts (English) e de reviews (English) guardam as entradas de fonte; esta página trata do ciclo e da escolha de carga.
Mudanças desde 4.7
A Anthropic afirma que 4.8 melhora julgamento, seguimento de instruções, eficiência de ferramentas e verificação do próprio código. High é o padrão; extra/xhigh e max gastam mais para problemas difíceis. Fast Mode é o mesmo modelo a cerca de 2,5 vezes a velocidade, a 10/50 dólares por milhão. Dynamic Workflows é uma prévia do Claude Code para Enterprise, Team e Max.
Os relatos são divididos. Um usuário do Reddit viu melhora clara em Playwright, Cloud CLI e Kubernetes CLI, mas preferiu GPT-5.5 em alguns repositórios muito grandes (relato). Outra discussão descreveu respostas rápidas e confiantes, mas erradas, ao corrigir código quebrado (discussão). São experiências específicas.
Benchmarks e segurança
Digital Applied resume 61,4 contra 60,2 para GPT-5.5 no índice composto da Artificial Analysis, mas 74,6 contra 78,2 no Terminal-Bench 2.1. SWE-Bench Pro aparece como 69,2 para 4.8 contra 64,3 para 4.7. Tarefas, datas e harness são diferentes. Outra review observa que os números SWE-bench da Anthropic não foram reproduzidos independentemente, enquanto uma medição da Artificial Analysis em 3 de agosto de 2026 mostra 84,6% no próprio Terminal-Bench.
Um estudo red-team com 7.826 intenções nocivas relata que um ataque adaptativo rompeu o Opus 4.8 em 11,5% das intenções. Não é taxa de falha normal, mas mostra por que controles da aplicação e revisão humana continuam necessários.
Ciclo, preço e rotas
O Platform mantém 4.8 como Legacy, com link para o Opus 5 e aposentadoria não antes de maio de 2027. A Anthropic cita Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry e Claude Platform on AWS. Claude.ai e Claude Code têm seletores e limites próprios.
| Rota ou função | Limite publicado | O que não prova |
|---|---|---|
| Claude API | claude-opus-4-8, $5/$25 | Que navegador ou assinatura ofereça os mesmos limites. |
| Provedores cloud | ID e termos próprios | Mesma região, quota ou ferramentas. |
| Claude.ai / Code | Esforço e acesso do produto | Créditos de API incluídos. |
| Fast Mode | Prévia, 2,5x, $10/$50 | Disponibilidade em todos os planos. |
| Cache / Batch | Tarifas e descontos separados | Que uma tarefa longa fique automaticamente barata. |
| Dynamic Workflows | Prévia Enterprise, Team, Max | Que todos executem centenas de agentes. |
Thinking, cache reads, tentativas, ferramentas e subagentes mudam o custo. Separe API, assinatura, provedor, Fast Mode e Tabbit.
Para comparar a família, leia separadamente o guia do Claude Sonnet 5 e a review do Claude Fable 5.1; as evidências de effort, preço e ciclo de vida não passam automaticamente para o Opus 4.8.
Autoverificação e limite do Tabbit
Registre ID, cliente, provedor, região, data, effort e ferramentas. Defina arquivos, saída, teste de aceitação e parada. Rode testes e revise o diff no código, registre ferramentas antes de ações irreversíveis e exija citações e contradições na pesquisa.
O Reddit relata até 900 mil cache tokens por turno com thinking e 14–34 mil no 4.7, além de sessões de centenas de milhares de tokens (fonte). São medições pessoais, não mudança no limite oficial de 1M.
Nenhuma tarefa autenticada foi executada no Tabbit Browser. Portanto não se afirma seletor, contexto efetivo, latência, provedor, assinatura, ferramentas ou custo. Os guias de navegador agêntico, automação, AI browser e Tabbit explicam o limite do cliente.
Veredito
Claude Opus 4.8 continua sendo candidato para código complexo, análise com ferramentas e agentes de navegador. A melhora sobre 4.7 existe, mas as evidências independentes dependem do harness e o catálogo já o chama de Legacy. Use um teste fixo, compare o Opus 5 antes de se comprometer e mantenha aprovação humana.
Fontes e perguntas
Fontes: anúncio Anthropic, Platform, preços, System Card, Digital Applied, ThePlanetTools e red-team. O registro interno conserva as URLs da comunidade e seus limites.
Ainda está disponível?
Sim, mas está marcado como Legacy; a aposentadoria não é anterior a 28 de maio de 2027.
Todos os clientes expõem 1M?
Não. O provedor ou plano pode oferecer menos.
Qual effort escolher?
Comece pelo mínimo que passe na aceitação. Mais effort pode aumentar tokens e quotas.
Fast Mode é outro modelo?
Não, é uma rota rápida do mesmo 4.8, com preço diferente.
É mais seguro que 4.7?
A Anthropic relata melhora, mas o red-team independente encontra uma superfície de ataque.
Funciona no Tabbit?
Uma sessão autenticada não foi verificada. Confira o seu seletor.
Perguntas frequentes
O que é Claude Opus 4.8?
É o modelo Opus da Anthropic lançado em maio de 2026 para código complexo, ferramentas, agentes de navegador e trabalho com contexto longo. O ID da API é claude-opus-4-8 e o catálogo indica contexto de 1M e saída máxima de 128K.
Opus 4.8 ainda é o modelo atual?
Ele continua disponível, mas a página Claude Platform verificada em 20 de setembro de 2026 o marca como Legacy e recomenda considerar o Opus 5. A aposentadoria não está prevista antes de 28 de maio de 2027.
Quanto custa?
A API padrão custa 5 dólares por milhão de tokens de entrada e 25 de saída. Fast Mode aparece a 10 e 50 dólares; cache, Batch, provedores e planos de consumidor são separados.
Quais effort devo usar?
O thinking adaptativo tem high como padrão, com extra ou xhigh e max documentados. Um effort menor pode ser mais rápido; um maior pode gastar mais tokens.
O que mudou desde 4.7?
A Anthropic destaca julgamento, seguimento de instruções, eficiência de ferramentas e autoverificação, além de effort, Fast Mode e Dynamic Workflows. As primeiras avaliações independentes variam conforme o harness.
Está disponível no Tabbit?
Nenhuma tarefa autenticada do Opus 4.8 foi executada no Tabbit. Por isso não se afirma seletor, contexto efetivo, latência, custo ou ferramentas; confira a sua conta.