Claude Haiku 4.5 é o modelo rápido da Anthropic para aplicações interativas, processamento em volume e etapas delimitadas de agentes. O número que muda a escolha é o contexto de 200.000 tokens: ele é mais barato e rápido que as camadas maiores da Claude, mas não tem o contexto de 1M listado para Sonnet 5 e Opus 5. Isso o torna adequado para extração, classificação, pequenos ciclos de código e tarefas de navegador com limites claros.
A página do modelo Claude Haiku 4.5, verificada em 21 de setembro de 2026, lista claude-haiku-4-5-20251001, 200K de contexto, 64K de saída máxima e preços de US$1/US$5 por milhão de tokens. A Anthropic marca o modelo como Active (latest), com aposentadoria não anterior a 15 de outubro de 2026. Este artigo não executou um teste autenticado no Tabbit.
Resumo
É a rota Claude mais rápida e barata na comparação da Anthropic, com extended thinking manual e sem effort adaptativo padrão.
200K de contexto e 64K de saída são limites práticos, diferentes do 1M de Sonnet 5 e Opus 5.
A API custa US$1 de entrada e US$5 de saída por milhão de tokens; cache, Batch, assinaturas, provedores e Tabbit ficam separados.
A Anthropic afirma desempenho de código semelhante ao Sonnet 4 por um terço do custo e mais de duas vezes a velocidade. Dados independentes sustentam apenas tarefas específicas.
Comece com Haiku quando entrada, saída e sucesso forem delimitados; suba de modelo quando houver planejamento profundo, contexto longo ou revisão ampla.
Claude Haiku 4.5 em uma tabela
Os recursos do modelo (English), a coleção de prompts (English) e a coleção de reviews (English) preservam as fontes, mas não concedem créditos de API nem acesso ao navegador.
| Pergunta | Resposta verificada | Limite |
|---|---|---|
| Papel | Rota Claude mais rápida, com inteligência próxima da fronteira | O rótulo não garante latência no seu app. |
| Lançamento | 15/10/2025 | A data não prova acesso atual. |
| IDs | claude-haiku-4-5-20251001; alias claude-haiku-4-5 | Bedrock e Google usam IDs próprios. |
| Contexto / saída | 200K / 64K tokens | Ferramentas e histórico reduzem o espaço. |
| Entrada / saída | Texto e imagens → texto | Permissões dependem da rota. |
| Pensamento | Extended thinking manual | O orçamento altera custo e espera. |
| API | US$1 entrada / US$5 saída por MTok | Cache, Batch, planos e cloud são distintos. |
| Estado | Active (latest); não antes de 15/10/2026 | Não é promessa de suporte permanente. |
O que mudou desde Haiku 3.5
O anúncio oficial apresenta uma melhoria de eficiência: desempenho de código parecido com Sonnet 4, um terço do preço, mais de duas vezes a velocidade e melhorias no uso de computadores. São afirmações de lançamento, não uma nova repetição independente com o mesmo teste.
O guia de migração pede a troca do ID, revisão dos limites, uso de apenas temperature ou top_p ao migrar de Claude 3.x, atualização das ferramentas, remoção de undo_edit, tratamento do motivo refusal e ajuste dos prompts ao estilo mais conciso do Claude 4. Para raciocínio difícil, ative manualmente um orçamento de thinking.
| Mudança | Verificação |
|---|---|
| ID | claude-3-5-haiku-20241022 → claude-haiku-4-5-20251001. |
| Amostragem | Não enviar temperature e top_p juntos; testar ausência de erro 400. |
| Ferramentas | Atualizar editor/code execution e remover undo_edit. |
| Parada | Tratar refusal e a recuperação. |
Preço, acesso e a fronteira dos 200K
A página de preços lista US$1 de entrada e US$5 de saída por MTok; escrita de cache de cinco minutos custa US$1,25, de uma hora US$2 e leitura US$0,10. Batch API dá 50% de desconto, mas não representa latência interativa. Regiões e marketplaces podem ter unidades ou adicionais próprios.
| Rota | O que está documentado | O que verificar |
|---|---|---|
| Claude API | ID, alias, preços e thinking manual | Limites, cache, rate limits e estado. |
| Claude / Claude Code | Disponível nos produtos no lançamento | Plano, seletor, região e ferramentas. |
| Bedrock / Vertex / Foundry | IDs e plataformas listados | Região, endpoint, cota e fatura. |
| Tabbit Browser | Cliente de navegador independente | Seletor, contexto, permissões e conta. |
Um PDF longo, uma sessão extensa de navegador ou um repositório com histórico de ferramentas pode alcançar 200K antes de terminar. Divida o material preservando citações, resuma o contexto estável ou compare com Claude Sonnet 4.6 e Claude Sonnet 5. Não converta preço de API em assinatura Claude ou preço do Tabbit.
O que os testes independentes mostram
DataLLM Lab executou nove funções Python independentes em 29 de julho de 2026: Haiku marcou 9/9, média de 3,7 segundos e US$0,94 por mil tarefas. O teste não cobre refatoração longa, agentes ou especificações ambíguas. ORCFLO avaliou 32 modelos em 10 de maio de 2026: Haiku ficou 20/32 em qualidade, 13/32 em custo e 11/32 em tempo. É um sinal de throughput, não um ranking universal. Um estudo de revisão de código também depende de seus 150 exemplos e avaliador.
A comunidade descreve a mesma fronteira. Uma discussão no ClaudeAI elogia chamadas de ferramentas rápidas, mas questiona planejamento complexo; outra discussão sobre extração de documentos relata bons formatos estruturados. Outro comentário diz que uma compilação sem supervisão apagou um diretório. São experiências pessoais, não estatísticas controladas.
Escolha um cenário e uma regra de escalonamento
| Trabalho | Comece com | Escale quando | Critério |
|---|---|---|---|
| Classificação, extração, resumo curto | Haiku 4.5 | Reconciliação profunda entre documentos | Schema e amostra das fontes. |
| Pequena correção ou lint | Haiku + testes | Plano multi-arquivo ou falhas repetidas | Diff, testes, revisão e rollback. |
| PDF longo ou pesquisa | Haiku em blocos | Perto de 200K ou citações instáveis | Cobertura, citações e revisão humana. |
| Plano de agente complexo | Comparar Sonnet / Opus | Perde o plano ou repete ferramentas | Etapas, parada e log. |
| UI de alto volume | Haiku 4.5 | Erro custa mais que a economia | p95, correções e saídas aceitas. |
A discussão de custo no Claude Code descreve uma política razoável: Haiku no cotidiano, Sonnet quando fica difícil. É uma estratégia pessoal, não uma conversão entre cota e API.
Um limite prático com o Tabbit Browser
Quando o trabalho começa em páginas, abas, capturas ou arquivos locais, o Tabbit Browser pode ser uma camada de navegador separada. Ele não aumenta o contexto de 200K, não muda a data de aposentadoria nem dá créditos de API. Este rascunho não executou Haiku 4.5 autenticado e não confirma seletor, contexto, latência ou ferramentas.
Se ele aparecer no seletor, comece por uma página pública e reversível. Registre o modelo, fontes, permissões e parada; compare uma extração de resposta conhecida e depois uma tarefa que deveria subir de modelo. Consulte o guia de AI browser, o guia de automação e a explicação de navegador agente.
Riscos desconhecidos e veredito
200K é um teto, o orçamento de thinking altera custo e espera, e os provedores divergem. A velocidade não elimina riscos de escrita sem supervisão: use testes, permissões e aprovação humana. Active (latest) não é suporte permanente.
Claude Haiku 4.5 é uma boa escolha de eficiência para tarefas curtas, repetíveis e de alto volume. Não substitui automaticamente os modelos maiores: fixe o critério de sucesso, meça uma amostra e suba de modelo quando planejamento, contexto ou revisão ficarem complexos. Fixe o ID e trate o Tabbit como uma pergunta de acesso da conta.
Fontes e FAQ
Fontes principais: anúncio da Anthropic, modelo, migração, preços e depreciações. Fontes independentes: DataLLM Lab, ORCFLO e estudo de código.
Ainda está disponível?
Está como Active (latest), sem aposentadoria antes de 15 de outubro de 2026. Confirme o fornecedor e a conta ao vivo.
200K basta para um documento grande?
Pode bastar para um documento delimitado, mas histórico, ferramentas e saída também usam contexto. Divida, cite e faça amostragem perto do limite.
Há extended thinking?
Sim, manualmente com budget_tokens; não há o controle adaptive/default-effort dos modelos mais novos.
É mais barato que Sonnet?
A API lista US$1/US$5 por milhão de entrada/saída; Sonnet 5 lista US$2/US$10 e Sonnet 4.6 US$3/US$15. Cache, lotes e tentativas alteram o custo real.
Pode substituir Opus para programar?
Pode atender correções delimitadas. Planos complexos e revisões grandes precisam de amostra de regressão e validação humana.
Funciona no Tabbit Browser?
Este rascunho não validou uma conta autenticada. Confira o seletor e interprete o resultado como evidência limitada à sua conta.
Perguntas frequentes
O que é o Claude Haiku 4.5?
Claude Haiku 4.5 é o modelo rápido e econômico da Anthropic, lançado em 15 de outubro de 2025. Seu ID de API fixo é claude-haiku-4-5-20251001 e o alias é claude-haiku-4-5. Ele é voltado para tarefas interativas e de alto volume.
Quais são os limites de contexto e saída?
A página atual da Claude Platform lista 200.000 tokens de contexto e 64.000 tokens de saída máxima. São limites do modelo; cliente, ferramentas e provedor podem deixar menos espaço efetivo.
Quanto custa o Claude Haiku 4.5?
A Anthropic lista US$1 por milhão de tokens de entrada e US$5 por milhão de saída. Escritas e leituras de cache e a Batch API têm regras próprias. Assinaturas e faturas de provedores são separadas.
O Claude Haiku 4.5 é bom para programação?
Ele pode funcionar bem para correções pequenas, leitura de código, lint e etapas repetitivas. Um teste de nove funções Python marcou 9/9, mas usuários também relatam erros em planos complexos. Use testes e uma regra de escalonamento.
Onde posso usar o Claude Haiku 4.5?
A Anthropic lista Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry e Claude Platform on AWS. Plano, região, cota, ferramentas e seletor dos produtos Claude podem ser diferentes da API.
Posso usar o Claude Haiku 4.5 no Tabbit Browser?
Este rascunho não executou uma tarefa autenticada no Tabbit, então não confirma seletor, contexto efetivo ou latência. Verifique o seletor atual com uma tarefa pequena e reversível.