Claude Sonnet 5 merece um piloto controlado quando o trabalho exige várias chamadas de ferramentas, código e acompanhamento em várias etapas. Comece por tarefas de agente bem delimitadas e trabalho de conhecimento em que a capacidade do Opus seria útil, mas custo ou acesso são restrições. Mantenha Sonnet 4.6 ou um modelo maior como comparação se cobertura de bugs, convergência rápida ou uma ferramenta especializada forem mais importantes.
A Anthropic anunciou Claude Sonnet 5 em 30 de junho de 2026. O ID atual é claude-sonnet-5. Este artigo usa o anúncio da Anthropic e o catálogo do Claude Platform, verificados em 20 de setembro de 2026. A escolha não depende apenas de ser mais novo: esforço, ferramentas e rota de oferta determinam custo e resultado. (Anthropic, Claude Platform)
Resumo
Sonnet 5 é o Sonnet da Anthropic mais focado em agentes: planejamento, ferramentas, código e tarefas profissionais em várias etapas.
O catálogo mostra
claude-sonnet-5, pensamento adaptativo, contexto de 1 milhão de tokens e saída máxima de 128K. Nem todo cliente expõe esses controles.A fotografia da API é de 2 dólares de entrada e 10 de saída por milhão de tokens. Esforço, tokens de pensamento e novas tentativas aumentam o custo por tarefa.
As avaliações públicas são condicionais: Terminal-Bench e trabalho de conhecimento ficam próximos do Opus 4.8, enquanto a CodeRabbit encontrou um compromisso entre precisão e recall em revisão de código.
Este rascunho não executou uma tarefa Sonnet 5 no Tabbit nem capturou imagem. Confira o recurso do Claude Sonnet 5 (English) e seu seletor real.
Especificações e acesso
| Pergunta | Fotografia atual | Limite da decisão |
|---|---|---|
| ID do modelo | claude-sonnet-5 | Registre o ID exato nos logs. |
| Lançamento | 30 de junho de 2026 | Compare com a mesma tarefa e ambiente. |
| Entrada / saída | Texto e imagem / texto | Ferramentas dependem da rota. |
| Contexto / saída máxima | 1 milhão / 128K tokens | Tetos do catálogo; o cliente pode limitar mais. |
| Pensamento | Adaptativo; esforço padrão high | Compare níveis de esforço. |
| Preço da API | 2 / 10 dólares por MTok | Assinatura, nuvem e Tabbit são separados. |
| Acesso | Planos Claude e API segundo a Anthropic | Confirme conta, região, cota e seletor. |
O catálogo indica janeiro de 2026 como corte de conhecimento confiável. Isso não garante que uma ferramenta conectada esteja atualizada. Um navegador agêntico pode operar páginas ao vivo, mas o modelo não recebe essas permissões automaticamente.
O que mudou desde o Sonnet 4.6?
A Anthropic destaca planos longos, ferramentas de navegador e terminal, programação, raciocínio e trabalho de conhecimento. Também afirma que comportamentos indesejáveis são menos frequentes e que proteções cibernéticas estão ativadas por padrão. São afirmações do fornecedor, não um teste próprio.
| Dimensão | Sonnet 4.6 | Sonnet 5 | Ação |
|---|---|---|---|
| Continuidade do agente | Base anterior | Mais tarefas em várias etapas e verificação, segundo a Anthropic | Fixe condição de parada e comando de validação. |
| Ferramentas | Dependem da rota | Centro do lançamento | Verifique permissões e registre chamadas. |
| Terminal | 67,0% na comparação datada | 80,4% no Terminal-Bench 2.1 | Avaliação publicada, não repetição local. |
| Trabalho de conhecimento | Base anterior | 1.618 contra 1.615 do Opus 4.8 | Três pontos não definem vencedor universal. |
| Revisão de código | Cerca de 63% de recall estrito, 29% de precisão | Cerca de 50–51%, 38–40% | Escolha cobertura ou comentários mais limpos. |
| Segurança | Base do Sonnet 4.6 | Menos comportamentos indesejáveis segundo a Anthropic | Mantenha revisão humana e testes específicos. |
A Vellum alerta que algumas bases do Sonnet 4.6 foram recalculadas. Não misture datas, avaliadores e configurações diferentes em um ranking. Os recursos de revisão do Sonnet 5 (English) e o guia de raciocínio agêntico dão o contexto.
Riscos ainda desconhecidos
Uma avaliação pública não é o seu ambiente. A Endor Labs mostra que Sonnet 5 com Claude Code foi forte em correção funcional, mas mais fraco para fechar vulnerabilidades. O resumo indica 83,2% de FuncPass e o corpo indica 82,6%; por isso nenhum número é usado aqui como fato definitivo. Um patch que passa nos testes funcionais não é automaticamente seguro.
O esforço também muda a conta. A CodeRabbit não observou melhora clara no recall estrito com esforço alto, embora o custo de revisão quase dobrasse. Registre tokens de pensamento, tentativas, ferramentas e correções humanas, e não apenas o preço por milhão.
O acesso depende da rota. O catálogo não prova que um navegador ou provedor externo ofereça o mesmo modelo e as mesmas ferramentas.
O que a comunidade está dizendo
No Reddit, Exodus_Green escreveu que Sonnet 4.6 com low effort pode superar Sonnet 5 com medium em pesquisa agêntica, segundo o gráfico publicado (comentário). Rent_South repetiu uma avaliação de fluxos lógicos cinco vezes por modelo e concluiu que a escolha depende do fluxo (mesma discussão). qubedView considera Sonnet muito mais barato para extração documental de uma etapa, mas prefere Opus para código difícil (discussão). TheRealJesus2 recomenda dividir o trabalho: modelos menores fazem raciocínio baixo ou médio e modelos grandes planejam e verificam (mesma discussão).
São experiências pessoais, não benchmarks. X e YouTube foram tentados em 20 de setembro, mas não exibiram texto estável e atribuível. Nenhuma imagem é inventada; o artigo continua em rascunho.
Quem deve experimentar?
| Situação | Primeiro passo | Motivo |
|---|---|---|
| Extração, classificação ou roteamento repetido | Teste com esforço baixo/médio | Tarefas delimitadas dão custo mais previsível. |
| Código em vários arquivos com testes | Ative ferramentas e faça um piloto | O acompanhamento longo é o principal sinal positivo. |
| Revisão de segurança de alto risco | Mantenha modelo especializado ou maior | Correção funcional não fecha vulnerabilidade. |
| Mudança de uma linha ou chat sensível à latência | Compare Sonnet 4.6 ou modelo rápido | Ele pode pensar demais para uma tarefa pequena. |
| O ID não aparece no seletor | Não prometa acesso; confira conta e região | O nome do catálogo não é autorização. |
A automação do navegador não remove autenticação, limites ou revisão. Para comparar produtos, veja a comparação de navegadores de IA e o guia de navegadores de IA.
Próximo passo: medir uma tarefa concluída
Escolha uma tarefa reversível e registre ID, cliente, esforço, contexto, permissões, tokens, tempo, tentativas, chamadas de ferramentas, verificação independente e intervenção humana. Rode a mesma amostra de teste com Sonnet 4.6 ou com o modelo atual. Decida pelo custo por resultado concluído, não por token.
O guia do Tabbit Browser explica o fluxo no navegador e as práticas do Tabbit mostram como manter uma pessoa no circuito. Este rascunho não executou Sonnet 5 no Tabbit, portanto não afirma disponibilidade.
Veredito
Claude Sonnet 5 merece um piloto para código agêntico, fluxos com ferramentas e trabalho de conhecimento repetitivo. Não é substituto automático do Opus nem garantia de segurança ou economia. Esforço, tentativas, rota e divisão do trabalho determinam o resultado. Mantenha o texto em rascunho até concluir o teste real no Tabbit e as capturas comunitárias exigidas.
Fontes
Anthropic — lançamento, acesso, segurança e preço.
Claude Platform — ID, contexto, saída e pensamento.
Preços do Claude Platform — referência da API.
Endor Labs — avaliação de segurança e limites.
CodeRabbit — avaliação de revisão de código.
Vellum — comparação datada e segmentação de tokens.
Perguntas frequentes
O que é o Claude Sonnet 5?
Claude Sonnet 5 é o modelo intermediário da Anthropic para programação, uso de ferramentas, trabalho de conhecimento e fluxos com agentes. O catálogo do Claude Platform consultado em 20 de setembro de 2026 mostra o ID claude-sonnet-5, pensamento adaptativo, contexto de 1 milhão de tokens e saída máxima de 128K.
O que mudou em relação ao Sonnet 4.6?
A Anthropic apresenta o Sonnet 5 como uma versão mais voltada a agentes, com melhorias em raciocínio, ferramentas, programação e trabalho profissional. Relatórios independentes também mostram uma troca: comentários de revisão mais precisos podem vir com menor recuperação estrita de bugs, dependendo do ambiente.
Quais são os limites de contexto e saída?
O catálogo do Claude Platform consultado em 20 de setembro de 2026 indica contexto de 1 milhão de tokens e saída máxima de 128K. São limites do catálogo; o cliente, plano ou provedor pode expor limites efetivos diferentes.
Quanto custa o Claude Sonnet 5?
A fotografia atual do Claude Platform indica 2 dólares por milhão de tokens de entrada e 10 dólares de saída. API, assinaturas, nuvem e acréscimos de terceiros são separados, e o pensamento adaptativo altera o custo por tarefa.
Onde posso usar o Claude Sonnet 5?
O anúncio da Anthropic cita os planos Claude e a API Claude. Seletor, região, cota e ferramentas dependem da rota; confirme a conta real antes de prometer acesso à equipe.
Como devo testá-lo antes de migrar?
Escolha uma tarefa representativa, registre ID do modelo, esforço, chamadas de ferramentas, tempo, tokens e intervenção humana, e compare com Sonnet 4.6 ou com o modelo atual. Um único sucesso não prova confiabilidade em produção.