TabbitBlog

Preços do Claude Fable 5.1: tarifas, custos por esforço e faturas reais

Preços do Claude Fable 5.1 explicados: a tabela de tarifas da API completa, o corte de 75% nas leituras de cache, a escada de custo por esforço, regras dos planos, orçamentos calculados e uma calculadora local.

Neste artigo
  1. Pontos-chave
  2. Preços do Claude Fable 5.1 de relance
  3. O número que mudou: leituras de cache caíram 75%
  4. O que "até 45% mais barato" realmente significa
  5. A alavanca de esforço: de 2,37 a 7,63 dólares por tarefa
  6. As linhas de cobrança fora do título
  7. A escada da família: Fable 5.1 vs Opus 5 vs Sonnet 5
  8. Pelo que você não paga
  9. Disponibilidade em planos: API, nuvens e planos de consumo
  10. Dois orçamentos calculados, todas as suposições visíveis
  11. Uma opção prática: rode a comparação no Tabbit
  12. Tabela de decisão de preços do Claude Fable 5.1
  13. Veredito final
  14. Fontes

O Claude Fable 5.1 custa 10 dólares por milhão de tokens de entrada e 50 por milhão de saída na API da Anthropic, com leituras de cache a 0,25 dólar por milhão — todas as tarifas verificadas na própria documentação de preços da Anthropic em 22 de setembro de 2026. Essa é a tabela de tarifas, e ela é quase entediante: das cinco linhas de token, quatro não se moveram desde o Fable 5. A fatura é outro objeto. Sobre a mesma tabela, a Artificial Analysis mede uma tarefa de benchmark a 2,37 dólares com esforço baixo e 7,63 no máximo — uma oscilação de 3,2x sem tocar em uma única linha de preço — e outra medição independente coloca o Fable 5.1 18% mais caro por tarefa que o Fable 5, apesar da promessa de lançamento de "até 45% mais barato".

As duas frases são verdadeiras, e o vão entre elas é a razão de este artigo existir. Um post do r/LLMDevs resumiu a questão com precisão: GPT-6 Astra e Fable 5.1 "têm o mesmo preço de tabela. Não custam o mesmo" — porque a forma do seu tráfego, não a etiqueta, decide a fatura (r/LLMDevs). Esta página é o lado do dinheiro do nosso panorama do Claude Fable 5.1 e da sua review; mais adiante, o Tabbit Browser aparece como um lugar prático para rodar essas comparações quando o orçamento estiver claro. Primeiro, os números.

Pontos-chave

  • A tabela de tarifas: 10 dólares de entrada, 0,25 de leitura de cache (0,025x — uma exceção para toda a família), 12,50/20 dólares de gravação de cache (5m/1h), 50 de saída por milhão de tokens. Batch corta tudo pela metade; a inferência somente em EE. UU. adiciona 1,1x a cada linha.

  • Uma linha mudou; todo o resto é a forma da fatura. As leituras de cache caíram 75% em relação ao dólar do Fable 5. A Anthropic estima economias típicas de ~25% e agênticas de até ~45%; medições independentes realizaram 15–30%, e uma build comunitária cuidadosamente registrada custou 2,4x mais que no Fable 5.

  • O esforço é a maior alavanca controlável. A escada da AA vai de 2,37 a 7,63 dólares por tarefa entre esforço baixo e máximo, por 6 pontos de inteligência. O Fable vem em High por padrão no Claude Code e em Medium nos demais — confira pelo que você está pagando.

  • Não há penhasco de contexto longo. A janela completa de 1M é cobrada a tarifas padrão — diferente de carro-chefes que reprecificam prompts longos — mas o tokenizador novo produz ~30% mais tokens para o mesmo texto.

  • Assinaturas são outra economia. O Fable não está no Free; Pro/Max o medem como créditos de uso a 50% dos limites semanais dentro de janelas móveis de 5 horas. O Enterprise é 20 dólares por assento mais uso a tarifas de API.

Preços do Claude Fable 5.1 de relance

A tabela de tarifas padrão completa, renderizada da documentação de preços da Anthropic em 22 de setembro de 2026. O Mythos 5.1 — os mesmos pesos atrás de um programa de acesso restrito — lista idêntico, mas não é comprável em geral; o panorama cobre essa linhagem.

ModeloEntrada / 1MGravação 5m / 1MGravação 1h / 1MLeitura de cache / 1MSaída / 1M
Claude Fable 5.1$10,00$12,50$20,00$0,25$50,00
Claude Fable 5$10,00$12,50$20,00$1,00$50,00
Claude Opus 5$5,00$6,25$10,00$0,50$25,00
Claude Sonnet 5$2,00$2,50$4,00$0,20$10,00
Claude Haiku 4.5$1,00$1,25$2,00$0,10$5,00
Tabela oficial de preços de modelos da Anthropic listando entrada base, gravações de cache de 5 minutos e 1 hora, leituras de cache e tarifas de saída para Claude Fable 5.1, Mythos 5.1, Fable 5, Opus 5, Sonnet 5 e Haiku 4.5
Tabela oficial de preços de modelos da Anthropic conforme exibida em 22 de setembro de 2026.

Três coisas nesta tabela fazem o estrago, e nenhuma é o 10 do título:

  1. A saída custa 5x a entrada. O Fable é um modelo de raciocínio adaptativo; ele pensa em tokens de saída cobráveis. Um prompt modesto com uma longa cadeia de raciocínio é uma fatura de saída vestida de entrada.

  2. Gravar cache custa mais que a entrada. 12,50 dólares é 1,25x a tarifa base para uma entrada de 5 minutos; 20 (2x) para uma hora. O cache se paga após uma leitura de 5 minutos ou duas de 1 hora — mas só se o prefixo for realmente reutilizado.

  3. O tokenizador mudou debaixo de você. Modelos Claude 4.7 e posteriores usam um tokenizador novo que produz aproximadamente 30% mais tokens para o mesmo texto, segundo a própria nota da Anthropic. Comparar preços por token com modelos da era Sonnet 4.6 sem essa correção superestima em um terço o custo do modelo antigo.

Vale cravar mais um ponto: a janela completa de 1M tokens é cobrada a tarifas padrão — "uma solicitação de 900k tokens é cobrada à mesma tarifa por token que uma de 9k", nas palavras da Anthropic. Diferente do penhasco de 272K do GPT-6 Astra, onde cruzar um limiar reprecifica a solicitação inteira, o Fable não tem nenhuma faixa de contexto longo.

O número que mudou: leituras de cache caíram 75%

O cache de prompts é a única linha que se moveu entre o Fable 5 e o 5.1, e vale entendê-lo mecanicamente, porque é a linha na qual vivem seus loops de agente.

Quando uma solicitação repete um prefixo já processado — prompt de sistema, contexto do repositório, histórico da conversa, definições de ferramentas — a API pode ler esse prefixo do cache em vez de reprocessá-lo. As gravações custam 1,25x a entrada base para uma entrada de 5 minutos, 2x para uma de 1 hora. As leituras normalmente custam 0,1x. O Fable 5.1 (e o Mythos 5.1) são a exceção da família inteira: as leituras custam 0,025x — 0,25 dólar por milhão — e a nota da Anthropic marca isso explicitamente. Esses multiplicadores se acumulam com o desconto Batch e os preços de residência de dados.

Por que isso domina faturas de agentes: um agente que faz 40 chamadas de ferramentas sobre um contexto de 200.000 tokens relê esse prefixo 40 vezes. Com leituras a 1,00 do Fable 5, essas releituras custam 8,00 dólares; com 0,25 do Fable 5.1, custam 2,00 — antes de gerar um único token novo. Os números da comunidade vão na mesma direção. Um desenvolvedor que rodou por uma semana um pipeline de recuperação documental tanto no Fable 5.1 quanto num concorrente com leituras a 1,00 relatou pagar cerca da metade com uma taxa de acerto de cache de 85%:

Comentário no Reddit r/LLMDevs relatando que um pipeline de recuperação de uma semana custou metade no Fable 5.1 com 85% de acerto de cache
Comentário r/LLMDevs: uma semana, 85% de acertos de cache, metade do custo; relato de um único pipeline, não um ranking.

E no r/ClaudeCode, um desenvolvedor Django que trocou um combo Fable 5 + Opus 5 pelo Fable 5.1 escrevendo o código diretamente com esforço Medium calculou cerca de 37% menos por solicitação, e 52% menos por token de saída — "o motivo é quase inteiramente o preço do cache", nas palavras dele:

Post no Reddit r/ClaudeCode descrevendo uma queda de 37% no custo por solicitação após mudar para o Fable 5.1 com esforço medium e forte reutilização de cache
r/ClaudeCode: um cálculo de fluxo autodeclarado, não um benchmark de faturamento controlado.

A condição nos dois relatos: a economia de cache exige um prefixo estável. Se seu contexto muda a cada turno — saídas dinâmicas de ferramentas, documentos rotativos — você paga a penalidade de gravação de 1,25x–2x repetidamente em vez de surfar as leituras a 0,025x. Esse modo de falha é exatamente o que a próxima seção mede.

O que "até 45% mais barato" realmente significa

A alegação de lançamento da Anthropic tem condições precisas, e dissecá-las é a diferença entre um orçamento e um desejo. Duas ressalvas antes de orçar.

Ressalva um: a linha de base e as condições. "O Fable 5.1 custará cerca de 25% menos que o Fable 5 para cargas típicas, sempre que o uso for cobrado por token… Para trabalho altamente agêntico, a economia costuma ser muito maior — de até aproximadamente 45%." A base é o Fable 5, não concorrentes. A alegação cobre uso cobrado por token, e "altamente agêntico" significa cargas que releem grandes prefixos estáveis — a forma de leitura de cache da seção anterior. Não é uma promessa sobre sua fatura por tarefa concluída.

Ressalva dois: medições independentes encontraram a direção oposta. A Artificial Analysis mediu o Fable 5.1 gastando 140M de tokens de saída no Intelligence Index contra 83M do Fable 5, elevando o custo por tarefa em 18% (3,14 → 3,69 dólares). A medição de 57 execuções da Firecrawl (7 de setembro de 2026) encontrou o Fable 5.1 usando mais tokens de saída em todos os níveis de esforço — 1,37x no baixo, 1,12x no alto, 1,30x no máximo — e economias realizadas de 15–30% da fatura, não 25–45%, "porque as gravações de cache (de 1 hora) custam 20 dólares por milhão e não têm desconto". A conclusão deles merece citação: "A Anthropic diz que o Fable 5.1 é mais barato… A Artificial Analysis mediu que custa 18% a mais. Ambos mediram corretamente." A qual se parece sua fatura depende de qual token a domina.

A comunidade encontrou o modo de falha no mundo real. Um desenvolvedor do r/ClaudeCode passou o mesmo prompt de build pelos dois modelos: o Fable 5.1 custou 1.200 dólares onde o Fable 5 custou 500 — 2,4x — com tarifas de tabela idênticas:

Post no Reddit r/ClaudeCode descrevendo um teste paralelo em que o Fable 5.1 custou 1.200 dólares contra 500 do Fable 5
r/ClaudeCode: uma build paralela autodeclarada; execução única, score 0 na captura — evidência de forma de custo, não benchmark.

Sua autópsia: o Fable 5.1 delegou 57% das subtarefas a workers Opus (cobrados a tarifas Opus) onde o Fable 5 roteava 80% para Sonnet, e seus loops de raciocínio inflaram o contexto ativo para além de 404K tokens — "pagando penalidades pesadas de gravação em vez de andar nas leituras baratas de cache". A lição não é que o Fable 5.1 é caro; é que níveis de delegação e a agitação de contexto são linhas de cobrança que nenhuma tabela de tarifas mostra. Para o lado de capacidades dessa troca, veja a review e nosso guia de raciocínio agêntico.

A alavanca de esforço: de 2,37 a 7,63 dólares por tarefa

O Fable 5.1 expõe níveis de esforço de raciocínio adaptativo — e nada na tabela de tarifas diz que esse dial move o custo mais do que qualquer linha de preço. A Artificial Analysis o rastreia como cinco entradas separadas; instantâneo de 22 de setembro de 2026:

EsforçoIntelligence IndexCusto por tarefa IIVelocidade de saída
low47$2,3755 t/s
medium49$2,9857 t/s
high51$3,9156 t/s
xhigh53$5,9863 t/s
max53$7,6367 t/s

Leia juntas as colunas externas: o esforço máximo custa 3,2x o baixo por tarefa, por 6 pontos de inteligência medida. O baixo também tem o menor tempo até o primeiro token (8,47s no mesmo instantâneo). O ajuste caro não é automaticamente o cuidadoso; é o que pensa por mais tempo em tokens de saída cobráveis — os dados da Firecrawl mostram que a brecha é quase inteiramente raciocínio oculto (no máximo: tokens de raciocínio 4.205 → 6.725 enquanto o texto visível caía 6%).

Os padrões da própria Anthropic tornam isso uma decisão viva: o Fable 5.1 vem em esforço High por padrão no Claude Code, e Medium no Claude Cowork e no Claude.ai. A mesma tarefa em duas superfícies é cobrada de forma diferente desde o primeiro token. As notas de lançamento são incomumente diretas: Low ou Medium "alcançam resultados semelhantes ou melhores que os do Fable 5 a um custo muito menor" — quando o fabricante diz que o ajuste barato costuma bastar, é um presente; aceite.

As linhas de cobrança fora do título

Quatro linhas decidem a maioria das faturas reais, e só a primeira aparece na cobertura de lançamento.

Batch: a alavanca de 50%. Solicitações Batch assíncronas são cobradas a 5 dólares de entrada / 25 de saída no Fable 5.1 — o maior desconto da tabela, e se acumula com o cache de prompts. Para avaliações, refators noturnos e tudo que não olha para um usuário, este interruptor economiza mais do que qualquer otimização de prompt. Sessões de agentes gerenciados não se qualificam (com estado e interativas).

Inferência somente em EE. UU.: 1,1x em tudo. Configurar inference_geo: "us" — ou a implantação equivalente do Azure US Data Zone — multiplica cada categoria por 1,1, leituras de cache incluídas. Regiões movidas por conformidade pagam 10% silenciosos por linha; o roteamento global é o padrão e o caminho barato.

Sobrecustos de ferramentas são faturas de tokens. Declarar o toolset browser-use adiciona cerca de 6.600 tokens de entrada por solicitação; computer-use cerca de 4.500; a definição da ferramenta bash, 325. A busca web no servidor cobra 10 dólares por 1.000 buscas além dos tokens. Um "agente" é uma estrutura de preços, não um chat — fluxos de automação de navegador deveriam orçar a linha do toolset explicitamente.

O que Batch e residência não consertam: retentativas, o fan-out de subagentes (cada subtarefa roteada para Opus é cobrada a tarifas Opus) e a inflação de ~30% de tokens do tokenizador frente a modelos pré-4.7. Nada aparece na tabela de tarifas; tudo aparece na fatura.

A escada da família: Fable 5.1 vs Opus 5 vs Sonnet 5

Linha (por 1M tokens)Fable 5.1Opus 5Sonnet 5
Entrada$10,00$5,00$2,00
Leitura de cache$0,25 (0,025x)$0,50 (0,1x)$0,20 (0,1x)
Saída$50,00$25,00$10,00
Batch entrada / saída$5,00 / $25,00$2,50 / $12,50$1,00 / $5,00

A linha contraintuitiva é a leitura de cache: o modelo mais caro da família tem a leitura de cache mais barata — 4x abaixo do multiplicador padrão da família. A Anthropic precificou no menor ratio exatamente a linha que os loops de agente martelam mais. Se seu tráfego relê contextos grandes e estáveis, o preço de entrada efetivo do Fable desaba; se não, o Opus 5 — com a tabela pela metade e o dobro do ratio de leitura — pode ganhar: a Firecrawl achou tarefas de especificação apertada mais baratas no Opus 5 "sempre", enquanto builds abertas ficaram em média 11,83 dólares no Opus contra 7,00 no Fable 5.1.

Dois fatos a mais na escada: os 2/10 dólares do Sonnet 5 eram introdutórios até 31 de agosto de 2026 — a Anthropic os tornou o preço padrão, cancelando o aumento previsto para 3/15 em 1º de setembro. E a armadilha do mesmo preço de tabela cruza famílias: Fable 5.1 e GPT-6 Astra listam ambos a 10/50, e ainda assim custam quantidades opostas na prática — o Astra termina tarefas longas isoladas com menos tokens, enquanto as leituras a 0,25 do Fable vencem qualquer carga de contexto cacheado de alto volume. A análise do r/LLMDevs que a emoldurou:

Post no Reddit r/LLMDevs explicando que GPT-6 Astra e Fable 5.1 compartilham o mesmo preço de tabela mas diferem em custo real conforme a forma da tarefa
r/LLMDevs: mesmo preço de tabela, custo real diferente; análise comunitária com método declarado.

O posicionamento da própria Anthropic acompanha a escada: Fable 5.1 para "trabalho ambicioso, de longa duração e assíncrono" — a review cobre quando isso se sustenta — com Opus e Sonnet para o trabalho interativo diário.

Pelo que você não paga

A documentação de preços e a página de produto traçam limites que leem como política de reembolso, e em escala agêntica eles importam:

  • Reroteamentos de salvaguarda não são cobrados a preços do Fable. Consultas sinalizadas por salvaguardas de cibersegurança ou biologia são concluídas por Opus 4.8 ou Opus 5 — "Você não será cobrado a preços do Fable por solicitações reroteadas", diz a página de produto. Uma resposta que parece recusa num tópico de segurança pode ser literalmente uma resposta Opus mais barata.

  • Buscas na web com falha não são cobradas. Cada busca bem-sucedida custa 10 dólares por 1.000; as que falham, não. O web fetch não tem cobrança adicional além dos tokens que o conteúdo se torna.

  • A execução de código é gratuita junto a busca/fetch, e cada organização recebe 1.550 horas de contêiner gratuitas por mês antes de a tarifa de 0,05/hora começar.

A contrapartida: cota não é dinheiro, mas se comporta como tal. Em assinaturas, o Fable queima janelas de 5 horas rápido — um usuário do r/ClaudeAI relatou 30% do uso de um dia sumidos numa sessão de depuração ("não vou deixar ele spawnar agentes Opus 5"), e comentaristas do vídeo semanal do Every relataram esgotar uma janela de 5 horas em 10–20 minutos. São experiências de plano autodeclaradas, não benchmarks, mas apontam na mesma direção que a aritmética da API: delegação e esforço decidem a velocidade de queima. Os créditos de uso dos planos pagos permitem continuar a tarifas de API padrão além dos limites.

Post no Reddit r/ClaudeAI elogiando o Claude Fable 5.1 enquanto relata que 30% do uso diário desapareceu numa sessão sobre uma base de código
r/ClaudeAI: capacidade e queima de cota no mesmo post; relato de uso pessoal, plano desconhecido.

Disponibilidade em planos: API, nuvens e planos de consumo

A tabela da API é apenas uma de três economias. Verificado em claude.com/pricing e na documentação da plataforma em 22 de setembro de 2026:

SuperfíciePreço (exibição verificada)Acesso ao Fable 5.1
API da AnthropicTarifas de token acimaSim — claude-fable-5-1
Plano Free$0Não (apenas Sonnet/Haiku)
Pro$17/mês anual ($200 adiantados) ou $20 mensaisSim — créditos de uso, 50% dos limites semanais
Max 5x / 20xA partir de $100/mêsSim — mesma regra de créditos, 5x/20x o uso do Pro
Team Padrão / Premium$20 / $100 por assento anual ($25/$125 mensais)Sim — Premium = 5x Padrão
Enterprise$20/assento/mês anual + uso a tarifas de APISim, com controles de gasto
NuvensAWS Bedrock, Google Cloud, Microsoft FoundrySim; endpoints regionais +10%, Foundry mede em CCU

A mecânica de assinatura que decide o custo real: o uso reinicia em janelas de sessão móveis de 5 horas, com limites semanais adicionais nos planos pagos; web, desktop, celular e Claude Code bebem do mesmo pool; Pro é "pelo menos 5x" o Free por janela, Max é 5x/20x o Pro. O Fable especificamente consome créditos de uso fixados em 50% dos limites semanais no Pro e no Max — uma hora de Fable custa contra sua verba o dobro de uma de Sonnet, a aritmética por trás dos relatos de "janela queimada" acima.

Rotas de terceiros têm condições próprias: a página do Fable no OpenRouter observa que a retenção de dados lá não é dispensável, e o endpoint Bedrock está só-BYOK durante a migração. Os padrões de esforço também diferem por superfície — High no Claude Code contra Medium na web — de modo que a mesma assinatura se esgota em velocidades diferentes conforme onde você trabalha.

Comentários sob o vídeo de uma semana do Every sobre Claude Fable 5.1 descrevendo janelas de sessão de 5 horas esgotadas em dez a vinte minutos
Teste de uma semana do Every com Fable 5.1, comentários: experiências de limite de sessão autodeclaradas, planos e cargas desconhecidos.

Dois orçamentos calculados, todas as suposições visíveis

Tarifas padrão, sem retentativas, sem ferramentas, sem impostos. Aritmética trabalhada, não previsões.

Uma pergunta curta com um pensamento longo. 10.000 tokens de entrada, 2.000 de saída:

(10.000 × $10 + 2.000 × $50) / 1.000.000 = $0,20

Um loop de agente a frio sobre um repositório grande. 300.000 tokens de entrada (ainda tarifa padrão — sem faixa longa), 8.000 de saída:

(300.000 × $10 + 8.000 × $50) / 1.000.000 = $3,40

A versão aquecida do mesmo loop. Mesmo contexto de 300.000 tokens, 90% em cache, uma gravação de 1 hora por sessão, 8.000 de saída:

(270.000 × $0,25 + 30.000 × $10 + 300.000 × $20 + 8.000 × $50) / 1.000.000 = $0,97 + gravações

Essa terceira linha é toda a história deste lançamento num cálculo: o mesmo trabalho cai de 3,40 para menos de um dólar quando o prefixo fica quieto — e sobe de volta no instante em que agitação de contexto, retentativas ou subagentes roteados para Opus reaparecem. O recurso do modelo (English) e sua coleção de prompts (English) reúnem tarefas repetíveis para medir sua própria taxa de acerto.

Cálculo local

Estime o custo de tokens da API Claude Fable 5.1

Usa as tarifas oficiais em USD verificadas em 22/09/2026. Os valores ficam neste navegador.

Por tarefa$0.20000
Por mês$0.20

As leituras de cache são cobradas a 0,25 USD por milhão de tokens — a exceção de 0,025x do Fable. A estimativa exclui novas tentativas, sobrecustos de ferramentas, redirecionamentos de salvaguarda e margens de provedores. O multiplicador apenas EUA se aplica a todas as linhas. Ver tarifas atuais

A calculadora roda inteiramente nesta página — nada é enviado a lugar algum. Ela precifica as duas durações de gravação de cache, os modos Batch e somente-EE. UU., e valida as entradas localmente. O que deliberadamente não modela: retentativas, roteamento de nível de subagentes, sobrecustos de ferramentas e reroteamentos de salvaguarda — isso vai na sua margem. Reconfira a tabela oficial antes de comprometer um orçamento; estes são os números de 22 de setembro de 2026.

Uma opção prática: rode a comparação no Tabbit

Depois do orçamento vem a parte chata: rodar trabalho com cara de Fable precisa de um lugar onde páginas, arquivos e chamadas de modelo morem juntos, e onde "testar Fable no medium, cair para Sonnet" seja uma seleção e não um projeto de orquestração. É a lacuna que o Tabbit Browser ocupa — um navegador AI agêntico cujo seletor de modelos, abas vivas e arquivos locais compartilham uma só superfície.

Seletor de modelos da nova aba do Tabbit Browser mostrando a lista de modelos disponíveis

Os limites, ditos sem rodeios: o Tabbit é um cliente, não uma camada de cobrança da Anthropic. A disponibilidade de modelos depende da sua conta e edição, e nada no navegador muda o que a Anthropic cobra — a tabela acima vale onde quer que o Fable rode. Este artigo não executou uma tarefa do Fable dentro do Tabbit, portanto nenhuma alegação de disponibilidade ou desempenho é feita aqui. O que o navegador muda é o custo de preparação: medir sua própria taxa de acerto de cache e seu limiar de esforço em trabalho real — os dois números que esta página inteira diz que decidem sua fatura — sai mais barato numa bancada construída exatamente para isso. O guia de hábitos no Tabbit cobre o método; a visão geral do navegador AI é o ponto de partida geral.

Tabbit Browser

Tabela de decisão de preços do Claude Fable 5.1

Sua carga de trabalhoFator de custoMelhor rota inicialCuidado com
Loops longos de agente, contexto estável de repositório/documentosLeituras de cachePadrão, prefixos estáveis, gravações 1hAgitação de contexto converte leituras em gravações 1,25–2x
Chat curto, edições rápidasTokens de saídaEsforço mais baixo — ou Sonnet 5Saída a $50/M domina; Fable é matar mosca com canhão
Avaliações noturnas, refators em loteVolumeAPI Batch a 50%Sessões interativas/gerenciadas não se qualificam
Builds autônomas abertasDelegação + saídaLimitar níveis de subagente; deixar o Fable escrever o próprio códigoSubagentes roteados para Opus cobrados a tarifas Opus
Processamento em EE. UU. por conformidadeCada linhaSomente-EE. UU. a 1,1x, Batch onde permitidoO prêmio também se aplica às leituras de cache
Uso diário por assinaturaJanelas 5h + créditosPro/Max com créditos a 50% dos limites semanaisPadrões High queimam janelas em minutos

Veredito final

O Claude Fable 5.1 tem o preço de um ingrediente para trabalho de longo prazo, e o lançamento realmente moveu um número: leituras de cache a 0,25 por milhão tornam loops de agente sobre contexto cacheado radicalmente mais baratos que no Fable 5 — medições independentes situam a economia realizada em 15–30%, e a sua quilometragem é decidida pela taxa de acerto, não pela etiqueta. Compre-o exatamente para essa forma de trabalho, no esforço mais baixo que passe seu critério de aceitação, com níveis de delegação limitados e Batch para tudo que pode esperar. Para tarefas interativas curtas, orçamentos apertados ou contextos em agitação, a escada da família existe precisamente para que o carro-chefe seja uma decisão de roteamento, não um padrão — e em assinaturas, trate a janela de 5 horas como a fatura real.

Reconfira a página oficial de preços mensalmente: a padronização do Sonnet 5 mostra que essa escada se move. O panorama e a review carregam a história de capacidades; os registros comunitários acima, a evidência de cargas; e a comparação de preços entre famílias mostra o que o mesmo preço de tabela custa em outro lugar.

Fontes

Perguntas frequentes

Quanto custa o Claude Fable 5.1?

Na API da Anthropic, o Claude Fable 5.1 custa 10 dólares por milhão de tokens de entrada e 50 por milhão de saída, verificado na documentação de preços da Anthropic em 22 de setembro de 2026. As gravações de cache custam 12,50 dólares por milhão (5 minutos) ou 20 dólares (1 hora), e as leituras de cache 0,25 dólar por milhão. A API Batch corta tudo pela metade (5/25 dólares) e a inferência somente em EE. UU. adiciona um multiplicador de 1,1x a cada linha.

O Claude Fable 5.1 é mais barato que o Fable 5?

Depende de qual token domina sua fatura. A Anthropic estima que cargas típicas fiquem cerca de 25% mais baratas e cargas altamente agênticas até cerca de 45% mais baratas, tudo pela queda das leituras de cache para 0,25 dólar por milhão. Mas a Artificial Analysis mediu o custo por tarefa de benchmark subindo 18%, porque o Fable 5.1 emite mais tokens de raciocínio. Cargas que releem um contexto estável em cache ficam mais baratas; cargas que geram saída nova ou trocam de contexto podem ficar mais caras.

O Claude Fable 5.1 está disponível no plano Free?

Não. A comparação de planos da Anthropic marca o Fable como indisponível no Free. Ele está disponível para usuários Pro, Max, Team e Enterprise; no Pro e no Max, o uso do Fable consome créditos de uso fixados em 50% dos limites semanais. Usuários do plano Free têm acesso apenas aos modelos Sonnet e Haiku.

Qual é a forma mais barata de usar o Claude Fable 5.1?

Empilhe as alavancas em ordem: mantenha prefixos de prompt estáveis para que as leituras sejam cobradas a 0,25 em vez de 10 dólares por milhão, use o nível de esforço mais baixo que passe seu critério de aceitação, mande pelo API Batch com 50% de desconto o que não tem pressa, e não ative a inferência somente em EE. UU. sem exigência de conformidade. Também limite a delegação: subagentes roteados para o Opus 5 são cobrados a tarifas do Opus e são a linha de custo oculto mais comum.

O Claude Fable 5.1 cobra a mais por contexto longo?

Não. A Anthropic cobra a janela completa de 1 milhão de tokens a tarifas padrão por token, sem faixa de contexto longo nem reprecificação por limiar; o cache de prompts e os descontos Batch se aplicam à janela inteira. Isso difere de modelos carro-chefe como o GPT-6 Astra, onde prompts acima de 272K tokens de entrada reprecificam a solicitação inteira a tarifas de contexto longo mais altas.

Reroteamentos de salvaguarda ou chamadas de ferramenta com falha são cobrados a preços do Fable?

Não. A Anthropic afirma que consultas automaticamente reroteadas por salvaguardas de cibersegurança ou biologia não são cobradas a preços do Fable; elas são concluídas pelo Opus 4.8 ou Opus 5. Pesquisas na web com falha não são cobradas, o web fetch não tem cobrança adicional e a execução de código é gratuita junto às ferramentas de busca ou fetch.

Dê o próximo passo

Deixe o Tabbit trabalhar ao seu lado.

Pesquise entre abas, automatize o trabalho repetitivo do navegador e mantenha todo o contexto ao alcance.