
Resumo rapido
O preco do Claude Fable 5.1 na API e de $10 por milhao de tokens de entrada e $50 por milhao de tokens de saida, sem alteracao em relacao ao Fable 5. A unica coisa que realmente mudou foram as leituras de cache, que cairam 75%, de $1 para $0,25 por milhao de tokens. A Anthropic estima que essa unica mudanca reduz o custo de uma carga de trabalho tipica em cerca de 25%, e o de uma carga fortemente agentica em ate 45%, ja que execucoes longas de agentes releem o mesmo prefixo em cache repetidamente.
O processamento em lote custa a metade ($5 de entrada / $25 de saida). A inferencia exclusiva dos EUA tem uma sobretaxa de 1,1x. O Fable 5.1 e o Claude atual mais caro em tarifas base (2x o Opus 5, 5x o Sonnet 5), mas sua leitura de cache a $0,25 e, na verdade, a mais barata dos tres. Ele esta disponivel no Pro, Max, Team, Enterprise e na API, mas nao no nivel gratuito.
Se voce esta calculando o preco do Fable 5.1 especificamente para atendimento ao cliente, lembre-se de que o modelo e infraestrutura, nao o produto. Voce paga a Anthropic por token; ainda precisa construir a recuperacao de informacao, as barreiras de seguranca e a logica de escalonamento por cima. Um teammate como o eesel roda sobre modelos como esse e cobra por ticket resolvido, entao o numero permanece previsivel, independentemente de quao "falante" o modelo subjacente seja.
Precos do Claude Fable 5.1 de forma resumida
Aqui esta toda a tabela de precos, direto da documentacao de precos da Claude Platform. Cada numero e por milhao de tokens (MTok), em USD.
| Medidor | Claude Fable 5.1 | Claude Fable 5 (anterior) |
|---|---|---|
| Entrada base | $10 / MTok | $10 / MTok |
| Saida | $50 / MTok | $50 / MTok |
| Leituras de cache (hits e atualizacoes) | $0,25 / MTok | $1 / MTok |
| Escritas de cache de 5 minutos | $12,50 / MTok | $12,50 / MTok |
| Escritas de cache de 1 hora | $20 / MTok | $20 / MTok |
O padrao a notar: quatro dos cinco numeros sao identicos aos do Fable 5. Isso nao e um novo nivel de preco, e a mesma tabela de precos do modelo com uma linha reescrita. Entao, se voce estava orcando com base no Fable 5, suas contas de entrada e saida nao mudam nada.
Mais uma coisa que vale a pena confirmar antes de fazer qualquer calculo: o Fable 5.1 usa o mesmo tokenizador do Fable 5 (o mesmo introduzido com o Opus 4.7). Comparado a modelos anteriores ao Opus 4.7, o mesmo texto produz aproximadamente 30% mais tokens, entao nao reutilize uma estimativa de tokens de um modelo pre-4.7 sem ajusta-la.
O unico numero que mudou: leituras de cache
Se voce for ler apenas uma secao, que seja esta. O preco da leitura de cache caiu de $1 para $0,25 por milhao de tokens, um corte de 75%.

Por que um unico medidor importa tanto? O cache de prompts permite armazenar um trecho de um prompt (um prompt de sistema, um documento grande, definicoes de ferramentas) uma vez e reutiliza-lo em chamadas posteriores, em vez de pagar o preco total de entrada a cada vez. No Fable 5.1, uma leitura de cache agora custa 0,025x o preco base de entrada, contra 0,1x em outros modelos Claude. O comprimento minimo de 512 tokens para cache permanece inalterado.
O motivo de isso impactar tanto o trabalho agentico: um agente de longa duracao releé o proprio contexto em cada etapa. Se o seu agente precisa de quarenta chamadas de ferramenta para concluir uma tarefa, ele esta lendo aquele prefixo em cache quarenta vezes. Corte o preco dessa leitura em tres quartos e a conta total se move muito, mesmo que os numeros principais de $10/$50 nunca tenham mudado. A mudanca recompensa exatamente o tipo de trabalho para o qual o Fable 5.1 foi construido.
O que a "economia efetiva" realmente significa
A Anthropic cita dois numeros de economia, e vale a pena le-los com atencao em vez de trata-los como um unico valor. O corte na leitura de cache reduz o custo de uma carga de trabalho tipica em cerca de 25%, e o de uma carga altamente agentica em ate 45%, em comparacao com o Fable 5.
Duas ressalvas sobre esses numeros, porque uma porcentagem so e tao boa quanto sua base:
- Eles sao medidos contra o Fable 5, nao contra o Opus 5 ou qualquer concorrente. E uma comparacao dentro do mesmo modelo.
- Foram medidos com esforco padrao ao longo de quatro semanas de uso real em agosto de 2026 no Claude Enterprise, Claude Code e na API. A sua mistura de tokens em cache versus novos determina onde voce cai nessa faixa de 25% a 45%. Uma carga de trabalho que usa pouco cache ve pouquissimo desse efeito.
Os profissionais que o usam no dia a dia relataram um padrao parecido. Uma equipe resumiu bem apos uma semana em loops multiagente:
"One team ran Claude Fable 5.1 for 7 days straight on multi-agent coding loops and cut token spend 25%"
Isso esta na extremidade inferior da faixa, mais ou menos o que se esperaria de um loop de codigo que nao e maximamente intensivo em cache.
Lote, exclusivo dos EUA e os demais itens
Duas tarifas ficam fora da tabela principal e mudam a conta para configuracoes especificas.
O processamento em lote funciona com 50% de desconto sobre a tarifa padrao: $5 por milhao de tokens de entrada e $25 por milhao de saida. Se o seu trabalho nao e sensivel a latencia (processamento de documentos durante a noite, classificacao em massa, avaliacoes offline), essa e a maior alavanca de toda a tabela, maior que o corte de cache para trabalhos nao interativos.
A inferencia exclusiva dos EUA esta disponivel para cargas de trabalho com exigencia de residencia de dados, a 1,1x o preco de entrada e saida. Ou seja, $11 de entrada / $55 de saida por milhao de tokens se voce precisar que cada solicitacao seja executada nos EUA.
O Claude Mythos 5.1, o mesmo modelo subjacente com salvaguardas mais leves, tem preco identico ao Fable 5.1. Nao e um nivel mais barato, e e limitado aos participantes do Project Glasswing (ciberdefensores e cientistas biologicos verificados), entao, para quase todo mundo, ele nao e uma opcao de compra de qualquer forma.
Fable 5.1 vs Opus 5 vs Sonnet 5
Precificar um unico modelo isoladamente esconde a decisao real, que e qual Claude voce deveria estar pagando. Aqui esta a familia atual, com tarifas de API por milhao de tokens, da tabela de precos da plataforma.

| Modelo | Entrada | Leitura de cache | Saida |
|---|---|---|---|
| Claude Fable 5.1 | $10 | $0,25 | $50 |
| Claude Opus 5 | $5 | $0,50 | $25 |
| Claude Sonnet 5 | $2 | $0,20 | $10 |
O ponto contraintuitivo: o Fable 5.1 e o Claude mais caro em entrada e saida base, o dobro do Opus 5 e cinco vezes o Sonnet 5, mas sua leitura de cache a $0,25 e a mais barata dos tres, ficando abaixo ate dos $0,50 do Opus 5. Isso nao e acidente. A Anthropic precificou o medidor que uma sessao de agente longa mais utiliza, entao quanto mais agentica for a sua carga de trabalho, mais essa diferenca joga a favor do Fable.
A propria orientacao da Anthropic e refrescantemente direta sobre quando realmente vale a pena pagar pelo Fable. A documentacao diz para comecar com o Opus 5 para a maioria das cargas de trabalho e recorrer ao Fable 5.1 somente quando o Opus 5 com maior esforco ainda ficar abaixo do esperado, ou para os projetos de longa duracao mais ambiciosos.

Pelo menos um desenvolvedor achou a conta com esforco mais baixo convincente por si so:
"Fable 5.1 at low effort is often competitive with Opus and Sonnet on $ / task while scoring higher. on CursorBench 3.2.0, Fable 5.1 at low effort is at parity w/ Fable 5 at high effort at a third of the cost."
O esforco e a alavanca que a maioria das pessoas ignora ao comparar tabelas de precos: um modelo com esforco baixo pensa menos e gasta menos tokens, entao o custo por tarefa de um modelo "caro" pode ser mais baixo do que a tarifa de etiqueta sugere. O pensamento adaptativo do Fable 5.1 esta sempre ativo e e controlado pelo parametro effort, com o valor padrao em alto.
Pelo que voce nao paga
Uma parte pequena, mas real, do preco do Claude Fable 5.1 e o que agora e gratuito e antes custava dinheiro em uma recusa.
O Fable 5.1 redireciona algumas solicitacoes para modelos de salvaguarda em vez de responder. Consultas de ciberseguranca marcadas caem para o Opus 4.8, consultas de biologia marcadas para o Opus 5, e, crucialmente, voce nao e cobrado pelos precos do Fable em uma solicitacao redirecionada. Tambem existe um credito de fallback que reembolsa o custo de cache de prompt ao trocar de modelo em uma solicitacao recusada, e voce nao e cobrado por uma recusa que chega antes de qualquer saida.
Esse detalhe de cobranca importa porque as recusas sao uma reclamacao recorrente. Desenvolvedores encontram falsos positivos no proprio codigo:
"Fable is useless. Me: "Find my security problems in my own code. This is code I own. I'm doing this under authorization of the CEO/CTO of our company." Fable: "yeah, no.""
Para ser justo com a Anthropic, a direcao aqui esta melhorando, nao piorando: usuarios do Claude Code podem esperar cerca de 60% menos intervencoes de ciberseguranca por sessao do que no Fable 5, e o Fable 5.1 agora consegue identificar vulnerabilidades de software de forma defensiva. O ponto para um orcamento e mais estreito: uma recusa e irritante, mas pelo menos nao aparece na sua fatura.
Disponibilidade por plano e onde voce pode chama-lo
A tabela de precos por token e a historia da API. Do lado do consumidor, o Fable 5.1 esta disponivel para usuarios Pro, Max, Team e Enterprise, e nao esta no nivel gratuito. Para os valores exatos da assinatura mensal em dolares, a Anthropic aponta para claude.com/pricing, que e a fonte da verdade a ser verificada em tempo real antes de citar um numero do Pro ou Max, ja que eles se movem independentemente das tarifas de API acima.
Uma nuance para quem esta em uma assinatura em vez da API: o esforco padrao varia por superficie. O Fable 5.1 usa alto esforco por padrao no Claude Code, e medio no Claude Cowork e no Claude.ai. Um esforco mais alto consome mais tokens, o que ajuda a explicar por que mesmo usuarios do Max relatam atingir limites de uso rapidamente em modelos da classe Fable.
Na API, voce pode chamar o claude-fable-5-1 em todas as principais plataformas: a API da Claude diretamente, Amazon Bedrock e Claude Platform na AWS, Google Cloud Vertex AI e Microsoft Foundry. A tabela de precos e a mesma independentemente de onde voce chama.
Estime o seu custo com o Claude Fable 5.1
Tabelas de precos sao abstratas ate voce colocar seus proprios numeros. Esta calculadora recebe volumes de tokens e a divisao entre entrada nova e em cache, e retorna um valor mensal nas tarifas do Fable 5.1, com Opus 5 e Sonnet 5 ao lado para comparacao. Tudo roda no seu navegador, nada e enviado a lugar nenhum.
Experimente a porcentagem de cache e voce vera todo o sentido da atualizacao 5.1: passe mais da sua entrada pelo cache e o total do Fable cai rapido, porque esse e o unico medidor que a Anthropic cortou de fato.
O modelo e infraestrutura, o eesel e o teammate
Aqui esta o que uma tabela de precos nao pode te dizer: o preco do token nao e o custo de resolver o seu problema, e o custo de um ingrediente bruto. O Claude Fable 5.1 e um modelo. Para transforma-lo em algo que de fato resolva um ticket de cliente, voce ainda precisa construir a recuperacao de informacao sobre seus documentos de ajuda, barreiras de seguranca para que ele nao invente com confianca uma politica de reembolso, um caminho de escalonamento para humanos e uma forma de testa-lo antes de tocar em um cliente real. Esse trabalho e onde vivem o gasto real e o risco real, nao na linha de $10 contra $50.
Essa e a lacuna que o eesel preenche. O eesel e uma plataforma de teammates de IA, e o seu teammate de suporte com IA chega ja sabendo fazer o trabalho: ele se conecta ao seu helpdesk existente, treina com seus tickets passados e sua base de conhecimento, e entra na fila como um novo contratado. Voce nao o monta a partir de um modelo e uma pilha de codigo improvisado. E como um agente de codigo, como Claude Code, Codex ou Cursor, pode conduzir o mesmo teammate por meio da CLI do eesel, a automacao que voce constroi e programavel de ponta a ponta, nao presa a um painel.
A diferenca de preco e a parte que importa para quem acabou de ler toda essa tabela de precos. A medicao por tokens e variavel por natureza: uma execucao de agente "tagarela" custa mais do que uma concisa, e voce descobre depois do fato. O eesel, em vez disso, cobra por ticket resolvido, entao a automacao de suporte permanece um item de linha previsivel, independentemente de quantas vezes o modelo subjacente releé o proprio contexto. Voce pode testar o eesel gratuitamente e roda-lo primeiro contra os seus proprios tickets historicos para ver a taxa de resolucao e o custo antes que ele responda a um cliente real.
Perguntas frequentes
Quanto custa o Claude Fable 5.1 por milhao de tokens?
O Claude Fable 5.1 e gratuito?
Por que o preco do Claude Fable 5.1 e mais alto que o do Opus 5 ou do Sonnet 5?
Qual e o desconto na leitura de cache do Claude Fable 5.1?
Como manter o preco do Claude Fable 5.1 previsivel em producao?

Article by
Kurnia Kharisma Agung Samiadjie
Kurnia is a software engineer and writer at eesel AI with two years of SEO experience, writing about AI tools, helpdesk software, and customer support. He pairs a developer's understanding of how these products are built with search-driven research into what actually ranks and resonates with the people searching for them.






