Precos do Claude Fable 5.1: todos os planos, modelos e custos de API explicados

Kurnia Kharisma Agung Samiadjie
Escrito por

Kurnia Kharisma Agung Samiadjie

Katelin Teen
Revisado por

Katelin Teen

Última edição September 8, 2026

Verificado por especialista
Ilustracao de uma tabela de precos da API do Claude Fable 5.1 com medidores de tokens e custos

Resumo rapido

O preco do Claude Fable 5.1 na API e de $10 por milhao de tokens de entrada e $50 por milhao de tokens de saida, sem alteracao em relacao ao Fable 5. A unica coisa que realmente mudou foram as leituras de cache, que cairam 75%, de $1 para $0,25 por milhao de tokens. A Anthropic estima que essa unica mudanca reduz o custo de uma carga de trabalho tipica em cerca de 25%, e o de uma carga fortemente agentica em ate 45%, ja que execucoes longas de agentes releem o mesmo prefixo em cache repetidamente.

O processamento em lote custa a metade ($5 de entrada / $25 de saida). A inferencia exclusiva dos EUA tem uma sobretaxa de 1,1x. O Fable 5.1 e o Claude atual mais caro em tarifas base (2x o Opus 5, 5x o Sonnet 5), mas sua leitura de cache a $0,25 e, na verdade, a mais barata dos tres. Ele esta disponivel no Pro, Max, Team, Enterprise e na API, mas nao no nivel gratuito.

Se voce esta calculando o preco do Fable 5.1 especificamente para atendimento ao cliente, lembre-se de que o modelo e infraestrutura, nao o produto. Voce paga a Anthropic por token; ainda precisa construir a recuperacao de informacao, as barreiras de seguranca e a logica de escalonamento por cima. Um teammate como o eesel roda sobre modelos como esse e cobra por ticket resolvido, entao o numero permanece previsivel, independentemente de quao "falante" o modelo subjacente seja.

Precos do Claude Fable 5.1 de forma resumida

Aqui esta toda a tabela de precos, direto da documentacao de precos da Claude Platform. Cada numero e por milhao de tokens (MTok), em USD.

MedidorClaude Fable 5.1Claude Fable 5 (anterior)
Entrada base$10 / MTok$10 / MTok
Saida$50 / MTok$50 / MTok
Leituras de cache (hits e atualizacoes)$0,25 / MTok$1 / MTok
Escritas de cache de 5 minutos$12,50 / MTok$12,50 / MTok
Escritas de cache de 1 hora$20 / MTok$20 / MTok

O padrao a notar: quatro dos cinco numeros sao identicos aos do Fable 5. Isso nao e um novo nivel de preco, e a mesma tabela de precos do modelo com uma linha reescrita. Entao, se voce estava orcando com base no Fable 5, suas contas de entrada e saida nao mudam nada.

A pagina de precos em tempo real da Claude Platform percorrendo toda a tabela de precos do modelo, retirada da documentacao da Anthropic

Mais uma coisa que vale a pena confirmar antes de fazer qualquer calculo: o Fable 5.1 usa o mesmo tokenizador do Fable 5 (o mesmo introduzido com o Opus 4.7). Comparado a modelos anteriores ao Opus 4.7, o mesmo texto produz aproximadamente 30% mais tokens, entao nao reutilize uma estimativa de tokens de um modelo pre-4.7 sem ajusta-la.

O unico numero que mudou: leituras de cache

Se voce for ler apenas uma secao, que seja esta. O preco da leitura de cache caiu de $1 para $0,25 por milhao de tokens, um corte de 75%.

Um grafico de barras mostrando o preco de leitura de cache do Claude Fable 5.1 caindo 75%, de $1,00 para $0,25 por milhao de tokens
Um grafico de barras mostrando o preco de leitura de cache do Claude Fable 5.1 caindo 75%, de $1,00 para $0,25 por milhao de tokens

Por que um unico medidor importa tanto? O cache de prompts permite armazenar um trecho de um prompt (um prompt de sistema, um documento grande, definicoes de ferramentas) uma vez e reutiliza-lo em chamadas posteriores, em vez de pagar o preco total de entrada a cada vez. No Fable 5.1, uma leitura de cache agora custa 0,025x o preco base de entrada, contra 0,1x em outros modelos Claude. O comprimento minimo de 512 tokens para cache permanece inalterado.

O motivo de isso impactar tanto o trabalho agentico: um agente de longa duracao releé o proprio contexto em cada etapa. Se o seu agente precisa de quarenta chamadas de ferramenta para concluir uma tarefa, ele esta lendo aquele prefixo em cache quarenta vezes. Corte o preco dessa leitura em tres quartos e a conta total se move muito, mesmo que os numeros principais de $10/$50 nunca tenham mudado. A mudanca recompensa exatamente o tipo de trabalho para o qual o Fable 5.1 foi construido.

O que a "economia efetiva" realmente significa

A Anthropic cita dois numeros de economia, e vale a pena le-los com atencao em vez de trata-los como um unico valor. O corte na leitura de cache reduz o custo de uma carga de trabalho tipica em cerca de 25%, e o de uma carga altamente agentica em ate 45%, em comparacao com o Fable 5.

Duas ressalvas sobre esses numeros, porque uma porcentagem so e tao boa quanto sua base:

  • Eles sao medidos contra o Fable 5, nao contra o Opus 5 ou qualquer concorrente. E uma comparacao dentro do mesmo modelo.
  • Foram medidos com esforco padrao ao longo de quatro semanas de uso real em agosto de 2026 no Claude Enterprise, Claude Code e na API. A sua mistura de tokens em cache versus novos determina onde voce cai nessa faixa de 25% a 45%. Uma carga de trabalho que usa pouco cache ve pouquissimo desse efeito.

Os profissionais que o usam no dia a dia relataram um padrao parecido. Uma equipe resumiu bem apos uma semana em loops multiagente:

"One team ran Claude Fable 5.1 for 7 days straight on multi-agent coding loops and cut token spend 25%"

Isso esta na extremidade inferior da faixa, mais ou menos o que se esperaria de um loop de codigo que nao e maximamente intensivo em cache.

Lote, exclusivo dos EUA e os demais itens

Duas tarifas ficam fora da tabela principal e mudam a conta para configuracoes especificas.

O processamento em lote funciona com 50% de desconto sobre a tarifa padrao: $5 por milhao de tokens de entrada e $25 por milhao de saida. Se o seu trabalho nao e sensivel a latencia (processamento de documentos durante a noite, classificacao em massa, avaliacoes offline), essa e a maior alavanca de toda a tabela, maior que o corte de cache para trabalhos nao interativos.

A inferencia exclusiva dos EUA esta disponivel para cargas de trabalho com exigencia de residencia de dados, a 1,1x o preco de entrada e saida. Ou seja, $11 de entrada / $55 de saida por milhao de tokens se voce precisar que cada solicitacao seja executada nos EUA.

O Claude Mythos 5.1, o mesmo modelo subjacente com salvaguardas mais leves, tem preco identico ao Fable 5.1. Nao e um nivel mais barato, e e limitado aos participantes do Project Glasswing (ciberdefensores e cientistas biologicos verificados), entao, para quase todo mundo, ele nao e uma opcao de compra de qualquer forma.

Fable 5.1 vs Opus 5 vs Sonnet 5

Precificar um unico modelo isoladamente esconde a decisao real, que e qual Claude voce deveria estar pagando. Aqui esta a familia atual, com tarifas de API por milhao de tokens, da tabela de precos da plataforma.

Uma escada de precos comparando Claude Fable 5.1, Opus 5 e Sonnet 5 em entrada, leitura de cache e preco de saida por milhao de tokens
Uma escada de precos comparando Claude Fable 5.1, Opus 5 e Sonnet 5 em entrada, leitura de cache e preco de saida por milhao de tokens
ModeloEntradaLeitura de cacheSaida
Claude Fable 5.1$10$0,25$50
Claude Opus 5$5$0,50$25
Claude Sonnet 5$2$0,20$10

O ponto contraintuitivo: o Fable 5.1 e o Claude mais caro em entrada e saida base, o dobro do Opus 5 e cinco vezes o Sonnet 5, mas sua leitura de cache a $0,25 e a mais barata dos tres, ficando abaixo ate dos $0,50 do Opus 5. Isso nao e acidente. A Anthropic precificou o medidor que uma sessao de agente longa mais utiliza, entao quanto mais agentica for a sua carga de trabalho, mais essa diferenca joga a favor do Fable.

A propria orientacao da Anthropic e refrescantemente direta sobre quando realmente vale a pena pagar pelo Fable. A documentacao diz para comecar com o Opus 5 para a maioria das cargas de trabalho e recorrer ao Fable 5.1 somente quando o Opus 5 com maior esforco ainda ficar abaixo do esperado, ou para os projetos de longa duracao mais ambiciosos.

Um fluxo de decisao em tres etapas: comecar com Sonnet 5 ou Opus 5, e recorrer ao Fable 5.1 somente quando o Opus 5 com alto esforco ficar abaixo do esperado em trabalho agentico de longo horizonte
Um fluxo de decisao em tres etapas: comecar com Sonnet 5 ou Opus 5, e recorrer ao Fable 5.1 somente quando o Opus 5 com alto esforco ficar abaixo do esperado em trabalho agentico de longo horizonte

Pelo menos um desenvolvedor achou a conta com esforco mais baixo convincente por si so:

"Fable 5.1 at low effort is often competitive with Opus and Sonnet on $ / task while scoring higher. on CursorBench 3.2.0, Fable 5.1 at low effort is at parity w/ Fable 5 at high effort at a third of the cost."

O esforco e a alavanca que a maioria das pessoas ignora ao comparar tabelas de precos: um modelo com esforco baixo pensa menos e gasta menos tokens, entao o custo por tarefa de um modelo "caro" pode ser mais baixo do que a tarifa de etiqueta sugere. O pensamento adaptativo do Fable 5.1 esta sempre ativo e e controlado pelo parametro effort, com o valor padrao em alto.

Pelo que voce nao paga

Uma parte pequena, mas real, do preco do Claude Fable 5.1 e o que agora e gratuito e antes custava dinheiro em uma recusa.

O Fable 5.1 redireciona algumas solicitacoes para modelos de salvaguarda em vez de responder. Consultas de ciberseguranca marcadas caem para o Opus 4.8, consultas de biologia marcadas para o Opus 5, e, crucialmente, voce nao e cobrado pelos precos do Fable em uma solicitacao redirecionada. Tambem existe um credito de fallback que reembolsa o custo de cache de prompt ao trocar de modelo em uma solicitacao recusada, e voce nao e cobrado por uma recusa que chega antes de qualquer saida.

Esse detalhe de cobranca importa porque as recusas sao uma reclamacao recorrente. Desenvolvedores encontram falsos positivos no proprio codigo:

Hacker News

"Fable is useless. Me: "Find my security problems in my own code. This is code I own. I'm doing this under authorization of the CEO/CTO of our company." Fable: "yeah, no.""

Para ser justo com a Anthropic, a direcao aqui esta melhorando, nao piorando: usuarios do Claude Code podem esperar cerca de 60% menos intervencoes de ciberseguranca por sessao do que no Fable 5, e o Fable 5.1 agora consegue identificar vulnerabilidades de software de forma defensiva. O ponto para um orcamento e mais estreito: uma recusa e irritante, mas pelo menos nao aparece na sua fatura.

Disponibilidade por plano e onde voce pode chama-lo

A tabela de precos por token e a historia da API. Do lado do consumidor, o Fable 5.1 esta disponivel para usuarios Pro, Max, Team e Enterprise, e nao esta no nivel gratuito. Para os valores exatos da assinatura mensal em dolares, a Anthropic aponta para claude.com/pricing, que e a fonte da verdade a ser verificada em tempo real antes de citar um numero do Pro ou Max, ja que eles se movem independentemente das tarifas de API acima.

Uma nuance para quem esta em uma assinatura em vez da API: o esforco padrao varia por superficie. O Fable 5.1 usa alto esforco por padrao no Claude Code, e medio no Claude Cowork e no Claude.ai. Um esforco mais alto consome mais tokens, o que ajuda a explicar por que mesmo usuarios do Max relatam atingir limites de uso rapidamente em modelos da classe Fable.

Na API, voce pode chamar o claude-fable-5-1 em todas as principais plataformas: a API da Claude diretamente, Amazon Bedrock e Claude Platform na AWS, Google Cloud Vertex AI e Microsoft Foundry. A tabela de precos e a mesma independentemente de onde voce chama.

Estime o seu custo com o Claude Fable 5.1

Tabelas de precos sao abstratas ate voce colocar seus proprios numeros. Esta calculadora recebe volumes de tokens e a divisao entre entrada nova e em cache, e retorna um valor mensal nas tarifas do Fable 5.1, com Opus 5 e Sonnet 5 ao lado para comparacao. Tudo roda no seu navegador, nada e enviado a lugar nenhum.

Experimente a porcentagem de cache e voce vera todo o sentido da atualizacao 5.1: passe mais da sua entrada pelo cache e o total do Fable cai rapido, porque esse e o unico medidor que a Anthropic cortou de fato.

O modelo e infraestrutura, o eesel e o teammate

Aqui esta o que uma tabela de precos nao pode te dizer: o preco do token nao e o custo de resolver o seu problema, e o custo de um ingrediente bruto. O Claude Fable 5.1 e um modelo. Para transforma-lo em algo que de fato resolva um ticket de cliente, voce ainda precisa construir a recuperacao de informacao sobre seus documentos de ajuda, barreiras de seguranca para que ele nao invente com confianca uma politica de reembolso, um caminho de escalonamento para humanos e uma forma de testa-lo antes de tocar em um cliente real. Esse trabalho e onde vivem o gasto real e o risco real, nao na linha de $10 contra $50.

Essa e a lacuna que o eesel preenche. O eesel e uma plataforma de teammates de IA, e o seu teammate de suporte com IA chega ja sabendo fazer o trabalho: ele se conecta ao seu helpdesk existente, treina com seus tickets passados e sua base de conhecimento, e entra na fila como um novo contratado. Voce nao o monta a partir de um modelo e uma pilha de codigo improvisado. E como um agente de codigo, como Claude Code, Codex ou Cursor, pode conduzir o mesmo teammate por meio da CLI do eesel, a automacao que voce constroi e programavel de ponta a ponta, nao presa a um painel.

A diferenca de preco e a parte que importa para quem acabou de ler toda essa tabela de precos. A medicao por tokens e variavel por natureza: uma execucao de agente "tagarela" custa mais do que uma concisa, e voce descobre depois do fato. O eesel, em vez disso, cobra por ticket resolvido, entao a automacao de suporte permanece um item de linha previsivel, independentemente de quantas vezes o modelo subjacente releé o proprio contexto. Voce pode testar o eesel gratuitamente e roda-lo primeiro contra os seus proprios tickets historicos para ver a taxa de resolucao e o custo antes que ele responda a um cliente real.

Perguntas frequentes

Quanto custa o Claude Fable 5.1 por milhao de tokens?
O preco do Claude Fable 5.1 na API e de $10 por milhao de tokens de entrada e $50 por milhao de tokens de saida, a mesma tarifa base do Fable 5. A mudanca esta nas leituras de cache, que cairam de $1 para $0,25 por milhao de tokens. Os numeros completos estao na pagina de precos da Anthropic.
O Claude Fable 5.1 e gratuito?
Nao. O Fable 5.1 esta disponivel para assinantes Pro, Max, Team e Enterprise e na API, mas nao no nivel gratuito. Se voce esta testando um agente de suporte com IA em vez de um modelo puro, a maioria das plataformas oferece um teste gratuito, independentemente de qual modelo roda por baixo.
Por que o preco do Claude Fable 5.1 e mais alto que o do Opus 5 ou do Sonnet 5?
O Fable 5.1 e o modelo mais capaz da Anthropic, por isso suas tarifas base de entrada e saida sao 2x as do Opus 5 e 5x as do Sonnet 5. A propria orientacao da Anthropic e comecar com o Opus 5 para a maioria dos trabalhos e recorrer ao Fable 5.1 somente quando uma tarefa realmente precisar.
Qual e o desconto na leitura de cache do Claude Fable 5.1?
As leituras de cache no Fable 5.1 custam $0,25 por milhao de tokens, uma queda de 75% em relacao ao $1 do Fable 5. A Anthropic estima que isso reduz cargas de trabalho tipicas em cerca de 25% e cargas altamente agenticas em ate 45%, porque sessoes de agentes longas releem um prefixo em cache repetidamente.
Como manter o preco do Claude Fable 5.1 previsivel em producao?
A medicao por tokens e variavel por natureza, entao uma execucao longa de um agente de IA pode custar alguns dolares enquanto uma curta custa centavos. Se voce precisa de um numero fixo por ticket para automacao de suporte, um teammate como o eesel cobra por resolucao em vez de repassar os custos brutos de tokens para voce.

Share this article

Kurnia Kharisma Agung Samiadjie

Article by

Kurnia Kharisma Agung Samiadjie

Kurnia is a software engineer and writer at eesel AI with two years of SEO experience, writing about AI tools, helpdesk software, and customer support. He pairs a developer's understanding of how these products are built with search-driven research into what actually ranks and resonates with the people searching for them.

Related Posts

All posts →
Illustration of a person weighing a small low-cost AI model against a larger caped flagship model on pedestals
Trending

Claude Opus 5 vs Fable 5: qual você deveria realmente usar?

O Fable 5 custa exatamente o dobro do Opus 5. Passei pelas duas system cards, pela documentação e pelos benchmarks independentes para descobrir quando esse dólar a mais realmente compra alguma coisa.

Rama Adi NugrahaRama Adi NugrahaJul 27, 2026
Ilustração de preços por token e pilhas de custo para o modelo Claude Mythos 5.1
Trending

Preços do Claude Mythos 5.1: cada tarifa, o corte na leitura de cache e quem realmente pode usá-lo

Um detalhamento completo dos preços do Claude Mythos 5.1: tarifas base, batch, escritas de cache e a leitura de cache de US$ 0,25 que é a verdadeira novidade, além de por que o Mythos custa o mesmo que o Fable 5.1.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieSep 8, 2026
Uma ilustração comparando Claude Mythos 5.1 e Fable 5.1 como o mesmo modelo subjacente atrás de camadas de segurança diferentes
Trending

Análise do Claude Mythos 5.1: vale a pena correr atrás do modelo de fronteira trancado da Anthropic?

Uma análise prática do Claude Mythos 5.1: o que é, como se compara ao Fable 5.1, o preço real da leitura de cache, quem realmente consegue acessá-lo e o que eu usaria no lugar dele.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieSep 8, 2026
Uma ilustração da porta de um cofre sendo aberta por uma pequena lista aprovada de pesquisadores, representando o acesso apenas por convite ao Claude Mythos 5.1
Trending

Claude Mythos 5.1: o que é, quem tem acesso e o que usar no lugar

Claude Mythos 5.1 foi lançado em 1º de setembro de 2026, e quase ninguém consegue usá-lo. Aqui está a ficha técnica real, os dois programas de acesso e o modelo que você deveria realmente rodar.

Alicia Kirana UtomoAlicia Kirana UtomoSep 2, 2026
Uma ilustração de uma pessoa a selecionar um dos cinco reguladores de esforço de raciocínio numa barra de controlo ao estilo Claude Opus 5
Trending

Claude Opus 5: o que é e como realmente utilizá-lo

O Claude Opus 5 não é um modelo, são cinco. Um guia simples sobre as especificações, o regulador de esforço que decide a sua fatura, e as duas alterações da API que quebram código antigo.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieAug 5, 2026
Uma ilustração de uma pessoa selecionando um dos cinco controles de esforço de raciocínio em uma barra de controle no estilo Claude Opus 5
Trending

Claude Opus 5: o que é e como usar de verdade

Claude Opus 5 não é um modelo, são cinco. Um guia prático sobre as especificações, o controle de esforço que decide sua fatura e as duas mudanças de API que quebram código antigo.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieAug 5, 2026
Illustration comparing a heavyweight reasoning model against a fast balanced model on cost and capability
Trending

Claude Opus 5 vs Sonnet 5: qual usar?

O Claude Opus 5 custa 1,7x o preço por token do Sonnet 5 e ainda assim termina algumas tarefas mais barato. Aqui está o confronto direto sobre preço, benchmarks e custo real por tarefa.

Rama Adi NugrahaRama Adi NugrahaJul 27, 2026
Illustration of a developer at a laptop watching an agentic coding loop run through code, checks and a bot
Trending

Análise do Claude Opus 5: programação quase de ponta pela metade do preço

Uma análise prática do Claude Opus 5: o que os benchmarks realmente mostram, a taxa de alucinação que subiu, e se ele tem lugar numa fila de suporte em produção.

Alicia Kirana UtomoAlicia Kirana UtomoJul 27, 2026
Imagem do banner para a análise do Claude Sonnet 4.6: O ponto ideal entre desempenho e preço
Guides

Análise do Claude Sonnet 4.6: O ponto ideal entre desempenho e preço

O Claude Sonnet 4.6 da Anthropic supera as expectativas com desempenho de codificação de nível avançado, uma janela de contexto de 1 milhão de tokens e melhorias significativas em relação ao Sonnet 4.5.

Stevia PutriStevia PutriFeb 26, 2026

Pronto para contratar seu colega de IA?

Configure em minutos. Sem cartão de crédito necessário.

Comece grátis