Claude Opus 5: o que é e como realmente utilizá-lo

Kurnia Kharisma Agung Samiadjie
Escrito por

Kurnia Kharisma Agung Samiadjie

Katelin Teen
Revisado por

Katelin Teen

Última edição August 4, 2026

Verificado por especialista
Uma ilustração de uma pessoa a selecionar um dos cinco reguladores de esforço de raciocínio numa barra de controlo ao estilo Claude Opus 5

Resumo

24 de julho de 2026 foi a data de lançamento do Claude Opus 5. O preço: $5 por milhão de tokens de entrada e $25 por milhão de saída. Exatamente o que custava o Opus 4.8, o que pegou muita gente desprevenida. Depois o resto da folha de especificações, rapidamente. ID do modelo claude-opus-5. Contexto de 1M de tokens, saída máxima de 128k, e um corte de conhecimento situado em maio de 2026. A documentação da Anthropic agora recomenda começar aqui, e só subir para o Fable 5 quando o limite máximo for mesmo o que precisa.

A maioria dos artigos salta a próxima parte. «Claude Opus 5» não é um modelo, são cinco. O parâmetro effort vai de low a max, e a Artificial Analysis avalia cada configuração como uma entrada separada, o que é bastante justo, porque é assim que ele se comporta. 497 pontos Elo de diferença em trabalho de conhecimento de longo alcance. Cerca de 8 vezes mais tokens de saída do extremo inferior ao superior do regulador. Por isso, quando as pessoas discutem online se o Opus 5 é absurdamente barato ou um forno de tokens, o que estão realmente a discutir é qual das cinco configurações cada um usou.

Há um limite que vale a pena nomear desde já, e eu encontro-o quase todas as semanas: este modelo demora 63 segundos a produzir o seu primeiro token com esforço max. Trabalhador em segundo plano. Essa é a categoria a que pertence. Aponte-o para uma janela de chat em direto e a espera por si só termina a conversa por si, e depois de alguns anos a colocar agentes de IA em filas de suporte reais na eesel, a lição que continuo a reaprender é que o modelo nunca foi a parte difícil desse trabalho.

O que realmente é o Claude Opus 5

Em cerca de dois meses, a Anthropic lançou quatro versões da geração Claude 5, e o Opus 5 é a quarta. Posiciona-se diretamente acima do Opus 4.8, a um preço que não mudou. A mensagem de lançamento diz que «se aproxima da inteligência de fronteira do Claude Fable 5 a metade do preço». De forma pouco habitual para uma mensagem de lançamento, os números independentes confirmam-no, na sua maioria.

Aqui estão as especificações, retiradas da visão geral dos modelos:

EspecificaçãoClaude Opus 5
ID do modelo na API da Claudeclaude-opus-5
ID AWS Bedrockanthropic.claude-opus-5
ID Google Cloudclaude-opus-5
Janela de contexto1M de tokens, sem cabeçalho beta, sem sobretaxa de contexto longo
Saída máxima128k síncrono, 300k na API Batch
Preço$5 / $25 por MTok
Thinking adaptativoSim, ativado por predefinição
Níveis de esforçolow, medium, high, xhigh, max
Corte de conhecimentoMaio de 2026
Web fetchNão suportado
Priority TierNão suportado

Duas linhas aí tendem a surpreender as pessoas. Primeiro, a janela de contexto de 1M é cobrada a taxas padrão, por isso um pedido de 900k tokens fatura por token à mesma taxa que um de 9k, como explica a documentação de preços. Segundo, não há Priority Tier de todo. O Opus 4.8 mantém um, por isso quem tiver um compromisso de capacidade tem de planear essa parte separadamente.

Se a sua última olhada nesta família foi há algumas versões, vale a pena registar o ritmo. A minha análise do Opus 4.5 tem apenas alguns meses e já se lê como uma ferramenta de outro nível, com o Opus 4.6 a situar-se algures no meio.

«Claude Opus 5» são cinco modelos com um só nome

Tudo o resto neste artigo é reformulado por esta única parte, por isso quero dedicar-lhe tempo real aqui.

O parâmetro effort não é um regulador de qualidade que se ajusta ao gosto. Em toda a API é, de longe, a maior palanca para o custo e a latência, e também para a qualidade da saída, e a distância entre os seus dois extremos é maior do que aquilo que separa a maioria dos modelos concorrentes.

Um diagrama que mostra o único ID de modelo claude-opus-5 a abrir-se em cinco configurações de esforço, de low com 1223 Elo até max com 1720 Elo e $17.79 por tarefa
Um diagrama que mostra o único ID de modelo claude-opus-5 a abrir-se em cinco configurações de esforço, de low com 1223 Elo até max com 1720 Elo e $17.79 por tarefa

A Artificial Analysis passou cada configuração pelo AA-Briefcase. Esse benchmark cobre trabalho de conhecimento de longo alcance, construído sobre projetos de várias semanas com milhares de ficheiros de origem. A dispersão é a verdadeira história aqui:

Configuração de esforçoAA-Briefcase EloCusto por tarefaMinutos por tarefaTurnos por tarefa
max1720$17.7936.2103
xhigh1693$14.2634.391
high1606$10.4125.776
medium1470não publicado
low1223não publicado
Claude Fable 5, para comparação1574$22.30

Compare a linha do Fable 5 com a linha high e o que sai é o melhor dado de valor de todo o conjunto: com esforço high, o Opus 5 supera o Fable 5 por 32 Elo, e fá-lo a $10.41 por tarefa, menos de metade do preço do Fable. Agora leia a mesma linha contra low. 1223, que está abaixo do GLM-5.2. Mesmo ID de modelo, mesma semana, e ambas são verdade.

O GDPval-AA v2 mostra a mesma forma, onde os níveis de esforço abrangem 407 pontos Elo e o consumo de tokens de saída anda em torno de 8 vezes mais de low a max.

Gráfico que representa o score Elo em relação ao custo do benchmark no GDPval-AA v2, com Opus 5, Fable 5, Opus 4.8 e GPT-5.6 Sol cada um desenhado como uma escada de esforço de cinco pontos, retirado da Anthropic
Gráfico que representa o score Elo em relação ao custo do benchmark no GDPval-AA v2, com Opus 5, Fable 5, Opus 4.8 e GPT-5.6 Sol cada um desenhado como uma escada de esforço de cinco pontos, retirado da Anthropic

Vale a pena notar o que o gráfico admite: na extremidade barata da escada, o GPT-5.6 Sol fica acima do Opus 5 e não abaixo. Só quando se paga dinheiro real por tarefa é que a linha da Anthropic passa para a frente. Uma única classificação em destaque esconde exatamente esse tipo de detalhe.

Mais uma complicação, e este é o número mais estranho de todo o lançamento. No FrontierCode 1.1 da Cognition, o melhor score do Opus 5 cai no esforço medium. Não max. A Anthropic explica porquê diretamente no system card: com esforço mais alto, o modelo «faz mais alterações do que a tarefa exige», e as edições fora do âmbito são penalizadas pelo avaliador. Adicionar uma breve instrução para se manter dentro do âmbito «recuperou o desempenho na maioria destas tarefas». Mais thinking, então, não é monotonamente melhor, e em pelo menos um benchmark de código real, é pior.

Escolha o seu nível de esforço

Em vez de o obrigar a voltar a essa tabela, aqui está a mesma decisão apresentada como um seletor. Escolha a configuração que planeava usar, e veja o que lhe traz.

O que cada nível de esforço do Claude Opus 5 realmente lhe dá

Elo, custo, tempo real e número de turnos são medições da Artificial Analysis AA-Briefcase. Escolha uma configuração.

AA-Briefcase Elo1223
Custo por tarefanão publicado
Tokens de saída~1/8 de max
FrontierBench25%
Use para: classificação, extração, etiquetagem, resumir um documento conhecido. Nesta configuração, o Opus 5 obtém um score abaixo do GLM-5.2 em trabalho de longo alcance, por isso é a ferramenta errada para qualquer coisa aberta. No FrontierBench alcança 25% com 64% menos tokens de saída do que a configuração mais alta.
AA-Briefcase Elo1470
AutomationBench24% a $0.89
FrontierCode 1.1o melhor de todas as configurações
Turnosmenos do que high
Use para: a maioria do coding do dia a dia. Esta é a configuração onde os próprios números do FrontierCode da Anthropic atingem o pico, e onde o AutomationBench chega a 24% por $0.89 por tarefa, superando tanto o Opus 4.8 como o Fable 5 a menos de metade do seu custo. Se só se lembrar de uma linha deste widget, que seja esta.
AA-Briefcase Elo1606
Custo por tarefa$10.41
Minutos por tarefa25.7
Turnos por tarefa76
Use para: a predefinição, e a Anthropic diz isso explicitamente. Supera o Fable 5 por 32 Elo a menos de metade do custo por tarefa do Fable, e é a configuração que produziu o score de destaque de 30.2% no ARC-AGI-3. Comece aqui, e desça antes de subir.
AA-Briefcase Elo1693
Custo por tarefa$14.26
Minutos por tarefa34.3
FrontierBench44.4%, o pico
Use para: engenharia agêntica difícil onde já experimentou high e não foi suficiente. Este é o melhor score do FrontierBench, e no GDPval continua a superar todos os outros modelos enquanto consome 25% menos tokens de saída do que max. Note que `thinking: disabled` é rejeitado acima de high, por isso esta configuração pensa sempre.
AA-Briefcase Elo1720
Custo por tarefa$17.79
Minutos por tarefa36.2
Turnos por tarefa103
Use para: quase nada de forma regular. É o melhor score em cada leaderboard publicado pela Anthropic, e custa 71% mais por tarefa do que high por 114 Elo adicionais, demora 36 minutos, e corre 103 turnos contra os 55 do Opus 4.8. Apenas para trabalho por lotes e execuções de investigação.

Fontes: execuções AA-Briefcase e Intelligence Index da Artificial Analysis, mais o system card do Opus 5 da Anthropic. Os valores de custo são por tarefa de benchmark, não por chamada à API.

Por que ninguém se entende online sobre se é barato

Quando o regulador de esforço fica claro na cabeça, o caos da semana de lançamento deixa de parecer confuso por completo.

Dentro das mesmas 48 horas, o Reddit teve dois tópicos de topo que se contradiziam completamente. Um grupo publicou que o consumo de tokens é incrível, e um utilizador de r/ClaudeCode relatou ali oito horas de trabalho por 5% de uma quota semanal. O outro grupo publicou sobre esgotar o limite de 5 horas 10 vezes mais rápido, descrevendo um limite que costumavam atingir em seis horas e que agora chega em menos de duas. Depois um tópico intitulado, literalmente, so which is it atraiu mais de 150 comentários de pessoas a perguntar sobre a contradição.

O Hacker News chegou à resposta mais rápido do que a cobertura dos benchmarks:

Hacker News

«O gráfico mostra esforço max, usado principalmente por utilizadores empresariais pouco sensíveis ao preço. Com esforço medium cai para quase metade do custo do K3, e é provavelmente suficiente para 95% das tarefas de código.»

Hacker News

«Ele pensa demasiado acima do esforço medium, experimente usar esse.»

Por baixo dessa primeira causa está uma segunda, e esta apanha pessoas que nunca tocaram no parâmetro effort. O thinking está ativado por predefinição no Opus 5 e não estava no Opus 4.8, por isso um pedido que nunca alterou agora gasta tokens em raciocínio que antes ignorava. Alguém detetou isto nas notas de migração poucas horas depois do lançamento:

Hacker News

«As breaking changes em relação ao Opus 4.8 são interessantes: 1. Thinking ativado por predefinição: no Claude Opus 4.8, pedidos sem um campo thinking correm sem thinking; no Claude Opus 5, os mesmos pedidos correm com thinking adaptativo. 2. Desativar o thinking está limitado a esforço high»

Ambos os lados, então, estavam a dizer a verdade. Apenas sobre configurações diferentes do mesmo modelo. É essa toda a discussão.

As duas coisas que quebram quando migra

A Anthropic chama ao Opus 5 «uma atualização direta do Claude Opus 4.8 ao mesmo preço», e o guia de migração depois lista exatamente duas breaking changes.

O thinking está ativado por predefinição. No 4.8, um pedido sem campo thinking corria sem thinking; no Opus 5 esse mesmo pedido corre com thinking adaptativo. E como max_tokens limita a saída total, raciocínio incluído, qualquer carga de trabalho que antes corria ajustada deve rever o seu limite antes que comece a truncar os resultados.

Desativar o thinking está limitado a high. Enviar thinking: {type: "disabled"} continua a funcionar, mas combinado com xhigh ou max recebe de volta um erro 400. Essa verificação corre por pedido, o que significa que aumentar o esforço a meio de uma conversa com o thinking desativado é rejeitado mesmo quando turnos anteriores passaram sem problemas. A Anthropic também avisa que, com o thinking desativado, o modelo «pode ocasionalmente emitir tool calls como texto simples ou incluir tags XML internas na sua saída visível».

O resto da atualização é só vantagem, e algumas partes valem a pena ativar deliberadamente:

  • O limite mínimo da cache de prompts desceu para 512 tokens, vindo de 1.024 no Opus 4.8 e 4.096 no Opus 4.6. System prompts curtos que nunca eram armazenáveis em cache agora são, e não é necessária qualquer alteração de código para isso.
  • As alterações de ferramentas a meio da conversa, escondidas por trás do cabeçalho beta mid-conversation-tool-changes-2026-07-01, permitem adicionar ou remover ferramentas entre turnos, e os acertos de cache dos turnos anteriores sobrevivem a isso.
  • Um parâmetro fallbacks envia as recusas do classificador cibernético para o Opus 4.8 em vez de devolver um erro, de modo que os pedidos «são sempre encaminhados por predefinição para o melhor modelo disponível em vez de serem bloqueados». O problema está na disponibilidade: não está na API Batch, não está na Bedrock, e não está no Google Cloud nem na Microsoft Foundry.
  • O Opus 5 tem o seu próprio bucket de limite de taxa. A página de limites de taxa é explícita quanto a não fazer parte do pool combinado Opus 4.x, e indica o bucket em 1.000 RPM com 2.000.000 de tokens de entrada por minuto.

Duas alterações de prompting são fáceis de não notar aqui. A Anthropic diz para remover quaisquer instruções de verificação transportadas de antes, porque «o Claude Opus 5 verifica o seu próprio trabalho sem que lhe seja pedido», e diz também para limitar a geração de subagentes, já que o modelo delega mais facilmente do que os seus antecessores. O Claude Code levou esse segundo ponto suficientemente a sério para lançar uma instrução codificada a dizer ao Opus 5 para não usar subagentes. A reação no HN dividiu-se, previsivelmente.

Até onde chega, e até onde não chega

O destaque é bastante real. No seu Intelligence Index, a Artificial Analysis coloca o Opus 5 com esforço max em 61, posição #1 contra uma mediana de classe de 32. Antes de se entusiasmar, leia os seguidores: Fable 5 com 60, GPT-5.6 Sol com 59, Kimi K3 com 57, depois Opus 4.8 com 56. As próprias palavras da Artificial Analysis para o Opus 5 são «por pouco, o modelo mais inteligente», e toda a fronteira cabe dentro de uma faixa de cinco pontos.

Onde estão as vitórias amplas e inequívocas é tudo num único lugar: o trabalho agêntico. O AutomationBench da Zapier coloca um agente numa empresa simulada com dezenas de endpoints REST distribuídos por 47 apps, e ali o Opus 5 obtém 26.0% contra 17.0 do Opus 4.8, 17.4 do Fable 5 e 18.1 do GPT-5.6 Sol.

Gráfico da taxa de aprovação do AutomationBench em relação ao custo por tarefa, com a escada de esforço do Opus 5 situada bem acima do Fable 5, Opus 4.8 e GPT-5.6 Sol, retirado da Anthropic
Gráfico da taxa de aprovação do AutomationBench em relação ao custo por tarefa, com a escada de esforço do Opus 5 situada bem acima do Fable 5, Opus 4.8 e GPT-5.6 Sol, retirado da Anthropic

O outro verdadeiro caso atípico é o ARC-AGI-3, com 30.16% de Relative Human Action Efficiency contra os 7.78% do GPT-5.6 Sol. E vale a pena assinalar para o argumento deste artigo: esse score saiu do esforço high, não max.

Gráfico do score ARC-AGI-3 em relação ao custo total de avaliação, mostrando o Opus 5 com esforço high perto de 30% e o GPT-5.6 Sol abaixo de 10%, retirado da Anthropic
Gráfico do score ARC-AGI-3 em relação ao custo total de avaliação, mostrando o Opus 5 com esforço high perto de 30% e o GPT-5.6 Sol abaixo de 10%, retirado da Anthropic

Agora a outra coluna, a honesta. A Artificial Analysis mediu 53% no Humanity's Last Exam, «em linha com o Fable 5», portanto um empate e não uma vitória. Na física de fronteira do CritPt iguala o Fable 5, ficando atrás de três modelos da OpenAI. O Terminal-Bench v2.1 dá-lhe 89%, o que está «aproximadamente em linha» com o líder. A própria Anthropic diz que o Opus 5 fica atrás do Mythos 5 em investigação biológica, e também em cibersegurança ofensiva.

Depois há o leaderboard que finalmente tem dados. No lançamento, o LMArena não tinha nenhuma entrada para o Opus 5, por isso ninguém podia dizer o que os humanos pensavam dele. No início de agosto já está listado. A resposta não é a que o Intelligence Index previria.

Uma comparação de duas colunas mostrando o Claude Opus 5 classificado em primeiro lugar no Artificial Analysis Intelligence Index e em sétimo lugar na preferência humana cega do LMArena
Uma comparação de duas colunas mostrando o Claude Opus 5 classificado em primeiro lugar no Artificial Analysis Intelligence Index e em sétimo lugar na preferência humana cega do LMArena

No leaderboard de texto do LMArena, claude-opus-5-high fica na posição 7 com 1492 Elo, e claude-opus-5-max na posição 8 com 1490. Acima de ambos: Fable 5 com 1509, mais três modelos Claude mais antigos. Os benchmarks que medem a conclusão de tarefas, e os humanos que votam na resposta de que mais gostaram, estão a medir duas coisas diferentes, e o Opus 5 demonstra essa lacuna com clareza. A comunidade colocou isso em termos mais simples:

Hacker News

«Comparei o estilo de escrita do Opus 5 com o Fable 5, e o Opus 5 continua muitos dos "claude-ismos" do seu antecessor 4.8, dos quais o Fable se afastou.»

Como consegui-lo de verdade

Seis caminhos até lá, e não dão todos a mesma coisa.

CaminhoO que obtémNotas
Claude Free, $0Nenhum OpusApenas Sonnet e Haiku, contexto de 200k
Claude Pro, $20/mêsOpus 5 como o modelo mais forte disponível$17/mês com faturação anual. Fable através de créditos de utilização
Claude Max 5x, $100/mêsOpus 5 como modelo predefinidoFable limitado a 50% dos limites semanais
Claude Max 20x, $200/mêsIgual, 20x a utilização do Pro por sessãoLimites baseados em sessão, não em contagem de mensagens
Claude Team, $25/lugar/mêsAs quatro famílias de modelos$20/lugar com faturação anual, equipas de 2 a 150
Claude APIclaude-opus-5 a $5 / $25O Batch reduz isso a metade, acertos de cache custam $0.50

O Claude Code vem incluído em todos os planos pagos e utiliza a mesma reserva. Se o seu seletor ainda mostrar 4.8, /model claude-opus-5 funciona diretamente, e em versões mais antigas da CLI, /model claude-opus-5[1m] dá-lhe a variante de contexto de 1M. Também vale a pena saber: o Claude Code inicialmente só expunha uma janela de 200K para ele, que é exatamente o tipo de coisa para a qual existem as minhas notas sobre a janela de contexto do Claude Code.

Nas plataformas cloud, Bedrock e Google Cloud são operadas por parceiros, faturam-lhe diretamente, e os endpoints regionais têm uma sobretaxa de 10% em relação aos globais. A Claude Platform na AWS fatura em Claude Consumption Units a $0.01 por CCU, e o mesmo faz a Microsoft Foundry. Além dos tokens, os Managed Agents adicionam $0.08 por hora de sessão de tempo de execução ativo.

O Fast mode é o único caminho com condições reais. Até 2.5x mais tokens de saída por segundo, exatamente ao dobro do preço, $10 e $50, aplicado em toda a janela de contexto. As condições: ainda é uma research preview, apenas na API da Claude de primeira parte, restringido por uma lista de espera ou um account manager, e não funciona com Batch. Por token, essas taxas caem no mesmo lugar do Fable 5 padrão, por isso o que se está a comprar ali é latência e não capacidade. A minha análise de preços do Claude Opus 5 analisa o que isso faz a uma fatura mensal, enquanto os preços do Claude Code cobrem o lado da CLI.

O muro entre o Opus 5 e um cliente em direto

Tudo o que foi dito acima foi sobre escolher uma configuração. Esta secção é sobre o sítio onde nenhuma configuração ajuda.

Uma linha temporal mostrando três zonas de latência, com o Claude Opus 5 com esforço max situado na zona de minutos a meia hora, atrás de um muro de latência marcado
Uma linha temporal mostrando três zonas de latência, com o Claude Opus 5 com esforço max situado na zona de minutos a meia hora, atrás de um muro de latência marcado

Neste momento, a Artificial Analysis mede o Opus 5 em 55.7 tokens de saída por segundo, o que é a posição #111 de 184, e o tempo até ao primeiro token situa-se em 63.43 segundos. Baixar o esforço recupera muito pouca velocidade. As três configurações mais altas no AA-Briefcase têm em média mais de 25 minutos por tarefa. A frase que a Artificial Analysis escreveu sobre ele: o Opus 5 está «entre os modelos líderes em inteligência, mas particularmente caro em comparação com outros modelos de preço semelhante. É também notavelmente lento e muito verboso».

O segundo número é o que mais me importa, e aponta no sentido contrário ao marketing. Em relação ao Opus 4.8, o Opus 5 ganhou 7 pontos de precisão no AA-Omniscience, e ao mesmo tempo a sua taxa de alucinação subiu 14 pontos, para 50%, pela razão de que responde mais vezes quando está incerto. O próprio system card da Anthropic diz isso claramente: «O modelo alucina afirmações factuais ligeiramente mais do que o Opus 4.8, apesar de ser mais preciso em geral».

Para um agente de código que volta a correr os seus próprios testes, essa troca está bem. Agora ponha a mesma troca numa resposta de suporte que sai para um cliente pagante com o seu logótipo associado. Uma resposta errada dita com confiança é ali o modo de falha que lhe custa a conta, e é por isso que prevenir alucinações no suporte acaba por ser um problema de design de produto em vez de um problema de seleção de modelo.

Já vi isto a desenrolar-se vezes suficientes para ser direto sobre o assunto. Algo como 10% de uma implementação de suporte que funciona é o modelo. Os outros 90% são recuperação de conhecimento que se mantém atualizada, mais um limiar de confiança que decide o que a IA sequer pode tocar, uma passagem de simulação sobre tickets históricos para que a taxa de resposta seja conhecida antes de qualquer cliente a ver, e depois uma transferência que não deixa cair o contexto. Um cliente eesel, que opera uma rede de caixas automáticas de criptomoedas, colocou o lado de construir versus comprar melhor do que eu conseguiria:

«Podíamos tentar escrever a nossa própria aplicação de LLM, mas não queríamos investir o nosso tempo nisso. Queríamos algo que não tivéssemos de manter.»

Karel, GENERAL BYTES

Uma responsável de CX numa marca de suplementos DTC descreveu depois o problema de controlo numa frase que me ficou na memória durante anos: a IA nunca vai responder a 100% das perguntas, por isso o que ela precisava era de uma IA que tratasse apenas dos tickets de que tem confiança e deixasse o resto em paz. Nenhum parâmetro effort lhe dá isso. É uma decisão de encaminhamento, e é tomada fora do modelo.

Experimente a eesel

Se chegou aqui porque está a escolher um modelo para uma fila de suporte, o conselho honesto é este: o Opus 5 é um bom motor, e o motor nunca foi o seu ponto de estrangulamento. A eesel é a parte que envolve tudo isso. Liga-se ao helpdesk que já utiliza, treina com os seus tickets passados e o seu centro de ajuda em vez de um prompt colado, e simula contra o seu próprio histórico de tickets, de modo que a taxa de resolução está à sua frente antes de qualquer cliente ver o agente. A configuração demora minutos em vez de um trimestre, e o preço conta tickets resolvidos e não tokens, por isso um modelo verboso não pode inflacionar a fatura silenciosamente.

O painel de relatórios da eesel mostrando o volume de tarefas ao longo de 30 dias, eventos de acionamento por tipo, e o uso de aprovação versus rejeição por ferramenta
O painel de relatórios da eesel mostrando o volume de tarefas ao longo de 30 dias, eventos de acionamento por tipo, e o uso de aprovação versus rejeição por ferramenta

Essa vista de relatórios é a peça que nenhuma chave de API em bruto lhe dá: que tickets o agente realmente tratou, o que despoletou cada execução, e os pontos onde um humano interveio. Para ver como ficam os seus próprios números, pode experimentar a eesel gratuitamente, ou ler como a mesma decisão se desenrola em as ferramentas de suporte deste ano e quanto custa um agente de suporte de IA.

Para o resto do panorama do Opus 5: a análise completa tem o veredito sobre se vale a pena atualizar, Opus 5 versus Fable 5 cobre o nível acima e Opus 5 versus Sonnet 5 o nível abaixo, e os preços do Sonnet 5 importam agora mesmo, já que as suas taxas introdutórias de $2 e $10 expiram a 31 de agosto de 2026.

Perguntas frequentes

O que é o Claude Opus 5?
O Claude Opus 5 é o modelo de trabalho da Anthropic, lançado a 24 de julho de 2026. O ID do modelo é claude-opus-5, tem uma janela de contexto de 1M de tokens com 128k de saída máxima, e custa $5 por milhão de tokens de entrada e $25 por milhão de saída. A documentação da Anthropic recomenda começar aqui para coding agêntico e trabalho empresarial, e subir para o Fable 5 apenas quando precisar do limite máximo. A minha análise do Opus 5 tem o veredito completo.
Quanto custa o Claude Opus 5?
$5 por milhão de tokens de entrada e $25 por milhão de saída na API da Claude, exatamente o que custava o Opus 4.8. O Batch reduz isso a metade, para $2.50 e $12.50, um acerto de cache custa $0.50, e o modo rápido duplica para $10 e $50. O problema é que o preço por token do Claude Opus 5 quase nada diz sobre a sua fatura, porque o nível de esforço decide quantos tokens são gastos. As tabelas completas estão na minha análise de preços do Opus 5.
O Claude Opus 5 é melhor do que o Claude Fable 5?
Nos benchmarks publicados pela Anthropic, supera o Fable 5 na maioria das linhas a metade do preço por token, e a Anthropic mesmo assim diz que não é mais capaz em geral. Ambas as coisas podem ser verdade, já que o Fable é o modelo maior e o Opus 5 chega mais rápido a uma tarefa concluída. Analisei tudo isto em Opus 5 versus Fable 5.
Qual é a diferença entre os níveis de esforço do Claude Opus 5?
Existem cinco: low, medium, high, xhigh, max. No AA-Briefcase da Artificial Analysis abrangem 497 pontos Elo, e o consumo de tokens de saída é cerca de 8 vezes maior de low a max no GDPval-AA v2. O valor predefinido da API é high. Trate o esforço como o seu principal controlo de custos antes de olhar para modelos mais baratos como o Sonnet 5.
Preciso de alterar o meu código para atualizar a partir do Opus 4.8?
Duas coisas quebram. O thinking agora está ativado por predefinição, por isso um pedido que antes corria sem thinking vai agora gastar parte do seu max_tokens em raciocínio. E enviar thinking: disabled juntamente com esforço xhigh ou max devolve um erro 400. Tudo o resto é uma substituição direta ao mesmo preço. Se o utiliza através da CLI, as minhas notas sobre seleção de modelo no Claude Code cobrem o lado do seletor.
Onde posso usar o Claude Opus 5 gratuitamente?
Não pode. O plano gratuito da Claude é apenas Sonnet e Haiku. O Opus 5 começa no Pro por $20 por mês, é o modelo predefinido no Max, e está disponível nos planos Team e Enterprise. Os preços do Claude Pro têm o detalhe dos planos, e as alternativas ao Claude cobrem o que usar quando nenhum destes encaixa.
O Claude Opus 5 consegue lidar com tickets de suporte ao cliente?
Consegue escrever a resposta. Não deveria ser aquilo que o seu cliente espera: 63 segundos até ao primeiro token com esforço max, e uma taxa de alucinação que subiu em vez de descer. Uma implementação de suporte precisa de recuperação de informação, encaminhamento por confiança, e uma transferência limpa para um humano em torno do modelo. Essa camada é exatamente o que os produtos de IA para helpdesk existem para fornecer.

Share this article

Kurnia Kharisma Agung Samiadjie

Article by

Kurnia Kharisma Agung Samiadjie

Kurnia is a software engineer and writer at eesel AI with two years of SEO experience, writing about AI tools, helpdesk software, and customer support. He pairs a developer's understanding of how these products are built with search-driven research into what actually ranks and resonates with the people searching for them.

Related Posts

All posts →
Illustration of a person weighing a small low-cost AI model against a larger caped flagship model on pedestals
Trending

Claude Opus 5 vs Fable 5: qual você deveria realmente usar?

O Fable 5 custa exatamente o dobro do Opus 5. Passei pelas duas system cards, pela documentação e pelos benchmarks independentes para descobrir quando esse dólar a mais realmente compra alguma coisa.

Rama Adi NugrahaRama Adi NugrahaJul 27, 2026
Uma ilustração de uma pessoa selecionando um dos cinco controles de esforço de raciocínio em uma barra de controle no estilo Claude Opus 5
Trending

Claude Opus 5: o que é e como usar de verdade

Claude Opus 5 não é um modelo, são cinco. Um guia prático sobre as especificações, o controle de esforço que decide sua fatura e as duas mudanças de API que quebram código antigo.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieAug 5, 2026
Illustration comparing a heavyweight reasoning model against a fast balanced model on cost and capability
Trending

Claude Opus 5 vs Sonnet 5: qual usar?

O Claude Opus 5 custa 1,7x o preço por token do Sonnet 5 e ainda assim termina algumas tarefas mais barato. Aqui está o confronto direto sobre preço, benchmarks e custo real por tarefa.

Rama Adi NugrahaRama Adi NugrahaJul 27, 2026
Illustration of a developer at a laptop watching an agentic coding loop run through code, checks and a bot
Trending

Análise do Claude Opus 5: programação quase de ponta pela metade do preço

Uma análise prática do Claude Opus 5: o que os benchmarks realmente mostram, a taxa de alucinação que subiu, e se ele tem lugar numa fila de suporte em produção.

Alicia Kirana UtomoAlicia Kirana UtomoJul 27, 2026
Texto alternativo da imagem
Guides

Uma visão geral dos preços e recursos do Claude Opus 4.6

Explore nossa análise detalhada dos preços do Claude Opus 4.6. Detalhamos os custos, novos recursos e casos de uso práticos para o modelo de IA mais recente da Anthropic.

Riellvriany IndriawanRiellvriany IndriawanFeb 6, 2026
Ilustração comparando a prévia do Qwen3.8-Max da Alibaba com o Claude Fable 5 da Anthropic
Trending

Qwen3.8-Max vs Claude Fable 5: a comparação que ninguém consegue fazer

A Alibaba chamou o Qwen3.8-Max de "atrás apenas do Fable 5". Comparei os dois modelos em preço, contexto, disponibilidade e evidências publicadas para ver se isso se sustenta.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieAug 3, 2026
Ilustração editorial para um guia sobre o que o Claude Fable 5, o modelo de IA mais poderoso da Anthropic, consegue fazer
Guides

O que o Claude Fable 5 consegue fazer? Um guia recurso por recurso

O que o Claude Fable 5 consegue fazer? Trabalhar por dias sem supervisão, escrever e publicar código, ler documentos de 1 milhão de tokens e revisar o próprio trabalho. Veja o que isso significa na prática.

Riellvriany IndriawanRiellvriany IndriawanJun 17, 2026
Texto alternativo da imagem
Guides

Gemini 3 Pro vs Claude Opus 4.6: Uma comparação prática

Este guia oferece uma visão direta e prática do Gemini 3 Pro e do Claude Opus 4.6. Vamos deixar o hype de lado e focar nas diferenças do mundo real que importam quando você coloca essas ferramentas para trabalhar.

Stevia PutriStevia PutriFeb 6, 2026
Ilustração de um modelo a produzir painéis de imagem, vídeo e áudio, representando o FLUX 3 da Black Forest Labs
Trending

FLUX 3: o que a Black Forest Labs realmente lançou

FLUX 3 é um único modelo para imagem, vídeo, áudio e ações de robôs. Mas também não tem API, preço nem pesos abertos ainda. Aqui está o que você pode e não pode obter.

Rama Adi NugrahaRama Adi NugrahaAug 4, 2026

Pronto para contratar seu colega de IA?

Configure em minutos. Sem cartão de crédito necessário.

Comece grátis