Análise do Claude Opus 5.5: o modelo mais inteligente, e a conta à altura

Alicia Kirana Utomo
Escrito por

Alicia Kirana Utomo

Katelin Teen
Revisado por

Katelin Teen

Última edição September 23, 2026

Verificado por especialista
Ilustração abstrata em tom azul-ardósia representando um modelo de IA de raciocínio topo de gama, banner de destaque da análise

O que o Claude Opus 5.5 realmente é

A Anthropic lançou o Claude Opus 5.5 a 22 de setembro de 2026, e entende-se melhor como um ajuste de eficiência sobre o Opus 5 do que como um modelo totalmente novo. A grande novidade é a inversão: todos os Opus anteriores foram lançados a preço premium, e este é o primeiro a ser lançado mais barato do que o modelo que substitui.

A página de comparação da Artificial Analysis mostra o Claude Opus 5.5 no topo do Intelligence Index com 58, GDPval-AA 1846 e Terminal-Bench 4.0 a 60%, conforme retirado da Artificial Analysis

O preço passou dos $5/$25 do Opus 5 para $4/$20 por milhão de tokens, um corte plano de 20%. Isso soa a pouco até nos lembrarmos para que o Opus normalmente serve: trabalho longo, intensivo em tokens e autónomo, em que o lado da saída da conta domina. Um corte de 20% na taxa de $20 de saída é onde a maioria das equipas sente o impacto.

O Opus 5 a 5 dólares de entrada e 25 dólares de saída cai 20 por cento para o Opus 5.5 a 4 dólares de entrada e 20 dólares de saída, o primeiro Opus a ficar mais barato
O Opus 5 a 5 dólares de entrada e 25 dólares de saída cai 20 por cento para o Opus 5.5 a 4 dólares de entrada e 20 dólares de saída, o primeiro Opus a ficar mais barato

Além do preço, várias coisas mudaram nos bastidores. O esforço padrão desceu de high para medium, o thinking está sempre ativo, e a Anthropic diz agora para começar com o Opus 5.5 na maior parte do trabalho, em vez de tratar o Opus como o nível premium de último recurso. Tem uma janela de contexto de 1M de tokens, até 128K tokens de saída (300K em Batch), visão nativa e uma data de corte de conhecimento de junho de 2026. É o modelo padrão no Claude Max, o mais forte no Claude Pro, e é o que alimenta o Claude Code para programação agêntica.

O seletor de esforço é a análise inteira

Eu construo agentes de IA na eesel, por isso cada lançamento de fronteira significa a mesma rotina: correr novamente as minhas avaliações, olhar para o custo por trabalho concluído, decidir o que muda. O que mais me surpreendeu no Opus 5.5 não foi a qualidade, foi o quanto a definição de esforço domina tudo o resto na sua utilização.

Eis o mecanismo. O Opus 5.5 expõe um controlo de esforço com cinco níveis: low, medium (o novo padrão), high, very high e max. Um esforço maior não faz apenas com que "se esforce mais" de forma vaga; faz com que o modelo raciocine durante mais tempo e emita muitos mais tokens antes de responder. Com esforço máximo numa tarefa difícil, gastou cerca de 119k tokens de saída, contra uma execução muito mais enxuta com esforço baixo. Como a saída é cobrada a $20 por milhão, o seletor de esforço é, na prática, um seletor de custo disfarçado de rótulo de qualidade.

O seletor de esforço do Opus 5.5 de low a max, com medium como padrão, mostrando o custo a subir de cerca de 0,55 dólares por tarefa com esforço baixo até cerca de 5,98 dólares com max
O seletor de esforço do Opus 5.5 de low a max, com medium como padrão, mostrando o custo a subir de cerca de 0,55 dólares por tarefa com esforço baixo até cerca de 5,98 dólares com max

É por isso que a taxa por token é quase uma distração. Segundo a própria medição da Artificial Analysis, a mesma tarefa difícil custa cerca de $0,55 com esforço baixo, cerca de $1,34 com esforço médio e cerca de $5,98 com esforço máximo. A inteligência pela qual está a pagar sobe junto: a execução com esforço baixo pontua 42 no Intelligence Index, o médio atinge 51, e só no máximo chega aos 58 do título. Por isso, a pergunta real ao implementar o Opus 5.5 não é "consigo pagar isto", é "qual é o nível de esforço mais baixo que ainda passa a fasquia para esta tarefa". Na maioria das vezes, é o médio.

Este é também o maior senão para quem vem do Opus 5, onde o esforço padrão era high. Ao colocar a mesma carga de trabalho no Opus 5.5 sem tocar na definição, a conta por tarefa pode efetivamente descer, porque o padrão agora está um nível mais baixo. É um padrão genuinamente bem pensado, mas significa que não se pode deduzir o custo apenas pelo preço de tabela.

Os benchmarks: ganha em quase todas as categorias

Deixando o preço de lado por um momento, em capacidade pura o Opus 5.5 é o líder claro. No Intelligence Index da Artificial Analysis está no número um com 58, à frente de todo o campo de fronteira. E não é um acaso de um único benchmark: lidera no GDPval-AA (1846), no AutomationBench e nas avaliações de programação de longo alcance que mais importam para agentes.

Um boletim de resultados do Claude Opus 5.5 listando Intelligence Index número um com 58, Terminal-Bench 4.0 a 60 por cento, preço 4 dólares de entrada e 20 dólares de saída, contexto de 1M de tokens, e custo por tarefa difícil de 0,55 a 5,98 dólares
Um boletim de resultados do Claude Opus 5.5 listando Intelligence Index número um com 58, Terminal-Bench 4.0 a 60 por cento, preço 4 dólares de entrada e 20 dólares de saída, contexto de 1M de tokens, e custo por tarefa difícil de 0,55 a 5,98 dólares

A história da programação é onde ele mais claramente se destaca. No Terminal-Bench 4.0, executado através do harness da Artificial Analysis a esforço máximo, o Opus 5.5 pontuou 60% contra 44% do seu rival mais próximo em preço. É o tipo de diferença que se traduz em menos becos sem saída numa execução longa de programação agêntica, exatamente a carga de trabalho para a qual a Anthropic o afinou. Se faz trabalho de engenharia difícil, autónomo e de vários passos, este é o modelo que termina tarefas em que outros modelos ficam presos.

Onde eu acrescentaria uma ressalva: a pontuação máxima é um número de esforço máximo, e esforço máximo é a definição de $5,98 por tarefa. Os benchmarks que coroam o Opus 5.5 medem-no no seu ponto mais caro. Isso é justo, todos os modelos são medidos no seu teto, mas significa que a vitória no leaderboard e a experiência do dia a dia não são a mesma coisa, a menos que esteja sempre a pagar pelo máximo.

O que o Claude Opus 5.5 realmente custa

Aqui está a tabela de preços completa, porque os preços "a partir de" escondem exatamente as partes que doem em trabalho intensivo em tokens.

ItemTaxa
Entrada (por 1M de tokens)$4
Saída (por 1M de tokens)$20
Leitura de cache (por 1M de tokens)$0,20
Sobretaxa de contexto longoNenhuma
Janela de contexto1M de tokens
Saída máxima128K tokens (300K em Batch)
Custo por tarefa difícil (AA)$0,55 (low) a $5,98 (max)

Duas linhas merecem um segundo olhar. Primeiro, não há sobretaxa de contexto longo, o que distingue o Opus 5.5 de rivais que duplicam a taxa de entrada a partir de um determinado limiar; em trabalhos com contexto enorme, esse preço fixo fecha silenciosamente a diferença por token. Segundo, as leituras de cache a $0,20 por milhão significam que, se a sua carga de trabalho for um prompt de sistema grande e estável mais perguntas curtas, uma grande fatia da sua conta de entrada sai barata.

Um exemplo rápido. Digamos que corre 1.000 tarefas de agente difíceis por mês. Com esforço médio ($1,34 cada) isso dá cerca de $1.340. Se levar as mesmas 1.000 tarefas para esforço máximo em busca dos últimos pontos de inteligência, fica por cerca de $5.980. Essa oscilação de 4x é uma escolha de configuração, não uma mudança de plano, e é o custo por tarefa que eu colocaria no quadro antes de integrar o Opus 5.5 em qualquer coisa de alto volume. Para o detalhamento completo com Batch e taxas regionais, veja o meu guia de preços do Opus 5.5, e a comparação mais ampla OpenAI API vs Anthropic API mostra como ele se compara com a outra plataforma de fronteira.

Onde o Opus 5.5 justifica o preço, e onde não justifica

Deixe-me ser concreto quanto ao encaixe, porque "é o melhor modelo" é verdadeiro e inútil ao mesmo tempo.

Justifica o preço quando a tarefa é difícil, longa e cara de errar. Um agente de programação de várias horas a refatorizar uma base de código real, uma tarefa de investigação que precisa de manter um contexto enorme e raciocinar sobre ele, um problema ambíguo em que um modelo mais barato gira em círculos. Nesses casos, os tokens extra compram um resultado terminado em vez de um beco sem saída com aparência plausível, e a conta é barata face às horas de engenharia que poupa.

É a ferramenta errada quando a tarefa é bem definida e de alto volume: classificação, respostas curtas, tradução, pesquisas simples, os 80% enfadonhos da maioria das cargas de trabalho em produção. Pagar preços e latência de Opus por trabalho que um modelo intermédio resolve sem esforço é dinheiro e velocidade que não recupera. O Opus é deliberadamente pausado por conceção, por isso, para tudo o que um humano espera em direto, como uma resposta de chat, a capacidade de resposta importa mais do que os últimos pontos do Intelligence Index. É esse o argumento para uma configuração de dois modelos: encaminhar as tarefas genuinamente difíceis para o Opus 5.5 e tudo o resto para o Sonnet 5, ou recorrer a uma das opções mais baratas no meu resumo de alternativas ao Opus 5.5.

A conclusão honesta numa linha: o Opus 5.5 é o melhor modelo, e "melhor modelo" raramente é a mesma pergunta que "modelo certo para esta tarefa".

O que as pessoas estão realmente a dizer

A reação na thread de lançamento alinhou-se com os meus próprios testes: respeito genuíno pela capacidade, e um lembrete recorrente de que o rótulo no seletor de esforço importa mais do que o leaderboard. Um testador experiente, comparando-o com a concorrência de fronteira lançada no dia seguinte, chegou a esta conclusão:

Hacker News

My initial takeaway is that GPT-6 is mostly a lower cost win, for Luna. GPT-6 Max is an upgrade on intelligence too, but its mostly a cost play (which is great, not complaining). I personally am preferring Opus 5.5 at medium over GPT-6 Sol Max, in very very early tests. Similar price range, more capability.

Esse "at medium" está a fazer muito trabalho, e é essa a questão central desta análise. O outro tema que vale a pena realçar é o quão pouco um único benchmark deve decidir a sua escolha em 2026:

Hacker News

Only hands-on experience matters in the end, and these days it's very easy to switch models.

Essa última frase, "very easy to switch models", é a verdadeira história do ano, e leva diretamente à pergunta que a maioria das análises de modelos evita.

Experimente a eesel: o colega de equipa que corre em qualquer modelo

Toda análise de modelo assume silenciosamente que o trabalho do leitor é escolher um modelo, ligar a sua API, tratar do prompt engineering, ligá-lo às suas ferramentas e evitar que alucine com clientes reais. Para a maioria das equipas, esse não é o trabalho. O trabalho é uma taxa de resolução mais alta, ou publicações publicadas. Um modelo de fronteira como o Opus 5.5 é infraestrutura; é o motor, não o funcionário.

O painel de relatórios da eesel AI mostra análises de resolução e utilização numa fila de suporte
O painel de relatórios da eesel AI mostra análises de resolução e utilização numa fila de suporte

É assim que eu enquadraria a eesel. É uma plataforma de colegas de equipa de IA, e contrata-se colegas de equipa prontos a trabalhar para funções específicas. A equipa atual inclui um colega de equipa de IA para helpdesk que se junta à sua fila de suporte existente e uma redatora de blog com IA que redige publicações pesquisadas. Cada um chega já a conhecer a sua função, ligado às suas ferramentas e ancorado no contexto da sua empresa, por isso não é você quem escolhe entre níveis de esforço e vigia um prompt. Como o modelo fica por baixo do colega de equipa, um modelo mais barato ou mais inteligente lançado no próximo mês é uma atualização gratuita, não uma reconstrução, e o colega de equipa de IA para helpdesk é cobrado por ticket resolvido em vez de por token, por isso a matemática do seletor de esforço acima deixa de ser problema seu.

Se é do tipo de pessoa que lê uma análise de modelo até ao fim, vai gostar disto: tudo pode ser conduzido a partir do terminal. O CLI da eesel (npx @eesel/cli) liga integrações, edita as instruções permanentes do agente, simula uma implementação face aos seus tickets históricos, aprova ações e lê o registo de atividade de cada execução, tudo em JSON, com uma flag --dry-run que imprime a chamada exata que uma escrita faria antes de a enviar. Cada workspace é também um servidor MCP, por isso agentes de programação como o Claude Code, o Codex e o Cursor podem operar o mesmo colega de equipa. É o mesmo produto que o painel, exposto para pessoas e agentes que vivem num terminal. Pode experimentar a eesel gratuitamente.

Perguntas frequentes

Vale a pena o Claude Opus 5.5 em 2026?
Para trabalho genuinamente difícil, longo e agêntico, sim: é o modelo líder no Artificial Analysis Intelligence Index com 58 pontos. Para tarefas do dia a dia é exagerado, e o Claude Sonnet 5 por metade do preço é a escolha padrão mais inteligente. O meu artigo sobre alternativas ao Opus 5.5 cobre as opções mais baratas.
Quanto custa o Claude Opus 5.5?
$4 por milhão de tokens de entrada e $20 por milhão de tokens de saída, um corte de 20% face aos $5/$25 do Opus 5. As leituras de cache custam $0,20 por milhão e não há sobretaxa para contexto longo. O detalhamento completo, incluindo Batch e exemplos práticos, está no meu guia de preços do Claude Opus 5.5.
O que é o seletor de esforço no Claude Opus 5.5?
É uma definição (low, medium, high, very high, max) que controla durante quanto tempo o modelo raciocina antes de responder. Maior esforço significa mais tokens de saída e uma conta mais alta, por isso a mesma tarefa pode custar $0,55 ou $5,98 conforme o nível. O valor padrão desceu de high no Opus 5 para medium no Opus 5.5.
O Claude Opus 5.5 é bom para programar?
É um dos modelos de programação mais fortes disponíveis, com 60% no Terminal-Bench 4.0 nos testes da Artificial Analysis, feito para execuções longas e autónomas no Claude Code. Se o conduz a partir de um terminal, o nosso resumo das melhores ferramentas de programação com IA mostra onde ele se encaixa.
Preciso do Claude Opus 5.5 para construir um agente de suporte com IA?
Não. Uma ferramenta como a eesel fica sobre a camada do modelo e trata da escolha do modelo, do prompting e das integrações por si, para que tenha um colega de equipa de IA para o seu helpdesk sem ter de ligar uma API de modelo em bruto. Pode mudar mais tarde para um modelo mais barato sem reconstruir nada, e a cobrança é feita por ticket resolvido em vez de por token.

Share this article

Alicia Kirana Utomo

Article by

Alicia Kirana Utomo

Kira is a writer at eesel AI with a Computer Science background and over a year of hands-on experience evaluating AI-powered customer service tools. She focuses on breaking down how helpdesk platforms and AI agents actually work so that support teams can make better buying decisions.

Related Posts

All posts →
Uma ilustração comparando Claude Mythos 5.1 e Fable 5.1 como o mesmo modelo subjacente atrás de camadas de segurança diferentes
Trending

Análise do Claude Mythos 5.1: vale a pena correr atrás do modelo de fronteira trancado da Anthropic?

Uma análise prática do Claude Mythos 5.1: o que é, como se compara ao Fable 5.1, o preço real da leitura de cache, quem realmente consegue acessá-lo e o que eu usaria no lugar dele.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieSep 8, 2026
Uma ilustração da porta de um cofre sendo aberta por uma pequena lista aprovada de pesquisadores, representando o acesso apenas por convite ao Claude Mythos 5.1
Trending

Claude Mythos 5.1: o que é, quem tem acesso e o que usar no lugar

Claude Mythos 5.1 foi lançado em 1º de setembro de 2026, e quase ninguém consegue usá-lo. Aqui está a ficha técnica real, os dois programas de acesso e o modelo que você deveria realmente rodar.

Alicia Kirana UtomoAlicia Kirana UtomoSep 2, 2026
Texto alternativo da imagem
Guides

Uma visão geral dos preços e recursos do Claude Opus 4.6

Explore nossa análise detalhada dos preços do Claude Opus 4.6. Detalhamos os custos, novos recursos e casos de uso práticos para o modelo de IA mais recente da Anthropic.

Riellvriany IndriawanRiellvriany IndriawanFeb 6, 2026
Texto alternativo da imagem
Guides

Gemini 3 Pro vs Claude Opus 4.6: Uma comparação prática

Este guia oferece uma visão direta e prática do Gemini 3 Pro e do Claude Opus 4.6. Vamos deixar o hype de lado e focar nas diferenças do mundo real que importam quando você coloca essas ferramentas para trabalhar.

Stevia PutriStevia PutriFeb 6, 2026
Um guia completo para análise de uso do Claude Code em 2025
Guides

Um guia completo para análise de uso do Claude Code em 2026

Tentando medir o ROI do seu investimento em Claude Code? Este guia abrange tudo o que você precisa saber sobre análise de uso para Claude Code, incluindo ferramentas integradas, integrações de terceiros e como obter uma visão completa de seu impacto nos negócios.

Kenneth PanganKenneth PanganOct 3, 2025
O que a engenharia de prompt do Claude Code pode nos ensinar sobre suporte de IA mais inteligente
Guides

O que a engenharia de prompt do Claude Code pode nos ensinar sobre suporte de IA mais inteligente

A engenharia de prompt do Claude Code mostra como transformar chatbots genéricos em agentes inteligentes. Veja como as equipes de suporte podem aplicar essas técnicas com o eesel AI.

Kenneth PanganKenneth PanganSep 15, 2025
Um guia especializado para as Habilidades do Claude: O que são & como funcionam
Guides

Claude Skills: O que fazem & como usá-los (2026)

As novas Habilidades do Claude da Anthropic permitem construir agentes de IA poderosos e personalizados usando arquivos e scripts simples. Mas são adequadas para sua equipe? Detalhamos exatamente o que são, como funcionam e suas limitações para casos de uso comercial como suporte ao cliente.

Stevia PutriStevia PutriOct 16, 2025
Claude vs ChatGPT: Uma comparação abrangente para casos de uso empresarial em 2025
Guides

Claude vs ChatGPT: Uma comparação abrangente para casos de uso empresarial em 2026

Claude ou ChatGPT? Descubra qual IA se adapta melhor a você comparando seus pontos fortes, casos de uso e como eles se alinham com suas necessidades únicas.

Stevia PutriStevia PutriSep 8, 2025
O guia definitivo para criar um modelo de instruções personalizadas do ChatGPT
Guides

O guia definitivo para criar um modelo de instruções personalizadas do ChatGPT

Cansado de se repetir para o ChatGPT? Aprenda a criar modelos poderosos de instruções personalizadas e descubra quando atualizar para uma verdadeira automação de IA.

Kenneth PanganKenneth PanganSep 10, 2025

Pronto para contratar seu colega de IA?

Configure em minutos. Sem cartão de crédito necessário.

Comece grátis