Qwen3.8-Max vs Claude Fable 5: a comparação que ninguém consegue fazer

Kurnia Kharisma Agung Samiadjie
Escrito por

Kurnia Kharisma Agung Samiadjie

Katelin Teen
Revisado por

Katelin Teen

Última edição August 3, 2026

Verificado por especialista
Ilustração comparando a prévia do Qwen3.8-Max da Alibaba com o Claude Fable 5 da Anthropic

The comparison everyone wants does not exist yet

Vamos começar pela parte incômoda, porque todos os outros artigos sobre esse confronto simplesmente pulam essa etapa.

Uma comparação de modelos precisa de dois conjuntos de números. A Anthropic publicou o dela: uma ficha de sistema, uma tabela de preços, além de todo um painel de parceiros de lançamento nomeados apresentando números oficiais. A Alibaba publicou dois posts no X e um endpoint pago em funcionamento. Essa é toda a base de evidências para um modelo que ela chama de segundo melhor do mundo.

Placar comparando o que Alibaba e Anthropic publicaram cada uma no lançamento: o Qwen3.8-Max não tem números de benchmark, ficha técnica de modelo, preço por token nem parceiros nomeados, enquanto o Claude Fable 5 tem os quatro
Placar comparando o que Alibaba e Anthropic publicaram cada uma no lançamento: o Qwen3.8-Max não tem números de benchmark, ficha técnica de modelo, preço por token nem parceiros nomeados, enquanto o Claude Fable 5 tem os quatro

Para dar contexto sobre o quanto isso se distancia do próprio padrão da Alibaba: o carro-chefe anterior, o Qwen3.7-Max, foi lançado em maio de 2026 com números reais, 80,4% no SWE-bench Verified, e a posição mais alta entre modelos chineses no índice da Artificial Analysis naquele momento. O Qwen3.8-Max chegou com a confiança, mas sem nenhum dos comprovantes.

Então trate o que vem a seguir como uma comparação entre dois produtos, e não entre duas inteligências. É a única comparação que a evidência realmente sustenta.

What Qwen3.8-Max actually is

Qwen é a família de modelos da Alibaba Cloud, e "Max" é a linha carro-chefe proprietária, acima dos níveis mais baratos Plus e Turbo. O Qwen3.8-Max foi apresentado em prévia em 19 de julho de 2026.

As especificações declaradas pela Alibaba:

  • 2,4 trilhões de parâmetros no total, em um design esparso de Mixture-of-Experts, segundo o Qwen no X.
  • O primeiro Qwen multimodal acima de 1T de parâmetros, processando texto, imagens, vídeo e documentos, segundo o pesquisador principal Shuai Bai.
  • Uma janela de contexto de 1 milhão de tokens, herdada do Qwen3.7-Max.
  • Voltado para codificação e trabalho agêntico, área em que a Alibaba diz superar o antecessor.

O número de parâmetros ativos, a proporção de esparsidade e a licença estavam todos ausentes. Um modelo denso de 2,4T seria caro demais para operar, então o roteamento MoE é o que torna esse número viável, e é justamente esse número que ninguém publicou.

"Qwen3.8-Max Preview is now available for early access! This is our first trillion-parameter multimodal model."

What Claude Fable 5 actually is

A Anthropic apresenta o Fable 5 como seu modelo geralmente disponível mais capaz, construído para "trabalho ambicioso, de longa duração e assíncrono". O posicionamento é incomumente estreito para um carro-chefe. A própria visão geral de modelos da Anthropic recomenda começar pelo Claude Opus 5, e subir para o Fable 5 apenas nas cargas de trabalho que exigem a maior capacidade disponível.

Algumas características fazem dele um animal genuinamente diferente de um lançamento de modelo comum.

O raciocínio está sempre ativo. O Fable 5 não aceita o parâmetro legado de pensamento estendido, e não tem nenhum interruptor de desligamento publicado. A profundidade é controlada pelo nível de esforço em vez disso.

Ele redireciona o próprio tráfego. O Fable 5 vem com salvaguardas para cibersegurança e biologia, e as consultas sinalizadas são automaticamente roteadas para modelos menos capazes. Consultas de segurança cibernética caem para o Opus 4.8, biologia para o Opus 5. Uma resposta do Opus é literalmente o que uma requisição bloqueada do Fable devolve, algo estranho de descobrir no meio de um fluxo de trabalho.

Usá-lo exige retenção de dados por 30 dias para monitoramento de segurança. Para um comprador regulado, isso é uma conversa de compras, não apenas uma caixinha para marcar.

Os números dos parceiros de lançamento são a evidência mais forte de toda essa comparação, e vale a pena lê-los como alegações de custo, não de inteligência. Um parceiro relata que o Fable 5 supera o Opus 4.8 em uma suíte de planilhas do dia a dia em todos os níveis de esforço, enquanto conclui execuções 25-30% mais rápido. Outro afirma ter alcançado resultados de física de ponta usando um terço dos tokens de raciocínio.

Head to head on what is actually published

Aqui está cada dimensão em que ambos os lados disseram algo concreto. As células em branco estão vazias porque o fornecedor não publicou, não porque eu não tenha encontrado.

Qwen3.8-MaxClaude Fable 5
VendorAlibaba CloudAnthropic
StatusPrévia (Qwen3.8-Max-Preview)Disponibilidade geral
Launched19 de julho de 20269 de junho de 2026
Model IDnão publicadoclaude-fable-5
ArchitectureMixture-of-Experts esparso de 2,4Tnão publicado
Multimodal inputTexto, imagens, vídeo, documentosTexto, imagens, diagramas, gráficos, PDF
Context window1M tokens1M tokens
Max outputnão publicado128k tokens
Input pricetarifa por token não publicadaUS$ 10 / MTok
Output pricetarifa por token não publicadaUS$ 50 / MTok
How you buy itAssinatura Token Plan, Qoder, QoderWorkClaude API, Bedrock, Google Cloud, Microsoft Foundry
Prompt caching discountnão publicado90% nos tokens de entrada
Benchmark tablenenhuma na préviabenchmarks de parceiros, sem tabela numérica pública
Model / system cardnenhumaficha de sistema publicada
Open weightsprometido para "em breve", sem data nem licençanão
API protocolscompatível com OpenAI e AnthropicAnthropic
Data retentionnão publicado30 dias, obrigatório
Documented outagen/a (prévia)12 de junho a 1º de julho de 2026
Knowledge cutoffnão publicadojaneiro de 2026

Duas dessas linhas merecem um segundo olhar.

A linha API protocol é a vantagem escondida. O endpoint Token Plan da Alibaba fala tanto o protocolo da OpenAI quanto o da Anthropic, então o Claude Code, o Cursor e o Cline funcionam com o Qwen3.8-Max assim que você tem uma chave. Testar leva cinco minutos, e essa acessibilidade faz boa parte do trabalho por trás do burburinho.

A linha knowledge cutoff é a esquisitice silenciosa do Fable 5. Janeiro de 2026 é quatro meses mais antigo que o corte de maio de 2026 do Opus 5, apesar de o Fable ser o modelo mais novo e mais caro. Então, se o seu trabalho depende de fatos recentes, o modelo caro sabe menos.

Price: two sheets that do not line up

Este é o ponto onde a comparação desmorona por completo, em vez de apenas ficar confusa.

Eixo de preços mostrando o Claude Sonnet 5 a 3$/15$, o Opus 5 a 5$/25$ e o Fable 5 a 10$/50$ por milhão de tokens, com o Qwen3.8-Max fora do eixo em uma caixa tracejada porque nenhuma tarifa por token foi publicada
Eixo de preços mostrando o Claude Sonnet 5 a 3$/15$, o Opus 5 a 5$/25$ e o Fable 5 a 10$/50$ por milhão de tokens, com o Qwen3.8-Max fora do eixo em uma caixa tracejada porque nenhuma tarifa por token foi publicada

A Anthropic vende tokens. O Fable 5 custa 10$ na entrada e 50$ na saída por milhão, exatamente o dobro do Claude Opus 5 nas duas linhas, com o desconto de 90% por cache de prompt ainda válido, e inferência exclusiva dos EUA disponível a 1,1x.

A Alibaba vende uma assinatura em vez disso. Durante a prévia, o Qwen3.8-Max roda a 10% do preço padrão pelo Token Plan, com níveis Personal a cerca de US$ 6, US$ 20 e US$ 70 por mês para Lite, Standard e Pro. Depois some o desconto noturno, mais 80% de desconto no consumo de créditos entre 22h e 8h (UTC+8), e as execuções fora do horário chegam a cerca de 0,2% da tarifa padrão.

Não dá para dividir esses dois valores um pelo outro. Um deles é uma tarifa, o outro é uma cota, e o denominador dessa cota são créditos cuja conversão em tokens nunca foi publicada.

Também há uma segunda armadilha no modelo de assinatura, e não é hipotética. Na geração anterior, usuários do Qwen relataram que os créditos se esgotavam muito mais rápido do que o esperado, e os modelos Qwen realmente tendem a gerar mais tokens de saída por tarefa do que os concorrentes. O que infla silenciosamente o custo real, mesmo quando o preço na etiqueta parece imbatível. O desconto da prévia disfarça isso por enquanto. Reserve orçamento para o dia em que ele acabar, e leia nossa análise de preços do Qwen3.8-Max antes de comprometer qualquer carga de trabalho.

Enquanto isso, as alegações dos parceiros do Fable 5 apontam na direção oposta quanto ao custo total. Menos turnos, e um terço dos tokens de raciocínio em tarefas difíceis, significam que o preço na etiqueta de 2x não vira uma conta de 2x. É a mesma lógica que percorremos na nossa comparação Opus 5 vs Sonnet 5, em que o modelo mais barato não é automaticamente também o trabalho mais barato.

Where each one actually breaks

Pergunte "qual é melhor" e você recebe de ombros. Pergunte "qual eu posso colocar em produção na segunda-feira", e os dois respondem não, por motivos completamente diferentes.

Dois caminhos convergindo para um portão fechado rotulado Produção padrão: o Qwen3.8-Max bloqueado por ser endpoint de prévia, sem licença e sem preço por token; o Claude Fable 5 bloqueado por uma interrupção de 19 dias, retenção obrigatória de 30 dias e redirecionamentos de salvaguarda
Dois caminhos convergindo para um portão fechado rotulado Produção padrão: o Qwen3.8-Max bloqueado por ser endpoint de prévia, sem licença e sem preço por token; o Claude Fable 5 bloqueado por uma interrupção de 19 dias, retenção obrigatória de 30 dias e redirecionamentos de salvaguarda

O Qwen3.8-Max é uma prévia. Sem licença e sem preço por token, também sem ficha técnica de modelo, além de um endpoint que pode mudar debaixo dos seus pés. Bom para experimentos, e desqualificante para qualquer coisa com um cliente atrelado.

O Fable 5 tem um histórico público de disponibilidade com um buraco bem no meio. A Anthropic lançou em 9 de junho, retirou o acesso em 12 de junho, e depois restaurou em 1º de julho. Dezenove dias, reconhecidos pelo próprio fornecedor em seu site. Some a retenção obrigatória de 30 dias e o redirecionamento de salvaguarda, e você tem três perguntas de compras para responder antes que um único ticket seja tratado.

Nenhum dos dois pontos é uma crítica ao modelo subjacente. Ambos são motivos pelos quais a escolha importa menos do que a arquitetura que você constrói ao redor.

So which one should you actually test?

A prévia é barata e o carro-chefe é rápido, o que torna "devo trocar" a pergunta errada. Primeiro, descubra o que você está realmente testando.

Qwen3.8-Max ou Claude Fable 5?

Escolha a tarefa que você realmente tem.

O que você está tentando fazer?
Qwen3.8-Max. A 10% do preço padrão, e cerca de 0,2% durante a madrugada, a prévia é a forma mais barata de sentir um modelo multimodal de 2,4T. O suporte duplo aos protocolos OpenAI e Anthropic significa que suas ferramentas atuais se conectam hoje mesmo.
Claude Fable 5. Essa é a carga de trabalho para a qual ele foi realmente construído, e a única dos dois com evidências de parceiros publicadas para trabalho de longo horizonte. Espere que o preço na etiqueta de 2x seja parcialmente compensado por menos turnos.
Nenhum dos dois, ainda. O Qwen3.8-Max é um endpoint de prévia sem licença. O Fable 5 tem uma interrupção de 19 dias registrada e retenção obrigatória de 30 dias. Faça protótipos com ambos, não se comprometa com nenhum, e mantenha o modelo substituível.
Camada totalmente errada. Um modelo bruto não tem memória dos seus tickets, nem barreiras de segurança, nem conexão com o helpdesk. O que você precisa é de uma camada pronta para suporte em cima de um modelo de fronteira, não do modelo sozinho. É isso que a próxima seção aborda.

What this actually means if you are buying for support

Agora chega a parte que realmente me importa, porque construir agentes de IA para filas de suporte é o meu trabalho do dia a dia.

A cada poucas semanas, um lançamento como esse faz as pessoas pensarem que o modelo é o gargalo. Não é, e essa lacuna é exatamente o lugar onde a maioria dos projetos de IA para suporte morre em silêncio. Tanto o Qwen3.8-Max quanto o Fable 5 entregam raciocínio bruto. Nenhum dos dois conhece sua política de reembolso, os casos extremos do seu produto, ou o fato de que o ticket #4021 é um cliente VIP que já escreveu duas vezes. Nenhum tem uma barreira de segurança que o impeça de inventar uma resposta com confiança, e nenhum se conecta ao helpdesk onde o trabalho realmente acontece.

Passamos anos colocando IA em filas de suporte reais, e a lição que ficou é que uma resposta confiante e errada é pior do que nenhuma resposta. O bot de um cliente confirmou alegremente que dava suporte a modelos de produtos que não estavam no banco de dados, porque a central de ajuda dizia "damos suporte a todos os modelos". Um número maior de parâmetros torna essa falha mais provável, não menos, porque o modelo soa ainda mais confiante. Um líder de suporte resumiu esse requisito melhor do que eu conseguiria:

"The AI will never be able to answer 100% of the questions, but if it tries and just answers wrong, I cannot go check all my 7,000 tickets to see if it made a good answer. I need an AI that only handles the tickets it's confident about, and leaves the rest alone."

a DTC brand CX lead handling 7,000 tickets a month

Isso é uma declaração sobre arquitetura, não sobre escolha de modelo. É por isso que a eesel AI simula sobre seus tickets históricos antes de qualquer coisa ir ao ar, para que você veja a taxa de resolução e as respostas exatas em conversas passadas reais, em vez de descobrir isso por meio de um cliente. É também por isso que as respostas são roteadas por confiança: incerteza significa rascunho ou escalonamento, nunca adivinhação. Operando dessa forma, a Gridwise atingiu 73% de resolução em nível 1 já no primeiro mês.

O ponto mais amplo que vale a pena tirar de todo esse confronto é este. Dois laboratórios acabaram de mover o teto de tamanho em uma quinzena, o Kimi K3 a 2,8T e o Qwen3.8-Max a 2,4T, e depois a Anthropic lançou um modelo que trabalha sem supervisão por dias. A camada de modelo está ficando melhor e mais barata mais rápido do que qualquer ciclo de compras consegue acompanhar. Então construa de um jeito em que você possa trocar o motor sem precisar refazer toda a fiação ao redor, e cada um desses ganhos cairá no seu colo de graça.

Try eesel AI

Se você veio até aqui tentando descobrir qual modelo apontar para sua fila de suporte, a resposta honesta é que essa escolha importa muito menos do que a camada que fica acima dela. Essa camada é o que a eesel AI é.

O painel de helpdesk da eesel AI, onde um colega de equipe de IA resolve e redige tickets de suporte
O painel de helpdesk da eesel AI, onde um colega de equipe de IA resolve e redige tickets de suporte

Ela se conecta ao Zendesk, ao Freshdesk, ao Slack e a mais de 100 outras ferramentas, aprende com sua central de ajuda e tickets anteriores, e começa a redigir em minutos. O diferencial é a rampa de confiança: simule sobre seu histórico real de tickets, leia os números, comece no modo rascunho, e só vá para o modo autônomo quando estiver satisfeito. Você ganha a inteligência do modelo de fronteira com barreiras de segurança construídas para suporte, e nunca mais precisará fazer essa comparação sozinho. Experimente a eesel grátis, sem cartão de crédito.

Perguntas frequentes

O Qwen3.8-Max é melhor que o Claude Fable 5?
Ainda ninguém pode afirmar isso, e a Alibaba também não. O post de lançamento da Alibaba chamou o Qwen3.8-Max de "atrás apenas do Fable 5", mas não veio com tabela de benchmarks, ficha técnica do modelo nem pontuação em um índice independente, então a afirmação não é verificável. A Anthropic publicou benchmarks de parceiros e uma ficha de sistema para o Fable 5. Nossa análise do Qwen3.8-Max detalha o que foi medido e o que não foi.
Como o preço do Qwen3.8-Max se compara ao do Claude Fable 5?
Eles nem estão na mesma tabela de preços. O Claude Fable 5 custa 10 dólares por milhão de tokens de entrada e 50 dólares por milhão de tokens de saída. O Qwen3.8-Max não tem uma tarifa de API por token durante a prévia; é vendido pela assinatura Token Plan da Alibaba, a 10% do preço padrão. Veja nosso guia de preços do Qwen3.8-Max e nossa análise dos preços do Claude Opus 5 para o panorama completo.
Qual é a janela de contexto do Qwen3.8-Max em comparação com o Claude Fable 5?
Ambos têm uma janela de contexto de 1 milhão de tokens. O Fable 5 também publica uma saída máxima de 128 mil tokens. A janela de 1M do Qwen3.8-Max é herdada do Qwen3.7-Max, e nenhum valor de saída máxima foi publicado na prévia. Para entender como janelas grandes se comportam no trabalho real de suporte, veja nosso guia sobre RAG versus contexto longo.
O Qwen3.8-Max é open source e o Claude Fable 5 não é?
Nenhum dos dois disponibiliza pesos hoje. A Alibaba diz que o Qwen3.8 terá pesos abertos "em breve", sem data nem licença definidas, e a Anthropic simplesmente não libera pesos. Se pesos abertos forem um requisito, veja nossa lista de agentes de IA open source e modelos de linguagem pequenos.
Posso usar o Qwen3.8-Max ou o Claude Fable 5 para atendimento ao cliente?
Você pode enviar tickets para qualquer um dos dois, mas um modelo bruto é só o motor. Ele não tem memória dos seus tickets anteriores, nem barreiras de segurança, nem conexão com o helpdesk. A eesel AI fornece essa camada e se conecta ao Zendesk e ao Freshdesk, entregando uma IA para atendimento ao cliente de verdade, e não apenas uma janela de chat.
Qual modelo devo escolher se preciso de disponibilidade confiável?
Verifique o histórico de disponibilidade, não os benchmarks. A Anthropic retirou publicamente o acesso ao Claude Fable 5 de 12 de junho a 1º de julho de 2026, e o Qwen3.8-Max continua sendo um endpoint de prévia que pode mudar sem aviso. Para qualquer aplicação voltada ao cliente, nosso guia de soluções de IA para atendimento ao cliente explica como evitar prender um fluxo de trabalho a um único modelo.
Quais são as melhores alternativas ao Qwen3.8-Max?
Os concorrentes mais óbvios são o Kimi K3 da Moonshot, o Claude Opus 5 e o GPT-5.6. Nossa lista completa de alternativas ao Qwen3.8-Max os compara em preço e disponibilidade, não apenas na inteligência anunciada.

Share this article

Kurnia Kharisma Agung Samiadjie

Article by

Kurnia Kharisma Agung Samiadjie

Kurnia is a software engineer and writer at eesel AI with two years of SEO experience, writing about AI tools, helpdesk software, and customer support. He pairs a developer's understanding of how these products are built with search-driven research into what actually ranks and resonates with the people searching for them.

Related Posts

All posts →
Illustration of a person weighing a small low-cost AI model against a larger caped flagship model on pedestals
Trending

Claude Opus 5 vs Fable 5: qual você deveria realmente usar?

O Fable 5 custa exatamente o dobro do Opus 5. Passei pelas duas system cards, pela documentação e pelos benchmarks independentes para descobrir quando esse dólar a mais realmente compra alguma coisa.

Rama Adi NugrahaRama Adi NugrahaJul 27, 2026
Ilustração representando o preço de preview do Qwen3.8-Max da Alibaba
Trending

Preço do Qwen3.8-Max: a oferta de preview e seus custos ocultos

Um guia direto do preço do Qwen3.8-Max: a tarifa de preview de 10%, os níveis do Token Plan, o desconto noturno e o custo de consumo de créditos que ninguém coloca na página de preços.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 20, 2026
Ilustração comparando o Qwen3.8-Max com modelos de IA de ponta rivais
Trending

As 6 melhores alternativas ao Qwen3.8-Max em 2026

As melhores alternativas ao Qwen3.8-Max em 2026, comparadas com honestidade: Kimi K3, Claude, GPT-5.6, Gemini 3.5 Pro, Grok 4.5 e a camada de suporte que realmente resolve tickets.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 20, 2026
Ilustração representando a prévia do modelo de linguagem Qwen3.8-Max da Alibaba
Trending

O que é Qwen3.8-Max: a prévia do carro-chefe de 2,4T da Alibaba

Um guia simples sobre o Qwen3.8-Max, a prévia multimodal de 2,4 trilhões de parâmetros da Alibaba: o que é, o que a Alibaba afirma, quanto custa e se vale a pena testar agora.

Alicia Kirana UtomoAlicia Kirana UtomoJul 20, 2026
Uma ilustração de uma pessoa a selecionar um dos cinco reguladores de esforço de raciocínio numa barra de controlo ao estilo Claude Opus 5
Trending

Claude Opus 5: o que é e como realmente utilizá-lo

O Claude Opus 5 não é um modelo, são cinco. Um guia simples sobre as especificações, o regulador de esforço que decide a sua fatura, e as duas alterações da API que quebram código antigo.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieAug 5, 2026
Uma ilustração de uma pessoa selecionando um dos cinco controles de esforço de raciocínio em uma barra de controle no estilo Claude Opus 5
Trending

Claude Opus 5: o que é e como usar de verdade

Claude Opus 5 não é um modelo, são cinco. Um guia prático sobre as especificações, o controle de esforço que decide sua fatura e as duas mudanças de API que quebram código antigo.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieAug 5, 2026
Ilustração de um desenvolvedor acessando o Qwen 3.8 Max da Alibaba por meio de chat, multimodal e superfícies de API
Trending

Como acessar o Qwen 3.8 Max: 5 caminhos e o que cada um cobra

Cinco formas reais de chegar ao carro-chefe de 2,4 trilhões de parâmetros da Alibaba, do chat gratuito à API de $2/$6, além das armadilhas de cobrança que pegam as pessoas no caminho.

Rama Adi NugrahaRama Adi NugrahaAug 3, 2026
Ilustração comparando o Qwen 3.8 Max da Alibaba e o Kimi K3 da Moonshot AI
Trending

Qwen 3.8 Max vs Kimi K3: os números que nenhum laboratório publicou

Dois laboratórios chineses lançaram um modelo principal com mais de 2 trilhões de parâmetros com dezessete dias de diferença, e nenhum colocou o outro em seu gráfico de benchmarks. Aqui está o que realmente se compara, quanto a conta realmente custa, e qual eu escolheria.

Alicia Kirana UtomoAlicia Kirana UtomoAug 3, 2026
Illustration comparing a heavyweight reasoning model against a fast balanced model on cost and capability
Trending

Claude Opus 5 vs Sonnet 5: qual usar?

O Claude Opus 5 custa 1,7x o preço por token do Sonnet 5 e ainda assim termina algumas tarefas mais barato. Aqui está o confronto direto sobre preço, benchmarks e custo real por tarefa.

Rama Adi NugrahaRama Adi NugrahaJul 27, 2026

Pronto para contratar seu colega de IA?

Configure em minutos. Sem cartão de crédito necessário.

Comece grátis