Qwen 3.8 Max vs Kimi K3: os números que nenhum laboratório publicou

Alicia Kirana Utomo
Escrito por

Alicia Kirana Utomo

Katelin Teen
Revisado por

Katelin Teen

Última edição August 3, 2026

Verificado por especialista
Ilustração comparando o Qwen 3.8 Max da Alibaba e o Kimi K3 da Moonshot AI

A tabela de 60 segundos

Todos os números abaixo vêm das próprias páginas publicadas pelos fornecedores, verificados em 3 de agosto de 2026. Onde um dado não está publicado, eu deixei assim indicado em vez de pegar um número emprestado de um agregador.

Qwen 3.8 MaxKimi K3
ID do modeloqwen3.8-maxkimi-k3
LaboratórioAlibabaMoonshot AI
Lançamento2 ago 2026 (GA)16 jul 2026
Parâmetros totais2,4T2,8T
Parâmetros ativos95BNão publicado
Entrada / 1M$2.00$3.00
Saída / 1M$6.00$15.00
Entrada em cache / 1M$0.25 implícito, $0.17 leitura explícita$0.30
Janela de contexto1.000.0001.048.576
Sobretaxa de contexto longoNenhumaNenhuma
Saída máxima131.072Não publicado
Orçamento máximo de raciocínio262.144Não publicado
Modalidades de entradaTexto, imagem, vídeoTexto, imagem, vídeo
Controle de raciocíniolow / medium / xhigh, xhigh por padrãoSomente max
Pesos abertosPrometido, não lançadoLançado em 27 jul 2026
LicençaNão publicadaListada como "other"
Ficha do modeloNenhumaNo Hugging Face
Corte de conhecimentoNão publicadoNão publicado
Limite de taxa (nível superior)15K RPM / 2M TPMNão publicado
Chat para consumidoresQwen Studio, gratuitoKimi.com, gratuito a $199/mês

Três linhas fazem a maior parte do trabalho aqui. O Qwen publica uma contagem de parâmetros ativos e a Moonshot não, o que importa porque são os parâmetros ativos que determinam sua latência e sua conta, não os totais. O Qwen é mais barato em todos os indicadores. E o Kimi é o único dos dois que você realmente pode baixar.

O que é o Qwen 3.8 Max

Qwen é a família de modelos da Alibaba, e Max é a linha principal proprietária acima dos níveis mais baratos Plus e Turbo. O Qwen 3.8 Max foi lançado em dois atos: um preview em 19 de julho na World AI Conference com uma afirmação verbal de estar na fronteira e nenhum número publicado, seguido por um post de lançamento de 5.000 palavras em 2 de agosto trazendo tudo o que o preview havia deixado de fora.

A arquitetura, conforme descrita pela Alibaba: 2,4 trilhões de parâmetros totais com 95 bilhões ativos, um design esparso de Mixture-of-Experts construído sobre a base do Qwen 3.5. A história mais ampla da família está na minha análise do Qwen, e a visão geral do Qwen cobre os níveis mais antigos.

O raciocínio é controlado por reasoning_effort, que aceita low, medium e xhigh, com xhigh como padrão. A Alibaba também ativa preserve_thinking por padrão "para a melhor experiência pronta para uso". Guarde esse detalhe, porque ele reaparece como um problema de custo mais adiante.

O que é o Kimi K3

O Kimi K3 é o modelo principal da Moonshot AI, e sua história técnica é mais incomum que a do Qwen. Ele tem 2,8 trilhões de parâmetros totais, que a Moonshot descreve como a ativação de 16 de 896 especialistas sob um framework Stable LatentMoE, além de dois componentes inéditos: o Kimi Delta Attention, um mecanismo híbrido de atenção linear, e o Attention Residuals, um substituto direto para conexões residuais padrão que a Moonshot publicou como open source separadamente. Afirma ter uma eficiência de escalonamento cerca de 2,5 vezes melhor que o Kimi K2.5.

A Moonshot é incomumente franca em seu próprio post de lançamento sobre onde ele se posiciona:

"While its overall performance still trails the most powerful proprietary models, Claude Fable 5 and GPT 5.6 Sol, Kimi K3 demonstrated frontier-level performance across our evaluation suite, consistently outperforming other tested models."

Compare isso com o posicionamento do preview da Alibaba, que buscou "atrás apenas do Fable 5" antes mesmo de publicar uma única pontuação. Dois laboratórios, dois níveis de conforto muito diferentes com suas próprias evidências. Minhas análises mais profundas estão na análise do Kimi K3 e na análise do Qwen 3.8 Max.

Uma coisa que o K3 não oferece é um controle de raciocínio. reasoning_effort aceita apenas max, nada mais, com low e high listados como "em breve". Não existe uma SKU mais barata sem raciocínio. Um modelo, um preço, sempre pensando.

Benchmarks: nenhum mediu o outro

É aqui que a maioria das comparações lado a lado trapaceia silenciosamente. A Alibaba publicou um gráfico de dezesseis painéis em 2 de agosto. A Moonshot publicou o seu em julho. Nenhum dos gráficos contém o outro modelo.

Os painéis oficiais de benchmark da Alibaba para o Qwen 3.8 Max, com Opus 4.8, Fable 5, Gemini 3.1 Pro e GPT-5.6 Sol como colunas de referência, conforme publicado em Qwen
Os painéis oficiais de benchmark da Alibaba para o Qwen 3.8 Max, com Opus 4.8, Fable 5, Gemini 3.1 Pro e GPT-5.6 Sol como colunas de referência, conforme publicado em Qwen
As pontuações gerais e de agente visual do Kimi K3 segundo a Moonshot, com os mesmos modelos de terceiros como colunas de referência, publicadas no blog do Kimi
As pontuações gerais e de agente visual do Kimi K3 segundo a Moonshot, com os mesmos modelos de terceiros como colunas de referência, publicadas no blog do Kimi

Existe, porém, uma forma de conectar os dois, e quase ninguém se dá ao trabalho. Ambos os gráficos compartilham os mesmos modelos de referência: Claude Fable 5, Claude Opus 4.8, GPT-5.6 Sol. Então onde os dois laboratórios reportam a mesma pontuação para o mesmo modelo de referência no mesmo benchmark, os dois harnesses estão se comportando de forma equivalente, e seus próprios números podem ser comparados entre si. Onde as pontuações de referência divergem, não podem.

Dois cartões de benchmark de fornecedores que não se conectam, ligados apenas pelas linhas onde suas pontuações de referência compartilhadas concordam
Dois cartões de benchmark de fornecedores que não se conectam, ligados apenas pelas linhas onde suas pontuações de referência compartilhadas concordam

Aplicando esse teste aos dois gráficos, sobrevivem exatamente três linhas:

BenchmarkConcordância de referência compartilhadaQwen 3.8 MaxKimi K3Vencedor
TerminalBench-2.1Fable 5 84.6, Opus 4.8 84.6, Sol 88.8 em ambos86.688.3Kimi, por 1.7
CharXiv (RQ, com Python)Fable 5 93.5, Opus 4.8 89.9, Sol 89.1 em ambos93.591.3Qwen, por 2.2
JobBenchFable 5 57.4, Opus 4.8 48.4 em ambos; Sol 45.4 vs 46.553.452.9Qwen, por 0.5

Ou seja: uma vitória clara para cada um em uma avaliação próxima de codificação e outra de raciocínio com gráficos, e um empate estatístico em trabalho agêntico de conhecimento. Essa é toda a comparação direta defensável que existe. Quem te mostrar uma tabela de quinze linhas declarando um vencedor misturou números de dois harnesses diferentes.

E o motivo para ser rigoroso quanto a isso está bem ali, na quarta linha que tive de descartar. No FrontierSWE, o gráfico da Alibaba coloca o GPT-5.6 Sol em 88.8; o da Moonshot o coloca em 71.3. Mesmo modelo, mesmo benchmark, uma diferença de 17,5 pontos. Seja qual for o gráfico correto, um dos dois está medindo algo que o outro não está, e essa lacuna é maior do que a margem que qualquer um dos laboratórios afirma ter sobre o outro.

As notas de rodapé da Alibaba também valem a leitura. Ela revela que seis de seus benchmarks de codificação são internos e não publicados, que as pontuações dos concorrentes foram retiradas de harnesses mistos em vez de reexecutadas, que os resultados do Fable 5 "podem envolver fallbacks", e que várias linhas são avaliadas por modelos rivais: gemini-3.1-pro-preview avalia o PLawBench, o Claude Opus 4.6 avalia o PaperBench. O gráfico da Moonshot traz sua própria versão do mesmo aviso.

A única leitura independente disponível é a da Artificial Analysis, que pontuou o Kimi K3 com 57 em seu Intelligence Index, quarto entre 189 modelos avaliados, com uma velocidade de saída de cerca de 62 tokens por segundo. Em sua avaliação privada de trabalho de conhecimento de longo prazo, o K3 alcançou um Elo de 1547, que o mesmo resumo situa em +732 acima do Kimi K2.6.

A tabela de preços diz Qwen. A conta diz empate.

O Qwen é mais barato em todos os indicadores publicados. A entrada custa um terço a menos, a saída 60% a menos, e sua leitura de cache implícita é de $0,25 contra a taxa de acerto de cache de $0,30 do Kimi. Com contagens de tokens idênticas, não há discussão.

As contagens de tokens não são idênticas. Um desenvolvedor que rodou a mesma construção de um app web nos dois modelos, cada um no harness próprio do seu fornecedor, publicou a contabilidade:

Hacker News

"* Kimi K3: 9532k input (9172k cached), 114k output - cost $5.5

Qwen 3.8 Max: 18020k input (17836k cached), 114k output - cost $6.3"
A mesma tarefa custando aproximadamente o mesmo nos dois modelos apesar de tarifas por token muito diferentes
A mesma tarefa custando aproximadamente o mesmo nos dois modelos apesar de tarifas por token muito diferentes

Esses $6,30 são anteriores à disponibilidade geral, então foram cobrados sob as condições do preview, não pela tabela publicada em 2 de agosto. Refazendo essas mesmas contagens de tokens com as tarifas atuais, o Qwen chega a cerca de $5,51 (0,184M de entrada sem cache a $2, 17,836M em cache a $0,25, 0,114M de saída a $6). O Kimi chega a $5,54. Uma tarifa de saída 60% mais barata, quase totalmente anulada por precisar de 1,9 vezes mais tokens de entrada.

Esse é o número que realmente decide sua conta, e ele não aparece em nenhuma das duas páginas de preços. O Qwen ativa o raciocínio xhigh por padrão com preserve_thinking habilitado, e os tokens de raciocínio são cobrados como saída. O Kimi também roda sempre no máximo, e sua própria comunidade foi direta sobre a consequência:

Hacker News

"The shift from "value" models to "intelligent, huge and slow" models coming from China is an interesting change in strategy. My main issue with GLM 5.2 and Kimi 3 is that they're extremely token hungry and thus feel slow(er) to use."

Nenhum dos dois é mais a opção econômica. Ambos estão na mesma faixa de preço do Claude Sonnet, e o DeepSeek V3.2 continua uma ordem de grandeza abaixo dos dois. O enquadramento de "modelo chinês barato" pertence à geração anterior.

Insira seus próprios volumes, incluindo quanto da sua entrada está em cache e o quanto mais verboso você espera que o Qwen seja:

Mova o controle de verbosidade além de 1,9x e o Kimi vence em custo apesar de cobrar mais do que o dobro por token de saída. Esse ponto de cruzamento, não o preço de tabela, é o que sua equipe financeira vai observar daqui a três meses.

Pesos abertos: a única diferença clara

Ambos os modelos foram anunciados como abertos. Só um deles é.

A Moonshot disse que os pesos estariam disponíveis até 27 de julho de 2026, e estiveram. O repositório do Kimi K3 mostra um checkpoint modificado pela última vez em 27 de julho, com um índice safetensors totalizando 2.779.931.837.184 parâmetros, o que confirma a afirmação de 2,8T de fora para dentro, e não a partir de um comunicado de imprensa. Já passou de 837.000 downloads e 9.700 curtidas, e já existem quantizações feitas pela comunidade. A licença aparece listada apenas como "other", então vale ler antes de construir um negócio em cima dela.

O Qwen 3.8 Max ainda está esperando. O post de lançamento da Alibaba promete os pesos no Hugging Face e no ModelScope "na próxima semana" três vezes distintas, a página inicial do qwen.ai marca o lançamento como "Open-Source", e não há repositório, licença ou data. A partir de 2 de agosto, "próxima semana" significa a semana de 9 de agosto.

Duas ressalvas antes de se empolgar. Primeiro, um checkpoint de 8 bits com 2,78 trilhões de parâmetros é um artefato de data center, não algo que se roda em uma estação de trabalho, então "aberto" aqui significa auditável e autoalojável em grande escala, não local. Se a execução local for realmente o requisito, os modelos de linguagem pequenos são a categoria honesta. Segundo, a comunidade de modelos locais no Hacker News deixou claro que interpretou o anúncio do Qwen como uma resposta de calendário:

Hacker News

"I assume that this announcement has been prompted by that of Moonshot AI, which has just announced a 2.8T parameter open-weights LLM, Kimi K3, to be published on Huggingface by 27 July. Now the response of Alibaba is that they will also publish soon a big open weights LLM, the 2.4T parameter Qwen 3.8."

O que os desenvolvedores que testaram os dois realmente dizem

Benchmarks medem capacidade. Produção mede capacidade dividida por paciência. Nas threads de lançamento, os relatos práticos favorecem o Kimi, e quase nenhum deles é sobre inteligência.

A frase mais afiada na thread de preview do Qwen foi uma comparação direta:

Hacker News

"The few tests I ran were by no means comprehensive, but while kimi felt like the real deal qwen seems a bit of a benchmark princess."

Um desenvolvedor que testou quatro modelos de ponta lado a lado ao longo de vários dias chegou a uma conclusão mais equilibrada:

Hacker News

"Having tested K3, Qwen 3.8 max preview, Fable and Sol for the past few days, I partially agree. Don't trust the benchmarks, and the Chinese models really are slow and token-inefficient. However they do seem very close to SOTA [...] if I had to find an alternative, I could live with both K3 and Qwen3.8 just fine."

E um relato foi além do que eu iria com base em uma única carga de trabalho, mas é o veredito mais repetido na thread e vale a pena ler como um ponto de dados, não como uma conclusão:

Hacker News

"In my limited anecdotal experience, Kimi K3 is a bit better than Opus 4.8 and Qwen3.8 Max is disastrously bad. It can reason fine, but the moment it tries to do something it gets stuck into long second-guessing loops with no progress."

Vale contrabalançar isso com o lado do Kimi, onde o entusiasmo foi alto no dia do lançamento e um desenvolvedor não conseguiu diferenciá-lo do modelo principal da Anthropic em um teste às cegas:

Hacker News

"I've been playing around with it for the past few hours, and I think it's an amazing model. I'm not sure I could tell the difference between this and Fable in a blind test."

Se essa dispersão incomoda, a rota mais segura é uma lista curta em vez de uma escolha única. A minha para esse lado da comparação é alternativas ao Qwen. O panorama de alternativas ao Kimi K3 cobre pelo outro lado, e existe uma lista mais específica de alternativas ao Qwen 3.8 Max só para esse modelo.

Algumas coisas simplesmente não são publicadas para nenhum dos dois modelos. Nenhum corte de conhecimento. Nenhuma ficha de sistema. Nenhuma avaliação de segurança do lado do Qwen, e nenhum artigo de arquitetura do lado do Kimi até que o relatório técnico saia. Se o setor de compras perguntar, a resposta hoje é que isso não existe.

Onde um modelo de ponta termina e o trabalho de suporte começa

Essa é a parte que mais me preocupa, porque é onde vejo equipes perderem um trimestre inteiro.

Uma camada de suporte fica acima de modelos de ponta intercambiáveis e os transforma em uma resposta segura para o cliente
Uma camada de suporte fica acima de modelos de ponta intercambiáveis e os transforma em uma resposta segura para o cliente

Nenhum desses modelos conhece sua política de reembolso. Nenhum leu seus últimos 7.000 tickets. Nenhum sabe que o cliente que está escrevendo para você tem um plano enterprise e já escalou o caso duas vezes. Uma pontuação de benchmark não é um agente de suporte, e a distância entre essas duas coisas é onde a maioria dos projetos de automação de suporte com IA empaca silenciosamente.

É também por isso que escolher um helpdesk com IA é um exercício diferente de escolher um modelo, e por isso a automação de tickets vive ou morre com base na recuperação de dados, não no raciocínio bruto.

Passei meu tempo na eesel construindo a camada de agentes, e o modo de falha que continuo vendo é pior do que "a IA não sabe". É a invenção confiante. A história das marcas de carro no início deste artigo é o exemplo mais claro que tenho: o modelo não errou na linguagem, errou no escopo, porque a central de ajuda dizia "suportamos todos os modelos" e ele levou isso ao pé da letra. O resumo que aquela equipe fez sobre como acertaram a configuração foi "tentativa e erro no início". Um modelo de 2,8 trilhões de parâmetros teria feito a mesma afirmação, só que com mais fluência.

O controle que resolve isso surgiu em uma ligação com um líder de suporte que gerencia 7.000 tickets por mês, e não tem nada a ver com a escolha do modelo:

"The AI will never be able to answer 100% of the questions, but if it tries and just answers 'sorry I don't know this,' I cannot go and check all my 7,000 tickets to see if the AI actually made a good answer. I need an AI who is only handling the tickets that it's confident to handle and all the other ones, leave them alone."

a CX lead at a 7,000-ticket-a-month DTC brand

Essa é uma decisão de produto, não uma decisão de modelo. É por isso que a eesel AI executa uma simulação sobre tickets históricos antes de qualquer coisa ir ao ar, para que você veja primeiro a taxa de resolução e as respostas reais em conversas passadas de verdade.

É também por isso que as respostas são roteadas por confiança, gerando rascunho para um humano ou escalando em vez de adivinhar, e por isso a classificação de tickets roda como uma etapa própria em vez de ser encaixada em um único prompt gigante.

O que torna a leitura estratégica desta comparação um pouco anticlimática: construa de forma que dê para trocar o motor. A camada de modelo fica melhor e mais barata a cada poucas semanas. O Kimi K3 chegou dezessete dias antes do Qwen, o GPT-5.6 cortou seu nível mais barato em 80% em uma única tarde, e o que liderar o gráfico em setembro não está em nenhum dos dois gráficos hoje.

Essa é a mesma razão pela qual eu não me prenderia ao Gemini também, por melhores que pareçam os números deste mês. O mesmo vale para o Grok. O GLM 5.2 é o outro modelo principal chinês exatamente nessa mesma faixa, e eu leria seu caso de negócio com o mesmo dar de ombros.

Então, qual você deveria escolher?

Se você está lançando algo e quer uma única resposta:

  • Loops longos de agentes onde a eficiência de tokens decide a conta: Kimi K3. Fez o mesmo trabalho com aproximadamente metade dos tokens de entrada, e essa diferença compensa sua tabela de preços mais alta.
  • Trabalho intenso em gráficos, documentos e vídeo: Qwen 3.8 Max. Vence no CharXiv com um harness comparável, e a Alibaba documenta entrada de vídeo com limites concretos que a Moonshot não iguala em seu próprio material de lançamento.
  • Qualquer coisa que você precise autoalojar ou auditar: Kimi K3, e não há debate. Os pesos existem, a contagem de parâmetros bate a partir do checkpoint, e os do Qwen ainda são uma promessa.
  • Um controle de raciocínio que dá para baixar: Qwen 3.8 Max, o único dos dois com níveis de esforço low e medium. O Kimi roda no máximo ou nem roda.
  • Menor custo por token, ponto final: Qwen, em todos os indicadores. Só meça o custo por tarefa concluída antes de planejar um orçamento em cima disso.
  • Qualquer coisa voltada para o cliente: nenhum dos dois sozinho. Escolha primeiro a camada e deixe que ela escolha o modelo. As contas estão no meu detalhamento de custo de agentes, e a lista curta está em melhores agentes de IA.

O que eu não faria é tratar nenhum dos dois gráficos como definitivo. Três linhas são toda a sobreposição honesta entre eles, seis dos benchmarks de codificação da Alibaba são avaliações internas não publicadas, e nenhum terceiro reexecutou nada disso.

Espere que ambas as tabelas de preços mudem antes que números independentes surjam. Por isso mantenho o detalhamento de preços do Kimi K3 como uma página viva, e o mesmo vale para preços do Qwen 3.8 Max. A comparação Qwen 3.8 Max vs GPT-5.6 também precisará ser refeita junto com esta.

Experimente a eesel

Se você chegou até aqui porque quer um modelo que resolve tickets em vez de vencer gráficos, esse é exatamente o propósito da eesel AI. Ela se conecta ao Zendesk, Freshdesk, Gorgias e mais de 100 outras ferramentas, aprende com sua central de ajuda e seus tickets anteriores, e começa a gerar rascunhos em poucos minutos.

O painel da eesel AI, onde um colega de equipe de IA redige e resolve tickets de suporte
O painel da eesel AI, onde um colega de equipe de IA redige e resolve tickets de suporte

O diferencial é a rampa de confiança, não o motor. Simule com base no seu histórico real de tickets, leia os números, comece no modo rascunho e vá para o modo autônomo só quando gostar do que vir. Você herda cada avanço de ponta, seja Kimi, Qwen ou o que for lançado em setembro, sem precisar reconfigurar nada. Experimente a eesel grátis, sem cartão de crédito.

Perguntas frequentes

O Qwen 3.8 Max é melhor que o Kimi K3?
Nas três linhas de benchmark em que os gráficos dos dois fornecedores concordam sobre seus modelos de referência compartilhados, o resultado se divide: o Kimi K3 vence no TerminalBench-2.1 (88.3 contra 86.6), o Qwen vence no raciocínio de gráficos CharXiv (93.5 contra 91.3) e no JobBench por meio ponto. Todo o resto é medido em harnesses diferentes e não pode ser comparado diretamente. Nossa análise do Qwen 3.8 Max e a análise do Kimi K3 aprofundam cada um deles.
Qual é mais barato, o Qwen 3.8 Max ou o Kimi K3?
O Qwen 3.8 Max é mais barato em todos os indicadores publicados: $2 por milhão de tokens de entrada contra $3, e $6 de saída contra $15. Mas a única contagem de tokens lado a lado publicada mostra o Qwen consumindo 18,0M de tokens de entrada, contra 9,5M do Kimi, na mesma tarefa, o que anula essa diferença. Os detalhes completos estão nos nossos artigos sobre preços do Qwen 3.8 Max e preços do Kimi K3.
O Kimi K3 é open source e os pesos do Qwen 3.8 Max já foram lançados?
O Kimi K3 publicou seus pesos no Hugging Face em 27 de julho de 2026, na data prometida pela Moonshot, sob uma licença listada apenas como "other". Os pesos do Qwen 3.8 Max foram prometidos para "a próxima semana" desde 2 de agosto e ainda não foram lançados, sem licença, data ou repositório. Nosso explicador do Qwen 3.8 Max acompanha o status.
Qual é a janela de contexto do Qwen 3.8 Max em comparação ao Kimi K3?
O Kimi K3 tem 1.048.576 tokens, com preço uniforme em toda a janela. O Qwen 3.8 Max tem 1.000.000 de tokens com um teto de saída de 131.072 tokens e um orçamento de raciocínio separado de 262.144 tokens. Nenhum dos dois cobra sobretaxa por contexto longo, o que é uma vantagem real sobre o modelo de preços do GPT-5.6.
Qual é melhor para programação, Qwen 3.8 Max ou Kimi K3?
Relatos práticos no Hacker News favorecem o Kimi K3, principalmente pela eficiência de tokens e menos travamentos do que pela capacidade bruta. Ambos os laboratórios afirmam ter pontuações de ponta em codificação em avaliações que o outro não executou. Para contexto sobre ferramentas, veja nosso panorama de ferramentas de codificação com IA e o artigo sobre Kimi K2.7 Code.
Posso rodar o Qwen 3.8 Max ou o Kimi K3 localmente?
Não em hardware comum. O checkpoint publicado do Kimi K3 é uma versão de 2,78 trilhões de parâmetros em 8 bits, então "pesos abertos" aqui significa um data center, não um notebook. Se a execução local for o requisito real, vale olhar para os modelos de linguagem pequenos ou as plataformas de chatbot open source.
O Qwen 3.8 Max e o Kimi K3 suportam visão?
Ambos aceitam entrada de imagem e geram apenas texto. O Qwen 3.8 Max também documenta suporte a vídeo, com a Alibaba afirmando suportar clipes de mais de 100 horas, embora as configurações de harness que publica declarem apenas texto e imagem. A documentação da API do Kimi também lista entrada de vídeo. Nenhum dos dois substitui um agente feito sob medida.
Posso usar o Qwen 3.8 Max ou o Kimi K3 para atendimento ao cliente?
Qualquer um dos dois consegue escrever uma resposta, e nenhum conhece sua política de reembolso. Um modelo puro não tem memória de tickets anteriores, nenhum limite de confiança e nenhuma transferência para o helpdesk. A eesel AI adiciona essa camada e se conecta ao Zendesk e ao Freshdesk, então você tem uma IA para atendimento ao cliente de verdade, não apenas uma chave de API.

Share this article

Alicia Kirana Utomo

Article by

Alicia Kirana Utomo

Kira is a writer at eesel AI with a Computer Science background and over a year of hands-on experience evaluating AI-powered customer service tools. She focuses on breaking down how helpdesk platforms and AI agents actually work so that support teams can make better buying decisions.

Related Posts

All posts →
Ilustração de um desenvolvedor acessando o Qwen 3.8 Max da Alibaba por meio de chat, multimodal e superfícies de API
Trending

Como acessar o Qwen 3.8 Max: 5 caminhos e o que cada um cobra

Cinco formas reais de chegar ao carro-chefe de 2,4 trilhões de parâmetros da Alibaba, do chat gratuito à API de $2/$6, além das armadilhas de cobrança que pegam as pessoas no caminho.

Rama Adi NugrahaRama Adi NugrahaAug 3, 2026
Ilustração comparando o Qwen 3.8 Max da Alibaba com o DeepSeek V4 Flash
Trending

Qwen 3.8 Max vs DeepSeek V4 Flash: preço, specs, veredito real

Um modelo custa 21x mais por token de saída do que o outro. Isso é o menos interessante nessa comparação, e aqui está o que as especificações realmente decidem.

Alicia Kirana UtomoAlicia Kirana UtomoAug 3, 2026
Ilustração comparando as famílias de modelos Qwen 3.8 Max da Alibaba e GPT-5.6 da OpenAI
Trending

Qwen 3.8 Max vs GPT-5.6: preço, benchmarks e a diferença real

Os dois modelos finalmente têm preços e benchmarks publicados. Aqui está o que os números realmente dizem, o que não podem dizer, e qual eu escolheria para construir.

Rama Adi NugrahaRama Adi NugrahaAug 3, 2026
Qwen 3.8 Max review: um preview de 2,4T testado com honestidade
Trending

Qwen 3.8 Max review: um preview de 2,4T testado com honestidade

Uma review honesta do Qwen 3.8 Max: o que é de fato o carro-chefe de 2,4 trilhões de parâmetros da Alibaba, por que 'só atrás do Fable 5' é uma afirmação e não um benchmark, e quem deveria esperar.

Alicia Kirana UtomoAlicia Kirana UtomoJul 20, 2026
Ilustração comparando as melhores alternativas ao modelo de linguagem de grande porte Kimi K3
Trending

As 8 melhores alternativas ao Kimi K3 em 2026

O Kimi K3 é um modelo de fronteira de verdade, mas não é o mais barato e os pesos chegam atrasados. Aqui estão as 8 melhores alternativas ao Kimi K3, com preços reais de API.

Rama Adi NugrahaRama Adi NugrahaJul 17, 2026
Ilustração comparando a prévia do Qwen3.8-Max da Alibaba com o Claude Fable 5 da Anthropic
Trending

Qwen3.8-Max vs Claude Fable 5: a comparação que ninguém consegue fazer

A Alibaba chamou o Qwen3.8-Max de "atrás apenas do Fable 5". Comparei os dois modelos em preço, contexto, disponibilidade e evidências publicadas para ver se isso se sustenta.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieAug 3, 2026
Ilustração de duas pessoas analisando cartões de preços escalonados em uma tela, com o logotipo do Qwen
Trending

Preços do Qwen 3.7 Flash: o que você realmente paga em 2026

A tarifa de $0.03 é real, e é apenas um dos quatro medidores da sua fatura. Veja como o degrau de prompt, o cache, a região de batch e a taxa de retentativas se combinam no número que você realmente paga.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 31, 2026
Ilustração de painéis de imagem, vídeo e documentos alimentando um modelo de visão e linguagem, com o logotipo da Qwen
Trending

Qwen 3.7 Flash: especificações, preços e o que ele realmente faz

O Qwen 3.7 Flash foi lançado sem post no blog, sem benchmarks e sem pesos. Aqui está a folha de especificações completa, os preços em faixas e o que a Qwen nunca afirmou.

Alicia Kirana UtomoAlicia Kirana UtomoJul 31, 2026
Ilustração de um desenvolvedor trabalhando com painéis de imagem, vídeo e documentos, com o logo da Qwen
Trending

Análise do Qwen 3.7 Flash: um modelo de visão de $0,03 com uma pegadinha

Qwen 3.7 Flash é o modelo de visão mais barato que você pode comprar. Investiguei as faixas de preço, o único benchmark independente, e o que ninguém está contando.

Rama Adi NugrahaRama Adi NugrahaJul 31, 2026

Pronto para contratar seu colega de IA?

Configure em minutos. Sem cartão de crédito necessário.

Comece grátis