Preço do Qwen3.8-Max: a oferta de preview e seus custos ocultos

Kurnia Kharisma Agung Samiadjie
Escrito por

Kurnia Kharisma Agung Samiadjie

Katelin Teen
Revisado por

Katelin Teen

Última edição July 20, 2026

Verificado por especialista
Ilustração representando o preço de preview do Qwen3.8-Max da Alibaba

Por que eu leio essa etiqueta de preço com tanto cuidado

Eu construo e escrevo sobre IA na eesel, e dois anos fazendo SEO me ensinaram que o número que as pessoas buscam ("preço do Qwen3.8-Max") e o número que elas realmente pagam raramente são o mesmo. Meu trabalho do dia a dia está ainda mais perto dessa lacuna: na eesel, colocamos modelos de ponta em filas de suporte reais há anos, e a lição que se repete é que o preço do token quase nunca é o que determina o custo de rodar IA em trabalho real.

Então, quando um modelo de 2,4 trilhões de parâmetros aparece com 10% de desconto, meu instinto não é "barato, vamos colocar no ar". É: em qual unidade eu estou realmente sendo cobrado, com que velocidade ela se esgota, e o que acontece com o preço quando a festa acaba? Essa é a lente para todo este artigo. Se você quer as especificações completas e a afirmação de "atrás só do Fable 5", o artigo explicativo do Qwen3.8-Max e a análise prática cobrem isso. Aqui, estamos seguindo o dinheiro.

Pelo que você está realmente pagando

Um contexto rápido, porque o preço só faz sentido quando você sabe em qual nível está. Qwen (Tongyi Qianwen) é a família de modelos da Alibaba Cloud, e "Max" é a linha principal proprietária, acima dos níveis mais baratos Plus e Turbo, e acima dos checkpoints de pesos abertos do Qwen3. O Qwen3.8-Max é o modelo Max mais recente, apresentado em preview como Qwen3.8-Max-Preview e descrito como um modelo Mixture-of-Experts de 2,4 trilhões de parâmetros que processa texto, imagens, vídeo e documentos.

O fato importante sobre preço se esconde nesse sufixo "Preview": isso é um lançamento promocional, não um produto consolidado. A tarifa de 10%, o preço por token ausente e a promessa de "pesos abertos em breve" são todos estados de preview. Isso importa porque é a diferença entre um preço com o qual você pode planejar um ano inteiro e um preço que pode mudar debaixo dos seus pés no mês que vem.

A oferta de preview do Qwen3.8-Max, em uma linha

Foi isso que todo desenvolvedor repetiu: durante o preview, o Qwen3.8-Max roda a 10% do preço padrão, disponível através de três canais:

  • Token Plan, a assinatura baseada em créditos da Alibaba (a principal via para consumidores).
  • Qoder, o produto de programação agêntica da Alibaba.
  • QoderWork, a versão para equipes/workspace do mesmo produto.

Não existe nenhuma tarifa por token independente publicada. Para um modelo de nível Max, isso é incomum, e é o ponto mais importante para entender o preço do Qwen3.8-Max: você não está comprando tokens a uma tarifa fixa, está comprando créditos em uma assinatura e gastando-os com um desconto de preview.

O acesso à chave de API e ao console do Qwen, onde você emite chaves e gerencia o plano baseado em créditos, conforme mostrado em qwen.ai
O acesso à chave de API e ao console do Qwen, onde você emite chaves e gerencia o plano baseado em créditos, conforme mostrado em qwen.ai

Níveis do Token Plan Personal

O ponto de entrada para consumidores é o Token Plan (Personal Edition). É uma assinatura mensal que concede um conjunto de créditos, limitado de duas formas: uma cota de 7 dias e uma cota rotativa de 5 horas (para que você não consiga esgotar os créditos de um mês inteiro em uma tarde).

NívelMensalCota de créditos em 7 diasCota de créditos em 5 horas
Lite~US$6 (39 CNY)2.500 créditos700 créditos
Standard~US$20 (139 CNY)10.000 créditos3.000 créditos
Pro~US$70 (499 CNY)40.000 créditos12.000 créditos

Fonte: Alibaba Cloud Token Plan. Os valores em dólar são conversões aproximadas dos preços em CNY e variam com a taxa de câmbio.

O crédito, não o dólar, é a unidade real aqui. Um "crédito" corresponde a consumo de tokens, e quantos tokens um crédito compra depende do modelo e do desconto aplicado em cima. O que nos leva à parte que faz o preço de tabela parecer quase de graça.

O desconto noturno que faz parecer quase de graça

Além da tarifa de preview de 10%, a Alibaba adiciona um desconto noturno: mais 80% de desconto no consumo de créditos entre 22h00 e 08h00 (UTC+8). Combinando os dois, as execuções fora do horário de pico ficam em torno de 0,2% da tarifa padrão.

É uma jogada agressiva e deliberada. Foi feita para levar desenvolvedores a testar o preview de forma barata, e se sua carga de trabalho puder ser processada em lote (avaliações, geração de datasets, tarefas de programação noturnas), programá-la para a janela noturna UTC+8 é uma alavanca real de redução de custo. Se você estiver nas Américas, a noite em UTC+8 coincide mais ou menos com o seu horário de trabalho, o que é conveniente ou inútil dependendo de onde você está.

A pegadinha é a mesma de qualquer tarifa promocional: ela mostra o custo do desconto, não o custo do produto. Faça protótipos a 0,2%, mas planeje o orçamento a 100%.

Como o preço de preview do Qwen3.8-Max se comprime da tarifa padrão até cerca de 0,2% durante a noite
Como o preço de preview do Qwen3.8-Max se comprime da tarifa padrão até cerca de 0,2% durante a noite

O custo oculto que ninguém coloca na página de preços

Essa é a linha que eu sublinharia em qualquer conversa sobre o preço do Qwen3.8-Max. O modelo de assinatura por créditos é exatamente aquilo de que os usuários do Qwen já reclamaram antes.

Na geração anterior, usuários do Reddit relataram créditos se esgotando muito mais rápido do que o esperado. E há um motivo estrutural para isso: os modelos Qwen tendem a gerar mais tokens de saída por tarefa do que modelos concorrentes. Como tokens de saída costumam custar mais do que tokens de entrada e a cobrança é por consumo, um modelo mais "tagarela" infla discretamente a conta real mesmo quando a tarifa anunciada parece baixa.

Juntando tudo isso, o desconto de preview está encobrindo um modelo de medição que historicamente surpreende as pessoas. A tarifa de 10% esconde o consumo. Quando o preview terminar e o desconto for embora com ele, é esse consumo que você vai realmente sentir. Então a forma honesta de ler o preço do Qwen3.8-Max é: barato para testar, imprevisível para depender dele, pelo menos até a Alibaba publicar uma tarifa real por token que dê para prever.

Por que a tarifa de tabela subestima a conta real: tokens de saída extras e consumo de créditos mais rápido se somam ao preço anunciado
Por que a tarifa de tabela subestima a conta real: tokens de saída extras e consumo de créditos mais rápido se somam ao preço anunciado

Estime o seu próprio custo de preview

Como não há uma tarifa por token clara, a coisa mais útil que posso te dar é uma forma de sentir a dimensão da conta. Insira um consumo mensal aproximado de créditos e veja como o desconto de preview e a janela noturna mudam o que você pagaria, comparado a rodar em tarifas padrão.

O que a calculadora transmite melhor do que um parágrafo: o preview é surpreendentemente barato, mas "sua estimativa" é construída sobre um desconto, não sobre um preço. Simule também a coluna padrão, porque é nela que você vai viver mais tarde.

Como o preço se compara

Em custo de acesso bruto, o preview supera todo mundo, esse é todo o design. Mas a comparação é onde a tarifa por token ausente morde, porque você não consegue colocar o Qwen3.8-Max lado a lado com uma tabela de preços normal.

  • Kimi K3, o carro-chefe de 2,8 trilhões de parâmetros da Moonshot, com preço de aproximadamente US$3/US$15 por milhão de tokens de entrada/saída. Isso é nível Sonnet, não nível barato, e vale notar que é uma tarifa publicada e previsível. O Kimi K3 chegou dias antes do Qwen3.8-Max, e o momento escolhido foi claramente uma resposta.
  • O modelo topo de linha da Claude (Fable 5), o modelo com o qual a Alibaba está se medindo, com preço acima do Kimi K3, também com uma tarifa claramente publicada.
  • Qwen3.8-Max, o mais barato para testar, o menos claro para orçar. Uma assinatura de créditos com um desconto promocional não é o mesmo tipo de número que US$3/US$15 por milhão de tokens.
Onde os três modelos se posicionam: o Qwen3.8-Max é barato para testar mas difícil de orçar, enquanto o Kimi K3 e a Claude são mais caros mas previsíveis
Onde os três modelos se posicionam: o Qwen3.8-Max é barato para testar mas difícil de orçar, enquanto o Kimi K3 e a Claude são mais caros mas previsíveis

Se a sua decisão é "qual é o mais barato para experimentar essa semana", o preview ganha fácil. Se é "com qual eu consigo prever um ano de gasto em produção", o Qwen3.8-Max é atualmente o mais difícil de responder, justamente porque o preço de preview é um alvo em movimento. Para um panorama mais amplo, o compilado de melhores modelos de IA e o guia de alternativas ao Qwen são boas próximas leituras.

Onde o preço do modelo deixa de importar: o trabalho de verdade

Aqui está a parte que mais me importa, porque é o erro que vejo equipes cometerem a cada novo modelo. Quando o trabalho é atendimento ao cliente, o preço do modelo é o número pequeno na fatura.

Um modelo puro, por mais barato e inteligente que seja, não tem memória dos seus tickets, nenhuma barreira de segurança e nenhuma conexão com o seu helpdesk. Para responder a um cliente real, ele precisa da sua base de conhecimento, das suas políticas, de regras de escalonamento e de uma forma de encaminhar para um humano quando estiver em dúvida. Construir e manter essa camada é onde o custo real mora, não na diferença entre 10% e 100% de uma tarifa de token. Um cliente da eesel resumiu bem essa decisão entre construir ou comprar:

"We could try to write our own LLM application, but we didn't want to invest our time into that. We wanted something we wouldn't have to maintain."

a mid-market support lead evaluating build vs buy

Essa é a boa notícia silenciosa sobre o Qwen3.8-Max, o Kimi K3, ou qualquer que seja o modelo que lidere a tabela de tamanhos no mês que vem. Uma IA para atendimento ao cliente bem construída herda cada avanço de ponta sem que você precise reconstruir nada, e o seu preço está atrelado a tickets resolvidos, não a um saldo de créditos de preview que você precisa vigiar.

Essa é a lacuna que a eesel AI preenche. Ela envolve um modelo de ponta com o seu conhecimento e suas barreiras de segurança, se conecta ao Zendesk, ao Freshdesk e mais, e, a parte que importa para o custo, simula com base nos seus tickets históricos antes de qualquer coisa entrar no ar, para que você veja primeiro a taxa de resolução e as respostas exatas em conversas passadas reais.

Painel de relatórios da eesel AI mostrando análises de resolução e uso, para que o custo acompanhe os tickets resolvidos, não um medidor de créditos
Painel de relatórios da eesel AI mostrando análises de resolução e uso, para que o custo acompanhe os tickets resolvidos, não um medidor de créditos
Fazendo assim, a Gridwise atingiu 73% de resolução de tickets de nível 1 já no primeiro mês. O preço é por resolução, então você paga por resultados, não por vigiar o medidor de créditos de um modelo de 2,4 trilhões de parâmetros.

Quer um agente de IA que transforma qualquer modelo de ponta em resolução de tickets de verdade? Experimente a eesel de graça, sem cartão de crédito.

O resumo sobre o preço do Qwen3.8-Max

O preview é uma forma barata de experimentar um modelo multimodal de 2,4 trilhões de parâmetros: 10% do padrão, caindo para ~0,2% durante a noite. Trate isso como um teste, não como um plano. As duas coisas a observar são a tarifa por token ausente (não dá para prever com clareza em cima de uma assinatura de créditos) e o consumo histórico de créditos que o desconto está escondendo por enquanto. Faça protótipos agora, planeje o orçamento para a tarifa real depois, e se o trabalho for suporte, lembre-se de que o preço do modelo nunca foi o número que realmente importava.

Frequently Asked Questions

Quanto custa o Qwen3.8-Max?
Durante o preview, o Qwen3.8-Max é vendido a 10% do preço padrão através do Token Plan da Alibaba, do Qoder e do QoderWork. Os níveis do Token Plan Personal ficam em torno de US$6/mês (39 CNY) para o Lite, ~US$20 (139 CNY) para o Standard e ~US$70 (499 CNY) para o Pro. Ainda não há uma tarifa por token publicada separadamente. Nosso guia mais amplo sobre preços do Qwen cobre o restante da linha.
Qual é o preço do Qwen3.8-Max durante o preview?
A grande novidade do preview é uma tarifa fixa de 10% do preço padrão, e a Alibaba ainda soma um desconto noturno extra de 80% sobre o consumo de créditos entre 22h00 e 08h00 (UTC+8). Isso equivale a aproximadamente 0,2% da tarifa padrão em execuções fora do horário de pico. É um preço promocional de preview, então trate-o como um preço de teste, não como o preço que você vai pagar quando ele terminar.
Existe um preço de API por token para o Qwen3.8-Max?
Não durante o preview. De forma incomum para um modelo de nível Max, a Alibaba não publicou nenhuma tarifa por token independente. O acesso está integrado à assinatura baseada em créditos do Token Plan e aos produtos de programação Qoder. Se o seu orçamento depende de um preço fixo de entrada/saída por token, ainda não existe nenhum disponível.
O Qwen3.8-Max tem custos ocultos?
O modelo de créditos é a pegadinha. Nas gerações anteriores, usuários do Qwen relataram créditos se esgotando mais rápido do que o esperado, e os modelos Qwen tendem a gerar mais tokens de saída por tarefa do que modelos concorrentes, o que infla discretamente o custo real. A tarifa de preview de 10% esconde isso por enquanto. Quando o preview terminar, planeje o orçamento pensando no consumo de créditos, não no preço de tabela.
Como o preço do Qwen3.8-Max se compara ao Kimi K3 e ao Claude?
O Kimi K3 está no nível Sonnet, com preço de aproximadamente US$3/US$15 por milhão de tokens, e o modelo topo de linha da Claude é mais caro que isso. O Qwen3.8-Max não pode ser comparado de forma direta porque não tem tarifa por token, apenas uma assinatura de créditos. Em custo de acesso bruto, o preview é mais barato que qualquer coisa; em previsibilidade, é o menos claro. Veja nossos guias de Kimi K3 e comparação de modelos.
Posso usar o preço do Qwen3.8-Max para rodar um agente de suporte ao cliente?
Você pode apontar o modelo para os tickets, mas o preço do modelo é a parte pequena da conta. Um modelo puro não tem memória dos seus tickets, nenhuma barreira de segurança e nenhuma conexão com o seu helpdesk. A eesel AI envolve um modelo de ponta com exatamente isso e se conecta ao Zendesk, ao Freshdesk e mais, então você compra uma IA para atendimento ao cliente, não só tokens.

Share this article

Kurnia Kharisma Agung Samiadjie

Article by

Kurnia Kharisma Agung Samiadjie

Kurnia is a software engineer and writer at eesel AI with two years of SEO experience, writing about AI tools, helpdesk software, and customer support. He pairs a developer's understanding of how these products are built with search-driven research into what actually ranks and resonates with the people searching for them.

Related Posts

All posts →
Ilustração comparando o Qwen3.8-Max com modelos de IA de ponta rivais
Trending

As 6 melhores alternativas ao Qwen3.8-Max em 2026

As melhores alternativas ao Qwen3.8-Max em 2026, comparadas com honestidade: Kimi K3, Claude, GPT-5.6, Gemini 3.5 Pro, Grok 4.5 e a camada de suporte que realmente resolve tickets.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 20, 2026
Ilustração representando a prévia do modelo de linguagem Qwen3.8-Max da Alibaba
Trending

O que é Qwen3.8-Max: a prévia do carro-chefe de 2,4T da Alibaba

Um guia simples sobre o Qwen3.8-Max, a prévia multimodal de 2,4 trilhões de parâmetros da Alibaba: o que é, o que a Alibaba afirma, quanto custa e se vale a pena testar agora.

Alicia Kirana UtomoAlicia Kirana UtomoJul 20, 2026
Ilustração comparando a prévia do Qwen3.8-Max da Alibaba com o Claude Fable 5 da Anthropic
Trending

Qwen3.8-Max vs Claude Fable 5: a comparação que ninguém consegue fazer

A Alibaba chamou o Qwen3.8-Max de "atrás apenas do Fable 5". Comparei os dois modelos em preço, contexto, disponibilidade e evidências publicadas para ver se isso se sustenta.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieAug 3, 2026
Qwen 3.8 Max review: um preview de 2,4T testado com honestidade
Trending

Qwen 3.8 Max review: um preview de 2,4T testado com honestidade

Uma review honesta do Qwen 3.8 Max: o que é de fato o carro-chefe de 2,4 trilhões de parâmetros da Alibaba, por que 'só atrás do Fable 5' é uma afirmação e não um benchmark, e quem deveria esperar.

Alicia Kirana UtomoAlicia Kirana UtomoJul 20, 2026
Ilustração de um desenvolvedor acessando o Qwen 3.8 Max da Alibaba por meio de chat, multimodal e superfícies de API
Trending

Como acessar o Qwen 3.8 Max: 5 caminhos e o que cada um cobra

Cinco formas reais de chegar ao carro-chefe de 2,4 trilhões de parâmetros da Alibaba, do chat gratuito à API de $2/$6, além das armadilhas de cobrança que pegam as pessoas no caminho.

Rama Adi NugrahaRama Adi NugrahaAug 3, 2026
Ilustração comparando o Qwen 3.8 Max da Alibaba e o Kimi K3 da Moonshot AI
Trending

Qwen 3.8 Max vs Kimi K3: os números que nenhum laboratório publicou

Dois laboratórios chineses lançaram um modelo principal com mais de 2 trilhões de parâmetros com dezessete dias de diferença, e nenhum colocou o outro em seu gráfico de benchmarks. Aqui está o que realmente se compara, quanto a conta realmente custa, e qual eu escolheria.

Alicia Kirana UtomoAlicia Kirana UtomoAug 3, 2026
Ilustração de duas pessoas analisando cartões de preços escalonados em uma tela, com o logotipo do Qwen
Trending

Preços do Qwen 3.7 Flash: o que você realmente paga em 2026

A tarifa de $0.03 é real, e é apenas um dos quatro medidores da sua fatura. Veja como o degrau de prompt, o cache, a região de batch e a taxa de retentativas se combinam no número que você realmente paga.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 31, 2026
Ilustração de painéis de imagem, vídeo e documentos alimentando um modelo de visão e linguagem, com o logotipo da Qwen
Trending

Qwen 3.7 Flash: especificações, preços e o que ele realmente faz

O Qwen 3.7 Flash foi lançado sem post no blog, sem benchmarks e sem pesos. Aqui está a folha de especificações completa, os preços em faixas e o que a Qwen nunca afirmou.

Alicia Kirana UtomoAlicia Kirana UtomoJul 31, 2026
Ilustração de um desenvolvedor trabalhando com painéis de imagem, vídeo e documentos, com o logo da Qwen
Trending

Análise do Qwen 3.7 Flash: um modelo de visão de $0,03 com uma pegadinha

Qwen 3.7 Flash é o modelo de visão mais barato que você pode comprar. Investiguei as faixas de preço, o único benchmark independente, e o que ninguém está contando.

Rama Adi NugrahaRama Adi NugrahaJul 31, 2026

Pronto para contratar seu colega de IA?

Configure em minutos. Sem cartão de crédito necessário.

Comece grátis