
Por que eu leio essa etiqueta de preço com tanto cuidado
Eu construo e escrevo sobre IA na eesel, e dois anos fazendo SEO me ensinaram que o número que as pessoas buscam ("preço do Qwen3.8-Max") e o número que elas realmente pagam raramente são o mesmo. Meu trabalho do dia a dia está ainda mais perto dessa lacuna: na eesel, colocamos modelos de ponta em filas de suporte reais há anos, e a lição que se repete é que o preço do token quase nunca é o que determina o custo de rodar IA em trabalho real.
Então, quando um modelo de 2,4 trilhões de parâmetros aparece com 10% de desconto, meu instinto não é "barato, vamos colocar no ar". É: em qual unidade eu estou realmente sendo cobrado, com que velocidade ela se esgota, e o que acontece com o preço quando a festa acaba? Essa é a lente para todo este artigo. Se você quer as especificações completas e a afirmação de "atrás só do Fable 5", o artigo explicativo do Qwen3.8-Max e a análise prática cobrem isso. Aqui, estamos seguindo o dinheiro.
Pelo que você está realmente pagando
Um contexto rápido, porque o preço só faz sentido quando você sabe em qual nível está. Qwen (Tongyi Qianwen) é a família de modelos da Alibaba Cloud, e "Max" é a linha principal proprietária, acima dos níveis mais baratos Plus e Turbo, e acima dos checkpoints de pesos abertos do Qwen3. O Qwen3.8-Max é o modelo Max mais recente, apresentado em preview como Qwen3.8-Max-Preview e descrito como um modelo Mixture-of-Experts de 2,4 trilhões de parâmetros que processa texto, imagens, vídeo e documentos.
O fato importante sobre preço se esconde nesse sufixo "Preview": isso é um lançamento promocional, não um produto consolidado. A tarifa de 10%, o preço por token ausente e a promessa de "pesos abertos em breve" são todos estados de preview. Isso importa porque é a diferença entre um preço com o qual você pode planejar um ano inteiro e um preço que pode mudar debaixo dos seus pés no mês que vem.
A oferta de preview do Qwen3.8-Max, em uma linha
Foi isso que todo desenvolvedor repetiu: durante o preview, o Qwen3.8-Max roda a 10% do preço padrão, disponível através de três canais:
- Token Plan, a assinatura baseada em créditos da Alibaba (a principal via para consumidores).
- Qoder, o produto de programação agêntica da Alibaba.
- QoderWork, a versão para equipes/workspace do mesmo produto.
Não existe nenhuma tarifa por token independente publicada. Para um modelo de nível Max, isso é incomum, e é o ponto mais importante para entender o preço do Qwen3.8-Max: você não está comprando tokens a uma tarifa fixa, está comprando créditos em uma assinatura e gastando-os com um desconto de preview.

Níveis do Token Plan Personal
O ponto de entrada para consumidores é o Token Plan (Personal Edition). É uma assinatura mensal que concede um conjunto de créditos, limitado de duas formas: uma cota de 7 dias e uma cota rotativa de 5 horas (para que você não consiga esgotar os créditos de um mês inteiro em uma tarde).
| Nível | Mensal | Cota de créditos em 7 dias | Cota de créditos em 5 horas |
|---|---|---|---|
| Lite | ~US$6 (39 CNY) | 2.500 créditos | 700 créditos |
| Standard | ~US$20 (139 CNY) | 10.000 créditos | 3.000 créditos |
| Pro | ~US$70 (499 CNY) | 40.000 créditos | 12.000 créditos |
Fonte: Alibaba Cloud Token Plan. Os valores em dólar são conversões aproximadas dos preços em CNY e variam com a taxa de câmbio.
O crédito, não o dólar, é a unidade real aqui. Um "crédito" corresponde a consumo de tokens, e quantos tokens um crédito compra depende do modelo e do desconto aplicado em cima. O que nos leva à parte que faz o preço de tabela parecer quase de graça.
O desconto noturno que faz parecer quase de graça
Além da tarifa de preview de 10%, a Alibaba adiciona um desconto noturno: mais 80% de desconto no consumo de créditos entre 22h00 e 08h00 (UTC+8). Combinando os dois, as execuções fora do horário de pico ficam em torno de 0,2% da tarifa padrão.
É uma jogada agressiva e deliberada. Foi feita para levar desenvolvedores a testar o preview de forma barata, e se sua carga de trabalho puder ser processada em lote (avaliações, geração de datasets, tarefas de programação noturnas), programá-la para a janela noturna UTC+8 é uma alavanca real de redução de custo. Se você estiver nas Américas, a noite em UTC+8 coincide mais ou menos com o seu horário de trabalho, o que é conveniente ou inútil dependendo de onde você está.
A pegadinha é a mesma de qualquer tarifa promocional: ela mostra o custo do desconto, não o custo do produto. Faça protótipos a 0,2%, mas planeje o orçamento a 100%.

O custo oculto que ninguém coloca na página de preços
Essa é a linha que eu sublinharia em qualquer conversa sobre o preço do Qwen3.8-Max. O modelo de assinatura por créditos é exatamente aquilo de que os usuários do Qwen já reclamaram antes.
Na geração anterior, usuários do Reddit relataram créditos se esgotando muito mais rápido do que o esperado. E há um motivo estrutural para isso: os modelos Qwen tendem a gerar mais tokens de saída por tarefa do que modelos concorrentes. Como tokens de saída costumam custar mais do que tokens de entrada e a cobrança é por consumo, um modelo mais "tagarela" infla discretamente a conta real mesmo quando a tarifa anunciada parece baixa.
Juntando tudo isso, o desconto de preview está encobrindo um modelo de medição que historicamente surpreende as pessoas. A tarifa de 10% esconde o consumo. Quando o preview terminar e o desconto for embora com ele, é esse consumo que você vai realmente sentir. Então a forma honesta de ler o preço do Qwen3.8-Max é: barato para testar, imprevisível para depender dele, pelo menos até a Alibaba publicar uma tarifa real por token que dê para prever.

Estime o seu próprio custo de preview
Como não há uma tarifa por token clara, a coisa mais útil que posso te dar é uma forma de sentir a dimensão da conta. Insira um consumo mensal aproximado de créditos e veja como o desconto de preview e a janela noturna mudam o que você pagaria, comparado a rodar em tarifas padrão.
O que a calculadora transmite melhor do que um parágrafo: o preview é surpreendentemente barato, mas "sua estimativa" é construída sobre um desconto, não sobre um preço. Simule também a coluna padrão, porque é nela que você vai viver mais tarde.
Como o preço se compara
Em custo de acesso bruto, o preview supera todo mundo, esse é todo o design. Mas a comparação é onde a tarifa por token ausente morde, porque você não consegue colocar o Qwen3.8-Max lado a lado com uma tabela de preços normal.
- Kimi K3, o carro-chefe de 2,8 trilhões de parâmetros da Moonshot, com preço de aproximadamente US$3/US$15 por milhão de tokens de entrada/saída. Isso é nível Sonnet, não nível barato, e vale notar que é uma tarifa publicada e previsível. O Kimi K3 chegou dias antes do Qwen3.8-Max, e o momento escolhido foi claramente uma resposta.
- O modelo topo de linha da Claude (Fable 5), o modelo com o qual a Alibaba está se medindo, com preço acima do Kimi K3, também com uma tarifa claramente publicada.
- Qwen3.8-Max, o mais barato para testar, o menos claro para orçar. Uma assinatura de créditos com um desconto promocional não é o mesmo tipo de número que US$3/US$15 por milhão de tokens.

Se a sua decisão é "qual é o mais barato para experimentar essa semana", o preview ganha fácil. Se é "com qual eu consigo prever um ano de gasto em produção", o Qwen3.8-Max é atualmente o mais difícil de responder, justamente porque o preço de preview é um alvo em movimento. Para um panorama mais amplo, o compilado de melhores modelos de IA e o guia de alternativas ao Qwen são boas próximas leituras.
Onde o preço do modelo deixa de importar: o trabalho de verdade
Aqui está a parte que mais me importa, porque é o erro que vejo equipes cometerem a cada novo modelo. Quando o trabalho é atendimento ao cliente, o preço do modelo é o número pequeno na fatura.
Um modelo puro, por mais barato e inteligente que seja, não tem memória dos seus tickets, nenhuma barreira de segurança e nenhuma conexão com o seu helpdesk. Para responder a um cliente real, ele precisa da sua base de conhecimento, das suas políticas, de regras de escalonamento e de uma forma de encaminhar para um humano quando estiver em dúvida. Construir e manter essa camada é onde o custo real mora, não na diferença entre 10% e 100% de uma tarifa de token. Um cliente da eesel resumiu bem essa decisão entre construir ou comprar:
"We could try to write our own LLM application, but we didn't want to invest our time into that. We wanted something we wouldn't have to maintain."
a mid-market support lead evaluating build vs buy
Essa é a boa notícia silenciosa sobre o Qwen3.8-Max, o Kimi K3, ou qualquer que seja o modelo que lidere a tabela de tamanhos no mês que vem. Uma IA para atendimento ao cliente bem construída herda cada avanço de ponta sem que você precise reconstruir nada, e o seu preço está atrelado a tickets resolvidos, não a um saldo de créditos de preview que você precisa vigiar.
Essa é a lacuna que a eesel AI preenche. Ela envolve um modelo de ponta com o seu conhecimento e suas barreiras de segurança, se conecta ao Zendesk, ao Freshdesk e mais, e, a parte que importa para o custo, simula com base nos seus tickets históricos antes de qualquer coisa entrar no ar, para que você veja primeiro a taxa de resolução e as respostas exatas em conversas passadas reais.

Quer um agente de IA que transforma qualquer modelo de ponta em resolução de tickets de verdade? Experimente a eesel de graça, sem cartão de crédito.
O resumo sobre o preço do Qwen3.8-Max
O preview é uma forma barata de experimentar um modelo multimodal de 2,4 trilhões de parâmetros: 10% do padrão, caindo para ~0,2% durante a noite. Trate isso como um teste, não como um plano. As duas coisas a observar são a tarifa por token ausente (não dá para prever com clareza em cima de uma assinatura de créditos) e o consumo histórico de créditos que o desconto está escondendo por enquanto. Faça protótipos agora, planeje o orçamento para a tarifa real depois, e se o trabalho for suporte, lembre-se de que o preço do modelo nunca foi o número que realmente importava.
Frequently Asked Questions
Quanto custa o Qwen3.8-Max?
Qual é o preço do Qwen3.8-Max durante o preview?
Existe um preço de API por token para o Qwen3.8-Max?
O Qwen3.8-Max tem custos ocultos?
Como o preço do Qwen3.8-Max se compara ao Kimi K3 e ao Claude?
Posso usar o preço do Qwen3.8-Max para rodar um agente de suporte ao cliente?

Article by
Kurnia Kharisma Agung Samiadjie
Kurnia is a software engineer and writer at eesel AI with two years of SEO experience, writing about AI tools, helpdesk software, and customer support. He pairs a developer's understanding of how these products are built with search-driven research into what actually ranks and resonates with the people searching for them.








