
Preços do Gemini 4 Argon num relance
O Google anunciou o Argon em 30 de setembro de 2026. O preço inteiro está numa única linha do post de lançamento mais uma nota de rodapé. Aqui está tudo o que o Google publicou até agora, numa tabela:
| Preço introdutório | Após a promo | |
|---|---|---|
| Entrada, por 1M de tokens | $2,00 | $4,00 |
| Entrada em cache, por 1M de tokens | $0,10 (95% de desconto) | $0,20 (95% de desconto) |
| Saída, por 1M de tokens (raciocínio incluído) | $10,00 | $20,00 |
| Sobretaxa de contexto longo | Nenhuma publicada | Nenhuma publicada |
| Batch / Flex / Priority | Não publicado | Não publicado |
| Plano gratuito | Não publicado | Não publicado |
| Janela de contexto / saída máxima | 1M / 1M de tokens | 1M / 1M de tokens |
| Quem pode comprar | Ninguém ainda | Primeiro clientes pagos da API |
A própria nota de rodapé diz: "After the introductory period expires, the price of $4 per 1M input tokens and $20 per 1M output tokens will apply." A tarifa de cache de $0,20 pós-promo vem da minha própria aritmética sobre o "95% off input token price" do Google, e bate com o valor no detalhamento de custos da Artificial Analysis. A Artificial Analysis descreve o desconto como uma promoção de 50% "por pelo menos um mês" e também observa que o desconto de cache subiu em relação aos 90% do Gemini 3.8 Flash.
Se você quer as especificações por trás do preço (benchmarks, segurança e quem está no Fairwind Program), minha visão geral do Gemini 4 Argon cobre isso. Aqui fico só no dinheiro.
Dá para pagar por ele de verdade já?
Não. Vale saber antes de colocar qualquer número numa planilha. O Argon está sendo "rolling out to a set of trusted cyber defenders" pelo Fairwind Program do Google. Clientes pagos da API e assinantes do Google AI Ultra são os próximos da fila, e o Google não deu data para nenhum dos grupos.
Conferi de novo em 1º de outubro de 2026. Uma chamada generateContent para gemini-4-argon na minha chave da Gemini API retornou 404 NOT_FOUND, e não havia nenhum Argon na lista de modelos. A página de preços da Gemini Developer API ainda termina no 3.8 Flash e no 3.1 Pro:
Do lado do consumidor, não está mais perto. A página de assinaturas do Gemini lista o Google AI Plus a $4,99 por mês, o Google AI Pro a $19,99 e o Ultra a $99,99 (5x os limites do Pro) ou $199,99 (20x), e o melhor modelo que ela cita ainda é o 3.1 Pro. Se é acesso de consumidor que você procura, o Ultra é o único nível que o Google nomeou. Ainda assim, nada nessa página promete o Argon a ninguém por enquanto.

Como o Gemini 4 Argon se compara em preço por token
Olhando só a tabela de preços, o Argon cai num lugar estranho: seu preço promocional é o preço do GPT-6.1 Sol, e seu preço padrão é o do Claude Opus 5.5. Abaixo estão as tarifas publicadas da API de todos os modelos da tabela de comparação do Google, e também dos mais baratos com os quais as pessoas o comparam. Os guias completos de preços da API da OpenAI e preços da API da Anthropic trazem o resto:
| Modelo | Entrada / 1M | Entrada em cache / 1M | Saída / 1M | Fonte |
|---|---|---|---|---|
| Gemini 4 Argon (promo) | $2,00 | $0,10 | $10,00 | |
| Gemini 4 Argon (padrão) | $4,00 | $0,20 | $20,00 | |
| GPT-6.1 Sol | $2,00 | $0,10 | $10,00 | OpenAI |
| GPT-6 Astra | $10,00 | $1,00 | $50,00 | OpenAI |
| Claude Opus 5.5 | $4,00 | $0,20 | $20,00 | Anthropic |
| Claude Fable 5.1 | $10,00 | $0,25 | $50,00 | Anthropic |
| Claude Sonnet 5.5 | $2,00 | $0,20 | $10,00 | Anthropic |
| Gemini 3.8 Flash | $0,75 | $0,075 | $3,75 |
Algumas coisas chamam a atenção. Primeiro, a reação no Hacker News ("5x cheaper than Astra") está correta por token, e é exatamente a comparação que o Google quer que você faça. Ao lado do GPT-6 Astra e do Claude Fable 5.1, o Argon em promo custa um quinto.
Segundo, a diferença fecha rápido. No preço padrão o Argon ainda fica em 40% da tarifa por token do Astra, mas fica exatamente no mesmo nível do Opus 5.5, que está cerca de 5 pontos acima no índice da Artificial Analysis com esforço máximo. O Gemini 3.8 Flash também tem seu próprio relógio: a página de preços do Google diz que seus $0,75/$3,75 dobram para $1,50/$7,50 em 1º de janeiro de 2027. Então, para quem monta um orçamento só com Google para o ano que vem, as duas linhas vão subir.
Há um detalhe menor que importa se você trabalha com documentos longos. O Gemini 3.1 Pro cobra $4/$18 quando um prompt passa de 200K tokens, e a OpenAI cobra prompts acima de 272K com o dobro na entrada. O Google não publicou nenhuma sobretaxa de contexto longo para o Argon. Talvez seja um recurso real, talvez só não esteja escrito ainda. Confira a tabela final antes de contar com isso.
O número que importa: custo por tarefa
Um preço por token diz quanto custa uma palavra. Não diz nada sobre quantas palavras o modelo usa, e o Argon usa bastante. A Artificial Analysis rodou o índice completo no Argon e encontrou 62K tokens de saída por tarefa, contra 27K do GPT-6 Astra. No índice todo ele produziu 110M de tokens, enquanto o modelo mediano usa 82M.

É assim que uma mesma tabela de preços acaba produzindo contas muito diferentes. Isto é o que a Artificial Analysis mediu para cada tarefa do índice:
| Modelo e configuração | AA Intelligence Index | Custo por tarefa |
|---|---|---|
| GPT-6.1 Sol (max) | 52 | $0,72 |
| Claude Opus 5.5 (high) | 54 | $1,82 |
| Gemini 4 Argon (high), preço promo | 53 | $1,99 |
| GPT-6 Astra (max) | 53 | $3,26 |
| Gemini 4 Argon (high), preço padrão | 53 | $3,98 |
As linhas do Sol, Astra e Argon vêm do artigo da Artificial Analysis; a linha do Opus 5.5 high é o valor que um comentarista do Hacker News tirou do mesmo gráfico da AA no dia do lançamento. Como eu leio: o Argon e o Sol pagam preços idênticos por token, então a diferença de 2,7x se deve quase toda ao fato de o Argon escrever mais.
A Artificial Analysis também divulgou um gráfico em cascata mostrando de onde vem o custo do Argon. Ele começa no Gemini 3.1 Pro Preview a $0,67 por tarefa:

A primeira barra é a que eu mostraria a um responsável financeiro. Mesmo com os preços antigos do 3.1 Pro, os tokens extras sozinhos levariam uma tarefa de $0,67 para $2,43. Depois disso, a promo esconde a maior parte do aumento de preço. Tire a promo e uma tarefa custa cerca de 6x o que o modelo Pro anterior custava.
Um comentarista do Hacker News viu isso chegando antes mesmo de os números da AA saírem:
"watch it somehow use 20x more tokens tho"
Não é 20x, está mais perto de 2,3x a saída do Astra. Mas o instinto estava certo, e bate com o que vi no Gemini 3.8 Flash, que também foi prolixo no índice.
Exemplos práticos: quanto o Argon custa em cargas reais
Os preços de tabela fazem mais sentido quando você coloca algumas execuções concretas ao lado. Cada exemplo abaixo usa as tarifas publicadas pelo Google e as mesmas contagens de tokens para todos os modelos. Isso favorece um pouco o Argon, já que ele tende a escrever mais.
1. Uma execução pesada de agente. Imagine um agente que lê 200K tokens de contexto e escreve 60K tokens de saída, perto da média de 62K do Argon. No preço promo são $0,40 de entrada mais $0,60 de saída, ou seja, $1,00 por execução. Se você colocar o contexto em cache, o lado da entrada cai para $0,02 e a execução custa $0,62. Com 1.000 execuções por mês, o fim da promo leva você de $620 para $1.240.

Esse é o padrão habitual do trabalho com agentes: quando o cache entra em ação, a saída é cerca de 97% da conta. O desconto de cache de 95% é generoso, mas só se aplica à parte da conta que já era pequena. Para deixar o Argon mais barato, busque saídas mais curtas, não mais cache.
2. Uma revisão de documento longo. Imagine enviar um pacote de contratos de 800K tokens e receber um resumo de 10K tokens, 500 vezes por mês. Argon na promo: $1,60 + $0,10 = $1,70 por execução, $850 por mês. No preço padrão, $1.700. Com as tarifas do Gemini 3.1 Pro acima de 200K a mesma execução custa $3,38, e a tarifa do GPT-6.1 Sol acima de 272K dá $3,35. Então, se o Google mantiver o Argon sem sobretaxa de contexto longo, é aqui que ele é mais barato em relação aos outros, mesmo a preço cheio.
3. Um ticket de suporte. Este eu consigo sustentar com um teste real. No início da semana passei 15 tickets de suporte pelo GPT-6.1 Sol para a minha análise do GPT-6.1 Sol. Em média, cada um usou cerca de 545 tokens de entrada e 70 de saída, e o lote custou cerca de $1,80 por 1.000 tickets. O Argon na promo tem exatamente a mesma tabela, então esses mesmos tokens custam os mesmos $1,80. Se o Argon escrever 2,7x a saída, como a diferença da AA sugere, dá cerca de $3 por 1.000 tickets. Após a promo, dobre os dois números. Para comparar, o GPT-6 Astra marcou $9,09 por 1.000 no mesmo teste.
Não consegui rodar o próprio Argon, já que a API retorna 404. Então trate o terceiro exemplo como uma reprecificação e não como resultado de teste. Quando o acesso pago abrir, vou rodar os mesmos tickets de novo.
Calculadora de custo do Gemini 4 Argon
Coloque suas próprias contagens de tokens. Os presets correspondem aos três exemplos acima. Os preços seguem as tabelas publicadas pelo Google, OpenAI e Anthropic, para prompts abaixo de 200K tokens.
Algumas coisas para observar enquanto você mexe nela. Aumente os tokens de saída e o Argon promo empata com o Sol e corta pela metade o Opus 5.5, mas marque a caixa de 2,3x e a maior parte dessa vantagem some. No preset de documento longo, o Argon não ter sobretaxa publicada ajuda mais a conta do que qualquer desconto.
Os custos ocultos e as perguntas em aberto
A tabela de preços é curta, então uma parte maior do custo real ainda é desconhecida. Isto é o que eu acompanharia antes de fechar um orçamento:
- A data do fim da promo. "Pelo menos um mês" segundo a Artificial Analysis, sem data do Google. Qualquer previsão que passe do fim de outubro deve usar $4/$20.
- A verbosidade. 62K tokens de saída por tarefa da AA. Sua carga pode ser diferente, mas a conta mora na saída, então meça isso primeiro.
- Níveis ausentes. Ainda sem tarifa de Batch, Flex ou Priority. No Gemini 3.8 Flash o Batch e o Flex têm 50% de desconto e o Priority custa 1,8x, então jobs offline podem ficar bem mais baratos quando o Google publicar.
- Grounding. O grounding com Google Search no Gemini 3.x é 5.000 requisições grátis por mês, depois $14 por 1.000. Para o Argon, ainda não há tarifa publicada.
- Armazenamento de cache. O Gemini 3.8 Flash cobra por milhão de tokens por hora de armazenamento de cache, além das leituras de cache. A tarifa de armazenamento do Argon também não saiu, e com um contexto de 1M de tokens isso pode pesar.
A discussão no Hacker News chegou rápido ao ponto da promo. Alguém elogiou o preço de saída de $10, e a resposta foi curta:
"That is a promotional price. The regular price is double that."
Outros foram direto ao custo por tarefa, o que considero o melhor instinto:
"It's also more token hungry than similar models, so does it really make a big difference in the end?"
O Gemini 4 Argon vale o preço?
Para algumas cargas, sim, mesmo a $4/$20. O trabalho com documentos longos é o caso mais claro: o Argon lidera a tabela do Google em recuperação com contexto de 256K a 1M (84,2% contra os 60 e poucos e os 70 e poucos dos rivais) e não tem sobretaxa publicada de contexto longo, então um pipeline de contratos ou relatórios financeiros ganha um modelo melhor e também uma conta mais barata do que teria no 3.1 Pro. Agentes jurídicos e financeiros também têm um argumento, porque o Argon lidera o Legal Agent Benchmark da Harvey por cerca de 3x.
Para trabalho geral com agentes e programação, eu esperaria por números reais. Nos preços promo, você paga 2,7x o GPT-6.1 Sol por tarefa para ganhar um ponto a mais no índice da AA. Nos preços padrão, você paga a tabela do Opus 5.5 por um modelo que fica 9 pontos atrás do Opus 5.5 no Terminal-Bench 4.0 na tabela do próprio Google. Se você precisa hoje de um modelo de fronteira mais barato, os comparativos de alternativas ao GPT-6.1 Sol e alternativas ao Gemini cobrem o que está à venda hoje.
Para atendimento ao cliente, o preço do Argon quase não importa. A alguns dólares por 1.000 tickets, o modelo é a menor linha num detalhamento do custo do atendimento ao cliente com IA. A taxa de alucinação do Argon de 15% no AA-Omniscience, contra 51% do GPT-6 Astra, é o número mais interessante para suporte. Mesmo isso só ajuda se o agente em volta lê o conhecimento certo e transfere quando não sabe a resposta. O guia sobre alucinações de IA no suporte cobre essa parte.
O que isso significa se você lidera uma equipe de suporte
Passei muito tempo colocando IA em filas de suporte reais na eesel, e o preço do modelo quase nunca decidiu se uma implantação funcionou. O que decide é tudo em volta do modelo: a central de ajuda e os tickets passados de onde ele aprende, como ele se conecta ao Zendesk ou ao Freshdesk, e se foi testado em tickets reais antes de tocar num cliente. O custo por resolução é sobretudo pessoas e processo, não tokens.
Onde uma promo como a do Argon faz diferença é na previsibilidade. Se você constrói o seu próprio bot sobre tokens brutos, agora é dono de uma conta que dobra numa data que ninguém anunciou, e ainda acompanha qual modelo é o melhor do mês. Para uma equipe de engenharia que opera agentes, tudo bem. Para um líder de suporte que precisa de um número para o orçamento do próximo trimestre, é um encaixe ruim.

Experimente a eesel
Se você está calculando o preço do Gemini 4 Argon porque quer uma IA respondendo tickets, pode pular a matemática de tokens. O Argon é infraestrutura; a eesel é o funcionário. O colega de IA para helpdesk da eesel aprende com os seus tickets passados e com a sua central de ajuda e se conecta ao helpdesk que você já usa. Ele também roda uma simulação nos seus tickets reais do passado para você conferir as respostas antes que ele responda a um cliente.
O preço é um plano de créditos mensal fixo em que um ticket ou chat é um crédito. Todos os recursos e assentos ilimitados estão incluídos, e há um plano gratuito com 100 créditos e sem cartão. Se a promo de um modelo acabar por baixo de você, a sua conta continua a mesma. Experimente a eesel numa fatia da sua fila e veja como ela lida com os seus próprios tickets.
Perguntas frequentes
Quanto custa o Gemini 4 Argon?
Quando termina o preço promocional do Gemini 4 Argon?
Posso pagar pelo Gemini 4 Argon hoje?
gemini-4-argon e o modelo não está na página de preços da API do Google. Ele está sendo liberado primeiro para defensores cibernéticos, depois para clientes pagos da API e assinantes do Google AI Ultra, sem data.O Gemini 4 Argon é mais barato que o GPT-6.1 Sol?
O Gemini 4 Argon é mais barato que o Claude Opus 5.5?
O Gemini 4 Argon tem preço de batch ou plano gratuito?
Quanto o Gemini 4 Argon custaria no atendimento ao cliente?

Article by
Kira
Kira is a writer at eesel AI with a Computer Science background and over a year of hands-on experience evaluating AI-powered customer service tools. She focuses on breaking down how helpdesk platforms and AI agents actually work so that support teams can make better buying decisions.








