Preços do Gemini 3.6 Flash: o detalhamento completo de custos para 2026

Kurnia Kharisma Agung Samiadjie
Escrito por

Kurnia Kharisma Agung Samiadjie

Katelin Teen
Revisado por

Katelin Teen

Última edição August 6, 2026

Verificado por especialista
Banner principal de preços do Gemini 3.6 Flash em fundo azul do Google

Os preços do Gemini 3.6 Flash em resumo

Aqui está a tabela completa do nível padrão, direto da página de preços do Google. O modo de consumo escolhido muda a tarifa mais do que qualquer outra coisa.

Modo de consumoEntrada (por 1M)Saída (incl. raciocínio)Cache de contexto
Standard$1.50$7.50$0.15
Batch (50% de desconto)$0.75$3.75$0.075
Flex$0.75$3.75$0.075
Priority$2.70$13.50$0.27
Nível gratuitoGratuitoGratuitoGratuito

Em resumo: o Standard é o padrão, Batch e Flex compartilham a mesma tarifa com 50% de desconto para trabalho que não precisa ser em tempo real, e o Priority custa 1.8 vezes mais para garantir baixa latência. O cache de contexto a $0.15 por 1M é a alavanca que a maioria das equipes subutiliza, ele evita pagar novamente pela entrada do mesmo prompt de sistema ou trecho de conhecimento em cada chamada. É o novo carro-chefe da família Gemini, e ocupa o lugar onde antes você recorreria ao 3.5 Flash.

Calcule quanto isso vai realmente custar

As tarifas anunciadas só fazem sentido quando multiplicadas pelo seu tráfego real. Informe seu volume mensal e a contagem média de tokens para ver o custo mensal no nível padrão e no nível batch, além do custo por solicitação.

A lição que a maioria das equipes aprende aqui: em qualquer volume real, os tokens de saída dominam a conta, e é exatamente por isso que o corte de $9.00 para $7.50 na saída é a mudança principal, e por que um modelo que termina com menos tokens vale mais do que um que é alguns centavos mais barato por milhão.

O que mudou desde o Gemini 3.5 Flash

A mudança de uma geração para a outra é uma vitória de custo pura exatamente no lado que mais dói. Veja como os dois modelos se comparam no nível padrão, ao lado da opção econômica.

ModeloEntrada (por 1M)Saída (por 1M)Posicionamento
Gemini 3.6 Flash$1.50$7.50O Flash mais inteligente, feito para velocidade
Gemini 3.5 Flash$1.50$9.00Flash principal da geração anterior
Gemini 3.5 Flash-Lite$0.30$2.50Modelo GA mais barato, para trabalho de alto volume
O Gemini 3.6 Flash entrega mais qualidade por token de saída que o 3.5 Flash, segundo o 9to5Google
O Gemini 3.6 Flash entrega mais qualidade por token de saída que o 3.5 Flash, segundo o 9to5Google

Na verdade, há duas economias se acumulando uma sobre a outra. A primeira é a tarifa de saída ~17% mais baixa. A segunda é a eficiência de tokens: segundo o Artificial Analysis Index, o 3.6 Flash usa 17% menos tokens de saída para fazer o mesmo trabalho, e em benchmarks agênticos como o DeepSWE a diferença chegou a 65% (a saída média caiu de 276K para 97K tokens por tarefa). Menos tokens a uma tarifa mais baixa se combinam, então a economia efetiva em uma carga de trabalho real é maior do que o corte de preço sugere. O nível Batch conta a mesma história: o batch do 3.6 Flash é $0.75/$3.75 contra $0.75/$4.50 do 3.5 Flash.

Entre fornecedores, essa tarifa de saída de $7.50 fica bem abaixo do Claude Sonnet 5 (cerca de $15 de saída na tabela), ao mesmo tempo em que se mantém em uma faixa de qualidade semelhante para a maior parte do trabalho agêntico. Se o que você realmente busca é o nível principal, vale a pena olhar as próprias alternativas ao Gemini do Google enquanto o 3.5 Pro continua atrasado.

Os custos ocultos que a tabela de preços não mostra

É aqui que uma conta real se distancia do valor anunciado de $1.50/$7.50. Quatro itens costumam pegar as equipes de surpresa.

  • Os tokens de raciocínio são cobrados como saída. O 3.6 Flash oferece suporte a raciocínio, e esses tokens de raciocínio contam para a tarifa de saída de $7.50. Os ganhos de eficiência de tokens ajudam aqui, mas um prompt com muito raciocínio ainda cobra mais do que o tamanho visível da resposta sugere.
  • O grounding de busca é medido separadamente. Você tem 5.000 prompts com grounding gratuitos por mês em toda a família Gemini 3, e depois disso custa $14 por 1.000 consultas de busca, e uma única solicitação de cliente pode disparar várias consultas cobráveis.
  • O nível gratuito treina com seus dados. No nível gratuito, o Google usa seu conteúdo para melhorar seus produtos. Em qualquer nível pago, isso não acontece. Para qualquer coisa que envolva dados de clientes, isso já é suficiente para descartar o nível gratuito.
  • O modo Priority tem uma sobretaxa de 1.8 vezes. Se você precisa de baixa latência garantida, o Priority custa $2.70/$13.50, quase o dobro do padrão. A maioria das equipes não precisa disso, mas é fácil ativar e esquecer que está ligado.

Gemini 3.6 Flash vs. 3.5 Flash-Lite: quando o modelo mais barato vence

A forma mais eficaz de reduzir uma conta do Gemini muitas vezes não é usar o 3.6 Flash, e sim direcionar o trabalho simples para o Gemini 3.5 Flash-Lite. A $0.30/$2.50, o Flash-Lite é cerca de 5 vezes mais barato na entrada e 3 vezes mais barato na saída, e roda a cerca de 350 tokens de saída por segundo.

A regra prática é sobre profundidade de raciocínio, não fidelidade a uma marca. Use o 3.6 Flash quando o trabalho precisa de raciocínio real em várias etapas: programação, agentes que tocam vários sistemas, tickets de suporte complexos. Use o Flash-Lite quando cada item é simples e o volume é alto, como a triagem de tickets de primeira linha ou o desvio de chat em tempo real para perguntas rotineiras. Muitas pilhas em produção usam os dois, direcionando pela dificuldade, o que é a configuração mais barata de todas. Construir um agente de verdade ou um bot baseado em regras é uma decisão separada da escolha do modelo.

Níveis de conta, limites de gastos e limites de taxa

O preço do Gemini também é determinado pelo nível de uso em que sua conta de cobrança está, segundo a página de limites de taxa.

Nível de usoComo se qualificarLimite de cobrança
GratuitoProjeto ativo ou teste gratuitoN/A
Tier 1Conta de cobrança ativa vinculada$250
Tier 2Pago $100 + 3 dias$2,000
Tier 3Pago $1,000 + 30 dias$20,000+

Duas observações práticas. Primeiro, os limites de taxa baseados em gasto funcionam em uma janela móvel de 10 minutos (o Tier 1 tem limite de $10, os Tiers 2 e 3 de $200), e ultrapassar isso retorna um erro 429 RESOURCE_EXHAUSTED, então um pico de tráfego pode te limitar antes de você chegar ao orçamento mensal. Segundo, se você opera em escala real, o nível Enterprise do Google adiciona capacidade provisionada e descontos por volume que não aparecem na tabela pública. Para ver como isso se compara aos planos Gemini para consumidores, nosso guia de preços do Gemini e os preços do Gemini Workspace cobrem o resto.

O que realmente custa executar um agente de suporte

Esta é a parte que todo artigo sobre preços de modelos pula, e o motivo pelo qual eu diria para você não dar tanta importância à tarifa do token se seu objetivo é atendimento ao cliente.

Um modelo mais barato e mais rápido é uma boa notícia. Mas o $1.50/$7.50 é o custo do motor puro, não do carro inteiro. Passei os últimos três anos e meio colocando IA em filas de suporte reais, e a falha que vi repetidas vezes não é o modelo ser caro demais, é um bot que soa confiante dando uma resposta errada porque ninguém construiu e pagou pelas camadas em torno do modelo. Essas camadas são o custo real.

O modelo é a camada base de um agente de suporte, com recuperação de informações, salvaguardas, simulação e integração com o helpdesk empilhadas por cima
O modelo é a camada base de um agente de suporte, com recuperação de informações, salvaguardas, simulação e integração com o helpdesk empilhadas por cima

Recuperação de informações sobre o seu centro de ajuda, para que ele responda a partir da sua documentação em vez de adivinhar. Salvaguardas contra alucinações, para que ele faça um handoff limpo em vez de inventar uma política de reembolso. Integração, para que possa agir dentro do seu sistema de tickets. E testes, para que você saiba como ele se comporta antes de tocar em um cliente. Construa isso você mesmo sobre a API pura e você não estará pagando $7.50 por 1M de tokens, estará pagando uma equipe de engenharia para reconstruir a recuperação de informações, a simulação e cada integração com o helpdesk do zero, e depois mantê-la conforme os modelos mudam a cada poucas semanas. Esse é o argumento a favor de uma IA de helpdesk feita sob medida em vez de uma pilha construída internamente, e é por isso que os problemas de chatbots de IA quase sempre remetem à encanação por trás, não ao nível do modelo.

Experimente a eesel

Essa é exatamente a camada que a eesel foi construída para ser. Você a conecta ao seu helpdesk existente, ela aprende com seus tickets passados e sua base de conhecimento desde o início, e roda sobre modelos de ponta como o Gemini, então você ganha a eficiência sem conectar a API ou fazer contas de tokens sozinho.

Painel de relatórios da eesel AI mostrando análises de resolução e custo
Painel de relatórios da eesel AI mostrando análises de resolução e custo

As duas coisas que mais importam para o preço são justamente aquelas que a tarifa do token não pode te dar. Primeiro, a eesel permite que você simule o agente contra seus tickets históricos antes de responder a um cliente real, então você vê a taxa de resolução e as respostas exatas que ele teria enviado, sem precisar adivinhar no que o gasto se traduz. Segundo, ela cobra pelo trabalho que faz, por resolução em vez de por token, então um mês agitado não se transforma em uma conta surpresa de API. Se você está calculando o custo de modelos para construir automação de suporte, comece pelo resultado que você quer e deixe a plataforma cuidar da encanação. É grátis para testar.

Frequently Asked Questions

Quanto custa o Gemini 3.6 Flash?
No nível pago padrão, o preço do Gemini 3.6 Flash é de $1.50 por 1M de tokens de entrada e $7.50 por 1M de tokens de saída (a saída inclui os tokens de raciocínio). O modo Batch tem um desconto fixo de 50%, ficando em $0.75/$3.75, e existe um nível gratuito no qual o Google pode usar seu conteúdo para melhorar seus produtos. Veja o guia mais amplo de preços do Gemini para o resto da família.
Como o preço do Gemini 3.6 Flash se compara ao do 3.5 Flash?
A entrada permanece em $1.50 por 1M, mas a saída cai de $9.00 no Gemini 3.5 Flash para $7.50 no 3.6 Flash, um corte de aproximadamente 17% no lado mais caro da conta. Combinado com cerca de 17% menos tokens de saída por tarefa, a mesma carga de trabalho agêntica custa consideravelmente menos para executar.
O Gemini 3.6 Flash é mais barato que o Gemini 3.5 Flash-Lite?
Não. O Gemini 3.5 Flash-Lite é cerca de 5 vezes mais barato na entrada ($0.30) e 3 vezes mais barato na saída ($2.50) que o 3.6 Flash. O Flash-Lite é a escolha para trabalho de alto volume e pouco raciocínio, como triagem e tradução; o 3.6 Flash é para raciocínio em várias etapas.
O Gemini 3.6 Flash tem nível gratuito?
Sim. O Gemini 3.6 Flash é gratuito no nível gratuito em modo padrão, mas ali o Google usa seu conteúdo para melhorar seus produtos. Para qualquer coisa que envolva dados de clientes, use um nível pago em que seu conteúdo não seja usado para treinamento. Os modos Batch, Flex e Priority são exclusivos dos níveis pagos.
Quais são os custos ocultos no preço do Gemini 3.6 Flash?
Os tokens de raciocínio são cobrados como saída, o grounding de busca custa $14 por 1.000 consultas após 5.000 prompts gratuitos por mês, e uma única solicitação de cliente pode disparar várias consultas cobráveis. O modo Priority custa 1.8 vezes a tarifa padrão. Esses são os itens que fazem uma conta real se distanciar do valor anunciado de $1.50/$7.50.
Quanto custa executar um agente de atendimento ao cliente com o Gemini 3.6 Flash?
O preço do token é apenas uma fração do custo real. Um agente de suporte que funcione de verdade precisa de recuperação de informações, salvaguardas, testes e integração com o helpdesk, além do modelo. Uma plataforma como um software de atendimento ao cliente com IA cobra pelo trabalho feito por ticket em vez de por token, então você não precisa fazer contas de tokens em cada conversa.
Como o preço do Gemini 3.6 Flash se compara ao do GPT-5.6 e do Claude?
A $1.50/$7.50, o Gemini 3.6 Flash fica bem abaixo do Claude Sonnet 5 (cerca de $3/$15 de tabela) na saída, ao mesmo tempo em que se mantém em uma faixa de qualidade semelhante para a maior parte do trabalho agêntico. Veja nossas comparações Gemini vs. Claude e Gemini vs. ChatGPT.

Share this article

Kurnia Kharisma Agung Samiadjie

Article by

Kurnia Kharisma Agung Samiadjie

Kurnia is a software engineer and writer at eesel AI with two years of SEO experience, writing about AI tools, helpdesk software, and customer support. He pairs a developer's understanding of how these products are built with search-driven research into what actually ranks and resonates with the people searching for them.

Related Posts

All posts →
Banner do Gemini 3.5 Flash-Lite sobre um fundo azul Google
Trending

Gemini 3.5 Flash-Lite: o que é, preço e para quem serve

O Gemini 3.5 Flash-Lite é o modelo 3.5 mais rápido e barato do Google, a $0,30/$2,50 por 1M de tokens. Veja o que é, quanto custa e quando usar.

Rama Adi NugrahaRama Adi NugrahaJul 22, 2026
Banner principal do Gemini 3.6 Flash em fundo azul do Google
Trending

Gemini 3.6 Flash: o que é, quanto custa e para quem é indicado

Gemini 3.6 Flash é o novo modelo de trabalho do Google: 17% menos tokens de saída, saída mais barata e um contexto de 1M. Veja o que é e quem deveria usá-lo.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 22, 2026
Gemini 3.5 Flash Cyber hero banner on a Google-blue background
Trending

Gemini 3.5 Flash Cyber: o que é e quem pode usar

Gemini 3.5 Flash Cyber é o modelo de segurança do Google para encontrar e corrigir vulnerabilidades de código. Veja o que ele faz, como o CodeMender o utiliza e por que você provavelmente ainda não pode acessá-lo.

Alicia Kirana UtomoAlicia Kirana UtomoJul 22, 2026
Banner principal dos preços do Gemini 3.5 Flash-Lite em fundo azul Google
Trending

Preços do Gemini 3.5 Flash-Lite: quanto custa e para quem é indicado

O Gemini 3.5 Flash-Lite é o modelo mais barato do Google, a $0,30/$2,50 por 1M de tokens. Veja a tabela completa de preços, um exemplo de custo real e para quem ele é indicado.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 22, 2026
Ilustração de um modelo de controle de robô humanoide, representando o Gemini Robotics 2
Trending

Gemini Robotics 2: o que os números da DeepMind mostram

Gemini Robotics 2 lança três modelos e uma tabela de sucesso por tarefa em que a maioria das pontuações fica abaixo de 80%. Essa tabela é a parte mais útil de todo o lançamento.

Alicia Kirana UtomoAlicia Kirana UtomoAug 4, 2026
Ilustração de painéis de imagem, vídeo e documentos alimentando um modelo de visão e linguagem, com o logotipo da Qwen
Trending

Qwen 3.7 Flash: especificações, preços e o que ele realmente faz

O Qwen 3.7 Flash foi lançado sem post no blog, sem benchmarks e sem pesos. Aqui está a folha de especificações completa, os preços em faixas e o que a Qwen nunca afirmou.

Alicia Kirana UtomoAlicia Kirana UtomoJul 31, 2026
Texto alternativo da imagem
Guides

Visão geral do Gemini Agentic Vision: Como funciona e o que significa para a IA

O Gemini Agentic Vision do Google é um novo recurso no modelo Gemini 3 Flash que muda a forma como a IA interage com imagens, transformando a visualização passiva em uma investigação ativa de várias etapas para maior precisão.

Stevia PutriStevia PutriJan 30, 2026
Ilustração desenhada à mão com o logotipo do Grok, um agente de suporte e painéis de benchmarks e preços
Trending

Grok 4.5: benchmarks, preços e o que isso significa para o suporte

A xAI acabou de lançar o Grok 4.5. Analisamos os benchmarks reais, os preços por token e se um modelo novo e badalado realmente muda algo para a sua fila de suporte.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 9, 2026
Ilustração a comparar um núcleo de modelo pequeno e ordenado com outro muito maior e emaranhado, para uma análise do Inkling-Small
Trending

Análise do Inkling-Small: um quarto do tamanho, e quase tão inteligente

Uma análise prática do Inkling-Small: ele supera o próprio modelo pai de 975B em código com um quarto do tamanho e um quarto do preço, e depois despenca na factualidade. Eis o que essa troca realmente custa.

Alicia Kirana UtomoAlicia Kirana UtomoAug 4, 2026

Pronto para contratar seu colega de IA?

Configure em minutos. Sem cartão de crédito necessário.

Comece grátis