Preços do Gemini 3.5 Pro: quanto custa (e o que ainda falta)

Kurnia Kharisma Agung Samiadjie
Escrito por

Kurnia Kharisma Agung Samiadjie

Katelin Teen
Revisado por

Katelin Teen

Última edição July 21, 2026

Verificado por especialista
Banner ilustrado para um guia sobre os preços e custos de API do Google Gemini 3.5 Pro

Resumo

Se você chegou aqui procurando um preço do Gemini 3.5 Pro, aqui vai a versão honesta: ainda não existe um, porque o Gemini 3.5 Pro não foi lançado. Em julho de 2026, a própria página do modelo Pro do Google ainda traz o selo "3.5 Pro coming soon", e o carro-chefe que você pode realmente usar é o Gemini 3.1 Pro (Preview).

Por isso este post faz três coisas. Primeiro, traz o número real e em vigor para o nível Pro atual: 2 $ por milhão de tokens de entrada e 12 $ por milhão de tokens de saída na API padrão. Segundo, detalha os planos de consumo do Google AI (de 4,99 $ a 199,99 $ por mês). Terceiro, e o mais útil se você está precificando isso para uma equipe, percorre a conta de API que realmente decide sua fatura, porque o preço de etiqueta por token é a menor parte dela.

Uma coisa que aprendi construindo IA para filas de suporte ao vivo na eesel: a taxa por token quase nunca prevê quanto um caso de uso realmente custa. Lembre-se disso antes de colar um número de 2 $ / 1M numa planilha e chamar isso de orçamento.

O Gemini 3.5 Pro ainda não está disponível, e isso importa

Vamos esclarecer isso primeiro, porque metade das páginas que ranqueiam para "preços do Gemini 3.5 Pro" ignora isso silenciosamente.

A família Gemini 3.5 foi lançada, só não o membro Pro. O Gemini 3.5 Flash está disponível e estável, assim como o Gemini 3.5 Live Translate. Mas o nível Pro ainda está uma versão atrás. No lineup Gemini do DeepMind, o card do Pro mostra um selo "3.5 Pro coming soon" sobre um modelo que ainda diz "Gemini 3.1 Pro". Não há nenhum ID de modelo gemini-3.5-pro na documentação da API, nem nenhuma linha 3.5 Pro na página de preços.

Onde a família Gemini 3.5 está agora: 3.5 Flash lançado, 3.5 Pro chegando em breve, e 3.1 Pro como o modelo Pro que você realmente usa hoje
Onde a família Gemini 3.5 está agora: 3.5 Flash lançado, 3.5 Pro chegando em breve, e 3.1 Pro como o modelo Pro que você realmente usa hoje

Por que a espera? O Google disse publicamente que o 3.5 Pro está demorando mais porque está trabalhando nas capacidades do modelo, especialmente em programação. No Hacker News, o atraso é o tópico mais comentado da sala:

Hacker News

"No fim de 2025, o Google estava no topo - melhor LLM (Gemini 3 Pro), melhor modelo de vídeo (Veo 3.1) e melhor modelo de imagem (Nano Banana). Pareciam imbatíveis. E então, pararam."

A conclusão prática: se uma página te dá um preço exato do Gemini 3.5 Pro ou uma tabela de benchmark, é um palpite. Os únicos números que valem a pena usar no orçamento hoje são as taxas em vigor do Gemini 3.1 Pro, então é isso que vou usar, e vou sinalizar claramente onde o 3.5 Pro deve chegar.

Gráfico do anúncio do Gemini 3.1 Pro, o carro-chefe Pro atual até o 3.5 Pro ser lançado, retirado do Google DeepMind
Gráfico do anúncio do Gemini 3.1 Pro, o carro-chefe Pro atual até o 3.5 Pro ser lançado, retirado do Google DeepMind

O preço Pro atual: taxas da API do Gemini 3.1 Pro

Aqui está o modelo pelo qual você realmente estaria pagando hoje se construir sobre o nível Pro. O Gemini 3.1 Pro é o único membro da família com escalonamento por comprimento de contexto: prompts de até 200 mil tokens são mais baratos do que prompts acima disso. Cada modelo também publica quatro níveis de serviço, então o "preço Pro" depende de como você o chama.

NívelEntrada ≤200kEntrada >200kSaída ≤200kSaída >200kEntrada em cacheArmazenamento de cache
Standard$2.00$4.00$12.00$18.00$0.20 / $0.40$4.50 /1M/h
Batch$1.00$2.00$6.00$9.00$0.20 / $0.40$4.50 /1M/h
Flex$1.00$2.00$6.00$9.00$0.20 / $0.40$4.50 /1M/h
Priority$3.60$7.20$21.60$32.40$0.36 / $0.72$8.10 /1M/h

Todos os valores são por 1M de tokens, em USD, retirados da seção Gemini 3.1 Pro Preview da página de preços do Google. Não há nível gratuito para o Pro, o que vale a pena notar: o nível gratuito da API cobre apenas Flash e Flash-Lite.

Algumas coisas que costumam confundir:

  • A saída inclui o raciocínio. O Gemini 3.1 Pro é um modelo de raciocínio, então os tokens com os quais ele "pensa" são cobrados na taxa de saída. Num prompt difícil, o raciocínio pode superar em muito a resposta visível, por isso a saída custa 6x o preço da entrada.
  • Batch e Flex cortam sua conta pela metade se você tolerar atraso. O Batch roda de forma assíncrona; o Flex é para tráfego de menor prioridade. Ambos reduzem os 2 $/12 $ do Standard para 1 $/6 $.
  • O Priority custa 80% mais por latência baixa garantida. Se você atende usuários ao vivo, provavelmente está aqui, não no Standard.

Na ponta mais barata da família, o Gemini 3.5 Flash custa 1,50 $ de entrada / 9,00 $ de saída no Standard, e o Gemini 3.1 Flash-Lite é a opção econômica a 0,25 $ de entrada / 1,50 $ de saída. Se quiser a grade completa de todos os modelos, nosso guia de preços do Gemini mantém a tabela completa atualizada.

Como devem ser os preços do Gemini 3.5 Pro

O Google não publicou isso, então não vou inventar. Mas o padrão nos lançamentos recentes do Pro tem sido estável: preços escalonados por contexto na mesma faixa do modelo Pro anterior, com o novo modelo substituindo o antigo a uma taxa similar ou ligeiramente maior. Se o 3.5 Pro seguir esse padrão, espere algo próximo da faixa atual de 2 $ a 4 $ de entrada e 12 $ a 18 $ de saída, possivelmente com um aumento para um nível de raciocínio mais forte. Quem está citando um número preciso do 3.5 Pro agora está apenas chutando.

Preços do Gemini para consumidores: os planos Google AI

Se você não está construindo na API e só quer o Gemini no app, no Gmail e no Docs, você está num plano Google One AI. O Google renomeou esses planos após o I/O 2026, então ignore artigos antigos citando "7,99 $ AI Premium". Aqui estão os números em vigor do one.google.com:

PlanoPreçoArmazenamentoO que você recebe
Free0 $15 GBGemini 3.5 Flash, 3.1 Pro limitado, geração de imagens, Deep Research
Google AI Plus4,99 $/mês400 GBLimites mais altos, Gemini 3.1 Pro, YouTube Premium Lite
Google AI Pro19,99 $/mês5 TBLimites 4x maiores, 10 $/mês em créditos de Cloud, Jules, Antigravity
Google AI Ultra (5x)99,99 $/mês20 TB5x de uso em relação ao Pro, Deep Think, 40 $/mês em créditos de Cloud
Google AI Ultra (20x)199,99 $/mêsO mais alto20x de uso, os limites mais altos em tudo, 100 $/mês em créditos de Cloud

O que vale notar: pagar mais compra principalmente mais uso do mesmo modelo Pro, não um mais inteligente. O AI Plus e o AI Ultra rodam ambos o Gemini 3.1 Pro; o Ultra só deixa você usá-lo com muito mais frequência e libera o raciocínio Deep Think. Se você é um usuário único que ocasionalmente esbarra nos limites, o AI Pro a 19,99 $ é o ponto ideal. Se você é uma equipe tentando calcular o custo do trabalho real, os planos de consumidor não são a resposta, e eu vou explicar o porquê.

Sobre como esses planos se comparam ao resto do mercado, já fizemos os confrontos diretos: Gemini vs Perplexity, ChatGPT vs Gemini, e um conjunto mais amplo de alternativas ao Gemini.

Implantar o Gemini em toda uma empresa tem um preço diferente de novo. Se sua equipe roda no Google Workspace, os níveis de preços do Workspace são os que você deve ler, e nosso guia de preços do Gemini 3 cobre os números em nível de geração.

A conta de API que realmente decide sua fatura

Essa é a parte que a maioria dos posts sobre preços ignora, e a parte que importa. Um preço de etiqueta de 2 $ / 1M tokens de entrada parece barato. Depois você coloca no ar, e a fatura não se parece em nada com sua estimativa. É daqui que vem a diferença.

Preço de etiqueta por token versus seu custo real: tokens de raciocínio, search grounding e repetições ficam todos entre os dois
Preço de etiqueta por token versus seu custo real: tokens de raciocínio, search grounding e repetições ficam todos entre os dois

Coloque seus próprios números. Este estimador usa as taxas Standard em vigor do Gemini 3.1 Pro (o nível Pro atual) para você ver como o volume de tokens vira uma fatura mensal:

Rode os valores padrão com uma carga de trabalho do tamanho de suporte (10.000 conversas, ~6 mil tokens de entrada e ~1,5 mil de saída cada) e você chega perto de 440 $/mês em tokens e grounding. Isso já ignora as partes caras:

  • Os tokens de raciocínio são imprevisíveis. Você não controla quanto tempo o modelo raciocina, e cada um desses tokens é cobrado nas taxas de saída.
  • O grounding se acumula rápido. O search grounding é grátis para os primeiros 5.000 prompts por mês em toda a família Gemini 3, depois custa 14 $ por 1.000 consultas. Uma busca por ticket em escala é um item de custo real.
  • Repetições e chamadas de ferramentas com falha. Este é o que mais dói. No Hacker News, o uso agêntico do Gemini recebe reclamações específicas:
Hacker News

"Não é só abaixo da média, nem sequer sub-sub-média. Ele entra em loops e nunca completa uma tarefa em 8 de 10 vezes que eu usei."

Todo loop é cobrado. O preço de etiqueta pressupõe uma passagem limpa; a produção raramente entrega isso.

Como o Gemini 3.1 Pro se sai (já que você está pagando por ele)

Preço só significa algo ao lado da capacidade. O Gemini 3.1 Pro é genuinamente forte nos números que o Google publica, e a comunidade confirma boa parte disso para trabalho fora de programação.

Tabela de benchmark própria do Google para a família Gemini 3.5 com o 3.5 Flash destacado e o Gemini 3.1 Pro ao lado, retirada do Google DeepMind
Tabela de benchmark própria do Google para a família Gemini 3.5 com o 3.5 Flash destacado e o Gemini 3.1 Pro ao lado, retirada do Google DeepMind

Nas próprias avaliações do Google, o Gemini 3.1 Pro (Thinking High) lidera no GPQA Diamond (94,3%), Humanity's Last Exam (44,4%), ARC-AGI-2 (77,1%), LiveCodeBench Pro (2887 Elo) e BrowseComp (85,9%). Ele perde a liderança no SWE-Bench Verified, ficando com 80,6% contra os 80,8% do Claude Opus 4.6. É um carro-chefe forte por qualquer leitura, e o atrasado 3.5 Pro deve empurrar isso ainda mais adiante.

A experiência vivida é mais mista, e honesta. Os usuários avaliam bem o Gemini para chat rápido e factual:

Hacker News

"Na minha experiência, o Gemini 3.0 Pro é notavelmente melhor que o ChatGPT 5.2 para tarefas fora de programação. Este último me dá informações claramente erradas o tempo todo, o primeiro raramente."

Mas a crítica recorrente, e a razão pela qual a reconstrução do 3.5 Pro está demorando tanto, é a confiabilidade sob carga:

Hacker News

"Você se queima com as alucinações que o Gemini solta casualmente todos os dias. Você desenvolve o hábito de checar cada resposta."

Essa lacuna entre benchmark e comportamento é exatamente por que a escolha bruta do modelo é a pergunta inicial errada para uma equipe de suporte. Para comparações mais completas, veja nossas análises Gemini 3 Pro vs Claude Opus 4.6 e Gemini vs Mistral.

Qual preço do Gemini realmente se aplica a você

Três tipos diferentes de comprador chegam a esta página, e eles precisam de três respostas diferentes.

Árvore de decisão sobre qual preço do Gemini se aplica: conversar no app leva aos planos Google AI, construir na API leva ao preço por token, automatizar o suporte leva ao preço por resolução
Árvore de decisão sobre qual preço do Gemini se aplica: conversar no app leva aos planos Google AI, construir na API leva ao preço por token, automatizar o suporte leva ao preço por resolução
  • Você só quer conversar. Escolha um plano Google AI. O Free serve bem para uso ocasional; o AI Pro a 19,99 $ cobre a maioria dos power users; o Ultra é para uso diário intenso.
  • Você está construindo um produto sobre o modelo. Você está no preço de API por token, e o estimador acima é seu aliado. Orce para tokens de raciocínio e grounding, não só para a taxa de entrada.
  • Você quer que ele rode o atendimento ao cliente. É aqui que o preço por token silenciosamente vira uma escolha ruim, e é o ponto em que eu mais insistiria em contra. Uma ferramenta de atendimento ao cliente com IA ou um chatbot de helpdesk com IA feitos para isso encaixam melhor do que tokens brutos.

Aqui está o problema. Quando você compra tokens brutos de modelo para suporte, você constrói tudo em cima: o pipeline de recuperação, as guardrails, a lógica de escalonamento, o monitoramento, o tratamento de repetições. Sua fatura escala com o volume de tokens, o que significa que um mês de suporte movimentado também é um mês caro e imprevisível. Isso é o oposto do que um orçamento de suporte quer. Já escrevemos a comparação de custo real se você quiser o panorama completo, e as métricas que realmente importam para avaliar se está funcionando.

Experimente a eesel AI para suporte em vez de precificar tokens

Se você chegou aqui porque está avaliando o Gemini para impulsionar o atendimento ao cliente, a conta de tokens é a planilha errada. Passei os últimos anos construindo agentes de IA que ficam em cima de filas de suporte ao vivo, e a lição que se repete é esta: o modelo é a parte barata, e o pipeline ao redor dele é onde o custo e o risco reais vivem.

A eesel AI assume um formato diferente. Ela roda nos modelos de fronteira (o mesmo nível do Gemini Pro), mas você não paga por token nem por assento, você paga por resolução, então a fatura acompanha os resultados em vez de um uso que você não controla. Ela se conecta ao seu helpdesk existente e treina em minutos com seus tickets passados e sua base de conhecimento, e, como já vimos bots confiantes darem respostas erradas, toda implantação é simulada primeiro contra seus tickets históricos para que você veja a taxa de resolução antes que ela chegue a um cliente.

Painel de relatórios da eesel AI mostrando análises de resolução e uso para automação de suporte
Painel de relatórios da eesel AI mostrando análises de resolução e uso para automação de suporte

Essa é a diferença entre precificar um modelo e precificar um resultado. Você pode experimentar a eesel grátis e ver os preços em unidades nas quais você realmente orça, ou se aprofundar em como esses agentes se parecem na prática.

Perguntas frequentes

Quanto custa o Gemini 3.5 Pro?
Ainda não há um preço para o Gemini 3.5 Pro, porque o modelo não foi lançado. A própria página Pro do Google ainda mostra um selo "3.5 Pro coming soon", e o nível Pro em vigor continua sendo o Gemini 3.1 Pro a 2 $ por milhão de tokens de entrada e 12 $ por milhão de tokens de saída no nível padrão da API. Veja nosso detalhamento completo de preços do Gemini para o restante da família.
O Gemini 3.5 Pro já está disponível?
Não, em meados de 2026. A geração 3.5 foi lançada como Gemini 3.5 Flash e Live Translate, mas o membro Pro ainda está listado como "coming soon", enquanto o carro-chefe atual que você realmente usa é o Gemini 3.1 Pro (Preview).
Qual deve ser o preço da API do Gemini 3.5 Pro?
O Google ainda não publicou isso. Se seguir o padrão recente do Pro, espere preços escalonados por contexto próximos às taxas atuais do 3.1 Pro (2 $ a 4 $ de entrada, 12 $ a 18 $ de saída por milhão de tokens). Trate qualquer número específico de 3.5 Pro que você veja em outro lugar como um palpite até aparecer na página oficial de preços.
Quanto custa o Gemini para uso pessoal por mês?
Os planos Google AI vão de 4,99 $/mês (AI Plus) a 19,99 $/mês (AI Pro), passando por 99,99 $ e 199,99 $/mês (AI Ultra), e há também um nível gratuito. Planos mais altos compram principalmente mais uso do mesmo modelo Pro, não um diferente. Para equipes, compare isso com um custo baseado em resultado em vez disso.
Vale a pena o preço do Gemini 3.5 Pro para atendimento ao cliente?
O preço por token é só uma parte da conta. Quando você soma os tokens de raciocínio, o search grounding a 14 $ por 1.000 consultas, as repetições e a engenharia, o custo real fica bem acima do preço de etiqueta. Uma ferramenta com preço por resolução como a eesel AI precifica o resultado em vez dos tokens, o que é mais fácil de orçar para a automação de suporte.

Share this article

Kurnia Kharisma Agung Samiadjie

Article by

Kurnia Kharisma Agung Samiadjie

Kurnia is a software engineer and writer at eesel AI with two years of SEO experience, writing about AI tools, helpdesk software, and customer support. He pairs a developer's understanding of how these products are built with search-driven research into what actually ranks and resonates with the people searching for them.

Related Posts

All posts →
Banner principal da análise do Gemini 3.5 Pro em azul Google
Trending

Análise do Gemini 3.5 Pro: o estado honesto do carro-chefe do Google

Uma análise honesta do Gemini 3.5 Pro: ele ainda não foi lançado. Veja o que o Google confirmou, por que está atrasado, os benchmarks que realmente existem e o que usar hoje.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 21, 2026
Ilustração do detalhamento de preços do PromptQL
Trending

Preço do PromptQL: quanto custa de verdade em 2026

Um detalhamento do preço do PromptQL: a unidade cobrável OLU, a tarifa promocional de US$ 0,14, créditos gratuitos, o multiplicador de modelo que realmente define sua fatura e exemplos reais de custo.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 10, 2026
Texto alternativo da imagem
Guides

Gemini 3 Pro vs Claude Opus 4.6: Uma comparação prática

Este guia oferece uma visão direta e prática do Gemini 3 Pro e do Claude Opus 4.6. Vamos deixar o hype de lado e focar nas diferenças do mundo real que importam quando você coloca essas ferramentas para trabalhar.

Stevia PutriStevia PutriFeb 6, 2026
Ilustração de destaque comparando GPT-5.6 contra Gemini 3, duas famílias de modelos de IA equilibradas uma contra a outra
Trending

GPT-5.6 vs Gemini 3: qual modelo de IA vence em 2026?

GPT-5.6 vs Gemini 3 comparados: Sol, Terra e Luna contra Gemini 3.5 Flash e 3.1 Pro em preço, benchmarks, contexto e qual se encaixa melhor em agentes de suporte com IA.

Rama Adi NugrahaRama Adi NugrahaJul 10, 2026
Ilustração editorial representando uma comparação de modelos de IA como alternativas ao Inkling
Trending

8 melhores alternativas ao Inkling em 2026

O Inkling é aberto e interessante, mas é caro para um modelo de pesos abertos e não é o modelo mais inteligente que você pode usar. Aqui estão as 8 alternativas que eu realmente experimentaria, com preços reais e onde cada uma vence.

Rama Adi NugrahaRama Adi NugrahaJul 20, 2026
Ilustração do Inkling, o modelo de IA de pesos abertos da Thinking Machines Lab em análise
Trending

Análise do Inkling: o modelo aberto da Thinking Machines vale a pena?

Uma análise honesta do Inkling: no que o primeiro modelo de pesos abertos da Thinking Machines Lab é realmente bom, onde o preço e os benchmarks decepcionam, e quem deveria realmente usá-lo.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 20, 2026
Ilustração do Inkling, o modelo de IA de pesos abertos da Thinking Machines Lab
Trending

Inkling explicado: o modelo de IA de pesos abertos da Thinking Machines

O que o Inkling realmente é: o primeiro modelo de pesos abertos da Thinking Machines Lab, seus benchmarks reais, quanto custa rodá-lo e se ele tem algo a ver com uma fila de suporte.

Alicia Kirana UtomoAlicia Kirana UtomoJul 20, 2026
Ilustração do Google NotebookLM transformando documentos em um breve resumo em vídeo vertical
Trending

NotebookLM Resumos em Vídeo curtos: o formato de 60 segundos explicado

Os novos Short Video Overviews do NotebookLM transformam suas fontes em um clipe vertical de 60 segundos. Veja o que o formato faz, como é construído e onde ele fica aquém.

Alicia Kirana UtomoAlicia Kirana UtomoJul 11, 2026
Banner de capa das alternativas ao PromptQL sobre um fundo índigo
Trending

As 8 melhores alternativas ao PromptQL em 2026

As 8 melhores alternativas ao PromptQL em 2026, do Databricks Genie ao projeto open source Wren AI, com preços reais, pontos fortes e para quem cada uma realmente serve.

Rama Adi NugrahaRama Adi NugrahaJul 10, 2026

Pronto para contratar seu colega de IA?

Configure em minutos. Sem cartão de crédito necessário.

Comece grátis