
Resumo
Se você chegou aqui procurando um preço do Gemini 3.5 Pro, aqui vai a versão honesta: ainda não existe um, porque o Gemini 3.5 Pro não foi lançado. Em julho de 2026, a própria página do modelo Pro do Google ainda traz o selo "3.5 Pro coming soon", e o carro-chefe que você pode realmente usar é o Gemini 3.1 Pro (Preview).
Por isso este post faz três coisas. Primeiro, traz o número real e em vigor para o nível Pro atual: 2 $ por milhão de tokens de entrada e 12 $ por milhão de tokens de saída na API padrão. Segundo, detalha os planos de consumo do Google AI (de 4,99 $ a 199,99 $ por mês). Terceiro, e o mais útil se você está precificando isso para uma equipe, percorre a conta de API que realmente decide sua fatura, porque o preço de etiqueta por token é a menor parte dela.
Uma coisa que aprendi construindo IA para filas de suporte ao vivo na eesel: a taxa por token quase nunca prevê quanto um caso de uso realmente custa. Lembre-se disso antes de colar um número de 2 $ / 1M numa planilha e chamar isso de orçamento.
O Gemini 3.5 Pro ainda não está disponível, e isso importa
Vamos esclarecer isso primeiro, porque metade das páginas que ranqueiam para "preços do Gemini 3.5 Pro" ignora isso silenciosamente.
A família Gemini 3.5 foi lançada, só não o membro Pro. O Gemini 3.5 Flash está disponível e estável, assim como o Gemini 3.5 Live Translate. Mas o nível Pro ainda está uma versão atrás. No lineup Gemini do DeepMind, o card do Pro mostra um selo "3.5 Pro coming soon" sobre um modelo que ainda diz "Gemini 3.1 Pro". Não há nenhum ID de modelo gemini-3.5-pro na documentação da API, nem nenhuma linha 3.5 Pro na página de preços.

Por que a espera? O Google disse publicamente que o 3.5 Pro está demorando mais porque está trabalhando nas capacidades do modelo, especialmente em programação. No Hacker News, o atraso é o tópico mais comentado da sala:
"No fim de 2025, o Google estava no topo - melhor LLM (Gemini 3 Pro), melhor modelo de vídeo (Veo 3.1) e melhor modelo de imagem (Nano Banana). Pareciam imbatíveis. E então, pararam."
A conclusão prática: se uma página te dá um preço exato do Gemini 3.5 Pro ou uma tabela de benchmark, é um palpite. Os únicos números que valem a pena usar no orçamento hoje são as taxas em vigor do Gemini 3.1 Pro, então é isso que vou usar, e vou sinalizar claramente onde o 3.5 Pro deve chegar.

O preço Pro atual: taxas da API do Gemini 3.1 Pro
Aqui está o modelo pelo qual você realmente estaria pagando hoje se construir sobre o nível Pro. O Gemini 3.1 Pro é o único membro da família com escalonamento por comprimento de contexto: prompts de até 200 mil tokens são mais baratos do que prompts acima disso. Cada modelo também publica quatro níveis de serviço, então o "preço Pro" depende de como você o chama.
| Nível | Entrada ≤200k | Entrada >200k | Saída ≤200k | Saída >200k | Entrada em cache | Armazenamento de cache |
|---|---|---|---|---|---|---|
| Standard | $2.00 | $4.00 | $12.00 | $18.00 | $0.20 / $0.40 | $4.50 /1M/h |
| Batch | $1.00 | $2.00 | $6.00 | $9.00 | $0.20 / $0.40 | $4.50 /1M/h |
| Flex | $1.00 | $2.00 | $6.00 | $9.00 | $0.20 / $0.40 | $4.50 /1M/h |
| Priority | $3.60 | $7.20 | $21.60 | $32.40 | $0.36 / $0.72 | $8.10 /1M/h |
Todos os valores são por 1M de tokens, em USD, retirados da seção Gemini 3.1 Pro Preview da página de preços do Google. Não há nível gratuito para o Pro, o que vale a pena notar: o nível gratuito da API cobre apenas Flash e Flash-Lite.
Algumas coisas que costumam confundir:
- A saída inclui o raciocínio. O Gemini 3.1 Pro é um modelo de raciocínio, então os tokens com os quais ele "pensa" são cobrados na taxa de saída. Num prompt difícil, o raciocínio pode superar em muito a resposta visível, por isso a saída custa 6x o preço da entrada.
- Batch e Flex cortam sua conta pela metade se você tolerar atraso. O Batch roda de forma assíncrona; o Flex é para tráfego de menor prioridade. Ambos reduzem os 2 $/12 $ do Standard para 1 $/6 $.
- O Priority custa 80% mais por latência baixa garantida. Se você atende usuários ao vivo, provavelmente está aqui, não no Standard.
Na ponta mais barata da família, o Gemini 3.5 Flash custa 1,50 $ de entrada / 9,00 $ de saída no Standard, e o Gemini 3.1 Flash-Lite é a opção econômica a 0,25 $ de entrada / 1,50 $ de saída. Se quiser a grade completa de todos os modelos, nosso guia de preços do Gemini mantém a tabela completa atualizada.
Como devem ser os preços do Gemini 3.5 Pro
O Google não publicou isso, então não vou inventar. Mas o padrão nos lançamentos recentes do Pro tem sido estável: preços escalonados por contexto na mesma faixa do modelo Pro anterior, com o novo modelo substituindo o antigo a uma taxa similar ou ligeiramente maior. Se o 3.5 Pro seguir esse padrão, espere algo próximo da faixa atual de 2 $ a 4 $ de entrada e 12 $ a 18 $ de saída, possivelmente com um aumento para um nível de raciocínio mais forte. Quem está citando um número preciso do 3.5 Pro agora está apenas chutando.
Preços do Gemini para consumidores: os planos Google AI
Se você não está construindo na API e só quer o Gemini no app, no Gmail e no Docs, você está num plano Google One AI. O Google renomeou esses planos após o I/O 2026, então ignore artigos antigos citando "7,99 $ AI Premium". Aqui estão os números em vigor do one.google.com:
| Plano | Preço | Armazenamento | O que você recebe |
|---|---|---|---|
| Free | 0 $ | 15 GB | Gemini 3.5 Flash, 3.1 Pro limitado, geração de imagens, Deep Research |
| Google AI Plus | 4,99 $/mês | 400 GB | Limites mais altos, Gemini 3.1 Pro, YouTube Premium Lite |
| Google AI Pro | 19,99 $/mês | 5 TB | Limites 4x maiores, 10 $/mês em créditos de Cloud, Jules, Antigravity |
| Google AI Ultra (5x) | 99,99 $/mês | 20 TB | 5x de uso em relação ao Pro, Deep Think, 40 $/mês em créditos de Cloud |
| Google AI Ultra (20x) | 199,99 $/mês | O mais alto | 20x de uso, os limites mais altos em tudo, 100 $/mês em créditos de Cloud |
O que vale notar: pagar mais compra principalmente mais uso do mesmo modelo Pro, não um mais inteligente. O AI Plus e o AI Ultra rodam ambos o Gemini 3.1 Pro; o Ultra só deixa você usá-lo com muito mais frequência e libera o raciocínio Deep Think. Se você é um usuário único que ocasionalmente esbarra nos limites, o AI Pro a 19,99 $ é o ponto ideal. Se você é uma equipe tentando calcular o custo do trabalho real, os planos de consumidor não são a resposta, e eu vou explicar o porquê.
Sobre como esses planos se comparam ao resto do mercado, já fizemos os confrontos diretos: Gemini vs Perplexity, ChatGPT vs Gemini, e um conjunto mais amplo de alternativas ao Gemini.
Implantar o Gemini em toda uma empresa tem um preço diferente de novo. Se sua equipe roda no Google Workspace, os níveis de preços do Workspace são os que você deve ler, e nosso guia de preços do Gemini 3 cobre os números em nível de geração.
A conta de API que realmente decide sua fatura
Essa é a parte que a maioria dos posts sobre preços ignora, e a parte que importa. Um preço de etiqueta de 2 $ / 1M tokens de entrada parece barato. Depois você coloca no ar, e a fatura não se parece em nada com sua estimativa. É daqui que vem a diferença.

Coloque seus próprios números. Este estimador usa as taxas Standard em vigor do Gemini 3.1 Pro (o nível Pro atual) para você ver como o volume de tokens vira uma fatura mensal:
Rode os valores padrão com uma carga de trabalho do tamanho de suporte (10.000 conversas, ~6 mil tokens de entrada e ~1,5 mil de saída cada) e você chega perto de 440 $/mês em tokens e grounding. Isso já ignora as partes caras:
- Os tokens de raciocínio são imprevisíveis. Você não controla quanto tempo o modelo raciocina, e cada um desses tokens é cobrado nas taxas de saída.
- O grounding se acumula rápido. O search grounding é grátis para os primeiros 5.000 prompts por mês em toda a família Gemini 3, depois custa 14 $ por 1.000 consultas. Uma busca por ticket em escala é um item de custo real.
- Repetições e chamadas de ferramentas com falha. Este é o que mais dói. No Hacker News, o uso agêntico do Gemini recebe reclamações específicas:
"Não é só abaixo da média, nem sequer sub-sub-média. Ele entra em loops e nunca completa uma tarefa em 8 de 10 vezes que eu usei."
Todo loop é cobrado. O preço de etiqueta pressupõe uma passagem limpa; a produção raramente entrega isso.
Como o Gemini 3.1 Pro se sai (já que você está pagando por ele)
Preço só significa algo ao lado da capacidade. O Gemini 3.1 Pro é genuinamente forte nos números que o Google publica, e a comunidade confirma boa parte disso para trabalho fora de programação.

Nas próprias avaliações do Google, o Gemini 3.1 Pro (Thinking High) lidera no GPQA Diamond (94,3%), Humanity's Last Exam (44,4%), ARC-AGI-2 (77,1%), LiveCodeBench Pro (2887 Elo) e BrowseComp (85,9%). Ele perde a liderança no SWE-Bench Verified, ficando com 80,6% contra os 80,8% do Claude Opus 4.6. É um carro-chefe forte por qualquer leitura, e o atrasado 3.5 Pro deve empurrar isso ainda mais adiante.
A experiência vivida é mais mista, e honesta. Os usuários avaliam bem o Gemini para chat rápido e factual:
"Na minha experiência, o Gemini 3.0 Pro é notavelmente melhor que o ChatGPT 5.2 para tarefas fora de programação. Este último me dá informações claramente erradas o tempo todo, o primeiro raramente."
Mas a crítica recorrente, e a razão pela qual a reconstrução do 3.5 Pro está demorando tanto, é a confiabilidade sob carga:
"Você se queima com as alucinações que o Gemini solta casualmente todos os dias. Você desenvolve o hábito de checar cada resposta."
Essa lacuna entre benchmark e comportamento é exatamente por que a escolha bruta do modelo é a pergunta inicial errada para uma equipe de suporte. Para comparações mais completas, veja nossas análises Gemini 3 Pro vs Claude Opus 4.6 e Gemini vs Mistral.
Qual preço do Gemini realmente se aplica a você
Três tipos diferentes de comprador chegam a esta página, e eles precisam de três respostas diferentes.

- Você só quer conversar. Escolha um plano Google AI. O Free serve bem para uso ocasional; o AI Pro a 19,99 $ cobre a maioria dos power users; o Ultra é para uso diário intenso.
- Você está construindo um produto sobre o modelo. Você está no preço de API por token, e o estimador acima é seu aliado. Orce para tokens de raciocínio e grounding, não só para a taxa de entrada.
- Você quer que ele rode o atendimento ao cliente. É aqui que o preço por token silenciosamente vira uma escolha ruim, e é o ponto em que eu mais insistiria em contra. Uma ferramenta de atendimento ao cliente com IA ou um chatbot de helpdesk com IA feitos para isso encaixam melhor do que tokens brutos.
Aqui está o problema. Quando você compra tokens brutos de modelo para suporte, você constrói tudo em cima: o pipeline de recuperação, as guardrails, a lógica de escalonamento, o monitoramento, o tratamento de repetições. Sua fatura escala com o volume de tokens, o que significa que um mês de suporte movimentado também é um mês caro e imprevisível. Isso é o oposto do que um orçamento de suporte quer. Já escrevemos a comparação de custo real se você quiser o panorama completo, e as métricas que realmente importam para avaliar se está funcionando.
Experimente a eesel AI para suporte em vez de precificar tokens
Se você chegou aqui porque está avaliando o Gemini para impulsionar o atendimento ao cliente, a conta de tokens é a planilha errada. Passei os últimos anos construindo agentes de IA que ficam em cima de filas de suporte ao vivo, e a lição que se repete é esta: o modelo é a parte barata, e o pipeline ao redor dele é onde o custo e o risco reais vivem.
A eesel AI assume um formato diferente. Ela roda nos modelos de fronteira (o mesmo nível do Gemini Pro), mas você não paga por token nem por assento, você paga por resolução, então a fatura acompanha os resultados em vez de um uso que você não controla. Ela se conecta ao seu helpdesk existente e treina em minutos com seus tickets passados e sua base de conhecimento, e, como já vimos bots confiantes darem respostas erradas, toda implantação é simulada primeiro contra seus tickets históricos para que você veja a taxa de resolução antes que ela chegue a um cliente.

Essa é a diferença entre precificar um modelo e precificar um resultado. Você pode experimentar a eesel grátis e ver os preços em unidades nas quais você realmente orça, ou se aprofundar em como esses agentes se parecem na prática.
Perguntas frequentes
Quanto custa o Gemini 3.5 Pro?
O Gemini 3.5 Pro já está disponível?
Qual deve ser o preço da API do Gemini 3.5 Pro?
Quanto custa o Gemini para uso pessoal por mês?
Vale a pena o preço do Gemini 3.5 Pro para atendimento ao cliente?

Article by
Kurnia Kharisma Agung Samiadjie
Kurnia is a software engineer and writer at eesel AI with two years of SEO experience, writing about AI tools, helpdesk software, and customer support. He pairs a developer's understanding of how these products are built with search-driven research into what actually ranks and resonates with the people searching for them.






