Precios de Gemini 3.5 Pro: lo que cuesta (y lo que aún falta)

Kurnia Kharisma Agung Samiadjie
Escrito por

Kurnia Kharisma Agung Samiadjie

Katelin Teen
Revisado por

Katelin Teen

Última edición July 21, 2026

Verificado por expertos
Banner ilustrado para una guía sobre los precios y costes de API de Google Gemini 3.5 Pro

Resumen

Si has llegado buscando un precio de Gemini 3.5 Pro, esta es la versión honesta: todavía no existe, porque Gemini 3.5 Pro no se ha lanzado. A julio de 2026, la propia página del modelo Pro de Google sigue mostrando la insignia "3.5 Pro coming soon", y el buque insignia que realmente puedes usar es Gemini 3.1 Pro (Preview).

Por eso este artículo hace tres cosas. Primero, da la cifra real y vigente para el nivel Pro actual: 2 $ por millón de tokens de entrada y 12 $ por millón de tokens de salida en la API estándar. Segundo, expone los planes de consumo de Google AI (de 4,99 $ a 199,99 $ al mes). Tercero, y lo más útil si estás calculando esto para un equipo, recorre las matemáticas de la API que realmente deciden tu factura, porque el precio de etiqueta por token es la parte más pequeña de ella.

Algo que he aprendido construyendo IA para colas de soporte en vivo en eesel: la tarifa por token casi nunca predice lo que cuesta un caso de uso real. Ten esto en cuenta antes de pegar una cifra de 2 $ / 1M en una hoja de cálculo y llamarla presupuesto.

Gemini 3.5 Pro todavía no está disponible, y eso importa

Aclaremos esto primero, porque la mitad de las páginas que posicionan para "precios de Gemini 3.5 Pro" lo omiten en silencio.

La familia Gemini 3.5 se ha lanzado, solo que no el miembro Pro. Gemini 3.5 Flash está disponible y estable, y también lo está Gemini 3.5 Live Translate. Pero el nivel Pro sigue una versión por detrás. En la alineación de Gemini de DeepMind, la tarjeta Pro muestra una insignia "3.5 Pro coming soon" sobre un modelo que todavía dice "Gemini 3.1 Pro". No hay ningún ID de modelo gemini-3.5-pro en la documentación de la API, ni ninguna fila de 3.5 Pro en la página de precios.

Dónde está ahora mismo la familia Gemini 3.5: 3.5 Flash lanzado, 3.5 Pro próximamente, y 3.1 Pro como el modelo Pro que realmente usas hoy
Dónde está ahora mismo la familia Gemini 3.5: 3.5 Flash lanzado, 3.5 Pro próximamente, y 3.1 Pro como el modelo Pro que realmente usas hoy

¿Por qué la espera? Google ha dicho públicamente que 3.5 Pro está tardando más porque están trabajando en las capacidades del modelo, especialmente en programación. En Hacker News, el retraso es el hilo más comentado:

Hacker News

"A finales de 2025, Google estaba en la cima: el mejor LLM (Gemini 3 Pro), el mejor modelo de vídeo (Veo 3.1) y el mejor modelo de imagen (Nano Banana). Parecían imparables. Y entonces, se detuvieron."

La conclusión práctica: si una página te da un precio exacto de Gemini 3.5 Pro o una tabla de referencia, es una suposición. Las únicas cifras que vale la pena presupuestar hoy son las tarifas vigentes de Gemini 3.1 Pro, así que son las que usaré, y señalaré con claridad dónde se espera que aterrice 3.5 Pro.

Gráfico del anuncio de Gemini 3.1 Pro, el actual buque insignia Pro hasta que se lance 3.5 Pro, tomado de Google DeepMind
Gráfico del anuncio de Gemini 3.1 Pro, el actual buque insignia Pro hasta que se lance 3.5 Pro, tomado de Google DeepMind

El precio Pro actual: tarifas de la API de Gemini 3.1 Pro

Este es el modelo por el que realmente estarías pagando hoy si construyes sobre el nivel Pro. Gemini 3.1 Pro es el único miembro de la familia con escalado por longitud de contexto: los prompts de hasta 200k tokens son más baratos que los que superan ese límite. Cada modelo también publica cuatro niveles de servicio, así que el "precio Pro" depende de cómo lo invoques.

NivelEntrada ≤200kEntrada >200kSalida ≤200kSalida >200kEntrada en cachéAlmacenamiento de caché
Standard$2.00$4.00$12.00$18.00$0.20 / $0.40$4.50 /1M/h
Batch$1.00$2.00$6.00$9.00$0.20 / $0.40$4.50 /1M/h
Flex$1.00$2.00$6.00$9.00$0.20 / $0.40$4.50 /1M/h
Priority$3.60$7.20$21.60$32.40$0.36 / $0.72$8.10 /1M/h

Todas las cifras son por 1M de tokens, en USD, extraídas de la sección Gemini 3.1 Pro Preview de la página de precios de Google. No hay nivel gratuito para Pro, algo que vale la pena señalar: el nivel gratuito de la API solo cubre Flash y Flash-Lite.

Algunas cosas con las que la gente tropieza:

  • La salida incluye el razonamiento. Gemini 3.1 Pro es un modelo de razonamiento, así que los tokens con los que "piensa" se facturan a la tarifa de salida. En un prompt difícil, el razonamiento puede eclipsar la respuesta visible, por eso la salida cuesta 6 veces más que la entrada.
  • Batch y Flex reducen tu factura a la mitad si puedes tolerar el retraso. Batch se ejecuta de forma asíncrona; Flex es para tráfico de menor prioridad. Ambos bajan los 2 $/12 $ de Standard a 1 $/6 $.
  • Priority cuesta un 80 % más por latencia baja garantizada. Si sirves a usuarios en vivo, probablemente estés aquí, no en Standard.

En el extremo más económico de la familia, Gemini 3.5 Flash cuesta 1,50 $ de entrada / 9,00 $ de salida en Standard, y Gemini 3.1 Flash-Lite es la opción económica a 0,25 $ de entrada / 1,50 $ de salida. Si quieres la tabla completa de todos los modelos, nuestra guía de precios de Gemini mantiene la tabla completa actualizada.

Cómo será probablemente el precio de Gemini 3.5 Pro

Google no lo ha publicado, así que no lo voy a inventar. Pero el patrón en los lanzamientos recientes de Pro ha sido constante: precios escalonados por contexto en un rango similar al del modelo Pro anterior, con el nuevo modelo reemplazando al viejo a una tarifa similar o ligeramente superior. Si 3.5 Pro sigue ese patrón, se puede esperar algo cercano a la banda actual de 2 $ a 4 $ de entrada y 12 $ a 18 $ de salida, posiblemente con un aumento para un nivel de razonamiento más fuerte. Quien cite ahora mismo una cifra precisa de 3.5 Pro está leyendo el poso del café.

Precios de Gemini para consumidores: los planes de Google AI

Si no estás construyendo sobre la API y solo quieres Gemini en la app, Gmail y Docs, estás en un plan de Google One AI. Google los renombró tras el I/O de 2026, así que ignora los artículos antiguos que citan "7,99 $ AI Premium". Aquí están las cifras vigentes de one.google.com:

PlanPrecioAlmacenamientoQué obtienes
Free0 $15 GBGemini 3.5 Flash, 3.1 Pro limitado, generación de imágenes, Deep Research
Google AI Plus4,99 $/mes400 GBLímites más altos, Gemini 3.1 Pro, YouTube Premium Lite
Google AI Pro19,99 $/mes5 TBLímites 4x más altos, 10 $/mes de crédito de Cloud, Jules, Antigravity
Google AI Ultra (5x)99,99 $/mes20 TB5x de uso respecto a Pro, Deep Think, 40 $/mes de crédito de Cloud
Google AI Ultra (20x)199,99 $/mesEl más alto20x de uso, los límites más altos en todo, 100 $/mes de crédito de Cloud

Lo que hay que notar: pagar más compra sobre todo más uso del mismo modelo Pro, no uno más inteligente. AI Plus y AI Ultra funcionan ambos con Gemini 3.1 Pro; Ultra simplemente te deja usarlo mucho más a menudo y desbloquea el razonamiento Deep Think. Si eres un usuario individual que ocasionalmente choca con los límites, AI Pro a 19,99 $ es el punto dulce. Si eres un equipo tratando de calcular el trabajo real, los planes de consumidor no son tu respuesta, y llegaré a por qué.

Sobre cómo se comparan estos planes con el resto del mercado, hemos hecho las comparativas directas: Gemini vs Perplexity, ChatGPT vs Gemini, y un conjunto más amplio de alternativas a Gemini.

Desplegar Gemini en toda una empresa se cobra de forma distinta otra vez. Si tu equipo funciona con Google Workspace, la guía de precios de Workspace es la que hay que leer, y nuestra guía de precios de Gemini 3 cubre las cifras a nivel de generación.

Las matemáticas de la API que realmente deciden tu factura

Esta es la parte que la mayoría de los artículos de precios se saltan, y la parte que importa. Una etiqueta de 2 $ / 1M tokens de entrada parece barata. Luego lo despliegas, y la factura no se parece en nada a tu estimación. Aquí es de donde viene la diferencia.

Precio de etiqueta por token frente a tu coste real: los tokens de razonamiento, el search grounding y los reintentos se sitúan todos en medio
Precio de etiqueta por token frente a tu coste real: los tokens de razonamiento, el search grounding y los reintentos se sitúan todos en medio

Introduce tus propias cifras. Este estimador usa las tarifas Standard vigentes de Gemini 3.1 Pro (el nivel Pro actual) para que veas cómo el volumen de tokens se convierte en una factura mensual:

Ejecuta los valores por defecto con una carga de trabajo del tamaño de soporte (10.000 conversaciones, ~6k tokens de entrada y ~1,5k de salida cada una) y aterrizas en torno a 440 $/mes en tokens y grounding. Eso ya ignora las partes caras:

  • Los tokens de razonamiento son impredecibles. No controlas cuánto tiempo razona el modelo, y cada uno de esos tokens se factura a tarifas de salida.
  • El grounding se acumula rápido. Search grounding es gratis para los primeros 5.000 prompts al mes en toda la familia Gemini 3, y luego cuesta 14 $ por 1.000 consultas. Una búsqueda por ticket a escala es una partida real.
  • Reintentos y llamadas de herramientas fallidas. Este es el que más duele. En Hacker News, el uso agéntico de Gemini recibe quejas concretas:
Hacker News

"No es simplemente mediocre, ni siquiera sub-mediocre. Entra en bucles y no completa una tarea 8 de cada 10 veces que lo he usado."

Cada bucle se factura. El precio de etiqueta asume un pase limpio; la producción rara vez te da uno.

Cómo rinde Gemini 3.1 Pro (ya que estás pagando por ello)

El precio solo significa algo junto a la capacidad. Gemini 3.1 Pro es genuinamente fuerte en las cifras que publica Google, y la comunidad respalda mucho de eso para trabajo que no es de programación.

Tabla de referencia propia de Google para la familia Gemini 3.5 con 3.5 Flash destacado y Gemini 3.1 Pro al lado, tomada de Google DeepMind
Tabla de referencia propia de Google para la familia Gemini 3.5 con 3.5 Flash destacado y Gemini 3.1 Pro al lado, tomada de Google DeepMind

En las propias evaluaciones de Google, Gemini 3.1 Pro (Thinking High) lidera en GPQA Diamond (94,3 %), Humanity's Last Exam (44,4 %), ARC-AGI-2 (77,1 %), LiveCodeBench Pro (2887 Elo) y BrowseComp (85,9 %). Cede el primer puesto en SWE-Bench Verified, quedando en 80,6 % frente al 80,8 % de Claude Opus 4.6. Es un buque insignia sólido bajo cualquier lectura, y el retrasado 3.5 Pro pretende llevarlo aún más lejos.

La experiencia vivida es más mixta, y honesta. Los usuarios valoran muy bien a Gemini para chat rápido y factual:

Hacker News

"En mi experiencia, Gemini 3.0 Pro es notablemente mejor que ChatGPT 5.2 en tareas que no son de programación. Este último me da información claramente errónea todo el tiempo, el primero muy rara vez."

Pero la queja recurrente, y la razón por la que la reconstrucción de 3.5 Pro está tardando tanto, es la fiabilidad bajo carga:

Hacker News

"Te quemas con las alucinaciones que Gemini suelta casualmente a diario. Desarrollas el hábito de verificar cada respuesta."

Esa brecha entre el benchmark y el comportamiento es exactamente por qué la elección de modelo en bruto es la pregunta inicial equivocada para un equipo de soporte. Para comparativas más completas, consulta nuestras comparaciones de Gemini 3 Pro vs Claude Opus 4.6 y Gemini vs Mistral.

Qué precio de Gemini se aplica realmente a ti

Tres tipos de compradores distintos llegan a esta página, y necesitan tres respuestas distintas.

Árbol de decisión sobre qué precio de Gemini se aplica: chatear en la app lleva a los planes de Google AI, construir sobre la API lleva a precio por token, automatizar el soporte lleva a precio por resolución
Árbol de decisión sobre qué precio de Gemini se aplica: chatear en la app lleva a los planes de Google AI, construir sobre la API lleva a precio por token, automatizar el soporte lleva a precio por resolución
  • Solo quieres chatear. Elige un plan de Google AI. Free está bien para uso ocasional; AI Pro a 19,99 $ cubre a la mayoría de los usuarios avanzados; Ultra es para uso diario intensivo.
  • Estás construyendo un producto sobre el modelo. Estás en precios de API por token, y el estimador de arriba es tu amigo. Presupuesta para tokens de razonamiento y grounding, no solo para la tarifa de entrada.
  • Quieres que gestione atención al cliente. Aquí es donde el precio por token se convierte silenciosamente en una mala opción, y es el punto en el que más insistiría en contra. Una herramienta de atención al cliente con IA o un chatbot de helpdesk con IA diseñados para esto encajan mejor que los tokens en bruto.

Aquí está el problema. Cuando compras tokens de modelo en bruto para soporte, construyes todo lo demás encima: la pipeline de recuperación, las barreras de seguridad, la lógica de escalado, la monitorización, la gestión de reintentos. Tu factura escala con el volumen de tokens, lo que significa que un mes de soporte con mucho trabajo también es uno caro e impredecible. Eso es lo contrario de lo que quiere un presupuesto de soporte. Hemos escrito la comparación de coste real si quieres el panorama completo, y las métricas que realmente importan para juzgar si está funcionando.

Prueba eesel AI para soporte en vez de poner precio a los tokens

Si has llegado aquí porque estás evaluando Gemini para impulsar la atención al cliente, las matemáticas de tokens son la hoja de cálculo equivocada. He pasado los últimos años construyendo agentes de IA que se sientan sobre colas de soporte en vivo, y la lección que se repite es esta: el modelo es la parte barata, y la pipeline a su alrededor es donde vive el coste y el riesgo reales.

eesel AI toma una forma distinta. Funciona con modelos de frontera (el mismo nivel que Gemini Pro), pero no pagas por token ni por asiento, pagas por resolución, así que la factura sigue a los resultados en vez de a un uso que no puedes controlar. Se conecta a tu helpdesk existente y entrena en minutos con tus tickets pasados y tu base de conocimiento, y, porque hemos visto a bots confiados dar respuestas equivocadas, cada despliegue se simula primero contra tus tickets históricos para que veas la tasa de resolución antes de que toque a un cliente.

Panel de informes de eesel AI mostrando analíticas de resolución y uso para la automatización de soporte
Panel de informes de eesel AI mostrando analíticas de resolución y uso para la automatización de soporte

Esa es la diferencia entre poner precio a un modelo y poner precio a un resultado. Puedes probar eesel gratis y ver los precios en unidades en las que realmente presupuestas, o profundizar en cómo se ven estos agentes en la práctica.

Preguntas frecuentes

¿Cuánto cuesta Gemini 3.5 Pro?
Todavía no existe un precio de Gemini 3.5 Pro, porque el modelo no se ha lanzado. La propia página Pro de Google sigue mostrando una insignia de "3.5 Pro coming soon", y el nivel Pro vigente sigue siendo Gemini 3.1 Pro a 2 $ por millón de tokens de entrada y 12 $ por millón de tokens de salida en el nivel estándar de la API. Consulta nuestro desglose completo de precios de Gemini para el resto de la familia.
¿Está disponible Gemini 3.5 Pro ahora mismo?
No, a mediados de 2026. La generación 3.5 se lanzó como Gemini 3.5 Flash y Live Translate, pero el miembro Pro sigue listado como "coming soon" mientras el buque insignia actual que realmente usas es Gemini 3.1 Pro (Preview).
¿Cuál será probablemente el precio de la API de Gemini 3.5 Pro?
Google no lo ha publicado. Si sigue el patrón reciente de Pro, se puede esperar un precio escalonado por contexto cercano a las tarifas actuales de 3.1 Pro (2 $ a 4 $ de entrada, 12 $ a 18 $ de salida por millón de tokens). Trata cualquier cifra específica de 3.5 Pro que veas en otro sitio como una suposición hasta que aparezca en la página oficial de precios.
¿Cuánto cuesta Gemini para uso personal al mes?
Los planes de Google AI van desde 4,99 $/mes (AI Plus) hasta 19,99 $/mes (AI Pro) y 99,99 $ y 199,99 $/mes (AI Ultra), y también hay un nivel gratuito. Los planes superiores compran sobre todo más uso del mismo modelo Pro, no uno distinto. Para equipos, compáralo mejor con un coste basado en resultados.
¿Vale la pena el precio de Gemini 3.5 Pro para atención al cliente?
El precio por token es solo una parte de la factura. En cuanto sumas los tokens de razonamiento, el search grounding a 14 $ por 1.000 consultas, los reintentos y la ingeniería, el coste real queda muy por encima del precio de etiqueta. Una herramienta con precio por resolución como eesel AI pone precio al resultado en vez de a los tokens, lo que es más fácil de presupuestar para la automatización de soporte.

Share this article

Kurnia Kharisma Agung Samiadjie

Article by

Kurnia Kharisma Agung Samiadjie

Kurnia is a software engineer and writer at eesel AI with two years of SEO experience, writing about AI tools, helpdesk software, and customer support. He pairs a developer's understanding of how these products are built with search-driven research into what actually ranks and resonates with the people searching for them.

Related Posts

All posts →
Banner principal del análisis de Gemini 3.5 Pro en azul Google
Trending

Análisis de Gemini 3.5 Pro: el estado honesto del buque insignia de Google

Un análisis honesto de Gemini 3.5 Pro: todavía no ha salido. Esto es lo que Google ha confirmado, por qué llega tarde, los benchmarks que sí existen y qué usar hoy.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 21, 2026
Texto alternativo de la imagen
Guides

Gemini 3 Pro vs. Claude Opus 4.6: Una comparación práctica

Esta guía ofrece una visión directa y práctica de Gemini 3 Pro y Claude Opus 4.6. Iremos más allá del bombo publicitario para centrarnos en las diferencias del mundo real que importan cuando se ponen estas herramientas a trabajar.

Stevia PutriStevia PutriFeb 6, 2026
Ilustración del desglose de precios de PromptQL
Trending

Precios de PromptQL: lo que realmente cuesta en 2026

Un desglose de los precios de PromptQL: la unidad facturable OLU, la tarifa de lanzamiento de 0,14 $, los créditos gratuitos, el multiplicador de modelo que realmente determina tu factura y ejemplos de coste reales.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 10, 2026
Ilustración principal comparando GPT-5.6 contra Gemini 3, dos familias de modelos de IA equilibradas una frente a otra
Trending

GPT-5.6 vs Gemini 3: ¿qué modelo de IA gana en 2026?

GPT-5.6 vs Gemini 3 comparados: Sol, Terra y Luna frente a Gemini 3.5 Flash y 3.1 Pro en precio, benchmarks, contexto y qué encaja mejor en agentes de soporte con IA.

Rama Adi NugrahaRama Adi NugrahaJul 10, 2026
Gemini vs Claude: ¿Qué modelo de IA es el adecuado para ti en 2025?
Guides

Gemini vs Claude: ¿Qué modelo de IA es el adecuado para ti en 2025?

Gemini vs Claude: explora las fortalezas, diferencias y características clave de cada IA para descubrir cuál se adapta mejor a tus necesidades.

Stevia PutriStevia PutriAug 22, 2025
Ilustración editorial que representa una comparación de modelos de IA como alternativas a Inkling
Trending

8 mejores alternativas a Inkling en 2026

Inkling es abierto e interesante, pero es caro para ser de pesos abiertos y no es el modelo más inteligente que puedes usar. Aquí tienes las 8 alternativas que realmente probaría, con precios reales y en qué gana cada una.

Rama Adi NugrahaRama Adi NugrahaJul 20, 2026
Ilustración de Inkling, el modelo de IA de pesos abiertos de Thinking Machines Lab analizado en este artículo
Trending

Análisis de Inkling: ¿vale la pena el modelo abierto de Thinking Machines?

Un análisis honesto de Inkling: en qué es realmente bueno el primer modelo de pesos abiertos de Thinking Machines Lab, dónde fallan el precio y los benchmarks, y quién debería usarlo realmente.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 20, 2026
Ilustración de Inkling, el modelo de IA de pesos abiertos de Thinking Machines Lab
Trending

Inkling explicado: el modelo de IA de pesos abiertos de Thinking Machines

Qué es realmente Inkling: el primer modelo de pesos abiertos de Thinking Machines Lab, sus benchmarks reales, cuánto cuesta ejecutarlo y si tiene algo que hacer cerca de una cola de soporte.

Alicia Kirana UtomoAlicia Kirana UtomoJul 20, 2026
Ilustración de Google NotebookLM convirtiendo documentos en un breve resumen en video vertical
Trending

NotebookLM Resúmenes en Video cortos: el formato de 60 segundos explicado

Los nuevos Short Video Overviews de NotebookLM convierten tus fuentes en un clip vertical de 60 segundos. Esto es lo que hace el formato, cómo está construido y dónde se queda corto.

Alicia Kirana UtomoAlicia Kirana UtomoJul 11, 2026

Listo para contratar tu companero de IA?

Configuracion en minutos. Sin tarjeta de credito requerida.

Comienza gratis