Precios de Gemini 3.6 Flash: el desglose completo de costes para 2026

Kurnia Kharisma Agung Samiadjie
Escrito por

Kurnia Kharisma Agung Samiadjie

Katelin Teen
Revisado por

Katelin Teen

Última edición August 6, 2026

Verificado por expertos
Banner principal de precios de Gemini 3.6 Flash sobre un fondo azul de Google

Los precios de Gemini 3.6 Flash de un vistazo

Aquí tienes la tabla completa del nivel estándar, directamente de la página de precios de Google. El modo de consumo que elijas cambia la tarifa más que cualquier otra cosa.

Modo de consumoEntrada (por 1M)Salida (incl. pensamiento)Caché de contexto
Standard$1.50$7.50$0.15
Batch (50% de descuento)$0.75$3.75$0.075
Flex$0.75$3.75$0.075
Priority$2.70$13.50$0.27
Nivel gratuitoGratisGratisGratis

En resumen: Standard es el modo por defecto, Batch y Flex comparten la misma tarifa con 50% de descuento para trabajo que no necesita ser en tiempo real, y Priority cuesta 1.8 veces más para garantizar baja latencia. La caché de contexto a $0.15 por 1M es la palanca que la mayoría de los equipos infrautiliza, te permite evitar volver a pagar por la entrada del mismo prompt de sistema o fragmento de conocimiento en cada llamada. Es el nuevo caballo de batalla de la familia Gemini, y ocupa el lugar donde antes recurrías a 3.5 Flash.

Calcula lo que realmente te va a costar

Las tarifas destacadas solo cobran sentido cuando las multiplicas por tu tráfico real. Introduce tu volumen mensual y el número medio de tokens para ver el coste mensual en el nivel estándar y en el de batch, además del coste por solicitud.

La lección que la mayoría de los equipos aprende aquí: a cualquier volumen real, los tokens de salida dominan la factura, y por eso el recorte de $9.00 a $7.50 en la salida es el cambio principal, y por eso un modelo que termina con menos tokens vale más que uno que es unos céntimos más barato por millón.

Qué cambió respecto a Gemini 3.5 Flash

El salto de una generación a otra es una victoria de coste pura en el lado que más duele. Así se comparan ambos modelos en el nivel estándar, junto a la opción económica.

ModeloEntrada (por 1M)Salida (por 1M)Posicionamiento
Gemini 3.6 Flash$1.50$7.50El Flash más inteligente, diseñado para la velocidad
Gemini 3.5 Flash$1.50$9.00El Flash insignia anterior
Gemini 3.5 Flash-Lite$0.30$2.50El modelo GA más económico, para trabajo de gran volumen
Gemini 3.6 Flash ofrece más calidad por token de salida que 3.5 Flash, según 9to5Google
Gemini 3.6 Flash ofrece más calidad por token de salida que 3.5 Flash, según 9to5Google

En realidad hay dos ahorros que se acumulan uno sobre otro. El primero es la tarifa de salida ~17% más baja. El segundo es la eficiencia de tokens: según el Artificial Analysis Index, 3.6 Flash usa un 17% menos de tokens de salida para hacer el mismo trabajo, y en benchmarks agénticos como DeepSWE la diferencia llegó al 65% (la salida media pasó de 276K a 97K tokens por tarea). Menos tokens a una tarifa más baja se combinan, así que el ahorro efectivo en una carga de trabajo real es mayor de lo que sugiere el recorte de precio. El nivel Batch cuenta la misma historia: el batch de 3.6 Flash es $0.75/$3.75 frente a los $0.75/$4.50 de 3.5 Flash.

Comparado entre proveedores, esa tarifa de salida de $7.50 queda muy por debajo de Claude Sonnet 5 (aproximadamente $15 de salida de lista), mientras se mantiene en una franja de calidad similar para la mayoría del trabajo agéntico. Si lo que realmente buscas es el nivel insignia, merece la pena mirar las propias alternativas a Gemini de Google mientras 3.5 Pro sigue retrasado.

Los costes ocultos que la tabla de precios no muestra

Aquí es donde una factura real se aparta del titular $1.50/$7.50. Hay cuatro partidas que suelen sorprender a los equipos.

  • Los tokens de pensamiento se facturan como salida. 3.6 Flash admite el pensamiento, y esos tokens de razonamiento cuentan hacia la tarifa de salida de $7.50. Las mejoras de eficiencia de tokens ayudan aquí, pero un prompt con mucho razonamiento sigue facturando más de lo que sugiere la longitud visible de la respuesta.
  • El grounding de búsqueda se mide por separado. Tienes 5,000 prompts con grounding gratuitos al mes en toda la familia Gemini 3, y después cuesta $14 por cada 1,000 consultas de búsqueda, y una sola solicitud de un cliente puede disparar varias consultas facturables.
  • El nivel gratuito entrena con tus datos. En el nivel gratuito, Google usa tu contenido para mejorar sus productos. En cualquier nivel de pago no lo hace. Para cualquier cosa que toque datos de clientes, eso ya descarta por sí solo el nivel gratuito.
  • El modo Priority tiene un recargo de 1.8 veces. Si necesitas baja latencia garantizada, Priority cuesta $2.70/$13.50, casi el doble que el estándar. La mayoría de los equipos no lo necesita, pero es fácil activarlo y olvidarse de que está encendido.

Gemini 3.6 Flash frente a 3.5 Flash-Lite: cuándo gana el modelo más barato

La forma más eficaz de recortar una factura de Gemini a menudo no es usar 3.6 Flash en absoluto, sino enviar el trabajo sencillo a Gemini 3.5 Flash-Lite. A $0.30/$2.50, Flash-Lite es aproximadamente 5 veces más barato en entrada y 3 veces más barato en salida, y funciona a unos 350 tokens de salida por segundo.

La regla general tiene que ver con la profundidad del razonamiento, no con la fidelidad a una marca. Recurre a 3.6 Flash cuando el trabajo necesita razonamiento real en varios pasos: programación, agentes que tocan varios sistemas, tickets de soporte complejos. Recurre a Flash-Lite cuando cada elemento es sencillo y el volumen es alto, como el triaje de tickets de primera pasada o la desviación de chat en vivo para preguntas rutinarias. Muchas pilas en producción usan ambos, enrutando según la dificultad, que es la configuración más económica de todas. Si construyes un agente real o un bot basado en reglas es una decisión distinta de la del modelo.

Niveles de cuenta, límites de gasto y límites de tasa

El precio de Gemini también depende del nivel de uso en el que esté tu cuenta de facturación, según la página de límites de tasa.

Nivel de usoCómo calificasLímite de facturación
GratuitoProyecto activo o prueba gratuitaN/A
Tier 1Cuenta de facturación activa vinculada$250
Tier 2Pagados $100 + 3 días$2,000
Tier 3Pagados $1,000 + 30 días$20,000+

Dos notas prácticas. Primero, los límites de tasa basados en gasto funcionan en una ventana móvil de 10 minutos (Tier 1 tiene un tope de $10, Tier 2 y 3 de $200), y superarlo devuelve un error 429 RESOURCE_EXHAUSTED, así que un pico de tráfico puede limitarte antes de que llegues a tu presupuesto mensual. Segundo, si operas a gran escala real, el nivel Enterprise de Google añade capacidad aprovisionada y descuentos por volumen que no aparecen en la tabla pública. Para ver cómo se compara esto con los planes de consumo de Gemini, nuestra guía de precios de Gemini y los precios de Gemini Workspace cubren el resto.

Lo que realmente cuesta ejecutar un agente de soporte

Esta es la parte que todo artículo sobre precios de modelos se salta, y la razón por la que te diría que no le den demasiada importancia a la tarifa del token si tu objetivo es la atención al cliente.

Un modelo más barato y más rápido es una buena noticia. Pero el $1.50/$7.50 es el coste del motor en bruto, no del coche completo. Llevo más de tres años poniendo IA en colas de soporte reales, y el fallo que he visto una y otra vez no es que el modelo sea demasiado caro, es un bot que suena seguro de sí mismo dando una respuesta equivocada porque nadie construyó ni pagó las capas que rodean al modelo. Esas capas son el coste real.

El modelo es la capa inferior de un agente de soporte, con recuperación de información, barreras de seguridad, simulación e integración con el helpdesk apiladas encima
El modelo es la capa inferior de un agente de soporte, con recuperación de información, barreras de seguridad, simulación e integración con el helpdesk apiladas encima

Recuperación de información sobre tu centro de ayuda, para que responda a partir de tus documentos en lugar de adivinar. Barreras contra las alucinaciones, para que haga una transferencia limpia en lugar de inventarse una política de reembolsos. Integración, para que pueda actuar dentro de tu sistema de tickets. Y pruebas, para que sepas cómo se comporta antes de que llegue a un cliente. Si construyes eso tú mismo sobre la API en bruto, no estás pagando $7.50 por 1M de tokens, estás pagando a un equipo de ingeniería para reconstruir la recuperación, la simulación y cada integración con el helpdesk desde cero, y luego mantenerlo a medida que los modelos cambian cada pocas semanas. Ese es el argumento a favor de una IA de helpdesk creada para ese propósito frente a una pila hecha en casa, y por eso los problemas de los chatbots de IA casi siempre se remontan a la fontanería, no al nivel del modelo.

Prueba eesel

Esta es exactamente la capa que eesel está hecho para ser. Lo conectas a tu helpdesk actual, aprende de tus tickets pasados y de tu base de conocimiento desde el primer momento, y funciona sobre modelos de vanguardia como Gemini, así que obtienes la eficiencia sin tener que conectar la API ni hacer cálculos de tokens tú mismo.

Panel de informes de eesel AI mostrando estadísticas de resolución y coste
Panel de informes de eesel AI mostrando estadísticas de resolución y coste

Las dos cosas que más importan para el precio son justo las que la tarifa del token no puede darte. Primero, eesel te permite simular al agente contra tus tickets históricos antes de que responda a un cliente real, así que ves la tasa de resolución y las respuestas exactas que habría enviado, sin tener que adivinar en qué se traduce el gasto. Segundo, se cobra por el trabajo que hace, por resolución en lugar de por token, así que un mes ajetreado no se convierte en una factura de API sorpresa. Si estás calculando el coste de modelos para construir automatización de soporte, empieza por el resultado que quieres y deja que la plataforma se encargue de la fontanería. Es gratis probarlo.

Frequently Asked Questions

¿Cuánto cuesta Gemini 3.6 Flash?
En el nivel de pago estándar, el precio de Gemini 3.6 Flash es de $1.50 por 1M de tokens de entrada y $7.50 por 1M de tokens de salida (la salida incluye los tokens de pensamiento). El modo Batch tiene un descuento fijo del 50%, quedando en $0.75/$3.75, y existe un nivel gratuito en el que Google puede usar tu contenido para mejorar sus productos. Consulta la guía más amplia de precios de Gemini para el resto de la familia.
¿Cómo se compara el precio de Gemini 3.6 Flash con el de 3.5 Flash?
La entrada se mantiene en $1.50 por 1M, pero la salida baja de $9.00 en Gemini 3.5 Flash a $7.50 en 3.6 Flash, un recorte de aproximadamente el 17% en la parte más cara de la factura. Combinado con alrededor de un 17% menos de tokens de salida por tarea, la misma carga de trabajo agéntica cuesta notablemente menos de ejecutar.
¿Es Gemini 3.6 Flash más barato que Gemini 3.5 Flash-Lite?
No. Gemini 3.5 Flash-Lite es aproximadamente 5 veces más barato en entrada ($0.30) y 3 veces más barato en salida ($2.50) que 3.6 Flash. Flash-Lite es la opción para trabajo de gran volumen y poco razonamiento, como triaje y traducción; 3.6 Flash es para razonamiento en varios pasos.
¿Tiene Gemini 3.6 Flash un nivel gratuito?
Sí. Gemini 3.6 Flash es gratuito en el nivel gratuito en modo estándar, pero ahí Google usa tu contenido para mejorar sus productos. Para cualquier cosa que toque datos de clientes, usa un nivel de pago en el que tu contenido no se usa para entrenamiento. Los modos Batch, Flex y Priority son solo de pago.
¿Cuáles son los costes ocultos en el precio de Gemini 3.6 Flash?
Los tokens de pensamiento se facturan como salida, el grounding de búsqueda cuesta $14 por cada 1,000 consultas después de 5,000 prompts gratuitos al mes, y una sola solicitud de un cliente puede desencadenar varias consultas facturables. El modo Priority cuesta 1.8 veces la tarifa estándar. Estas son las partidas que hacen que una factura real se aleje del titular de $1.50/$7.50.
¿Cuánto cuesta usar Gemini 3.6 Flash para ejecutar un agente de atención al cliente?
El precio del token es solo una fracción del coste real. Un agente de soporte que funcione de verdad necesita recuperación de información, barreras de seguridad, pruebas e integración con el helpdesk, además del modelo. Una plataforma como software de atención al cliente con IA cobra por el trabajo hecho por ticket en lugar de por token, así que no tienes que hacer cálculos de tokens en cada conversación.
¿Cómo se compara el precio de Gemini 3.6 Flash con el de GPT-5.6 y Claude?
Con $1.50/$7.50, Gemini 3.6 Flash queda muy por debajo de Claude Sonnet 5 (aproximadamente $3/$15 de lista) en salida, mientras se mantiene en una franja de calidad similar para la mayoría del trabajo agéntico. Consulta nuestros análisis de Gemini frente a Claude y Gemini frente a ChatGPT.

Share this article

Kurnia Kharisma Agung Samiadjie

Article by

Kurnia Kharisma Agung Samiadjie

Kurnia is a software engineer and writer at eesel AI with two years of SEO experience, writing about AI tools, helpdesk software, and customer support. He pairs a developer's understanding of how these products are built with search-driven research into what actually ranks and resonates with the people searching for them.

Related Posts

All posts →
Banner de Gemini 3.5 Flash-Lite sobre un fondo azul Google
Trending

Gemini 3.5 Flash-Lite: qué es, precio y para quién es

Gemini 3.5 Flash-Lite es el modelo 3.5 más rápido y barato de Google, a $0,30/$2,50 por 1M de tokens. Aquí te explico qué es, cuánto cuesta y cuándo usarlo.

Rama Adi NugrahaRama Adi NugrahaJul 22, 2026
Banner de Gemini 3.6 Flash sobre un fondo azul de Google
Trending

Gemini 3.6 Flash: qué es, qué cuesta y para quién es

Gemini 3.6 Flash es el nuevo modelo de trabajo de Google: 17% menos tokens de salida, salida más barata y un contexto de 1M. Esto es lo que es y quién debería usarlo.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 22, 2026
Gemini 3.5 Flash Cyber hero banner on a Google-blue background
Trending

Gemini 3.5 Flash Cyber: qué es y quién puede usarlo

Gemini 3.5 Flash Cyber es el modelo de seguridad de Google para encontrar y corregir vulnerabilidades de código. Esto es lo que hace, cómo lo usa CodeMender y por qué probablemente todavía no puedas acceder a él.

Alicia Kirana UtomoAlicia Kirana UtomoJul 22, 2026
Banner principal de precios de Gemini 3.5 Flash-Lite sobre fondo azul de Google
Trending

Precios de Gemini 3.5 Flash-Lite: qué cuesta y para quién es

Gemini 3.5 Flash-Lite es el modelo más barato de Google, a $0.30/$2.50 por 1M de tokens. Aquí tienes la tabla de precios completa, un ejemplo de coste real y para quién es.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 22, 2026
Ilustración de un modelo de control de robots humanoides, que representa a Gemini Robotics 2
Trending

Gemini Robotics 2: lo que muestran las cifras de DeepMind

Gemini Robotics 2 lanza tres modelos y una tabla de éxito por tarea en la que la mayoría de las puntuaciones no llega al 80%. Esa tabla es lo más útil de todo el lanzamiento.

Alicia Kirana UtomoAlicia Kirana UtomoAug 4, 2026
Ilustración de paneles de imagen, video y documentos alimentando un modelo de visión y lenguaje, con el logo de Qwen
Trending

Qwen 3.7 Flash: especificaciones, precios y qué hace realmente

Qwen 3.7 Flash se lanzó sin entrada de blog, sin benchmarks y sin pesos. Aquí está la hoja de especificaciones completa, los precios escalonados y lo que Qwen nunca afirmó.

Alicia Kirana UtomoAlicia Kirana UtomoJul 31, 2026
Texto alternativo de la imagen
Guides

Una visión general de Gemini Agentic Vision: Cómo funciona y qué significa para la IA

Gemini Agentic Vision de Google es una nueva función del modelo Gemini 3 Flash que cambia la forma en que la IA interactúa con las imágenes, transformando la visualización pasiva en una investigación activa de varios pasos para una mayor precisión.

Stevia PutriStevia PutriJan 30, 2026
Ilustración de un chip de modelo compacto que enruta un token por dos rutas de expertos iluminadas entre muchas apagadas, para una explicación de Inkling-Small
Trending

Inkling-Small explicado: un modelo de 276B con 12B activos

Qué es realmente Inkling-Small: un MoE de pesos abiertos de 276B/12B de Thinking Machines, la ventana de contexto en la que la documentación y los proveedores no coinciden, lo que realmente cuesta un millón de tokens y dónde encaja en una pila de soporte.

Rama Adi NugrahaRama Adi NugrahaAug 4, 2026
Ilustración que compara un núcleo de modelo pequeño y ordenado con otro mucho mayor y enmarañado, para un análisis de Inkling-Small
Trending

Análisis de Inkling-Small: un cuarto del tamaño, y casi igual de listo

Un análisis práctico de Inkling-Small: supera a su propio modelo padre de 975B en programación con un cuarto del tamaño y un cuarto del precio, y luego se desploma en factualidad. Esto es lo que ese intercambio realmente te cuesta.

Alicia Kirana UtomoAlicia Kirana UtomoAug 4, 2026

Listo para contratar tu companero de IA?

Configuracion en minutos. Sin tarjeta de credito requerida.

Comienza gratis