
Los precios de Gemini 3.6 Flash de un vistazo
Aquí tienes la tabla completa del nivel estándar, directamente de la página de precios de Google. El modo de consumo que elijas cambia la tarifa más que cualquier otra cosa.
| Modo de consumo | Entrada (por 1M) | Salida (incl. pensamiento) | Caché de contexto |
|---|---|---|---|
| Standard | $1.50 | $7.50 | $0.15 |
| Batch (50% de descuento) | $0.75 | $3.75 | $0.075 |
| Flex | $0.75 | $3.75 | $0.075 |
| Priority | $2.70 | $13.50 | $0.27 |
| Nivel gratuito | Gratis | Gratis | Gratis |
En resumen: Standard es el modo por defecto, Batch y Flex comparten la misma tarifa con 50% de descuento para trabajo que no necesita ser en tiempo real, y Priority cuesta 1.8 veces más para garantizar baja latencia. La caché de contexto a $0.15 por 1M es la palanca que la mayoría de los equipos infrautiliza, te permite evitar volver a pagar por la entrada del mismo prompt de sistema o fragmento de conocimiento en cada llamada. Es el nuevo caballo de batalla de la familia Gemini, y ocupa el lugar donde antes recurrías a 3.5 Flash.
Calcula lo que realmente te va a costar
Las tarifas destacadas solo cobran sentido cuando las multiplicas por tu tráfico real. Introduce tu volumen mensual y el número medio de tokens para ver el coste mensual en el nivel estándar y en el de batch, además del coste por solicitud.
La lección que la mayoría de los equipos aprende aquí: a cualquier volumen real, los tokens de salida dominan la factura, y por eso el recorte de $9.00 a $7.50 en la salida es el cambio principal, y por eso un modelo que termina con menos tokens vale más que uno que es unos céntimos más barato por millón.
Qué cambió respecto a Gemini 3.5 Flash
El salto de una generación a otra es una victoria de coste pura en el lado que más duele. Así se comparan ambos modelos en el nivel estándar, junto a la opción económica.
| Modelo | Entrada (por 1M) | Salida (por 1M) | Posicionamiento |
|---|---|---|---|
| Gemini 3.6 Flash | $1.50 | $7.50 | El Flash más inteligente, diseñado para la velocidad |
| Gemini 3.5 Flash | $1.50 | $9.00 | El Flash insignia anterior |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | El modelo GA más económico, para trabajo de gran volumen |

En realidad hay dos ahorros que se acumulan uno sobre otro. El primero es la tarifa de salida ~17% más baja. El segundo es la eficiencia de tokens: según el Artificial Analysis Index, 3.6 Flash usa un 17% menos de tokens de salida para hacer el mismo trabajo, y en benchmarks agénticos como DeepSWE la diferencia llegó al 65% (la salida media pasó de 276K a 97K tokens por tarea). Menos tokens a una tarifa más baja se combinan, así que el ahorro efectivo en una carga de trabajo real es mayor de lo que sugiere el recorte de precio. El nivel Batch cuenta la misma historia: el batch de 3.6 Flash es $0.75/$3.75 frente a los $0.75/$4.50 de 3.5 Flash.
Comparado entre proveedores, esa tarifa de salida de $7.50 queda muy por debajo de Claude Sonnet 5 (aproximadamente $15 de salida de lista), mientras se mantiene en una franja de calidad similar para la mayoría del trabajo agéntico. Si lo que realmente buscas es el nivel insignia, merece la pena mirar las propias alternativas a Gemini de Google mientras 3.5 Pro sigue retrasado.
Los costes ocultos que la tabla de precios no muestra
Aquí es donde una factura real se aparta del titular $1.50/$7.50. Hay cuatro partidas que suelen sorprender a los equipos.
- Los tokens de pensamiento se facturan como salida. 3.6 Flash admite el pensamiento, y esos tokens de razonamiento cuentan hacia la tarifa de salida de $7.50. Las mejoras de eficiencia de tokens ayudan aquí, pero un prompt con mucho razonamiento sigue facturando más de lo que sugiere la longitud visible de la respuesta.
- El grounding de búsqueda se mide por separado. Tienes 5,000 prompts con grounding gratuitos al mes en toda la familia Gemini 3, y después cuesta $14 por cada 1,000 consultas de búsqueda, y una sola solicitud de un cliente puede disparar varias consultas facturables.
- El nivel gratuito entrena con tus datos. En el nivel gratuito, Google usa tu contenido para mejorar sus productos. En cualquier nivel de pago no lo hace. Para cualquier cosa que toque datos de clientes, eso ya descarta por sí solo el nivel gratuito.
- El modo Priority tiene un recargo de 1.8 veces. Si necesitas baja latencia garantizada, Priority cuesta $2.70/$13.50, casi el doble que el estándar. La mayoría de los equipos no lo necesita, pero es fácil activarlo y olvidarse de que está encendido.
Gemini 3.6 Flash frente a 3.5 Flash-Lite: cuándo gana el modelo más barato
La forma más eficaz de recortar una factura de Gemini a menudo no es usar 3.6 Flash en absoluto, sino enviar el trabajo sencillo a Gemini 3.5 Flash-Lite. A $0.30/$2.50, Flash-Lite es aproximadamente 5 veces más barato en entrada y 3 veces más barato en salida, y funciona a unos 350 tokens de salida por segundo.
La regla general tiene que ver con la profundidad del razonamiento, no con la fidelidad a una marca. Recurre a 3.6 Flash cuando el trabajo necesita razonamiento real en varios pasos: programación, agentes que tocan varios sistemas, tickets de soporte complejos. Recurre a Flash-Lite cuando cada elemento es sencillo y el volumen es alto, como el triaje de tickets de primera pasada o la desviación de chat en vivo para preguntas rutinarias. Muchas pilas en producción usan ambos, enrutando según la dificultad, que es la configuración más económica de todas. Si construyes un agente real o un bot basado en reglas es una decisión distinta de la del modelo.
Niveles de cuenta, límites de gasto y límites de tasa
El precio de Gemini también depende del nivel de uso en el que esté tu cuenta de facturación, según la página de límites de tasa.
| Nivel de uso | Cómo calificas | Límite de facturación |
|---|---|---|
| Gratuito | Proyecto activo o prueba gratuita | N/A |
| Tier 1 | Cuenta de facturación activa vinculada | $250 |
| Tier 2 | Pagados $100 + 3 días | $2,000 |
| Tier 3 | Pagados $1,000 + 30 días | $20,000+ |
Dos notas prácticas. Primero, los límites de tasa basados en gasto funcionan en una ventana móvil de 10 minutos (Tier 1 tiene un tope de $10, Tier 2 y 3 de $200), y superarlo devuelve un error 429 RESOURCE_EXHAUSTED, así que un pico de tráfico puede limitarte antes de que llegues a tu presupuesto mensual. Segundo, si operas a gran escala real, el nivel Enterprise de Google añade capacidad aprovisionada y descuentos por volumen que no aparecen en la tabla pública. Para ver cómo se compara esto con los planes de consumo de Gemini, nuestra guía de precios de Gemini y los precios de Gemini Workspace cubren el resto.
Lo que realmente cuesta ejecutar un agente de soporte
Esta es la parte que todo artículo sobre precios de modelos se salta, y la razón por la que te diría que no le den demasiada importancia a la tarifa del token si tu objetivo es la atención al cliente.
Un modelo más barato y más rápido es una buena noticia. Pero el $1.50/$7.50 es el coste del motor en bruto, no del coche completo. Llevo más de tres años poniendo IA en colas de soporte reales, y el fallo que he visto una y otra vez no es que el modelo sea demasiado caro, es un bot que suena seguro de sí mismo dando una respuesta equivocada porque nadie construyó ni pagó las capas que rodean al modelo. Esas capas son el coste real.

Recuperación de información sobre tu centro de ayuda, para que responda a partir de tus documentos en lugar de adivinar. Barreras contra las alucinaciones, para que haga una transferencia limpia en lugar de inventarse una política de reembolsos. Integración, para que pueda actuar dentro de tu sistema de tickets. Y pruebas, para que sepas cómo se comporta antes de que llegue a un cliente. Si construyes eso tú mismo sobre la API en bruto, no estás pagando $7.50 por 1M de tokens, estás pagando a un equipo de ingeniería para reconstruir la recuperación, la simulación y cada integración con el helpdesk desde cero, y luego mantenerlo a medida que los modelos cambian cada pocas semanas. Ese es el argumento a favor de una IA de helpdesk creada para ese propósito frente a una pila hecha en casa, y por eso los problemas de los chatbots de IA casi siempre se remontan a la fontanería, no al nivel del modelo.
Prueba eesel
Esta es exactamente la capa que eesel está hecho para ser. Lo conectas a tu helpdesk actual, aprende de tus tickets pasados y de tu base de conocimiento desde el primer momento, y funciona sobre modelos de vanguardia como Gemini, así que obtienes la eficiencia sin tener que conectar la API ni hacer cálculos de tokens tú mismo.

Las dos cosas que más importan para el precio son justo las que la tarifa del token no puede darte. Primero, eesel te permite simular al agente contra tus tickets históricos antes de que responda a un cliente real, así que ves la tasa de resolución y las respuestas exactas que habría enviado, sin tener que adivinar en qué se traduce el gasto. Segundo, se cobra por el trabajo que hace, por resolución en lugar de por token, así que un mes ajetreado no se convierte en una factura de API sorpresa. Si estás calculando el coste de modelos para construir automatización de soporte, empieza por el resultado que quieres y deja que la plataforma se encargue de la fontanería. Es gratis probarlo.
Frequently Asked Questions
¿Cuánto cuesta Gemini 3.6 Flash?
¿Cómo se compara el precio de Gemini 3.6 Flash con el de 3.5 Flash?
¿Es Gemini 3.6 Flash más barato que Gemini 3.5 Flash-Lite?
¿Tiene Gemini 3.6 Flash un nivel gratuito?
¿Cuáles son los costes ocultos en el precio de Gemini 3.6 Flash?
¿Cuánto cuesta usar Gemini 3.6 Flash para ejecutar un agente de atención al cliente?
¿Cómo se compara el precio de Gemini 3.6 Flash con el de GPT-5.6 y Claude?

Article by
Kurnia Kharisma Agung Samiadjie
Kurnia is a software engineer and writer at eesel AI with two years of SEO experience, writing about AI tools, helpdesk software, and customer support. He pairs a developer's understanding of how these products are built with search-driven research into what actually ranks and resonates with the people searching for them.







