Gemini 3.6 Flash: qué es, qué cuesta y para quién es

Kurnia Kharisma Agung Samiadjie
Escrito por

Kurnia Kharisma Agung Samiadjie

Katelin Teen
Revisado por

Katelin Teen

Última edición August 6, 2026

Verificado por expertos
Banner de Gemini 3.6 Flash sobre un fondo azul de Google

Qué es realmente Gemini 3.6 Flash

Arte del título de Gemini 3.6 Flash, compartido por Google
Arte del título de Gemini 3.6 Flash, compartido por Google

Google divide su familia Gemini en dos carriles. Los modelos Pro son el nivel de mayor capacidad para razonamiento y programación difíciles. Los modelos Flash son los caballos de batalla: menor costo, respuestas más rápidas, ajustados para aplicaciones en producción que hacen miles de llamadas al día. Gemini 3.6 Flash es el más reciente de esos caballos de batalla, y es una iteración directa de 3.5 Flash moldeada por los comentarios de desarrolladores desde el lanzamiento de I/O 2026.

La propuesta, en palabras de Google, es un modelo construido "para la velocidad, combinando inteligencia de frontera con búsqueda y grounding superiores". En la práctica eso significa que es el modelo al que recurres cuando estás conectando un agente de IA que tiene que funcionar de forma fiable y barata, no el que usas para resolver un único problema de investigación complicado. Maneja texto, imágenes, video, audio y PDFs como entrada, admite llamadas a funciones y salidas estructuradas, y ahora incluye uso del ordenador como herramienta integrada.

Aquí está el planteamiento honesto que se salta la mayoría de la cobertura del lanzamiento: para la gran mayoría de los casos de uso en producción, un modelo de clase Flash ya es más que suficiente. La pregunta interesante en 2026 no es "¿es el modelo lo bastante inteligente?", es "¿cuánto cuesta ejecutar esto un millón de veces?". Esa es exactamente la pregunta que 3.6 Flash está construido para responder.

El titular: más trabajo, menos tokens

La cifra con la que Google encabeza todo es la eficiencia de tokens. Según el Artificial Analysis Index, 3.6 Flash usa un 17% menos de tokens de salida que 3.5 Flash para hacer el mismo trabajo. En algunos benchmarks agénticos la brecha es mayor: en DeepSWE, Google midió hasta un 65% menos de tokens de salida, reduciendo la salida promedio de 276K a 97K tokens por tarea.

Gemini 3.6 Flash usa muchos menos tokens de salida por tarea que 3.5 Flash en DeepSWE y el Artificial Analysis Index, según lo compartido por Google
Gemini 3.6 Flash usa muchos menos tokens de salida por tarea que 3.5 Flash en DeepSWE y el Artificial Analysis Index, según lo compartido por Google

¿Por qué importa esto más que una puntuación de calidad bruta? Porque los tokens de salida son el lado caro de la factura, y un agente que llega a su respuesta en menos pasos de razonamiento y llamadas a herramientas también es más rápido y menos propenso a desviarse. Google dice que 3.6 Flash necesita menos pasos de razonamiento y llamadas a herramientas para terminar flujos de trabajo de varios pasos, con menos de la divagación verbosa que infla los costos en silencio. Cuando multiplicas eso en una cola de soporte que gestiona decenas de miles de tickets al mes, el ahorro acumulado es toda la historia.

Precios de Gemini 3.6 Flash

Este es el panorama completo. El precio de salida es el cambio significativo: la entrada se mantiene en $1.50, la salida baja a $7.50 por 1M de tokens.

Modo de consumoEntrada (por 1M)Salida (incl. razonamiento)Caché de contexto
Estándar$1.50$7.50$0.15
Por lotes (50% de descuento)$0.75$3.75$0.075
Flex$0.75$3.75$0.075
Prioridad$2.70$13.50$0.27
Nivel gratuitoGratisGratisGratis

Hay algunas cosas que vale la pena señalar antes de metértelo en una hoja de cálculo:

  • El nivel gratuito tiene una trampa. En el nivel gratuito, Google usa tu contenido para mejorar sus productos. En cualquier nivel de pago no lo hace. Para cualquier cosa que toque datos de clientes, eso solo descarta el nivel gratuito.
  • El grounding de búsqueda se mide por separado. Tienes 5,000 prompts con grounding gratis al mes en toda la familia Gemini 3, y después cuesta $14 por cada 1,000 consultas de búsqueda, y una sola solicitud de un cliente puede desencadenar varias consultas facturables.
  • El modo por lotes es un 50% de descuento fijo para trabajo que no necesita ser en tiempo real.

Para ver cómo se compara esto con los planes de Gemini para consumidores y el resto de niveles de la API, nuestra guía de precios de Gemini tiene el desglose completo, y los precios de Gemini Workspace cubren los planes empresariales.

Cómo se compara con GPT-5.6 y Claude

Google publicó una tabla comparativa cara a cara, y es refrescantemente honesta sobre dónde 3.6 Flash no gana. Lidera en uso del ordenador (OSWorld-Verified 83.0%), razonamiento sobre gráficos, comprensión de video largo y recuperación de contexto largo (54.0% en la brutal prueba GDM-MRCR de 1M de tokens, donde los rivales no publican nada). Pero GPT-5.6 Luna y Claude Sonnet 5 siguen liderando en varios benchmarks de programación y trabajo de conocimiento.

Tabla comparativa de Google mostrando Gemini 3.6 Flash frente a GPT-5.6 Luna, Grok 4.5 y Claude Sonnet 5 en precio y benchmarks, según lo compartido por Google
Tabla comparativa de Google mostrando Gemini 3.6 Flash frente a GPT-5.6 Luna, Grok 4.5 y Claude Sonnet 5 en precio y benchmarks, según lo compartido por Google

La lectura más útil es el precio por capacidad. A $1.50/$7.50, 3.6 Flash está muy por debajo de Claude Sonnet 5 (aproximadamente $3/$15 en lista) en salida, por un margen amplio, mientras se sitúa en la misma franja de calidad para la mayoría del trabajo agéntico. Ese es el trato que la línea Flash está construida para ganar: no "el modelo más inteligente del ranking", sino "la mayor capacidad por dólar para el trabajo que ejecutas a volumen". Si estás sopesando ambos directamente, lo desglosamos en Gemini vs Claude y Gemini vs ChatGPT.

Frente a sus propios predecesores, el salto de generación a generación es limpio en todos los benchmarks agénticos:

Gemini 3.6 Flash supera a 3.1 Pro y 3.5 Flash en DeepSWE, MLE-Bench, trabajo de conocimiento y uso del ordenador, según lo compartido por Google
Gemini 3.6 Flash supera a 3.1 Pro y 3.5 Flash en DeepSWE, MLE-Bench, trabajo de conocimiento y uso del ordenador, según lo compartido por Google

La programación sube de 37% a 49% en DeepSWE, la ingeniería de aprendizaje automático de 49.7% a 63.9% en MLE-Bench, y el trabajo de conocimiento de 1349 a 1421 en GDPval-AA. La fecha de corte de conocimiento también avanza de enero de 2025 a marzo de 2026, lo que importa si tu agente responde preguntas sobre algo reciente.

Los otros dos modelos lanzados junto a él

3.6 Flash no estuvo solo. Google lanzó tres modelos el mismo día, y saber cuál es cuál te evita elegir el equivocado.

La alineación de Gemini de julio de 2026: 3.6 Flash y 3.5 Flash-Lite lanzados, 3.5 Flash Cyber en piloto, 3.5 Pro retrasado, y Gemini 4 anunciado
La alineación de Gemini de julio de 2026: 3.6 Flash y 3.5 Flash-Lite lanzados, 3.5 Flash Cyber en piloto, 3.5 Pro retrasado, y Gemini 4 anunciado

Gemini 3.5 Flash-Lite es el modelo más rápido y barato de la clase 3.5, a $0.30 de entrada / $2.50 de salida y 350 tokens de salida por segundo. Está construido para trabajos de alto volumen y baja latencia como búsqueda agéntica, procesamiento de documentos y traducción, y se está implementando dentro de la Búsqueda de Google. El salto sobre su predecesor es grande:

Gemini 3.5 Flash-Lite supera a 3.1 Flash-Lite en programación agéntica de terminal y trabajo de conocimiento, según lo compartido por Google
Gemini 3.5 Flash-Lite supera a 3.1 Flash-Lite en programación agéntica de terminal y trabajo de conocimiento, según lo compartido por Google

Gemini 3.5 Flash Cyber es un especialista ajustado para encontrar y corregir vulnerabilidades de seguridad, que funciona dentro del agente CodeMender de Google. Dada su naturaleza de doble uso, está disponible solo para gobiernos y socios de confianza en un piloto limitado, así que la mayoría de los equipos no lo tocarán directamente.

Entonces, ¿cuál de los dos modelos de propósito general elegir realmente? La regla general es simple.

Una bifurcación de decisión: Gemini 3.6 Flash para razonamiento en varios pasos, programación y tickets complejos; Gemini 3.5 Flash-Lite para alto volumen, triaje simple y traducción
Una bifurcación de decisión: Gemini 3.6 Flash para razonamiento en varios pasos, programación y tickets complejos; Gemini 3.5 Flash-Lite para alto volumen, triaje simple y traducción

Recurre a 3.6 Flash cuando el trabajo necesita razonamiento real: agentes de varios pasos, programación, tickets de soporte complejos que tocan varios sistemas. Recurre a Flash-Lite cuando estás procesando volumen donde cada elemento es simple, como el triaje de tickets de primera pasada o la desviación de chat en vivo de preguntas rutinarias. Si construyes un agente real o un bot basado en reglas es una decisión separada de la del modelo.

El elefante en la habitación: no hay Gemini 3.5 Pro

Lo más revelador de este lanzamiento es lo que no incluyó. El modelo insignia Pro de Google fue actualizado por última vez en febrero de 2026, y 3.5 Pro fue anunciado en mayo como "ya en uso interno". Todavía no se ha lanzado. Bloomberg informó que Google sufrió retrasos internos ya que el modelo tuvo dificultades para cumplir sus propios objetivos de rendimiento.

Eso está pasando mientras OpenAI lanzó GPT-5.6 y Anthropic lanzó Claude Sonnet 5 y expandió Fable 5. La lectura de Google del momento: mantener el nivel Flash de alto volumen, generador de ingresos, fresco y barato mientras el buque insignia se cocina. Logan Kilpatrick de DeepMind dijo que 3.5 Pro está en pruebas con socios y debería "llegar pronto", y que el equipo ya ha comenzado su "ejecución de preentrenamiento más ambiciosa hasta la fecha" para Gemini 4. Si necesitas un modelo de primer nivel hoy, nuestro resumen de alternativas a Gemini es el lugar honesto donde mirar mientras esperas.

Qué significa esto si estás construyendo IA para soporte

Aquí es donde tengo que ser sincero contigo, porque esta es la parte que todo artículo de lanzamiento de modelos hace mal para los equipos de soporte.

Un modelo más barato y rápido es una buena noticia. Pero cambiar a Gemini 3.6 Flash no te da un agente de soporte funcional, igual que comprar un motor más rápido no te da un coche. Llevo los últimos tres años y medio poniendo IA en colas de soporte reales, y el fallo que he visto repetirse no es que el modelo sea tonto, es un bot de sonido confiado dando una respuesta incorrecta a un cliente real porque nadie construyó las capas alrededor del modelo. El modelo es la base de la pila, no toda la historia.

El modelo es la capa inferior de un agente de soporte, con recuperación de información, salvaguardas, simulación e integración con el helpdesk apiladas encima
El modelo es la capa inferior de un agente de soporte, con recuperación de información, salvaguardas, simulación e integración con el helpdesk apiladas encima

Esas capas son el trabajo real. Recuperación de información, para que el modelo responda desde tu centro de ayuda y tickets pasados en lugar de adivinar. Salvaguardas y alcance, para que ceda el control limpiamente en lugar de inventar una política de reembolso. Integración, para que pueda actuar realmente dentro de tu sistema de tickets. Y pruebas, para que sepas cómo se comporta antes de que toque a un cliente, no después. Esta es la misma brecha que separa una API en bruto de un software de atención al cliente con IA real, y es por qué los problemas de los chatbots de IA casi siempre se remontan a la fontanería, no al modelo.

También es por qué me opondría a conectar la API de Gemini en bruto a tu helpdesk tú mismo. Estarías reconstruyendo la recuperación de información, las salvaguardas contra alucinaciones, la simulación y cada integración de helpdesk desde cero, y luego manteniéndolo a medida que los modelos cambian cada pocas semanas. Ese es todo el argumento a favor de la IA de helpdesk construida a propósito frente a una pila casera: el nivel del modelo es una línea de partida, el sistema que lo rodea es el producto.

Prueba eesel

Esta es exactamente la capa que eesel está construido para ser. Lo conectas a tu helpdesk existente, aprende de tus tickets pasados y tu base de conocimiento desde el primer momento, y funciona sobre modelos de frontera como Gemini para que obtengas las ganancias de eficiencia sin conectar tú mismo la API.

Vista general del panel del helpdesk de eesel AI
Vista general del panel del helpdesk de eesel AI

El diferenciador que más importa aquí es el que 3.6 Flash no puede darte por sí solo: eesel te permite simular el agente contra tus tickets históricos antes de que responda a un cliente real, así que ves la tasa de resolución y las respuestas exactas que habría enviado. Y como tiene precio según el trabajo que hace, no por token, no estás haciendo cálculos de tokens en cada ticket. Si estás evaluando modelos para construir automatización de soporte, empieza desde el resultado que quieres y deja que la plataforma elija la fontanería. Es gratis probarlo.

Frequently Asked Questions

¿Qué es Gemini 3.6 Flash?
Gemini 3.6 Flash es el modelo de trabajo más reciente de Google, lanzado el 21 de julio de 2026. Está diseñado para la velocidad y la eficiencia al ejecutar agentes de IA en producción, y usa alrededor de un 17% menos de tokens de salida que su predecesor, Gemini 3 Flash, además de costar menos por token de salida. Para una visión más amplia de la familia de modelos de Google, consulta nuestro resumen de Gemini AI.
¿Cuánto cuesta Gemini 3.6 Flash?
En el nivel de pago estándar, el precio de Gemini 3.6 Flash es de $1.50 por 1M de tokens de entrada y $7.50 por 1M de tokens de salida, frente a los $9.00 de salida de 3.5 Flash. El modo por lotes reduce ambos precios a la mitad. También hay un nivel gratuito (donde Google puede usar tu contenido para mejorar sus productos). Compáralo con el desglose completo de precios de Gemini.
¿Es Gemini 3.6 Flash bueno para atención al cliente?
El modelo es lo bastante capaz, pero el modelo es solo la capa inferior de un agente de soporte. Aun necesitas recuperación de información sobre tu centro de ayuda, salvaguardas y pruebas antes de lanzarlo. Una plataforma como software de atención al cliente con IA se encarga de esa capa para que no tengas que conectar tú mismo la API en bruto.
¿Cómo se compara Gemini 3.6 Flash con GPT-5.6 y Claude?
Según la propia tabla de Google, 3.6 Flash lidera en uso del ordenador y tareas de contexto largo, mientras que GPT-5.6 y Claude Sonnet 5 lideran en algunos benchmarks de programación y trabajo de conocimiento. Consulta nuestras comparativas de Gemini vs Claude y Gemini vs ChatGPT para el panorama completo.
¿Por qué Google no lanzó Gemini 3.5 Pro?
Google lanzó tres modelos de la clase Flash, pero retuvo el modelo insignia 3.5 Pro, que todavía está en pruebas con socios tras, según se informa, no alcanzar sus objetivos internos de rendimiento. Si estás sopesando opciones mientras esperas, nuestro resumen de alternativas a Gemini cubre el terreno.

Share this article

Kurnia Kharisma Agung Samiadjie

Article by

Kurnia Kharisma Agung Samiadjie

Kurnia is a software engineer and writer at eesel AI with two years of SEO experience, writing about AI tools, helpdesk software, and customer support. He pairs a developer's understanding of how these products are built with search-driven research into what actually ranks and resonates with the people searching for them.

Related Posts

All posts →
Banner principal de precios de Gemini 3.5 Flash-Lite sobre fondo azul de Google
Trending

Precios de Gemini 3.5 Flash-Lite: qué cuesta y para quién es

Gemini 3.5 Flash-Lite es el modelo más barato de Google, a $0.30/$2.50 por 1M de tokens. Aquí tienes la tabla de precios completa, un ejemplo de coste real y para quién es.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 22, 2026
Banner de Gemini 3.5 Flash-Lite sobre un fondo azul Google
Trending

Gemini 3.5 Flash-Lite: qué es, precio y para quién es

Gemini 3.5 Flash-Lite es el modelo 3.5 más rápido y barato de Google, a $0,30/$2,50 por 1M de tokens. Aquí te explico qué es, cuánto cuesta y cuándo usarlo.

Rama Adi NugrahaRama Adi NugrahaJul 22, 2026
Gemini 3.5 Flash Cyber hero banner on a Google-blue background
Trending

Gemini 3.5 Flash Cyber: qué es y quién puede usarlo

Gemini 3.5 Flash Cyber es el modelo de seguridad de Google para encontrar y corregir vulnerabilidades de código. Esto es lo que hace, cómo lo usa CodeMender y por qué probablemente todavía no puedas acceder a él.

Alicia Kirana UtomoAlicia Kirana UtomoJul 22, 2026
Banner principal de precios de Gemini 3.6 Flash sobre un fondo azul de Google
Trending

Precios de Gemini 3.6 Flash: el desglose completo de costes para 2026

Gemini 3.6 Flash cuesta $1.50 de entrada y $7.50 de salida por 1M de tokens. Aquí tienes la tabla de precios completa, los costes ocultos y lo que realmente cuesta usarlo.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 22, 2026
Ilustración de un modelo de control de robots humanoides, que representa a Gemini Robotics 2
Trending

Gemini Robotics 2: lo que muestran las cifras de DeepMind

Gemini Robotics 2 lanza tres modelos y una tabla de éxito por tarea en la que la mayoría de las puntuaciones no llega al 80%. Esa tabla es lo más útil de todo el lanzamiento.

Alicia Kirana UtomoAlicia Kirana UtomoAug 4, 2026
Ilustración de paneles de imagen, video y documentos alimentando un modelo de visión y lenguaje, con el logo de Qwen
Trending

Qwen 3.7 Flash: especificaciones, precios y qué hace realmente

Qwen 3.7 Flash se lanzó sin entrada de blog, sin benchmarks y sin pesos. Aquí está la hoja de especificaciones completa, los precios escalonados y lo que Qwen nunca afirmó.

Alicia Kirana UtomoAlicia Kirana UtomoJul 31, 2026
Texto alternativo de la imagen
Guides

Una visión general de Gemini Agentic Vision: Cómo funciona y qué significa para la IA

Gemini Agentic Vision de Google es una nueva función del modelo Gemini 3 Flash que cambia la forma en que la IA interactúa con las imágenes, transformando la visualización pasiva en una investigación activa de varios pasos para una mayor precisión.

Stevia PutriStevia PutriJan 30, 2026
Ilustración de un chip de modelo compacto que enruta un token por dos rutas de expertos iluminadas entre muchas apagadas, para una explicación de Inkling-Small
Trending

Inkling-Small explicado: un modelo de 276B con 12B activos

Qué es realmente Inkling-Small: un MoE de pesos abiertos de 276B/12B de Thinking Machines, la ventana de contexto en la que la documentación y los proveedores no coinciden, lo que realmente cuesta un millón de tokens y dónde encaja en una pila de soporte.

Rama Adi NugrahaRama Adi NugrahaAug 4, 2026
Ilustración que compara un núcleo de modelo pequeño y ordenado con otro mucho mayor y enmarañado, para un análisis de Inkling-Small
Trending

Análisis de Inkling-Small: un cuarto del tamaño, y casi igual de listo

Un análisis práctico de Inkling-Small: supera a su propio modelo padre de 975B en programación con un cuarto del tamaño y un cuarto del precio, y luego se desploma en factualidad. Esto es lo que ese intercambio realmente te cuesta.

Alicia Kirana UtomoAlicia Kirana UtomoAug 4, 2026

Listo para contratar tu companero de IA?

Configuracion en minutos. Sin tarjeta de credito requerida.

Comienza gratis