GPT-5.6 Luna: el nivel más rápido y económico de OpenAI, explicado

Alicia Kirana Utomo
Escrito por

Alicia Kirana Utomo

Katelin Teen
Revisado por

Katelin Teen

Última edición July 10, 2026

Verificado por expertos
Banner ilustrado para GPT-5.6 Luna, el nivel de modelo más rápido y económico de OpenAI, con una media luna y un motivo de velocidad

Qué es realmente GPT-5.6 Luna

Construyo los agentes de IA en eesel, y he pasado los últimos tres años y medio observando qué cambia (y qué no) un modelo más barato y rápido cuando responde tickets de soporte reales, no prompts de benchmark. Así que cuando OpenAI lanzó un nuevo nivel de bajo costo, mi primera pregunta no fue "qué tan inteligente es", sino "lo bastante inteligente para qué, y a qué velocidad."

GPT-5.6 no es un solo modelo. OpenAI lo presentó en vista previa el 26 de junio de 2026 y lo llevó a disponibilidad general el 9 de julio como una familia de tres niveles de capacidad. El número, 5.6, es la generación. Los nombres son niveles duraderos que, según lo plantea OpenAI, "pueden avanzar a su propio ritmo":

  • Sol, el buque insignia, para código de largo alcance y trabajo agéntico.
  • Terra, el nivel intermedio equilibrado para el día a día.
  • Luna, el más rápido y eficiente en costo, para tareas de alto volumen y bien definidas.

El ID de modelo de Luna es gpt-5.6-luna. La publicación para desarrolladores de OpenAI la describe como algo que trae "velocidad al trabajo bien definido y de alto volumen", que es una forma educada de decir: este es el nivel al que recurres cuando ejecutas el mismo tipo de solicitud miles de veces y te importa más el costo y la latencia de respuesta que el razonamiento profundo. Reemplaza los antiguos sufijos mini/nano de generaciones anteriores por algo un poco más legible.

Dónde encaja Luna: Sol vs. Terra vs. Luna

La forma más clara de pensar en la familia es como una escalera de precio y capacidad. Sol está arriba y cuesta más; Luna está abajo y cuesta menos.

Escalera de precios de la familia GPT-5.6: Sol en $5/$30, Terra en $2.50/$15 y Luna destacado en $1/$6 como el nivel más rápido y de alto volumen
Escalera de precios de la familia GPT-5.6: Sol en $5/$30, Terra en $2.50/$15 y Luna destacado en $1/$6 como el nivel más rápido y de alto volumen

Aquí está la misma división en forma de tabla, con el trabajo para el que realmente sirve cada nivel:

NivelID del modeloEntrada / salida (por 1M)Ideal para
Solgpt-5.6-sol$5.00 / $30.00Código de largo alcance, planificación, trabajo agéntico
Terragpt-5.6-terra$2.50 / $15.00Tareas cotidianas equilibradas
Lunagpt-5.6-luna$1.00 / $6.00Trabajo de alto volumen, bien definido y sensible a la latencia

Si has leído mi visión general de GPT-5.6 o el análisis profundo de precios, el patrón te resultará familiar: Sol coincide exactamente con el precio insignia de GPT-5.5, y Terra reutiliza el precio de GPT-5.4. Luna es el único puesto nuevo de la familia, un nivel de bajo costo de la familia frontier que se ubica entre los precios antiguos de GPT-5.4 y GPT-5.4-mini.

Cuánto cuesta Luna

A $1 de entrada y $6 de salida por millón de tokens, Luna es la forma más económica de entrar a la generación 5.6. Dos detalles importan más allá del precio de lista.

Primero, el cacheo de prompts. GPT-5.6 introduce puntos de ruptura de caché explícitos y una vida mínima de caché de 30 minutos. Las lecturas de caché mantienen el descuento estándar del 90% en entrada en caché, así que el contexto repetido en Luna cuesta cerca de $0.10 por 1M de tokens. Las escrituras en caché se facturan a 1.25 veces la tarifa de entrada sin caché. Si tu carga de trabajo reutiliza un gran prompt de sistema o una base de conocimiento en cada llamada, ahí es donde vive el verdadero ahorro.

Segundo, no hay un recargo separado por contexto largo. A diferencia de GPT-5.5, que cobra más por prompts de más de unos 272K tokens, GPT-5.6 cotiza una única tarifa fija por modelo, algo que sigue siendo cierto en disponibilidad general.

Un ejemplo rápido. Digamos que envías 2M de tokens de entrada y 500K de salida al día a través de Luna. Eso es aproximadamente $2 de entrada más $3 de salida, así que unos $5 al día antes de cualquier descuento por caché. Ejecuta el mismo volumen en Sol y estarás más cerca de $25 al día. Para un pipeline repetitivo y de alto volumen, esa diferencia se acumula rápido, que es exactamente por qué los equipos que hacen automatización de tickets tier 1 se preocupan por el nivel más barato que sea capaz.

El benchmark del que todos hablan

Aquí está la parte que convirtió a Luna en el nivel más comentado para muchos desarrolladores. En Terminal-Bench 2.1, el benchmark de codificación de línea de comandos y agéntica de OpenAI, Luna obtiene 84.3%. Eso no es nivel insignia, pero mira a su lado a quién tiene.

Gráfico de barras horizontal de puntajes de Terminal-Bench 2.1: Sol Ultra en 91.9, Sol en 88.8, GPT-5.5 en 88.0, Luna destacado en 84.3 empatado con Claude Mythos 5, Claude Fable 5 en 83.4 y Terra en 82.5
Gráfico de barras horizontal de puntajes de Terminal-Bench 2.1: Sol Ultra en 91.9, Sol en 88.8, GPT-5.5 en 88.0, Luna destacado en 84.3 empatado con Claude Mythos 5, Claude Fable 5 en 83.4 y Terra en 82.5

Luna empata con Claude Mythos 5 (84.3%), supera a Claude Fable 5 (83.4%), e incluso supera a su propio hermano más caro Terra (82.5%) en este gráfico en particular. El equipo de desarrolladores de OpenAI también asegura que Luna "casi iguala el rendimiento máximo de GPT-5.5 a bastante menos de la mitad del costo estimado de la API."

La advertencia honesta: esto es un solo benchmark, publicado por el proveedor, y un solo benchmark rara vez predice el comportamiento del día a día. Muchos desarrolladores dijeron lo mismo (más sobre eso abajo). Pero sí desmiente la suposición habitual de que el nivel más barato es un juguete. Para tareas acotadas y repetitivas, Luna es un candidato real, no un plan B.

Dónde puedes usar Luna ahora mismo

Este es el detalle que causó más confusión el día del lanzamiento, así que vale la pena ser directo. GPT-5.6 ya "está en ChatGPT", pero Luna no.

Según el centro de ayuda de OpenAI, solo Sol se puede seleccionar en conversaciones estándar de ChatGPT (a través de las opciones de razonamiento Medium, High y Extra High en Plus, Pro, Business y Enterprise). GPT-5.5 Instant sigue siendo el predeterminado para el chat cotidiano. Terra y Luna no se pueden seleccionar en el chat normal de ChatGPT en absoluto. Dónde sí viven:

  • ChatGPT Work (Plus, Pro, Business, Enterprise) tiene los tres niveles.
  • Codex tiene los tres para planes pagos; Terra también llega a usuarios Free y Go ahí.
  • La API de OpenAI expone Sol, Terra y Luna directamente.
  • GitHub Copilot agregó los tres niveles el 9 de julio, según el changelog de GitHub, con Luna en los planes Pro, Pro+, Max, Business y Enterprise.

Así que si abriste ChatGPT esperando poder hacer clic en "Luna", esa opción no está ahí por diseño. Luna es un modelo para desarrolladores y flujos de trabajo, al que se llega por la API, Codex o Copilot, no una opción del selector de chat. Esa brecha fue lo que provocó las respuestas de "¿dónde está?" al propio anuncio de OpenAI el día de la disponibilidad general.

Qué dicen los desarrolladores

La reacción de la comunidad se dividió en una línea familiar: entusiasmo por la relación precio-rendimiento, atemperado por un "esperemos a las pruebas reales." El ángulo del precio es donde Luna ganó más simpatías.

Reddit

"Although GPT 5.6 Sol seems like a great improvement, imo GPT 5.6 [Luna] seems like the most significant improvement due to the price."

El propio planteamiento de OpenAI puso a Luna en la misma categoría de "alto volumen, bajo costo" que los profesionales adoptaron:

"Luna brings speed to well-defined, high-volume work... GPT-5.6 Luna nearly matches GPT-5.5's peak performance at well under half the estimated API cost."

También hay escepticismo, y es justo. Un comentario muy compartido en Hacker News argumentó que todo el renombramiento Sol/Terra/Luna se mapea limpiamente sobre la vieja división full/mini/nano, leyendo a Luna esencialmente como el nivel "nano" con un nombre más bonito. Tenga razón o no, es un recordatorio útil: un nombre legible no es lo mismo que un modelo más grande. Juzga a Luna por tu propia tarea, no por el nivel de marketing en el que se ubica.

Qué significa un nivel de modelo barato y rápido para la atención al cliente

Aquí me voy a poner opinático, porque esta es la parte en la que realmente trabajo. Un nivel de modelo más barato y rápido son buenas noticias para la IA en atención al cliente: el soporte es el ejemplo de manual de carga de trabajo de alto volumen y bien definida para la que se construyó Luna, y el costo por interacción es el número que decide si la automatización tiene sentido. Los tokens más baratos mueven las cuentas de ahorro de costos a tu favor.

Pero he visto a un bot que sonaba seguro dar respuestas equivocadas a clientes reales sin que nadie se diera cuenta, por lo que cada implementación que llevo a cabo se simula contra tickets históricos antes de tocar una cola en vivo. Esa experiencia me enseñó una verdad incómoda: cambiar a un modelo más barato casi nunca arregla un agente de soporte que responde mal, y cambiar a uno más caro tampoco lo arregla casi nunca. El modelo es una pieza intercambiable de un sistema mucho más grande.

Diagrama de pipeline que muestra cómo funciona una IA de soporte sin importar el modelo: tu conocimiento alimenta un motor de IA de eesel con un espacio de modelo intercambiable para Luna, Sol o Claude, luego simula sobre tickets pasados, luego sale en vivo en tu helpdesk
Diagrama de pipeline que muestra cómo funciona una IA de soporte sin importar el modelo: tu conocimiento alimenta un motor de IA de eesel con un espacio de modelo intercambiable para Luna, Sol o Claude, luego simula sobre tickets pasados, luego sale en vivo en tu helpdesk

Lo que realmente decide si una respuesta de IA es correcta es la capa alrededor del modelo: qué conocimiento puede recuperar, qué tan bien está anclado a tu centro de ayuda y tickets pasados, y qué barreras de seguridad le impiden alucinar una respuesta cuando debería escalar. Consigue esa capa bien y un modelo como Luna es más que suficiente. Consíguela mal y hasta Sol confundirá a tus clientes con confianza. Esta es la misma razón por la que una configuración específica de dominio suele superar a un modelo frontier crudo en soporte, y por qué la tasa de resolución depende mucho más de la calidad de la recuperación que del nivel que elegiste.

Prueba eesel

Si te emociona la idea de modelos más baratos y rápidos porque quieres automatizar soporte, el modelo es la parte fácil. eesel es la capa que convierte un modelo como GPT-5.6 Luna en un agente de soporte con IA que realmente se mantiene preciso: entrena con tus tickets pasados y tu centro de ayuda, te permite simular al agente contra miles de conversaciones históricas antes de que responda a un cliente real, y se conecta a tu software de helpdesk existente en minutos en lugar de un proyecto de todo un trimestre.

Resumen del panel de helpdesk de IA de eesel
Resumen del panel de helpdesk de IA de eesel

La propuesta es simple: no deberías tener que rediseñar tu stack de soporte cada vez que OpenAI lanza un nuevo nivel. eesel se mantiene flexible en cuanto a modelo, así que obtienes el beneficio de un Luna más barato y rápido sin apostar tu experiencia de cliente a la hoja de ruta de un solo proveedor. Es gratis para probar, y puedes ver cómo maneja tus tickets reales antes de comprometerte con nada.

Preguntas frecuentes

¿Qué es GPT-5.6 Luna?
GPT-5.6 Luna es el más rápido y económico de los tres niveles de la familia GPT-5.6 de OpenAI (Sol, Terra y Luna), pensado para tareas de alto volumen y bien definidas. Su ID de modelo es gpt-5.6-luna y funciona a $1 de entrada y $6 de salida por 1M de tokens.
¿Cuánto cuesta GPT-5.6 Luna?
El precio de GPT-5.6 Luna es de $1.00 por 1M de tokens de entrada y $6.00 por 1M de tokens de salida, el nivel más económico de la familia. Las lecturas de entrada en caché reciben el descuento estándar del 90%, así que el contexto repetido en Luna cuesta cerca de $0.10 por 1M. Consulta mi desglose completo de precios de GPT-5.6.
¿Puedo usar GPT-5.6 Luna en ChatGPT?
No en el chat estándar de ChatGPT. Según el centro de ayuda de OpenAI, solo Sol se puede seleccionar en conversaciones normales; Luna y Terra aparecen en ChatGPT Work, Codex, la API de OpenAI y GitHub Copilot.
¿GPT-5.6 Luna es lo bastante bueno para atención al cliente?
Para trabajo de tier 1 de alto volumen, un nivel rápido y económico es una opción razonable, pero el modelo es solo una parte del sistema. Lo que realmente decide la calidad son la recuperación de información y las barreras de seguridad a su alrededor, por lo que plataformas como eesel te permiten simular sobre tickets pasados antes de salir en vivo. Más sobre IA para atención al cliente.
¿Cómo se compara GPT-5.6 Luna con Sol y Terra?
Sol es el buque insignia ($5/$30), Terra es el nivel intermedio equilibrado ($2.50/$15), y Luna es el más rápido y económico ($1/$6). En Terminal-Bench 2.1, Luna obtiene 84.3%, por delante de Terra y empatado con Claude Mythos 5. El contexto completo está en mi análisis de GPT-5.6.

Share this article

Alicia Kirana Utomo

Article by

Alicia Kirana Utomo

Kira is a writer at eesel AI with a Computer Science background and over a year of hands-on experience evaluating AI-powered customer service tools. She focuses on breaking down how helpdesk platforms and AI agents actually work so that support teams can make better buying decisions.

Related Posts

All posts →
Ilustración principal comparando GPT-5.6 contra Gemini 3, dos familias de modelos de IA equilibradas una frente a otra
Trending

GPT-5.6 vs Gemini 3: ¿qué modelo de IA gana en 2026?

GPT-5.6 vs Gemini 3 comparados: Sol, Terra y Luna frente a Gemini 3.5 Flash y 3.1 Pro en precio, benchmarks, contexto y qué encaja mejor en agentes de soporte con IA.

Rama Adi NugrahaRama Adi NugrahaJul 10, 2026
Ilustración principal de la comparación entre GPT-5.6 y Claude, dos familias de modelos de IA equilibradas una frente a la otra
Trending

GPT-5.6 vs Claude: ¿qué modelo de IA gana en 2026?

Una comparación práctica entre GPT-5.6 y Claude: los niveles Sol/Terra/Luna frente a Opus 4.8 y Sonnet 5, en precio, benchmarks, contexto y agentes de soporte con IA.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 10, 2026
Banner principal explicativo de GPT-5.6 con el logo de OpenAI
AI news

¿Qué es GPT-5.6? Sol, Terra y Luna de OpenAI explicados

GPT-5.6 es la nueva familia de modelos Sol, Terra y Luna de OpenAI. Esto es lo que realmente es nuevo, cuánto cuesta, por qué aún no puedes usarlo y qué significa para los equipos de soporte.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJun 29, 2026
Ilustración principal del precio de GPT-Live, la IA de voz full-duplex en tiempo real de OpenAI en los planes de ChatGPT
Trending

Precio de GPT-Live: lo que realmente cuesta la IA de voz de OpenAI

GPT-Live no tiene un precio propio. Esto es lo que realmente pagas por la IA de voz full-duplex de OpenAI en los planes Free, Go, Plus y Pro de ChatGPT, y por qué todavía no hay precio de API.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 13, 2026
Ilustración principal de GPT-Live, la IA de voz full-duplex en tiempo real de OpenAI para conversaciones naturales
Trending

¿Qué es GPT-Live? La IA de voz en tiempo real de OpenAI, explicada

GPT-Live es el nuevo modelo de voz full-duplex de OpenAI para ChatGPT. Así es como funciona, qué planes lo incluyen, cuánto cuesta y qué significa para la atención al cliente con IA.

Alicia Kirana UtomoAlicia Kirana UtomoJul 11, 2026
Ilustración principal del análisis de GPT-Live, la IA de voz full-duplex en tiempo real de OpenAI para ChatGPT
Trending

Análisis de GPT-Live: ¿vale la pena la nueva IA de voz de OpenAI?

Un análisis práctico de GPT-Live, el nuevo modelo de voz full-duplex de OpenAI para ChatGPT: qué está bien, qué falta y si vale la pena para los equipos de soporte.

Riellvriany IndriawanRiellvriany IndriawanJul 13, 2026
Ilustración del agente ChatGPT Work convirtiendo un objetivo en un documento, una presentación y una hoja de cálculo terminados
Trending

¿Qué es ChatGPT Work? El agente de trabajo de OpenAI, explicado

ChatGPT Work es el nuevo agente de OpenAI para equipos, incluido en los planes Business y Enterprise. Esto es lo que realmente hace, el lío de planes y precios, y para quién es.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 10, 2026
Ilustración de un cronómetro que se eleva para revelar una pista despejada, que representa un límite de uso levantado
Trending

OpenAI eliminó el límite de 5 horas de Codex: qué cambió realmente

OpenAI eliminó temporalmente el límite de uso de 5 horas en Codex y ChatGPT Work. Esto es lo que cambió el 12 de julio, lo que se mantuvo y qué significa para ti.

Rama Adi NugrahaRama Adi NugrahaJul 20, 2026
Banner ilustrado que explica GPT-5.6 Terra, el modelo de gama media equilibrado de OpenAI, con un motivo de tierra y balanza
AI news

¿Qué es GPT-5.6 Terra? El modelo de gama media equilibrado de OpenAI, explicado

GPT-5.6 Terra es el nivel intermedio y equilibrado de la familia Sol/Terra/Luna de OpenAI, a 2,50$/15$ por 1M de tokens. Qué hace, cómo se compara y dónde encaja.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 13, 2026

Listo para contratar tu companero de IA?

Configuracion en minutos. Sin tarjeta de credito requerida.

Comienza gratis