
Lo que OpenAI cambió realmente el 12 de julio
El cambio vino de Thomas "Tibo" Sottiaux, quien lidera Codex en OpenAI, en una publicación de un domingo por la mañana en X. Ocurrieron tres cosas a la vez:
- El límite de uso de 5 horas se eliminó temporalmente para todos los planes Plus, Business y Pro.
- Se reiniciaron los límites de uso de todos, así que quienes estaban a mitad de ciclo obtuvieron un margen nuevo.
- GPT-5.6 Sol se hizo más eficiente, así que una tarea determinada consume menos de tu cuota.
"Morning. The last 48 hours of Codex and ChatGPT Work have been intense! Three important updates: - Temporarily removing the 5 hour usage limit restriction for all Plus, Business and Pro plans..."
Un par de días después reinició los límites de nuevo tras superar Codex y ChatGPT Work los 8 millones de usuarios activos, y confirmó que la ventana de 5 horas seguía desactivada. La palabra que hace todo el trabajo en cada una de estas publicaciones es temporalmente, y volveré sobre por qué importa.

Qué era realmente el límite de 5 horas
Antes de juzgar la eliminación, ayuda saber qué se eliminó exactamente. Cada nivel de suscripción de Codex mide el uso en una ventana móvil de cinco horas. Y lo crucial: tus mensajes locales (la CLI y el IDE) y tus chats en la nube comparten la misma ventana, según la página de precios de Codex de OpenAI. No tienes cubos separados, así que una tarde intensa en la terminal consume el mismo presupuesto que tus tareas en la nube.
Los límites se publican como rangos, porque un solo mensaje puede costar cantidades muy distintas según cuánto razone el modelo, qué tan grande sea tu contexto y cuántas herramientas invoque. Así es la forma actual para mensajes locales por ventana de cinco horas:
| Modelo | Plus | Pro 5x | Pro 20x | Business |
|---|---|---|---|---|
| GPT-5.6 Sol | 15–90 | 75–450 | 300–1800 | 15–90 |
| GPT-5.6 Terra | 20–110 | 100–550 | 400–2200 | 20–110 |
| GPT-5.6 Luna | 50–280 | 250–1400 | 1000–5600 | 50–280 |
| GPT-5.5 | 15–80 | 75–400 | 300–1600 | 15–80 |
| GPT-5.4 mini | 60–350 | 300–1750 | 1200–7000 | 60–350 |
Dos cosas llaman la atención. Primero, un plan Plus con Sol puede caer hasta 15 mensajes en cinco horas en tareas pesadas. Segundo, los límites por asiento de Business son idénticos a los de Plus sobre el papel, lo que causó su propia disputa (más adelante). Vale la pena leer la mecánica completa, incluido cómo funcionan los límites de Codex en la app de escritorio, si vives dentro de la herramienta.
Lo que cambió por debajo en abril es la parte que se subestima: Codex pasó silenciosamente de un modelo de conteo de mensajes a un medidor de tiempo de razonamiento. Cuanto más piensa el agente, más consume de tu ventana, por lo que un prompt "rápido" que dispara una cadena de razonamiento larga puede costarte una parte sorprendente de tus cinco horas.
Por qué se rompió: GPT-5.6 Sol y el fondo de créditos compartido
Nada de esto ocurrió en el vacío. GPT-5.6 Sol estuvo disponible de forma general el 9 de julio, se integró en Codex en los días siguientes, y la gente recurrió de inmediato a su modo de alta computación. La alta computación consume presupuesto rápido, el fondo compartido multiplicó el efecto, y la ventana de cinco horas empezó a colapsar en minutos para los usuarios intensivos. Duplicar el tráfico en 48 horas provoca justamente eso.
La frustración fue real y específica. Este es el tipo de testimonio que los desarrolladores publicaban en Hacker News:
"I personally went from being able to have several sessions running concurrently without hitting limits, to only having one session at a time and hitting my 5h every day twice a day in 3-4 hours tops... It just feels ~2x to ~3x less tokens than before."
Así que eliminar el muro de cinco horas se lee menos como un regalo y más como un alivio de presión. Y aquí está el matiz que la mayoría de la cobertura pasa por alto: levantar un techo no elimina los demás. El límite semanal sigue activo, y el fondo de créditos que Codex comparte con ChatGPT Work (y ChatGPT para Excel) sigue rigiendo tu total. Quita una puerta y quedan dos en pie.

Una vez que agotas los límites incluidos, el modelo de precios de Codex recurre a los créditos. La propia tarifa de OpenAI sitúa a GPT-5.6 Sol en 125 créditos por 1M de tokens de entrada y 750 por 1M de salida, y señala que el uso promedia 5 a 40 créditos por mensaje. Los usuarios de Plus y Pro pueden comprar más créditos para seguir, o traer una clave de la API de OpenAI y pagar tarifas estándar por token. El medidor nunca se apaga del todo, solo cambia de forma.
"Temporal" es la palabra que hace el trabajo
Cada anuncio sobre esto usa la palabra temporalmente, y eso no es casualidad. No hay fecha de finalización publicada. La medida nunca entró en el registro de cambios formal, que sigue mencionando la ventana de cinco horas como una mecánica vigente. Y OpenAI ya empezó a preguntar a los usuarios si la configuración sin límite siquiera está funcionando:
"We've had no 5h limit in Codex plus and pro for a few days. Do you think it is better or are you finding it difficult to manage the usage included in the weekly limit effectively? If we were to make this different, what should it look like in an ideal world?"
Eso es una empresa ejecutando un experimento en vivo, no lanzando una política permanente. Los desarrolladores lo notaron, por lo que ahora hay un issue abierto en GitHub pidiendo a OpenAI que haga permanente la eliminación. Mi lectura honesta, habiendo lanzado yo mismo sistemas con límites de tasa: una eliminación temporal de límites durante un pico de lanzamiento es una palanca de gestión de la demanda, y las palancas se retiran cuando las cuentas de la computación dejan de cuadrar. Planifica tu flujo de trabajo en torno al límite semanal, no al límite de cinco horas actualmente ausente.
Qué significa esto si ejecutas IA en trabajo real
Si eres un desarrollador independiente jugando con un proyecto paralelo, "el muro de cinco horas desapareció por ahora" es genuinamente una buena noticia, disfruta el margen. Si ejecutas IA en algo de lo que depende el negocio, la conclusión más útil tiene que ver con el modelo de precios subyacente.
Toda esta saga es un caso de estudio de lo que pasa cuando el uso incluido se mide contra la computación: un lanzamiento de modelo que tú no elegiste puede cambiar silenciosamente hasta dónde llega tu plan, las unidades son difíciles de predecir (tiempo de razonamiento, créditos, rangos de tokens), y las reglas cambian a mitad de ciclo. Para un hobby de programación, eso es una molestia manejable. Para una cola de soporte que atiende a miles de clientes, el coste impredecible es un riesgo operativo real.
Esta es la apuesta que hicimos de forma diferente en eesel, a propósito. eesel no es una herramienta de programación, así que no pretendo que compita con Codex. Pero ejecutamos agentes de IA para helpdesk en colas de soporte en vivo, y deliberadamente no les pusimos precio según una ventana de uso. Pagas por ticket que tu IA realmente resuelve, punto.

Eso significa: sin fondo de créditos compartido, sin reloj que se reinicia en tu contra, y el mismo coste sin importar si un ticket le tomó al modelo un paso de razonamiento o veinte. Es la filosofía opuesta a una ventana de cinco horas, y después de años viendo cómo se queman equipos con facturas de IA sorpresa, estoy bastante convencido de que es la correcta para todo lo que tiene que funcionar todos los días.
eesel para IA que tiene que ser predecible
Si tu IA responde a clientes en lugar de escribir código, lo que quieres es una factura que no se mueva con la semana de lanzamiento de otro. eesel se conecta a tu helpdesk existente (Zendesk, Freshdesk, Gorgias, y más de 100 más), aprende de tus tickets pasados desde el primer día, y resuelve conversaciones de nivel 1 por su cuenta. Gridwise vio cómo resolvió el 73% de las solicitudes de nivel 1 en el primer mes.
El precio es la parte que encaja con toda esta historia: 0,40 $ por ticket resuelto, sin cuotas por asiento, sin mínimo, y un tope de gasto que tú mismo estableces para que el agente se detenga antes de sorprenderte. Un ticket es una tarea, sin importar cuántos mensajes tome. Puedes ver exactamente qué se ejecutó y qué costó en una vista de actividad clara, no en un medidor de créditos misterioso.

Puedes probar eesel gratis (los primeros 50 $ de uso corren por nuestra cuenta, sin tarjeta), y si el escritor de blogs con IA va más contigo, funciona con el mismo modelo por tarea. Decida lo que decida OpenAI hacer con el límite de cinco horas a continuación, al menos tu factura de soporte no será parte del experimento.
Preguntas frecuentes
¿OpenAI realmente eliminó el límite de 5 horas en GPT?
¿Qué era el límite de 5 horas en Codex?
¿Es GPT-5.6 Sol ilimitado ahora?
¿Cuánto cuesta Codex después de alcanzar el límite?
¿Cuáles son las mejores alternativas si los límites de Codex siguen cambiando?

Article by
Rama Adi Nugraha
Rama is a software engineer at eesel AI with two years of experience writing about B2B SaaS, AI tools, and customer support technology. Based in Bali, Indonesia, he brings a developer's perspective to product comparisons — cutting through marketing copy to what the integrations and APIs actually do.







