
O que a OpenAI realmente mudou em 12 de julho
A mudança veio de Thomas "Tibo" Sottiaux, que lidera o Codex na OpenAI, em uma publicação de domingo de manhã no X. Três coisas aconteceram ao mesmo tempo:
- O limite de uso de 5 horas foi removido temporariamente para todos os planos Plus, Business e Pro.
- Os limites de uso de todos foram reiniciados, então quem estava no meio do ciclo ganhou um fôlego novo.
- O GPT-5.6 Sol se tornou mais eficiente, então uma determinada tarefa consome menos da sua cota.
"Morning. The last 48 hours of Codex and ChatGPT Work have been intense! Three important updates: - Temporarily removing the 5 hour usage limit restriction for all Plus, Business and Pro plans..."
Alguns dias depois, ele reiniciou os limites novamente depois que o Codex e o ChatGPT Work ultrapassaram 8 milhões de usuários ativos, e confirmou que a janela de 5 horas continuava desativada. A palavra que faz todo o trabalho em cada uma dessas publicações é temporariamente, e vou voltar a explicar por que isso importa.

O que o limite de 5 horas realmente era
Antes de julgar a remoção, ajuda saber o que foi removido de fato. Cada nível de assinatura do Codex mede o uso em uma janela móvel de cinco horas. E o ponto crucial: suas mensagens locais (CLI e IDE) e seus chats na nuvem compartilham a mesma janela, segundo a página de preços do Codex da OpenAI. Você não tem baldes separados, então uma tarde pesada no terminal consome o mesmo orçamento que suas tarefas na nuvem.
Os limites são publicados como faixas, porque uma única mensagem pode custar quantidades muito diferentes dependendo de quanto o modelo raciocina, do tamanho do seu contexto e de quantas ferramentas ele chama. Veja como isso está hoje para mensagens locais por janela de cinco horas:
| Modelo | Plus | Pro 5x | Pro 20x | Business |
|---|---|---|---|---|
| GPT-5.6 Sol | 15–90 | 75–450 | 300–1800 | 15–90 |
| GPT-5.6 Terra | 20–110 | 100–550 | 400–2200 | 20–110 |
| GPT-5.6 Luna | 50–280 | 250–1400 | 1000–5600 | 50–280 |
| GPT-5.5 | 15–80 | 75–400 | 300–1600 | 15–80 |
| GPT-5.4 mini | 60–350 | 300–1750 | 1200–7000 | 60–350 |
Duas coisas chamam a atenção. Primeiro, um plano Plus com o Sol pode cair para apenas 15 mensagens em cinco horas em tarefas pesadas. Segundo, os limites por assento do Business são idênticos aos do Plus no papel, o que gerou sua própria polêmica (mais abaixo). Vale a pena ler toda a mecânica, incluindo como os limites de uso do Codex funcionam no app de desktop, se você vive dentro da ferramenta.
O que mudou por baixo dos panos, lá em abril, é a parte que as pessoas subestimam: o Codex passou silenciosamente de um modelo de contagem de mensagens para um medidor de tempo de raciocínio. Quanto mais o agente pensa, mais da sua janela ele consome, e é por isso que um prompt "rápido" que dispara uma cadeia de raciocínio longa pode custar uma fatia chocante das suas cinco horas.
Por que quebrou: o GPT-5.6 Sol e o pool de créditos compartilhado
Nada disso aconteceu no vácuo. O GPT-5.6 Sol ficou disponível de forma geral em 9 de julho, foi incorporado ao Codex nos dias seguintes, e as pessoas correram imediatamente para o modo de alta computação. Alta computação consome orçamento rápido, o pool compartilhado multiplicou o efeito, e a janela de cinco horas começou a colapsar em minutos para usuários intensos. Dobrar o tráfego em 48 horas faz exatamente isso.
A frustração foi real e específica. Este é o tipo de relato que os desenvolvedores estavam postando no Hacker News:
"I personally went from being able to have several sessions running concurrently without hitting limits, to only having one session at a time and hitting my 5h every day twice a day in 3-4 hours tops... It just feels ~2x to ~3x less tokens than before."
Então remover o muro de cinco horas soa menos como um presente e mais como um alívio de pressão. E aqui está o detalhe que a maior parte da cobertura perde: tirar um teto não remove os outros. O limite semanal continua ativo, e o pool de créditos que o Codex compartilha com o ChatGPT Work (e o ChatGPT for Excel) continua regendo o seu total. Tire um portão e dois continuam de pé.

Depois que você esgota os limites incluídos, o modelo de preços do Codex recorre a créditos. A própria tabela de preços da OpenAI coloca o GPT-5.6 Sol em 125 créditos por 1M de tokens de entrada e 750 por 1M de saída, e observa que o uso médio é de 5 a 40 créditos por mensagem. Usuários Plus e Pro podem comprar mais créditos para continuar, ou trazer uma chave da API da OpenAI e pagar as tarifas padrão por token. O medidor nunca desliga de verdade, ele só muda de forma.
"Temporário" é a palavra que faz o trabalho
Todo anúncio sobre isso usa a palavra temporariamente, e isso não é acidente. Não há data de término publicada. A medida nunca entrou no changelog formal, que ainda faz referência à janela de cinco horas como um mecanismo ativo. E a OpenAI já começou a perguntar aos usuários se a configuração sem limite está sequer funcionando:
"We've had no 5h limit in Codex plus and pro for a few days. Do you think it is better or are you finding it difficult to manage the usage included in the weekly limit effectively? If we were to make this different, what should it look like in an ideal world?"
Isso é uma empresa rodando um experimento ao vivo, não lançando uma política permanente. Os desenvolvedores notaram, e é por isso que agora existe uma issue aberta no GitHub pedindo que a OpenAI torne a remoção permanente. Minha leitura honesta, tendo eu mesmo lançado sistemas com limite de taxa: uma remoção temporária de limite durante um pico de lançamento é uma alavanca de gestão de demanda, e alavancas são puxadas de volta quando a conta da computação para de fechar. Planeje seu fluxo de trabalho em torno do limite semanal, não do limite de cinco horas atualmente ausente.
O que isso significa se você roda IA em trabalho real
Se você é um desenvolvedor solo mexendo em um projeto paralelo, "o muro de cinco horas sumiu por enquanto" é genuinamente uma boa notícia, aproveite o fôlego. Se você roda IA em algo do qual o negócio depende, a conclusão mais útil é sobre o modelo de precificação por trás disso.
Toda essa saga é um estudo de caso do que acontece quando o uso incluído é medido contra a computação: um lançamento de modelo que você não escolheu pode mudar silenciosamente até onde seu plano alcança, as unidades são difíceis de prever (tempo de raciocínio, créditos, faixas de tokens), e as regras mudam no meio do ciclo. Para um hobby de programação, isso é um incômodo administrável. Para uma fila de suporte respondendo milhares de clientes, custo imprevisível é um risco operacional real.
Essa é a aposta que fizemos de forma diferente na eesel, de propósito. A eesel não é uma ferramenta de programação, então não estou fingindo que ela compete com o Codex. Mas rodamos agentes de IA para helpdesk em filas de suporte reais, e deliberadamente não precificamos isso com base em uma janela de uso. Você paga por ticket que sua IA realmente resolve, ponto final.

Isso significa nenhum pool de créditos compartilhado, nenhum relógio se reiniciando contra você, e o mesmo custo, não importa se um ticket levou o modelo a um passo de raciocínio ou a vinte. É a filosofia oposta a uma janela de cinco horas, e depois de anos vendo equipes se queimarem com contas surpresa de IA, estou bastante convencido de que essa é a certa para qualquer coisa que precise rodar todos os dias.
eesel para IA que precisa ser previsível
Se sua IA está respondendo clientes em vez de escrever código, o que você quer é uma conta que não mude com a semana de lançamento de outra empresa. A eesel se conecta ao seu helpdesk existente (Zendesk, Freshdesk, Gorgias, e mais de 100 outros), aprende com seus tickets passados desde o primeiro dia, e resolve conversas de nível 1 sozinha. A Gridwise viu a ferramenta resolver 73% das solicitações de nível 1 no primeiro mês.
O preço é a parte que combina com toda essa história: US$ 0,40 por ticket resolvido, sem taxas por assento, sem mínimo, e um teto de gastos que você mesmo define para que o agente pause antes de te surpreender. Um ticket é uma tarefa, não importa quantas mensagens ele leve. Você vê exatamente o que rodou e quanto custou em uma visão de atividade clara, não em um medidor de créditos misterioso.

Você pode experimentar a eesel de graça (os primeiros US$ 50 de uso são por nossa conta, sem cartão), e se o redator de blog com IA for mais a sua praia, ele roda no mesmo modelo por tarefa. O que quer que a OpenAI decida fazer com o limite de cinco horas em seguida, pelo menos sua conta de suporte não fará parte do experimento.
Perguntas frequentes
A OpenAI realmente removeu o limite de 5 horas no GPT?
O que era o limite de 5 horas no Codex?
O GPT-5.6 Sol agora é ilimitado?
Quanto custa o Codex depois que você atinge o limite?
Quais são as melhores alternativas se os limites do Codex continuarem mudando?
Por que os limites de uso de IA mudam com tanta frequência?

Article by
Rama Adi Nugraha
Rama is a software engineer at eesel AI with two years of experience writing about B2B SaaS, AI tools, and customer support technology. Based in Bali, Indonesia, he brings a developer's perspective to product comparisons — cutting through marketing copy to what the integrations and APIs actually do.







