A OpenAI removeu o limite de 5 horas do Codex: o que realmente mudou

Rama Adi Nugraha
Escrito por

Rama Adi Nugraha

Katelin Teen
Revisado por

Katelin Teen

Última edição July 20, 2026

Verificado por especialista
Ilustração de um cronômetro que se eleva revelando uma pista livre, representando um limite de uso removido

O que a OpenAI realmente mudou em 12 de julho

A mudança veio de Thomas "Tibo" Sottiaux, que lidera o Codex na OpenAI, em uma publicação de domingo de manhã no X. Três coisas aconteceram ao mesmo tempo:

  • O limite de uso de 5 horas foi removido temporariamente para todos os planos Plus, Business e Pro.
  • Os limites de uso de todos foram reiniciados, então quem estava no meio do ciclo ganhou um fôlego novo.
  • O GPT-5.6 Sol se tornou mais eficiente, então uma determinada tarefa consome menos da sua cota.

"Morning. The last 48 hours of Codex and ChatGPT Work have been intense! Three important updates: - Temporarily removing the 5 hour usage limit restriction for all Plus, Business and Pro plans..."

Alguns dias depois, ele reiniciou os limites novamente depois que o Codex e o ChatGPT Work ultrapassaram 8 milhões de usuários ativos, e confirmou que a janela de 5 horas continuava desativada. A palavra que faz todo o trabalho em cada uma dessas publicações é temporariamente, e vou voltar a explicar por que isso importa.

Linha do tempo das mudanças no limite de uso do Codex de abril a julho de 2026
Linha do tempo das mudanças no limite de uso do Codex de abril a julho de 2026

O que o limite de 5 horas realmente era

Antes de julgar a remoção, ajuda saber o que foi removido de fato. Cada nível de assinatura do Codex mede o uso em uma janela móvel de cinco horas. E o ponto crucial: suas mensagens locais (CLI e IDE) e seus chats na nuvem compartilham a mesma janela, segundo a página de preços do Codex da OpenAI. Você não tem baldes separados, então uma tarde pesada no terminal consome o mesmo orçamento que suas tarefas na nuvem.

Os limites são publicados como faixas, porque uma única mensagem pode custar quantidades muito diferentes dependendo de quanto o modelo raciocina, do tamanho do seu contexto e de quantas ferramentas ele chama. Veja como isso está hoje para mensagens locais por janela de cinco horas:

ModeloPlusPro 5xPro 20xBusiness
GPT-5.6 Sol15–9075–450300–180015–90
GPT-5.6 Terra20–110100–550400–220020–110
GPT-5.6 Luna50–280250–14001000–560050–280
GPT-5.515–8075–400300–160015–80
GPT-5.4 mini60–350300–17501200–700060–350

Duas coisas chamam a atenção. Primeiro, um plano Plus com o Sol pode cair para apenas 15 mensagens em cinco horas em tarefas pesadas. Segundo, os limites por assento do Business são idênticos aos do Plus no papel, o que gerou sua própria polêmica (mais abaixo). Vale a pena ler toda a mecânica, incluindo como os limites de uso do Codex funcionam no app de desktop, se você vive dentro da ferramenta.

O que mudou por baixo dos panos, lá em abril, é a parte que as pessoas subestimam: o Codex passou silenciosamente de um modelo de contagem de mensagens para um medidor de tempo de raciocínio. Quanto mais o agente pensa, mais da sua janela ele consome, e é por isso que um prompt "rápido" que dispara uma cadeia de raciocínio longa pode custar uma fatia chocante das suas cinco horas.

Por que quebrou: o GPT-5.6 Sol e o pool de créditos compartilhado

Nada disso aconteceu no vácuo. O GPT-5.6 Sol ficou disponível de forma geral em 9 de julho, foi incorporado ao Codex nos dias seguintes, e as pessoas correram imediatamente para o modo de alta computação. Alta computação consome orçamento rápido, o pool compartilhado multiplicou o efeito, e a janela de cinco horas começou a colapsar em minutos para usuários intensos. Dobrar o tráfego em 48 horas faz exatamente isso.

A frustração foi real e específica. Este é o tipo de relato que os desenvolvedores estavam postando no Hacker News:

Hacker News

"I personally went from being able to have several sessions running concurrently without hitting limits, to only having one session at a time and hitting my 5h every day twice a day in 3-4 hours tops... It just feels ~2x to ~3x less tokens than before."

Então remover o muro de cinco horas soa menos como um presente e mais como um alívio de pressão. E aqui está o detalhe que a maior parte da cobertura perde: tirar um teto não remove os outros. O limite semanal continua ativo, e o pool de créditos que o Codex compartilha com o ChatGPT Work (e o ChatGPT for Excel) continua regendo o seu total. Tire um portão e dois continuam de pé.

Diagrama mostrando a janela de 5 horas removida enquanto o limite semanal e o pool de créditos compartilhado permanecem
Diagrama mostrando a janela de 5 horas removida enquanto o limite semanal e o pool de créditos compartilhado permanecem

Depois que você esgota os limites incluídos, o modelo de preços do Codex recorre a créditos. A própria tabela de preços da OpenAI coloca o GPT-5.6 Sol em 125 créditos por 1M de tokens de entrada e 750 por 1M de saída, e observa que o uso médio é de 5 a 40 créditos por mensagem. Usuários Plus e Pro podem comprar mais créditos para continuar, ou trazer uma chave da API da OpenAI e pagar as tarifas padrão por token. O medidor nunca desliga de verdade, ele só muda de forma.

"Temporário" é a palavra que faz o trabalho

Todo anúncio sobre isso usa a palavra temporariamente, e isso não é acidente. Não há data de término publicada. A medida nunca entrou no changelog formal, que ainda faz referência à janela de cinco horas como um mecanismo ativo. E a OpenAI já começou a perguntar aos usuários se a configuração sem limite está sequer funcionando:

"We've had no 5h limit in Codex plus and pro for a few days. Do you think it is better or are you finding it difficult to manage the usage included in the weekly limit effectively? If we were to make this different, what should it look like in an ideal world?"

Isso é uma empresa rodando um experimento ao vivo, não lançando uma política permanente. Os desenvolvedores notaram, e é por isso que agora existe uma issue aberta no GitHub pedindo que a OpenAI torne a remoção permanente. Minha leitura honesta, tendo eu mesmo lançado sistemas com limite de taxa: uma remoção temporária de limite durante um pico de lançamento é uma alavanca de gestão de demanda, e alavancas são puxadas de volta quando a conta da computação para de fechar. Planeje seu fluxo de trabalho em torno do limite semanal, não do limite de cinco horas atualmente ausente.

O que isso significa se você roda IA em trabalho real

Se você é um desenvolvedor solo mexendo em um projeto paralelo, "o muro de cinco horas sumiu por enquanto" é genuinamente uma boa notícia, aproveite o fôlego. Se você roda IA em algo do qual o negócio depende, a conclusão mais útil é sobre o modelo de precificação por trás disso.

Toda essa saga é um estudo de caso do que acontece quando o uso incluído é medido contra a computação: um lançamento de modelo que você não escolheu pode mudar silenciosamente até onde seu plano alcança, as unidades são difíceis de prever (tempo de raciocínio, créditos, faixas de tokens), e as regras mudam no meio do ciclo. Para um hobby de programação, isso é um incômodo administrável. Para uma fila de suporte respondendo milhares de clientes, custo imprevisível é um risco operacional real.

Essa é a aposta que fizemos de forma diferente na eesel, de propósito. A eesel não é uma ferramenta de programação, então não estou fingindo que ela compete com o Codex. Mas rodamos agentes de IA para helpdesk em filas de suporte reais, e deliberadamente não precificamos isso com base em uma janela de uso. Você paga por ticket que sua IA realmente resolve, ponto final.

Comparação entre precificação por janela de uso e precificação por resolução
Comparação entre precificação por janela de uso e precificação por resolução

Isso significa nenhum pool de créditos compartilhado, nenhum relógio se reiniciando contra você, e o mesmo custo, não importa se um ticket levou o modelo a um passo de raciocínio ou a vinte. É a filosofia oposta a uma janela de cinco horas, e depois de anos vendo equipes se queimarem com contas surpresa de IA, estou bastante convencido de que essa é a certa para qualquer coisa que precise rodar todos os dias.

eesel para IA que precisa ser previsível

Se sua IA está respondendo clientes em vez de escrever código, o que você quer é uma conta que não mude com a semana de lançamento de outra empresa. A eesel se conecta ao seu helpdesk existente (Zendesk, Freshdesk, Gorgias, e mais de 100 outros), aprende com seus tickets passados desde o primeiro dia, e resolve conversas de nível 1 sozinha. A Gridwise viu a ferramenta resolver 73% das solicitações de nível 1 no primeiro mês.

O preço é a parte que combina com toda essa história: US$ 0,40 por ticket resolvido, sem taxas por assento, sem mínimo, e um teto de gastos que você mesmo define para que o agente pause antes de te surpreender. Um ticket é uma tarefa, não importa quantas mensagens ele leve. Você vê exatamente o que rodou e quanto custou em uma visão de atividade clara, não em um medidor de créditos misterioso.

Painel de atividade da IA da eesel mostrando tickets de suporte resolvidos e pendentes
Painel de atividade da IA da eesel mostrando tickets de suporte resolvidos e pendentes

Você pode experimentar a eesel de graça (os primeiros US$ 50 de uso são por nossa conta, sem cartão), e se o redator de blog com IA for mais a sua praia, ele roda no mesmo modelo por tarefa. O que quer que a OpenAI decida fazer com o limite de cinco horas em seguida, pelo menos sua conta de suporte não fará parte do experimento.

Perguntas frequentes

A OpenAI realmente removeu o limite de 5 horas no GPT?
Em parte. Em 12 de julho de 2026, a OpenAI removeu temporariamente o limite de uso de 5 horas no Codex e no ChatGPT Work para os planos Plus, Pro e Business. A medida é descrita como temporária, sem data de término publicada, e o limite semanal separado continua valendo.
O que era o limite de 5 horas no Codex?
Era uma janela móvel de cinco horas que media quanto trabalho você podia fazer no Codex antes de precisar esperar, comprar créditos ou fazer upgrade. O uso local e o uso na nuvem compartilhavam a mesma janela, conforme explicam a documentação de preços do Codex e o detalhamento dos limites do Codex.
O GPT-5.6 Sol agora é ilimitado?
Não. Remover a janela de cinco horas não torna o GPT-5.6 Sol ilimitado. O limite semanal passa a ser o teto, e o pool de créditos compartilhado continua regendo o uso total. Você ganha mais fôlego, não uma conta em aberto.
Quanto custa o Codex depois que você atinge o limite?
O Codex vem incluído nos planos do ChatGPT (Plus US$ 20/mês, Pro a partir de US$ 100/mês). Depois de esgotar os limites incluídos, usuários Plus e Pro compram créditos, e a própria tabela de preços da OpenAI coloca o GPT-5.6 Sol em 125 créditos por 1M de tokens de entrada, com uma média de 5 a 40 créditos por mensagem. Veja nossa análise do Codex para entender os prós e contras.
Quais são as melhores alternativas se os limites do Codex continuarem mudando?
Para programação, as pessoas comparam alternativas ao Copilot e alternativas ao Codex, ou recorrem diretamente à API da OpenAI. Para automação de suporte, onde o custo precisa ser previsível, a eesel cobra por ticket resolvido, sem relógio de uso.
Por que os limites de uso de IA mudam com tanta frequência?
Porque o uso incluído é precificado com base na computação, e um novo modelo popular pode estourar o orçamento para o qual o plano foi dimensionado. Quando a demanda dispara, os fornecedores reiniciam limites ou suspendem janelas como uma solução temporária. É por isso que algumas equipes preferem o preço por resultado para tudo que roda em trabalho real, para que a conta não mude com a semana de lançamento de outra empresa.

Share this article

Rama Adi Nugraha

Article by

Rama Adi Nugraha

Rama is a software engineer at eesel AI with two years of experience writing about B2B SaaS, AI tools, and customer support technology. Based in Bali, Indonesia, he brings a developer's perspective to product comparisons — cutting through marketing copy to what the integrations and APIs actually do.

Related Posts

All posts →
Ilustração de capa da análise do ChatGPT for Work na cor turquesa do ChatGPT
Trending

Análise do ChatGPT for Work: vale a pena em 2026?

Uma análise prática do ChatGPT for Work: quanto custam os planos Business e Enterprise, o que faz o novo agente ChatGPT Work e onde ele se encaixa (e onde não se encaixa).

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 10, 2026
Ilustração do agente ChatGPT Work transformando uma meta em um documento, apresentação e planilha finalizados
Trending

O que é o ChatGPT Work? O agente de trabalho da OpenAI, explicado

O ChatGPT Work é o novo agente da OpenAI para equipes, incluído nos planos Business e Enterprise. Veja o que ele realmente faz, o emaranhado de planos e preços, e para quem ele é indicado.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 10, 2026
Banner ilustrado para o GPT-5.6 Luna, o nível de modelo mais rápido e barato da OpenAI, com uma lua crescente e um motivo de velocidade
Trending

GPT-5.6 Luna: o nível mais rápido e barato da OpenAI, explicado

GPT-5.6 Luna é o nível mais rápido e barato da nova família de modelos da OpenAI, a $1/$6 por 1M de tokens. Veja o que ele faz, quanto custa e onde você pode usá-lo.

Alicia Kirana UtomoAlicia Kirana UtomoJul 10, 2026
Texto alternativo da imagem
Guides

OpenAI Frontier vs Claude Cowork: Um guia completo

Uma nova era da IA chegou, mudando o foco de funcionalidades para infraestrutura. Este post compara o OpenAI Frontier e o Claude Cowork, explorando suas diferentes abordagens para o trabalho impulsionado por IA, usuários-alvo e as implicações econômicas para a indústria de SaaS.

Riellvriany IndriawanRiellvriany IndriawanFeb 6, 2026
Ilustração de três níveis crescentes de planos do ChatGPT, do individual à equipe e ao empresarial, com pessoas comparando-os
Trending

Preços do ChatGPT for Work: custo do Business e Enterprise (2026)

O ChatGPT for Work custa entre $20 e $25 por usuário no plano Business, e tem preço personalizado no Enterprise. Veja aqui o detalhamento completo de custos, os extras ocultos e para quem é cada plano.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 13, 2026
Banner ilustrado de destaque para uma seleção das melhores alternativas ao ChatGPT for Work
Trending

As 8 melhores alternativas ao ChatGPT for Work em 2026

Um olhar prático sobre as melhores alternativas ao ChatGPT for Work em 2026, do Claude e do Gemini às ferramentas específicas de suporte que um assistente geral não consegue substituir.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 13, 2026
Banner de capa das alternativas ao PromptQL sobre um fundo índigo
Trending

As 8 melhores alternativas ao PromptQL em 2026

As 8 melhores alternativas ao PromptQL em 2026, do Databricks Genie ao projeto open source Wren AI, com preços reais, pontos fortes e para quem cada uma realmente serve.

Rama Adi NugrahaRama Adi NugrahaJul 10, 2026
Banner de capa o que é PromptQL com o logotipo do PromptQL sobre um fundo índigo
Trending

O que é PromptQL? O agente de dados de IA da Hasura, explicado

O que é PromptQL? Uma explicação clara do agente de dados de IA da Hasura: a ideia de planejar e depois executar, com o que ele se conecta, quanto custa e para quem é indicado.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 10, 2026
Banner principal da análise do PromptQL com o logo do PromptQL sobre um fundo índigo
Trending

Análise do PromptQL (2026): o agente de dados da Hasura, testado

Uma análise prática do PromptQL: como o agente de dados da Hasura separa planejamento de execução, quanto custa e se a promessa de confiabilidade se sustenta.

Alicia Kirana UtomoAlicia Kirana UtomoJul 10, 2026

Pronto para contratar seu colega de IA?

Configure em minutos. Sem cartão de crédito necessário.

Comece grátis