5 pontos por GN⁺ 1 일 전 | 1 comentários | Compartilhar no WhatsApp
  • Um site que acompanha os anúncios no X de @thsottiaux e registra os momentos de redefinição dos limites de uso do Codex; a última redefinição atual foi há 2 dias
  • Até agora, contabilizou 35 redefinições, com intervalo médio de espera de 8,9 dias e maior hiato de 67,7 dias
  • As redefinições acontecem não só para compensar falhas, atrasos e erros no cálculo de limites, mas também para incentivar o crescimento de usuários, lançamentos de produtos, datas comemorativas e o uso de novos recursos
  • Algumas redefinições restauram para 100% os limites semanais e por hora dos planos pagos, e também oferecem uma redefinição armazenada (banked reset) que pode ser aplicada quando o usuário quiser
  • Com o crescimento do Codex e do ChatGPT Work, as redefinições ficaram mais frequentes; anúncios recentes também mencionam a marca de 7 milhões, 8 milhões e 9 milhões de usuários ativos e o processo de expansão da infraestrutura

Histórico e métricas das redefinições

  • Codex Resets coleta anúncios de redefinição de limites de uso do Codex a partir do feed no X de @thsottiaux
  • Preserva os intervalos entre redefinições e os anúncios originais das últimas 26 semanas
  • O panorama agregado é o seguinte
    • Total acumulado de 35 redefinições
    • Tempo médio de espera de 8,9 dias
    • Maior hiato entre redefinições de 67,7 dias
    • A última redefinição foi há 2 dias

Redefinições impulsionadas pelo crescimento do Codex e do ChatGPT Work

  • Com o rápido aumento de usuários ativos, foram realizadas redefinições em sequência
    • Ao atingir 7 milhões de usuários ativos, foi adicionada uma redefinição armazenada a todas as contas, permitindo repor o uso semanal pelo app desktop ou pela web
    • Ao atingir 8 milhões de usuários ativos, todos os limites foram redefinidos novamente, sem aplicar o limite de velocidade de 5 horas
    • No dia em que atingiu 9 milhões de usuários ativos, também houve uma redefinição, com a informação de que trabalhos para manter a estabilidade e a confiabilidade do sistema estavam em andamento
  • Várias redefinições foram feitas para todos os usuários pagos do Codex e do ChatGPT Work, e em alguns casos foi informado que entrariam em vigor em 30 minutos a 1 hora
  • Em meio a um crescimento de tráfego sem precedentes, também houve caso de uma redefinição seguida do aviso de uma redefinição adicional no mesmo dia

Introdução e escopo das redefinições armazenadas

  • A redefinição armazenada não é aplicada obrigatoriamente de imediato; ela fica guardada na conta para o usuário repor o uso semanal no momento que quiser
  • Inicialmente, só podia ser usada no app desktop, mas depois foi expandida para web e mobile
  • Em um anúncio que adicionou redefinições armazenadas para 500 mil usuários do ChatGPT Work e do Codex, foi informado que houve um problema relacionado a menos de 10% das pessoas que as usaram
  • Alguns anúncios restauram imediatamente todos os limites e também concedem uma redefinição armazenada adicional que pode ser usada nas 24 horas seguintes
  • Quando usuários já haviam acumulado o máximo de 3 redefinições armazenadas, às vezes foi aplicada uma redefinição forçada (hard reset) separada do saldo armazenado
  • Também há casos de redefinição dupla (double reset), oferecendo ao mesmo tempo uma redefinição completa e uma redefinição armazenada de uso livre

Compensação por falhas e problemas de desempenho

  • Após três pequenos incidentes em 24 horas que afetaram a confiabilidade do Codex, os limites de uso de todos os planos pagos foram redefinidos e medidas para evitar recorrência foram iniciadas
  • Depois de mitigar um incidente que durou cerca de 10 minutos e confirmar a recuperação, foi anunciada uma redefinição
    • O Codex ajudou no trabalho de recuperação, mas a pista final para a solução foi encontrada por uma pessoa
  • Após resolver outra falha e observar várias horas de funcionamento estável, o limite de velocidade foi redefinido; em um caso separado, quando o serviço voltou a se estabilizar, o botão de redefinição também foi aplicado
  • Um problema em que solicitações eram classificadas incorretamente como alto risco cibernético e então bloqueadas ou recusadas foi corrigido em cerca de 8 minutos; após a recuperação do serviço, os limites foram redefinidos
  • Em um caso em que uma pequena falha de 45 minutos se tornou uma falha global nos últimos 30 minutos, o limite de velocidade foi redefinido após a recuperação
  • Para compensar latência anormalmente alta nos EUA ou regiões próximas, os limites de todos os usuários do Codex foram redefinidos, e o uso do GPT-5.1-Codex-Max também foi recomendado
  • Para compensar lentidão ocorrida enquanto GPUs adicionais eram preparadas, o limite do gpt-5-codex foi redefinido, com a informação de que a capacidade seria ampliada durante toda a semana
  • Também houve caso em que, enquanto a causa raiz era resolvida, a redefinição dos limites para todos os usuários foi usada como mitigação mais rápida, com previsão de refletir em cerca de 10 minutos

Problemas de cálculo de uso e esgotamento de limites

  • Uma otimização aplicada à compactação de sessões longas afetou a taxa de acerto de cache, fazendo os limites se esgotarem mais rápido que o esperado; após reverter a mudança, os limites de todas as contas foram redefinidos
  • Em um caso em que relatos de consumo mais rápido que o esperado do uso do Codex foram investigados, mas sem encontrar uma causa central única, houve compensação com uma redefinição geral e uma redefinição armazenada adicional
  • Mesmo sem evidências de impacto amplo, após receber relatos suficientes, o limite de velocidade de assinantes Plus e Pro foi redefinido, com a investigação a ser concluída em 1 a 3 dias
  • Em outra investigação, também não foi confirmado impacto em larga escala sobre usuários, mas medidas de mitigação foram aplicadas, uma redefinição gratuita foi oferecida a todos os usuários do Codex e o monitoramento continuou
  • Como o painel mostrava aumento na proporção de usuários chegando ao limite, mas a causa não havia sido totalmente identificada, os limites de todos os planos foram redefinidos preventivamente
  • Um erro em que o limite promocional de 2x não era aplicado a cerca de 9% dos usuários Plus e Pro foi corrigido e, como compensação, o limite de velocidade de todos os usuários desses planos foi redefinido
  • Ao reescrever o sistema-base de rastreamento de uso e cobrança do Codex, os limites foram redefinidos; em vez de repor uso passado, foi concedido uso gratuito

Lançamentos de planos e produtos e eventos comemorativos

  • Os limites do Codex de todos os assinantes pagos do ChatGPT foram redefinidos, restaurando os limites semanais e por hora para 100%
  • Para comemorar os resultados da semana e permitir que mais desenvolvimento fosse feito com GPT-5.5, uma redefinição foi oferecida a todos os planos pagos
  • No 1º aniversário do Codex, foi permitido que o próprio Codex redefinisse os limites de velocidade de todos os planos
  • Com o lançamento do novo plano de US$ 100, foi oferecido uso do Codex e também foi realizada a redefinição de limites anunciada no dia anterior
  • Quando o número de usuários semanais do Codex subiu de 2 milhões para 3 milhões em menos de um mês, o limite de velocidade foi redefinido em comemoração
  • Os limites de todos os planos foram redefinidos para permitir testar um novo plugin
  • No fim do ano, o limite de velocidade foi redefinido e o dobro do limite de uso habitual foi aplicado até 1º de janeiro
  • Também houve vários anúncios de redefinição dos limites de uso de todos os planos pagos simplesmente por causa do fim de semana

Como as redefinições são operadas

  • As redefinições são usadas não só como compensação por incidentes, mas também para crescimento de usuários, lançamentos de produtos, experimentos com novos recursos, datas comemorativas e eventos de fim de semana
  • O escopo varia conforme a situação: todos os usuários do Codex, todos os planos pagos, todos os assinantes pagos do ChatGPT, Plus e Pro, ou usuários do Codex e do ChatGPT Work
  • O momento de aplicação também varia por anúncio: de aplicação imediata a até 10 minutos, 30 minutos, 1 hora ou várias horas depois
  • Embora os anúncios digam que redefinições têm custo, os limites são restaurados repetidamente para compensar problemas de estabilidade e permitir que usuários desenvolvam mais

1 comentários

 
GN⁺ 1 일 전
Opiniões no Hacker News
  • É parecido com rodadas grátis de caça-níquel. Um amigo ficou tão obcecado em gastar todo o uso do Fable que acaba hoje que está fazendo um monte de tarefas de utilidade duvidosa só porque o recurso parece escasso

    • Metade dos projetos feitos com IA me passa essa sensação. Meus colegas gerenciam a infraestrutura doméstica com OpenClaw e uma equipe inteira de agentes, mas não entendo para que isso serve numa casa que já é automatizada com Home Assistant. Fora do trabalho, quase nunca sinto necessidade de usar IA
    • A própria IA é como um caça-níquel, e eu não ficaria surpreso se isso fosse um grande fator de psicose. Você puxa a alavanca com um prompt, fica vendo a tela girar e, muito de vez em quando, as moedas caem
    • Parece que entramos na etapa de gamificação para incentivar o uso do produto
    • No começo desta semana foi anunciado o Permafable, mas a sensação de caça-níquel é clara
  • A eliminação das redefinições e do limite de uso de 5 horas elevou muito, sem que eu percebesse, minha linha de base de uso. Já não economizo mais e inicio vários agentes no ritmo que quero, porque pelo menos na semana passada continuaram oferecendo redefinições extras
    Preocupa-me que, se um dia as redefinições pararem, meu fluxo de trabalho normal passe de repente a estourar o limite, e até migrar para um plano superior pareça um retrocesso

    • Essas redefinições são oferecidas por causa da concorrência com rivais. Depois que vencerem no mercado, vão extrair o máximo de dinheiro possível
    • Tenho dúvidas se foi mesmo “silenciosamente”
  • É impressionante ver redefinições oferecidas com tanta frequência. Claude Code e Grok Build também redefinem, mas não nesse nível; paradoxalmente, o Antigravity do Google, uma big tech com infraestrutura abundante, nunca fez isso pelo que vi. Fico curioso para saber qual é o custo das redefinições que a OpenAI assume

    • Algumas redefinições foram uma forma de acalmar os clientes depois que um bug no lançamento da 5.6 fez usuários de subagentes consumirem tokens em excesso
      Ainda assim, é impressionante que eles tenham capacidade para absorver isso
    • A OpenAI consegue fazer isso com frequência porque tem recursos computacionais suficientes, e essa folga também se deve ao fato de estar muito atrás da Anthropic em grandes clientes corporativos. Dizem que, após o lançamento da 5.6, os usuários aumentaram em milhões, então o crescimento é forte, mas resta ver se eles ficarão
      Pessoalmente, já vi a ferramenta tentar uma operação muito perigosa quando eu não estava olhando, então não a uso mais para coisas importantes; e conhecidos meus também passaram do período de lua de mel inicial e esfriaram
  • 7 milhões há 5 dias, 8 milhões há 4 dias, 9 milhões há 3 dias: é um crescimento impressionante

    • Como o app existente do ChatGPT para macOS foi transformado em Codex, usuários “novos” do Codex podem ser simplesmente pessoas que atualizaram o app do ChatGPT
    • Essa oferta generosa parece possivelmente um evento para inflar uma narrativa de crescimento para o IPO. É melhor aproveitar ao máximo o subsídio de IA enquanto der
    • Fico curioso para saber como eles medem o número de usuários. Será que contam uma pessoa a cada atualização do app do ChatGPT?
    • Como qualquer startup, devem contabilizar usuários de um jeito extremamente absurdo. Se uma pessoa usa em dois computadores e no celular, é bem possível que contem como 3 usuários
      Growth hackers e a indústria de otimização para mecanismos de busca tornaram o mundo difícil de aguentar, e a guerra psicológica do OpenClaw, sem nenhum resultado, agora ficou irrelevante, mas reconheço que foi uma bobagem criativa
    • É um growth hack inteligente: juntar o app do ChatGPT e o app do Codex em um único super app
  • Considerando até as redefinições acumuladas, o valor pelo preço agora é enorme. Minha empresa usa Claude Enterprise pelo preço de API e já gastou 10 mil dólares este mês; quando possível, usamos agentes Opus 4.8 e Sonnet 5
    No Codex Pro, rodo 5.6 Sol todos os dias e às vezes uso o modo ultra, então, convertido para uso real de API, deve ser algo insustentável

    • O preço da API pode incluir uma margem enorme em relação ao custo real. Nos meus testes, no Pro 20x de 200 dólares por mês, usando apenas GPT 5.6 Sol, eles oferecem por semana cerca de 2.200 dólares em uso de API, ou seja, 9 mil a 10 mil dólares por mês, embora varie um pouco conforme o custo de cache
      Os planos de 100 e 200 dólares da Anthropic têm uma diferença de 2x no limite semanal, mas a diferença no limite de 5 horas é maior. Já o Pro 20x da OpenAI custa 2x mais que o Pro 5x, mas oferece 4x mais uso, e todo o limite semanal do Codex numa conta Plus de 20 dólares corresponde a apenas 5% do limite do Pro 20x
      As redefinições acumuladas desaparecem 30 dias após serem concedidas, então é possível maximizar o uso extra gastando deliberadamente toda a cota antes de usá-las
    • Fico curioso para saber como vocês usam tanto. Minha empresa também usa o plano Claude Enterprise, mas, com limite mensal de 800 dólares, mesmo usando Opus para todas as tarefas, só chegamos perto do limite no fim do mês. É difícil imaginar usar 12 vezes mais tokens sem desperdiçar dinheiro de propósito
    • Fico curioso se, para empresas acima de certo porte, a Anthropic força o plano Enterprise, ou se vocês escolheram voluntariamente por causa dos recursos corporativos. Rodando o dia inteiro 2 ou 3 instâncias do VS Code com Opus 4.8 Max em assentos Premium Team, não chego ao limite
    • É interessante ver todo mundo tratando o preço da API como se fosse o custo real. A API provavelmente gera uma margem alta, e, mesmo que os planos de assinatura deem um pequeno prejuízo, acostumar usuários individuais aos modelos GPT para que os recomendem no trabalho pode render muito dinheiro
      Na média de todos os assinantes, a maior parte do uso da assinatura provavelmente também fica sobrando. Alguns clientes que consomem 100% toda semana obtêm um benefício enorme, mas a maioria usa bem menos
      O jogo das redefinições, que cria a pressão de usar o máximo possível antes da próxima redefinição imprevisível, é um mecanismo para deixar usuários centrais ainda mais viciados no produto
    • É uma pena eu não ter usado nenhuma das 4 redefinições expiradas, mas, de todo modo, todo o uso foi redefinido de novo. Estou tocando sem freio, com 5.6-Sol-ultra, um projeto que normalmente não faria: uma grande edição do romance de outra pessoa e adição de ilustrações
  • Aprendi da forma difícil que, quando o ciclo semanal começa, o Codex remove as redefinições que você tinha

  • Gosto disso, parece dois pais competindo para ver quem dá mais presentes ao filho. É como ter dois Natais

    • A Anthropic não dá tantos presentes
  • A Anthropic redefine de forma consistente entre quinta e sexta-feira, então é um pouco desfavorável para usuários cuja redefinição original já cai nesse período

    • Se a Anthropic também dá redefinições grátis, talvez agora a melhor relação custo-benefício seja usar duas assinaturas de 20 dólares por mês ao mesmo tempo
  • Seria bom se houvesse um endpoint oficial de API para verificar programaticamente o uso do Codex e o horário de redefinição da cota. Assim, daria para criar com vibe coding um app que avise quando o uso voltar a 100%, indicando que a OpenAI redefiniu, ou quando restar 10% do uso de 5 horas.
    Hoje é preciso usar o Codex App Server de forma indireta, o que não é ideal.

    • O horário de redefinição da cota pode ser verificado neste endpoint. Ao enviar uma requisição GET usando o token de autenticação local do Codex como Bearer token, a resposta inclui available_count e credits[].expires_at.
      https://chatgpt.com/backend-api/wham/rate-limit-reset-credit...
    • Basta usar o CodexBar.
      https://github.com/steipete/CodexBar
    • Atualmente o limite de 5 horas desapareceu, então não há necessidade de rastreá-lo. Para o restante, dá para pedir uma vez ao Codex para criar um código em Python que retorne o uso restante, a próxima data e hora de redefinição etc.
      O resultado usa o Codex App Server, mas como é um processo de curta duração que se comunica via stdio, é razoavelmente aceitável.
    • Deixo esta página nos favoritos e a consulto com frequência.
      https://chatgpt.com/codex/cloud/settings/analytics
    • Parece que a primeira parte pode ser verificada nesse site. Talvez eles também forneçam uma API de notificações.
  • É um site útil. Gosto da redefinição e ainda tenho 3 redefinições não usadas, então continuo usando 5.6 Sol Fast mode a 1 bilhão de tokens por dia.
    No entanto, ao removerem o limite de 5 horas, confirmei no Codex que eles reduziram silenciosamente o contexto do 5.6 Sol de 354k para cerca de 258k.

    • Há alguns tweets relacionados, então não foi uma mudança totalmente silenciosa. Parece que é possível voltar ao tamanho original definindo model_context_window=YOUR_VALUE em ~/.codex/config.toml.