Atingiu o limite do Codex?
Confira a renovação da cota e escolha como continuar.
Se o Codex mostra “usage limit reached”, consulte sua cota e o horário de renovação antes de pagar. No uso pela assinatura do ChatGPT, você pode esperar a renovação do limite relevante, comprar créditos extras se a conta permitir ou avaliar um plano maior. Para tarefas locais compatíveis, também é possível usar uma chave de API com cobrança separada.
Primeiro, descubra o que interrompeu o trabalho. Limite da assinatura, excesso de requisições à API e saldo de API esgotado pedem soluções diferentes. Adicionar uma chave não recarrega a cota do ChatGPT nem libera acesso ao Codex cloud.
Verificado em 27 de setembro de 2026. Este guia usa a documentação atual da OpenAI e o catálogo público da OmniaKey. Não esgotamos uma conta paga nem fizemos um teste de troca com uso cobrado. O custo apresentado é um cálculo; os limites e horários válidos são os da sua conta.
Identifique qual limite você atingiu
Veja o método de login e leia a mensagem completa. Avisos de assinatura pertencem à conta do ChatGPT. Erros de API pertencem à organização, ao projeto ou ao gateway que atende à requisição.
| O que aparece | O que conferir | Próximo passo |
|---|---|---|
| Limite de uso com login pelo ChatGPT | Cota disponível e horário indicado | Esperar, usar créditos extras elegíveis ou comparar planos |
| API 429 por requisições demais | Código, taxa de requisições/tokens, Retry-After | Reduzir concorrência e respeitar a espera |
| Saldo de API ou limite de gastos | Saldo e restrições do provedor selecionado | Recarregar o saldo correto ou revisar o limite com o responsável |
| 401, modelo não encontrado ou acesso negado | Chave, provedor, ID exato do modelo e permissões | Corrigir a configuração ou o acesso |
O HTTP 429, sozinho, não identifica a causa. O guia de erros da OpenAI também usa 429 para credit_balance_exhausted e project_spend_limit_exceeded; o tipo geral pode continuar sendo insufficient_quota. Repetir a chamada não repõe saldo. Gateways podem adotar outros nomes: confira a resposta real.
Para um limite de velocidade, siga Retry-After quando ele existir. Caso contrário, use recuo exponencial com variação aleatória e limite o número de tentativas. A OpenAI informa que requisições malsucedidas também podem contar para o limite por minuto, então insistir sem pausa pode piorar a recuperação.
Como consultar a cota e o reset do Codex
Se você usa a assinatura, abra o painel de uso do Codex na conta e no workspace usados para programar. Em uma sessão ativa da CLI, digite:
/status
A página oficial de preços documenta as duas opções. Para verificar o método de autenticação salvo pela CLI, execute:
codex login status
Com um provedor personalizado, confira também o model_provider, o modelo e a URL efetivos. Ter um login do ChatGPT salvo não prova que uma requisição específica foi cobrada na assinatura. Para uma rota API, confirme a cobrança no histórico do respectivo provedor.
Limite de cinco horas e limite semanal
A OpenAI publica faixas estimadas de mensagens locais por período de cinco horas e informa que limites semanais também podem se aplicar. Mensagens locais e tarefas na nuvem compartilham a cota do plano. Não é um número fixo de mensagens por dia: modelo, complexidade, contexto acumulado, raciocínio e ferramentas mudam o consumo.
Confira cada horário separadamente. A renovação de uma janela curta não garante a renovação de outra cota semanal. A documentação usada aqui não define um reset universal “toda segunda-feira à meia-noite”.
Ao pesquisar “limite de uso semanal Codex” ou “Codex limit reset”, prefira o horário mostrado para a sua conta. O contador em uma captura de outro usuário não determina o seu. Dez mensagens curtas também não equivalem a dez etapas de uma migração extensa.
O que fazer quando a cota acaba
Escolha conforme a urgência e os recursos de que a tarefa depende.
| Opção | Quando faz sentido | O que comparar |
|---|---|---|
| Esperar a renovação | O trabalho pode parar até o horário indicado | Se acabou a janela curta, a semanal ou ambas |
| Comprar créditos do ChatGPT | Você quer manter o fluxo atual e a conta é elegível | Condições de compra e consumo exibidas na conta |
| Mudar de assinatura | O uso intenso é frequente e os recursos extras são úteis | Custo recorrente, uso incluído e requisitos do workspace |
| Usar API localmente | Você quer pagar por consumo em um cliente compatível | Tarifas, limites, suporte a recursos e orçamento separado |
Atualmente, a OpenAI informa que usuários Plus e Pro podem comprar créditos extras após atingir o limite. Workspaces Business, Edu e Enterprise elegíveis com preços flexíveis também podem comprar créditos. Confira o que está disponível na sua conta antes de contar com essa possibilidade.
A mesma página diz que um turno já em execução pode continuar após atingir o limite, sujeito às regras de uso justo. Isso não autoriza novos turnos sem limite. Se o agente ainda estiver trabalhando, revise e salve as alterações antes de reiniciar o cliente ou mudar a cobrança.
Créditos extras podem ser simples para um pico ocasional. Uma assinatura maior pode compensar quando o uso alto é constante. A API ajuda a separar o orçamento de tarefas locais, mas não é necessariamente a alternativa mais barata para qualquer trabalho.
API key no Codex ou login do ChatGPT: quem cobra?
A documentação de autenticação diferencia o acesso por assinatura via ChatGPT do acesso por uso via chave API. CLI e extensão de IDE aceitam ambos no trabalho local. Codex cloud exige login com ChatGPT.
Mantenha estas três cobranças separadas:
- Assinatura e créditos extras do ChatGPT: seguem as regras da conta ou do workspace elegível.
- API direta da OpenAI: cobra da organização e do projeto vinculados à chave.
- Provedor personalizado OmniaKey: cobra as requisições compatíveis da chave e do saldo da OmniaKey, pelas tarifas atuais.
Plus não torna gratuito um endpoint API configurado à parte. Uma recarga na OmniaKey não renova a cota do ChatGPT. Use a chave OmniaKey na configuração do próprio provedor, não no campo de uma chave direta da OpenAI.
Para comparar os fluxos completos, veja Claude Code vs Codex. Aqui o foco é a decisão depois de atingir um limite.
Um perfil OmniaKey separado para a CLI
Confira a versão com codex --version. No Codex CLI 0.134.0 ou superior, os perfis nomeados ficam em arquivos separados. Preserve a configuração principal e crie, ou mescle com cuidado, ~/.codex/omniakey.config.toml:
model = "gpt-6-sol"
model_provider = "omniakey"
[model_providers.omniakey]
name = "OmniaKey"
base_url = "https://api.omniakey.com/v1"
env_key = "OMNIAKEY_API_KEY"
wire_api = "responses"
requires_openai_auth = false
Defina OMNIAKEY_API_KEY com sua chave OmniaKey no terminal local que iniciará o processo. Comece com uma pequena tarefa nova:
codex --profile omniakey
A documentação atual de perfis explica que, a partir de 0.134.0, --profile não lê mais as antigas tabelas [profiles.name] do config.toml principal. Em uma CLI anterior, atualize ou siga a documentação correspondente.
Não é preciso apagar as credenciais do ChatGPT. Verifique se a sessão selecionou OmniaKey e gpt-6-sol, e confirme a primeira chamada no histórico da OmniaKey antes de começar uma tarefa grande. Políticas do workspace, configurações do projeto e opções da linha de comando podem alterar o resultado efetivo.
Não combine essa autenticação por variável de ambiente com requires_openai_auth = true: segundo a documentação, isso faz o Codex ignorar env_key. O passo a passo está no guia do Codex CLI. Confira o ID no catálogo atual de modelos.
Como calcular o custo da API
Some os tokens reais de todas as chamadas, incluindo o contexto repetido. Uma mensagem do usuário pode gerar diversas requisições para ler arquivos, executar ferramentas, tentar novamente e continuar.
Em 27 de setembro de 2026, a página do GPT-6 Sol publica para a OmniaKey $0.225 por milhão de tokens de entrada e $1.35 por milhão de saída. Para 100.000 tokens de entrada sem cache e 10.000 tokens de saída faturáveis:
(100,000 / 1,000,000 × $0.225)
+ (10,000 / 1,000,000 × $1.35)
= $0.036 USD
São US$ 0,036 calculados com a tarifa publicada do gateway, não o custo medido de uma tarefa concluída nem o preço de uma assinatura OpenAI. Leituras de cache têm outra tarifa. Acrescente outros tokens faturáveis, novas tentativas e ferramentas cobradas separadamente, quando aplicável, e reconfira os valores antes de planejar o gasto.
Ao comparar com créditos do ChatGPT, meça trabalho equivalente em cada sistema. Não converta uma estimativa de mensagens da assinatura em uma cota fixa de tokens. Comece com pouco orçamento e compare alterações aprovadas, incluindo o tempo de correção.
Veja também GPT-6 Sol vs Luna e os preços atuais. Um modelo mais barato por token pode precisar de mais tentativas em uma tarefa difícil.
Perguntas frequentes
Reiniciar o Codex renova o limite?
Reiniciar, por si só, não repõe uma cota controlada pelo servidor. Confira primeiro o painel. Se o cliente parecer desatualizado depois do horário exibido, confirme a conta e atualize o status antes de mudar a cobrança.
Dá para continuar depois do limite semanal?
Veja se a conta oferece créditos extras. A API com cobrança separada é outra opção para trabalho local compatível. Nenhuma das duas significa que a cota semanal foi renovada, e uma chave API não adiciona direitos de cloud.
Por que o limite acabou com poucas mensagens?
Mensagens visíveis não representam todo o trabalho. Contexto longo, resultados de ferramentas, raciocínio e turnos sucessivos consomem recursos. A OpenAI também informa que configurações de velocidade e geração de imagens podem gastar a cota mais rápido. Delimite a tarefa e os arquivos antes de escolher um modelo menor.
Coloquei uma chave API e continuo vendo um limite
Confira o provedor selecionado, perfil, variável de ambiente e opções de prioridade maior. Depois leia o erro: a API pode ter restrições próprias de velocidade, saldo, projeto ou organização. Para erros de modelo indisponível, use o guia de compatibilidade do Codex.
API significa Codex ilimitado?
Não. O uso é medido e depende de limites do provedor, saldo, acesso aos modelos e controles aplicáveis do workspace. É uma cobrança separada para tarefas locais, sem promessa de capacidade ilimitada ou de todos os recursos do ChatGPT.