Codex-Limit erreicht: Was tun?
Prüfe den Reset und wähle, wie du weiterarbeitest.
Wenn Codex „usage limit reached“ meldet, prüfe zuerst dein Kontingent und den angezeigten Reset-Zeitpunkt. Bei Nutzung über ein ChatGPT-Abo kannst du auf die Erneuerung warten, bei entsprechender Berechtigung zusätzliches Guthaben kaufen oder einen größeren Tarif prüfen. Für unterstützte lokale Aufgaben kommt auch ein separat abgerechneter API-Schlüssel infrage.
Entscheidend ist die Ursache: Ein Abo-Limit, zu viele API-Anfragen und ein aufgebrauchtes API-Guthaben verlangen unterschiedliche Schritte. Ein zusätzlicher Schlüssel füllt dein Abo-Kontingent nicht auf und schaltet Codex cloud nicht frei.
Stand: 27. September 2026. Grundlage sind aktuelle OpenAI-Dokumentation und der öffentliche OmniaKey-Katalog. Wir haben kein bezahltes Konto bis zum Limit belastet und keinen kostenpflichtigen Wechseltest durchgeführt. Das Kostenbeispiel ist eine Rechnung; für dein Kontingent gelten die Angaben in deinem Konto.
Welches Codex-Limit hast du erreicht?
Prüfe die Anmeldung und die vollständige Fehlermeldung. Ein Abo-Hinweis gehört zum angemeldeten ChatGPT-Konto. API-Fehler betreffen die Organisation, das Projekt oder den Gateway, der die Anfrage bearbeitet.
| Meldung | Was du prüfen solltest | Nächster Schritt |
|---|---|---|
| Nutzungslimit bei ChatGPT-Anmeldung | Restkontingent und angezeigter Reset | Warten, berechtigtes Zusatzguthaben nutzen oder Tarife vergleichen |
| API 429 wegen zu vieler Anfragen | Fehlercode, Anfrage-/Token-Rate, Retry-After | Parallelität senken und Wartezeit einhalten |
| API-Guthaben oder Ausgabenlimit erschöpft | Guthaben und Limits beim gewählten Anbieter | Passendes Guthaben auffüllen oder Limit mit dem Verantwortlichen prüfen |
| 401, Modell nicht gefunden, fehlender Zugriff | Schlüssel, Anbieter, genaue Modell-ID, Berechtigungen | Konfiguration oder Zugriff korrigieren |
HTTP 429 allein erklärt die Ursache nicht. OpenAIs Fehlerdokumentation verwendet 429 auch für credit_balance_exhausted und project_spend_limit_exceeded. Der übergeordnete Typ kann weiterhin insufficient_quota sein. Wiederholte Anfragen ersetzen kein Guthaben. Gateways können andere Fehlernamen verwenden; lies die tatsächliche Antwort.
Bei einer Ratenbegrenzung gilt zunächst Retry-After, sofern vorhanden. Andernfalls helfen exponentiell längere Wartezeiten mit zufälliger Streuung und einer begrenzten Anzahl an Versuchen. Laut OpenAI können auch fehlgeschlagene Anfragen zum Minutenlimit beitragen. Sofortige Wiederholungen können die Erholung erschweren.
Codex-Nutzung und Reset-Zeit anzeigen
Für die Nutzung über ChatGPT öffnest du das Codex-Nutzungsdashboard im richtigen Konto und Workspace. In einer laufenden CLI-Sitzung kannst du Folgendes eingeben:
/status
Die offizielle Preisseite nennt beide Wege. Die gespeicherte Authentifizierung der CLI lässt sich so prüfen:
codex login status
Bei einem eigenen Anbieter prüfst du zusätzlich den tatsächlich ausgewählten model_provider, das Modell und die API-URL. Gespeicherte ChatGPT-Zugangsdaten beweisen nicht, dass eine bestimmte Anfrage über das Abo abgerechnet wird. API-Kosten solltest du im Nutzungsverlauf des jeweiligen Anbieters abgleichen.
Fünf-Stunden-Limit und Wochenlimit getrennt betrachten
OpenAI veröffentlicht geschätzte Bereiche lokaler Nachrichten pro Fünf-Stunden-Zeitraum und weist auf mögliche zusätzliche Wochenlimits hin. Lokale Nachrichten und Cloud-Aufgaben teilen das Kontingent deines Tarifs. Das sind keine festen täglichen Nachrichtenzahlen: Modell, Aufgabenumfang, angesammelter Kontext, Reasoning und Werkzeuge beeinflussen den Verbrauch.
Prüfe den Reset jeder betroffenen Grenze. Wenn sich das kurze Zeitfenster erneuert, muss ein separates Wochenkontingent noch nicht wieder verfügbar sein. Die hier verwendete Dokumentation nennt keinen allgemeinen Reset „montags um Mitternacht“.
Bei der Suche nach „Codex Limit zurücksetzen“ ist der Zeitpunkt in deinem eigenen Konto maßgeblich. Ein Countdown aus einem fremden Screenshot gilt nicht automatisch für dich. Zehn kurze Fragen und zehn Schritte einer umfangreichen Migration können sehr unterschiedlich viel verbrauchen.
Was tun, wenn das Kontingent aufgebraucht ist?
Wähle danach, wie dringend es weitergehen muss und ob deine Arbeit Cloud-Funktionen benötigt.
| Möglichkeit | Passt, wenn … | Vorher vergleichen |
|---|---|---|
| Auf Reset warten | die Arbeit bis zur angezeigten Zeit pausieren kann | Kurzes Limit, Wochenlimit oder beide betroffen? |
| ChatGPT-Guthaben zukaufen | du im bisherigen Ablauf bleiben möchtest und berechtigt bist | Kaufbedingungen und Verbrauchsraten deines Kontos |
| Abo wechseln | hohe Nutzung regelmäßig anfällt und Zusatzfunktionen passen | Laufende Kosten, enthaltene Nutzung, Workspace-Anforderungen |
| API lokal nutzen | du Modellnutzung in einem kompatiblen Client einzeln bezahlen möchtest | Preise, Ratenlimits, Funktionen und separates Budget |
OpenAI erklärt derzeit, dass Plus- und Pro-Nutzer nach Erreichen des Limits zusätzliche Credits kaufen können. Berechtigte Business-, Edu- und Enterprise-Workspaces mit flexibler Preisgestaltung können Workspace-Guthaben zukaufen. Prüfe die tatsächlich angebotenen Optionen in deinem Konto.
Die Seite sagt außerdem: Wird das Limit während eines laufenden Turns erreicht, kann dieser innerhalb der Fair-Use-Grenzen weiterlaufen. Das bedeutet keine unbegrenzte Zahl neuer Turns. Wenn der Agent noch arbeitet, prüfe und sichere seine Änderungen, bevor du den Client neu startest oder die Abrechnung wechselst.
Ein gelegentlicher Mehrbedarf lässt sich möglicherweise am einfachsten mit Credits abdecken. Bei dauerhafter hoher Nutzung kann ein größeres Abo passen. Eine API schafft ein separates Budget für lokale Aufgaben, ist aber nicht für jeden Arbeitsumfang automatisch günstiger.
Codex mit API-Schlüssel oder ChatGPT-Abo: Wer rechnet ab?
Die Authentifizierungsdokumentation trennt Abo-Zugriff per ChatGPT-Anmeldung und nutzungsbasierte Abrechnung per API-Schlüssel. CLI und IDE-Erweiterung unterstützen beide Wege bei lokaler Arbeit. Codex cloud benötigt eine ChatGPT-Anmeldung.
Unterscheide drei Abrechnungen:
- ChatGPT-Abo und zusätzliche Credits: Es gelten die Regeln des jeweiligen Kontos oder Workspaces.
- Direkte OpenAI-API: Die Kosten gehen an die API-Organisation und das Projekt des Schlüssels.
- OmniaKey als eigener Anbieter: Unterstützte Anfragen belasten Schlüssel und Guthaben bei OmniaKey zu dessen aktuellen Preisen.
Ein Plus-Abo macht eine separat konfigurierte API nicht kostenlos. OmniaKey-Guthaben setzt das ChatGPT-Limit nicht zurück. Ein OmniaKey-Schlüssel gehört in die passende Anbieter-Konfiguration, nicht in ein Feld für einen direkten OpenAI-Schlüssel.
Den allgemeinen Werkzeugvergleich findest du unter Claude Code vs. Codex. Hier geht es gezielt um die Entscheidung nach dem Limit.
Ein eigenes OmniaKey-Profil für lokale Arbeit
Prüfe die Version mit codex --version. Ab Codex CLI 0.134.0 liegen benannte Profile in eigenen Dateien. Behalte deine Hauptkonfiguration und lege ~/.codex/omniakey.config.toml an oder ergänze eine bestehende Datei vorsichtig:
model = "gpt-6-sol"
model_provider = "omniakey"
[model_providers.omniakey]
name = "OmniaKey"
base_url = "https://api.omniakey.com/v1"
env_key = "OMNIAKEY_API_KEY"
wire_api = "responses"
requires_openai_auth = false
Setze OMNIAKEY_API_KEY in der lokalen Shell auf deinen OmniaKey-Schlüssel. Starte zunächst eine kleine neue Aufgabe:
codex --profile omniakey
Die aktuelle Profildokumentation erklärt, dass --profile seit 0.134.0 keine alten [profiles.name]-Tabellen in der Hauptdatei config.toml mehr liest. Aktualisiere ältere CLI-Versionen oder nutze deren passende Anleitung.
Du musst gespeicherte ChatGPT-Zugangsdaten dafür nicht löschen. Prüfe, ob die Sitzung OmniaKey und gpt-6-sol verwendet, und gleiche den ersten Aufruf im OmniaKey-Nutzungsverlauf ab. Erst dann sollte eine größere Aufgabe folgen. Workspace-Regeln sowie Projekt- und CLI-Überschreibungen können die wirksame Konfiguration beeinflussen.
Kombiniere diesen Umgebungsvariablen-Zugang nicht mit requires_openai_auth = true: Laut OpenAI ignoriert Codex dann env_key. Details stehen in der Codex-CLI-Anleitung; die genaue Modell-ID findest du im aktuellen Katalog.
Was kostet die API-Nutzung?
Addiere die tatsächlich abgerechneten Tokens aller Aufrufe, auch erneut gesendeten Kontext. Eine Nutzernachricht kann mehrere Modellanfragen für Dateien, Werkzeuge, Wiederholungen und weitere Arbeitsschritte auslösen.
Am 27. September 2026 nennt die GPT-6-Sol-Seite für OmniaKey $0.225 je Million Eingabetokens und $1.35 je Million Ausgabetokens. Für 100.000 nicht gecachte Eingabetokens und 10.000 abrechenbare Ausgabetokens ergibt sich:
(100,000 / 1,000,000 × $0.225)
+ (10,000 / 1,000,000 × $1.35)
= $0.036 USD
Das sind rechnerisch 0,036 USD nach dem veröffentlichten Gateway-Tarif, kein gemessener Preis einer erledigten Coding-Aufgabe und kein OpenAI-Abo-Preis. Cache-Lesezugriffe haben einen eigenen Tarif. Weitere abrechenbare Tokens, Wiederholungen und gegebenenfalls separat bepreiste Werkzeuge kommen hinzu. Prüfe den aktuellen Preis vor der Budgetplanung.
Vergleiche mit zusätzlichen ChatGPT-Credits anhand gleichwertiger Arbeit. Ein geschätzter Nachrichtenbereich lässt sich nicht als festes Tokenpaket behandeln. Beginne mit einem kleinen Budget und bewerte akzeptierte Änderungen einschließlich der Zeit für Korrekturen.
Für die Modellwahl helfen GPT-6 Sol vs. Luna und aktuelle Preise. Ein niedrigerer Tokenpreis kann bei einer schwierigen Aufgabe durch zusätzliche Versuche aufgewogen werden.
Häufige Fragen
Setzt ein Codex-Neustart das Limit zurück?
Ein Neustart allein erneuert kein serverseitiges Kontingent. Prüfe zuerst das Dashboard. Wirkt der Client nach dem angezeigten Reset noch veraltet, kontrolliere Konto und Status, bevor du Abrechnungseinstellungen änderst.
Kann ich nach dem Wochenlimit weiterarbeiten?
Prüfe, ob dein Konto zusätzliche Credits anbietet. Für unterstützte lokale Arbeit ist eine separat berechnete API eine weitere Möglichkeit. Beides setzt das Wochenkontingent selbst nicht zurück; ein API-Schlüssel verleiht keine zusätzlichen Cloud-Rechte.
Warum reichen schon wenige Anfragen für das Limit?
Sichtbare Nachrichten zeigen nicht den gesamten Rechenaufwand. Langer Kontext, Werkzeugausgaben, Reasoning und mehrere Agent-Schritte verbrauchen Ressourcen. OpenAI nennt auch Geschwindigkeitsoptionen und Bildgenerierung als mögliche Beschleuniger des Verbrauchs. Begrenze Aufgabe und Quelldateien, bevor du ein kleineres Modell wählst.
Warum erscheint trotz API-Schlüssel ein Limit?
Kontrolliere Anbieter, Profil, Umgebungsvariable und höher priorisierte Einstellungen. Lies dann den Fehler: Auch die API hat eigene Raten-, Guthaben-, Projekt- und Organisationslimits. Modellfehler lassen sich mit dem Codex-Kompatibilitätsleitfaden gesondert eingrenzen.
Ist Codex mit API unbegrenzt?
Nein. Verbrauch wird berechnet; Anbieterlimits, Guthaben, Modellzugriff und anwendbare Workspace-Regeln gelten weiterhin. Die API bietet einen eigenen Abrechnungsweg für lokale Arbeit, keine unbegrenzte Kapazität oder sämtliche ChatGPT-Funktionen.