Codex-Quellcode & offizielle Doku · 2026-10-07

Codex-Fehler "Selected model is at capacity. Please try a different model": das ist weder Ihr Kontingent noch ein 429
Kapazität, Kontingent und 429 sind drei verschiedene Dinge

Stand 2026-10-07 ist das die Kapazitätsmeldung von Codex – kein aufgebrauchtes Kontingent und kein 429. Im Quellcode des offiziellen Codex-Repositorys von OpenAI (rust-v0.160.1, veröffentlicht am 2026-10-05) gehört „Selected model is at capacity. Please try a different model.“ zum Server-Fehlercode server_is_overloaded; ein aufgebrauchtes Kontingent meldet eine andere Zeile, „Quota exceeded. Check your plan and billing details.“, und Ratenbegrenzung entspricht rate_limit_exceeded. Wie Sie die Fälle unterscheiden, zurückfahren und das Modell wechseln, steht unten.

Aktualisiert 2026-10-08

Abo-Kontingent aufgebraucht oder ständig 429? Wechseln Sie zu einer API mit Bezahlung pro Token und arbeiten Sie mit einem Key weiter.

#Kapazitätssignal#Nicht Wochenkontingent#Kein 429#Model-Wechsel

Vier Kernpunkte

Kapazität

Fehlerklasse

Wörtlich „Selected model is at capacity. Please try a different model.“; im Codex-Quellcode (Stand 2026-10-07) gehört das zum Server-Fehlercode server_is_overloaded – der aktuellen Last des Modells.

2026-09-17

Issue eröffnet

Nutzer-Issue #46189 im offiziellen Codex-Repo dokumentiert es; an dem Tag ungelöst.

Nicht Kontingent

Häufigster Irrtum

Im Quellcode lautet ein aufgebrauchtes Kontingent „Quota exceeded. Check your plan and billing details.“, Ratenbegrenzung beginnt mit „rate limit exceeded“ – jeder Fall hat eigenen Wortlaut (geprüft am 2026-10-07).

Model wechseln

Maßnahme, die hilft

Parallelstufe wählen oder Backoff mit Jitter.

Was das ist

Codex gibt diese Zeile zurück, wenn ein Model gesättigt ist. Sie beschreibt die serverseitige Kapazität in dem Moment — nicht Ihren Kontingent-Status, nicht das 429-Throttling. Die drei unterscheiden sich in Wortlaut und Abhilfe: Kontingent heißt Nutzungsseite prüfen, Throttling heißt Retry-After einhalten, Kapazität heißt Model wechseln oder Zeitfenster verlagern.

Was geschah

Das Nutzer-Issue #46189 im offiziellen Codex-Repository wurde am 2026-09-17 mit dem wörtlichen Fehler "Selected model is at capacity. Please try a different model." eröffnet und meldet, dass das Konto zwischen diesem Fehler und einem zweiten hin- und herschwingt. Ergänzung 2026-10-07: Der Quellcode des offiziellen Codex-Repositorys von OpenAI (Release-Tag rust-v0.160.1, veröffentlicht am 2026-10-05) legt diese Meldung als festen Text für den Server-Fehlercode server_is_overloaded fest; in derselben Datei sind aufgebrauchtes Kontingent und Ratenbegrenzung zwei andere Fehler mit eigenem Wortlaut. Im Quellcode dieser Version gilt der Fehler als terminal und wird nicht automatisch wiederholt – Modellwechsel oder späterer Versuch liegen also bei Ihnen.

Chronik

2026-09-17

2026-09-17 wurde das Nutzer-Issue #46189 eröffnet; es dokumentiert den Fehler und die zwei alternierenden Fehlerbilder.

2026-09-18

2026-09-18 erneut geprüft: Issue weiter offen, diese Seite gibt den Issue-Text unverändert wieder.

2026-10-14

2026-10-14: sachfremdes, doch verwechselbares Ereignis — GPT-5.5 wird aus ChatGPT / Work / Codex entfernt (API ausgenommen).

Bestätigt vs. Vorsicht

Offiziell bestätigt

Der Issue-Text sagt: Das Konto schwanke zwischen "Selected model is at capacity" und einer erfolgreichen Anfrage, deren Model-Verhalten Auffälligkeiten zeigt; Stand 2026-09-17 ungelöst. Ergänzung 2026-10-07 (offener Codex-Quellcode und offizielle Doku): ① Im Codex-Quellcode rust-v0.160.1 gehört dieser Text zum Fehlercode server_is_overloaded, getrennt von Kontingent (Quota exceeded…) und Ratenbegrenzung (rate_limit_exceeded); ② die offizielle Codex-Modellseite empfiehlt gpt-6.1-sol für komplexes Coding und gpt-6-luna für fokussierte, wiederholbare Aufgaben; ③ seit Codex CLI 0.159.1 (2026-09-29) ist gpt-6.1-sol das mitgelieferte Standardmodell.

⚠️ Vorsicht

OpenAI hat im Issue keinen Kapazitätsalgorithmus dokumentiert und kein ETA genannt; am Eröffnungstag, dem 2026-09-17, war es weiterhin ungelöst. Aussagen wie "es erholt sich immer in fünf Minuten" oder "einige Regionen erhalten Vorrang" stehen nicht in der Quelle.

Gleich vs. anders

Gleich

Alle drei lassen Anfragen scheitern und sollten irgendwie als wiederholbar gelten.

Anders

Kapazität: Model wechseln oder Zeit verschieben. Wochenkontingent leer: Reset abwarten oder Plan wechseln — der Wortlaut zeigt auf die Nutzung. 429: Rate Limit, Retry-After einhalten. Der Wortlaut trennt sie; vermischen Sie sie nicht.

Was tun?

1) Erst den Wortlaut lesen, bevor Sie das Kontingent verdächtigen; 2) auf eine Parallelstufe wechseln (z. B. gpt-5.6-sol ↔ gpt-6-astra) oder exponentielles Backoff mit Jitter ergänzen; 3) wenn es bleibt, vergleichen Sie den Fall mit dem Issue #46189, statt nach Gefühl Konfigurationsänderungen vorzunehmen. 4) Stand 2026-10-07 wählen Sie den Ersatz nach offizieller Empfehlung: Die Codex-Modellseite empfiehlt gpt-6.1-sol für komplexes Coding und agentische Workflows und gpt-6-luna für fokussierte, wiederholbare Aufgaben; seit Codex CLI 0.159.1 (2026-09-29) ist gpt-6.1-sol das mitgelieferte Standardmodell. Prüfen Sie vor dem Wechsel status.openai.com: Beim Abruf am 2026-10-07 stand die Komponente „Codex in ChatGPT Desktop“ auf operational, ohne laufende Vorfälle. Ist die Statusseite sauber und meldet nur ein Modell diesen Satz, behandeln Sie es als Kapazitätshinweis.

Auf QCode

Stand 2026-10-07 binden die QCode-Dokumente Codex so an: in ~/.codex/config.toml base_url auf https://api.qcode.cc/openai und wire_api auf responses setzen. Alle GPT-Modelle laufen über diesen einen Endpunkt: gpt-6.1-sol, gpt-6-sol, gpt-6-astra und gpt-5.6-sol liegen unter demselben Schlüssel, ein Modellwechsel braucht also keinen anderen Endpunkt – praktisch, um „bei Kapazitätshinweis Stufe wechseln“ ins Skript zu schreiben. Claude und chinesische Modelle laufen nicht über den Responses-Endpunkt, den Codex nutzt. Verbrauch und Guthaben sehen Sie auf der Nutzungsseite der Konsole; nur dort lässt sich ein Kontingentproblem bestätigen. Abgerechnet wird pro Token, die Preise je Modell stehen unter /models. QCode unterstützt gpt-6-luna und gpt-5.6-luna derzeit nicht (beide aus /models entfernt); bitte nutzen Sie ein anderes GPT-Modell, etwa gpt-6.1-sol, gpt-6-sol oder gpt-5.6-terra.

FAQ

Ist das mein Wochenkontingent?

Nein. Kontingent-Erschöpfung formuliert sich anders und zeigt auf Nutzung oder Plan. "Selected model is at capacity. Please try a different model" betrifft die serverseitige Kapazität dieses Models genau jetzt.

Ist es ein 429?

Nein. Rate Limiting hat eigene Wortlaute und Retry-Semantik. Auf ein Kapazitätssignal antworten Sie mit Model-Wechsel oder Zeitfenster-Verschiebung, nicht mit Warten auf einen festen Header.

Was hilft sofort?

Wechseln Sie auf ein Parallelmodell, ergänzen Sie exponentielles Backoff mit Jitter. Teilen sich mehrere Models einen Key, ist der Wechsel die Änderung eines einzigen Felds. Stand 2026-10-07 empfiehlt die offizielle Codex-Modellseite gpt-6.1-sol für komplexes Coding und gpt-6-luna für fokussierte, wiederholbare Aufgaben. QCode unterstützt gpt-6-luna und gpt-5.6-luna derzeit nicht (beide aus /models entfernt); bitte nutzen Sie ein anderes GPT-Modell, etwa gpt-6.1-sol, gpt-6-sol oder gpt-5.6-terra.

Warum ist es auch mal seltsam, funktioniert aber weiter?

Das Issue meldet dieses alternierende Verhalten; OpenAI nennt im Thread keine Ursache, die Seite zieht daraus keinen Schluss. Erfassen Sie beide Fehlerbilder mit Model-ID und Zeitstempel, suchen Sie ein Muster.

Dasselbe wie die Stilllegung am 2026-10-14?

Nein. Die Stilllegung entfernt ein Model aus ChatGPT / ChatGPT Work / Codex und nimmt die API ausdrücklich aus; ein Kapazitätssignal ist eine Laufzeit-Auslastung. Anderer Wortlaut, andere Abhilfe.

Ein Ticket eröffnen?

Verweisen Sie zuerst auf das Nutzer-Issue #46189. Sehen Sie die alternierenden Fehler ebenfalls, hängen Sie Zeitstempel, Model-ID und den exakten Fehlertext an — deutlich hilfreicher als "es funktioniert nicht".

Quellen

Nutzer-Issue #46189 im offiziellen OpenAI-Codex-Repo (2026-09-17; kein offizielles Statement) und die offiziellen Release Notes, erfasst am 2026-09-18. Fehlertext gemäß Issue-Text. Am 2026-10-07 ergänzte Quellen: Quellcode des offiziellen Codex-Repositorys von OpenAI (Release-Tag rust-v0.160.1, veröffentlicht am 2026-10-05), offizielle Codex-Modellseite und Changelog (learn.chatgpt.com), die offizielle Statusseite von OpenAI (status.openai.com) und die Codex-Einrichtungsseite der QCode-Doku (docs.qcode.cc), alles abgerufen am 2026-10-07.

Stufenwechsel in einer Zeile

Ein QCode-Schlüssel deckt gpt-6.1-sol, gpt-6-sol, gpt-6-astra und weitere ab – wechseln Sie in Codex das Modell, um Lastspitzen zu umgehen.

Verwandte

Nur der im Nutzer-Issue im offiziellen Codex-Repo von OpenAI und in den offiziellen Release Notes vorhandene Fehlertext wird wiedergegeben; keine Schlussfolgerungen zur internen Kapazitätsrichtlinie. Seit 2026-10-07 zitiert die Seite zusätzlich den Quellcode des offiziellen Codex-Repositorys und die offizielle Doku (geprüft am 2026-10-07); maßgeblich sind die offiziellen Seiten. Die Modellverfügbarkeit richtet sich nach /models.

Erst testen, dann entscheiden

Unsicher bei der Tarifwahl? Beginnen Sie mit Starter ($8.57/Monat) und wechseln Sie auf einen höheren Tarif, wenn Sie zufrieden sind — der ungenutzte Wert des alten Tarifs geht auf Ihr Guthaben zurück.