News / Model Watch · Coding-Tool-Ökonomie
Codex erhält sein 5-Stunden-Limit zurück, Claude Code kürzt um 25%: Abo-Kontingent-Sorgen treffen auf Pay-per-Token-China-APIs
Aktualisiert am 31. Aug.: OpenAI hat am 30. Aug. erneut die Kontingente zurückgesetzt und die Liste behobener Bugs dahinter offengelegt (Details unten). Zwei Ankündigungen innerhalb von sechs Tagen bilden die Klammer um einen kuriosen Monat für KI-Coding-Tools. OpenAI hat am 25. Aug. still und leise das 5-Stunden-Limit von Codex wieder eingeführt – nachdem man den August über Kontingent-Resets wie Kamelle verteilt hatte – und Claude Code von Anthropic wird die Limits ab dem 14. Sep. um 25 % senken. Wenn Ihr Workflow von diesen Kontingenten abhängt, finden Sie hier die Chronologie für August, alle offiziellen Änderungen und die verbrauchsbasierten API-Alternativen, die das chinesische Modell-Ökosystem bietet.
Codex hat am 25. Aug. das 5-Stunden-Nutzungslimit für Plus-Nutzer wieder eingeführt (am 24. Aug. von Engineering Lead Tibo Sottiaux auf X angekündigt, der einräumte: "Ich hatte das vor einer Weile erwähnt, es dann aber aufgeschoben"). Im August gab es drei vollständige Kontingent-Resets (8., 13., 21. Aug.) sowie eine Pay-to-Reset-Funktion, die Berichten zufolge getestet wird. Update vom 30. Aug.: Die Kontingente wurden erneut zurückgesetzt – zum 4. Mal im August – und OpenAI gab die Behebung von 8 Bugs bekannt, die am Kontingent gezehrt hatten (ein feststeckender /goal-Task verbrauchte einmal 15–70 % eines Wochenkontingents); dasselbe Kontingent reicht nun 10–50 % weiter, und eine In-App-Verbrauchsübersicht ist in Arbeit. Claude Code: Limits sinken ab dem 14. Sep. um 25 % (offizieller ClaudeDevs-Post, 29. Aug.). Chinesische Modell-APIs rechnen tokenbasiert nach festen Tarifen ab – keine 5-Stunden-Fenster, keine wöchentlichen Limits – und unterstützen offiziell Claude Code, CLIs im Codex-Stil sowie über 20 Coding-Tools.
Die August-Chronologie anhand offizieller Beiträge
- 8. Aug. – Reset #1. Sottiaux setzte die Nutzung für alle zahlenden Codex- und ChatGPT Work-Nutzer zurück, feierte den Rollout von GPT-5.6 Sol und stellte denkwürdigerweise klar, dass er nicht zu Anthropic wechselt.
- 13. Aug. – Reset #2. Meilenstein von 15 Mio. aktiven Nutzern; ein weiterer Reset „trifft in der nächsten Stunde ein“.
- 21. Aug. – Reset #3. 20 Mio. aktive Nutzer; jedem Codex-/Work-Nutzer wurde ein flexibel einsetzbarer Reset gutgeschrieben (gespeicherte Resets verfallen 30 Tage nach Gutschrift).
- 24.–25. Aug. – Das 5-Stunden-Limit kehrt zurück. Nach wochenlanger Nutzung mit ausschließlich wöchentlicher Obergrenze erhalten Plus-Konten das rollierende 5-Stunden-Fenster zurück. Offizielle Begründung: Eine gleichmäßigere Rechenauslastung sorgt dafür, dass die wöchentlichen Kontingente großzügig bleiben, und Gelegenheitsnutzer verbrauchen nicht mehr versehentlich ganze Wochenkontingente. Business Insider berichtete zudem über einen unangekündigten $8 Pay-to-Reset-Button im Test für einige Plus-Nutzer.
- 30. Aug. – Reset #4, Gründe offengelegt. Sottiaux setzte alle bezahlten Kontingente nach einer Bereinigungswelle von 8 Fehlern bei der Verbrauchserfassung erneut zurück: Die Kompaktierung behielt veraltete Bilder im Kontext (+~10 % Verbrauch bei bildintensiver Nutzung), abgeschlossene /goal-Tasks liefen weiter, fehlerhafte Tools versuchten es endlos weiter – ein einzelner Amok laufender Task verbrauchte 15-70% of a weekly allowance; ein Memory-Hintergrundjob lief fast 15.000 Mal. Das Resultat: Dasselbe Kontingent reicht nun 10-50% further. Schutzmechanismen auf Architekturebene und automatische Warnungen sind aktiv, eine In-App-Verbrauchsübersicht ist in Entwicklung – und Tibo deutete an: "In zwei bis drei Monaten wird das heutige Codex primitiv wirken."
- 29. Aug. – Kürzung bei Claude Code. Anthropics ClaudeDevs-Account kündigte an, dass die Limits ab dem 14. Sep. um 25% sinken; Community-Berechnungen interpretieren das Kleingedruckte so, dass der wöchentliche Multiplikator von +50% auf +25% sinkt, was einer effektiven Kürzung von ~17% entspricht.
Kontext: Dies ist ein Muster und keine Neuigkeit einer einzelnen Woche. Ende Juni untersuchte ein offizieller „War Room“, warum das Codex-Kontingent schneller als erwartet aufgebraucht wurde – der Hinweis zum Fix räumte ein, dass Hintergrundfunktionen (Auto-Review, Subagents) teilweise doppelt liefen oder aggressive Wiederholungsversuche unternahmen und Dashboards Aktivitäten anzeigten, die nie abgerechnet wurden. Im März wurden die Limits sechsmal in einem Monat zurückgesetzt. Ein Community-Tracker (codex-resets.com) archiviert inzwischen jede Ankündigung.
Abo-Kontingente vs. verbrauchsbasierte chinesische Modell-APIs
| Dimension | Codex- / Claude Code-Tarife | Chinesische Modell-APIs |
|---|---|---|
| Abrechnungsmodell | Monatliches Abonnement; undurchsichtige Kontingentberechnung (Credits, Multiplikatoren, versteckte Zeitfenster) | Pro Token, veröffentlichte Tarife – z. B. GLM-5.3 $1.40/$4.40 pro 1M; DeepSeek V4 mit ~50% Rabatt außerhalb der Spitzenzeiten |
| Nutzungsfenster | Rollierende 5-Stunden-Fenster (wieder eingeführt), wöchentliche Obergrenzen, monatliche Richtlinienänderungen | Keine – führen Sie bei Bedarf 100 Aufgaben um 3 Uhr morgens aus; lediglich Beschränkungen bei gleichzeitigen Anfragen |
| Beim Erreichen des Limits | Auf den Reset warten, Credits kaufen ($8-Reset wird Berichten zufolge getestet) oder Resets ansparen, die nach 30 Tagen verfallen | Guthaben aufladen; die effektive Obergrenze ist Ihr Budget, kein Zeitfenster |
| Tool-Kompatibilität | Natives Ökosystem (VS Code, JetBrains, CLI) | GLM Coding Plan unterstützt offiziell Claude Code, Cline, Roo Code +20 Tools; Codex-CLI ist Open Source mit benutzerdefinierten Providern |
Preise verifiziert anhand offizieller Dokumentationen mit Stand vom 30. Aug. 2026; Kontingentmechanismen gemäß den unten verlinkten offiziellen X-Ankündigungen und Presseberichten.
Das praktische Fazit für Coding-Workloads
Nichts davon macht Codex oder Claude Code zu schlechten Tools – sie sind hervorragend, und die Resets waren wirklich großzügig. Doch die Mechanismen sind für jeden wichtig, der Produktiv-Workloads betreibt: Wenn Ihre Kosten von den Kontingentrichtlinien anderer abhängen, liegt Ihre Kapazitätsplanung in deren Changelog. Das Sortiment chinesischer Modell-APIs – GLM-5.3 und das günstigere GLM-5.3-Flash, Kimi K2.6/K3, DeepSeek V4 Flash/Pro, Qwen3.8 – berechnet dieselbe Arbeit pro Token mit nachvollziehbaren Tarifen und ohne Zeitfenster, die sich unter Ihnen zurücksetzen. Für Überlast-Traffic, CI-Jobs oder Workloads, die durch Abo-Kontingente immer weiter eingeschränkt werden, liegt darin der strukturelle Reiz: Sie tauschen Kontingentsorgen gegen eine Verbrauchsmessung ein, die Sie selbst kontrollieren.
Primärquellen
- Tibo Sottiaux auf X (24. Aug.) – 5h-Limit kehrt am 25. Aug. zurück, offizielle Ankündigung
- ClaudeDevs auf X (29. Aug.) – Claude Code-Limits −25% ab 14. Sep., offizielle Ankündigung
- codex-resets.com — Community-Archiv aller Reset-Ankündigungen (Einträge vom 8./13./21. Aug. im Wortlaut)
- 9to5Mac (24. Aug.) – Details zur Wiedereinführung und offizielle Begründung
- Business Insider — War Room zum Nutzungsfehler im Juni, offizieller Fix-Hinweis · $8-Pay-to-Reset im Test
- Hacker News — Thread zur Wiedereinführung (119 Punkte)
Häufig gestellte Fragen (2026)
Wann kehrte das 5-Stunden-Limit zurück?
Am 25. Aug. für Plus-Konten bei Codex und ChatGPT Work. Angekündigt am 24. Aug. auf X – mit dem Eingeständnis, dass es zuvor aufgeschoben worden war. Offizielle Gründe: gleichmäßigere Rechenauslastung, Schutz für Gelegenheitsnutzer.
Wie viele Resets gab es im August?
Vier: 8. Aug. (GPT-5.6 Sol), 13. Aug. (15 Mio. Nutzer), 21. Aug. (20 Mio. Nutzer + angesparter Reset), 30. Aug. (mit der Enthüllung der 8 Bugfixes, die +10–50 % effektive Nutzung bringen). Der Verbrauchs-Bug im Juni führte zu einem War Room, einem Fix und Entschädigungen; der März verzeichnete sechs Resets in einem Monat.
Claude Code: Wie stark ist die Kürzung?
Offiziell 25% ab dem 14. Sep. Berechnungen der Community zum Multiplikator (von +50% auf +25% der Basis) beziffern die effektive Kürzung auf knapp 17%. Quelle: offizieller ClaudeDevs-X-Post vom 29. Aug.
Haben chinesische APIs Nutzungsfenster?
Nein. Nur transparente Preise pro Token – keine 5h-Fenster, keine wöchentlichen Obergrenzen. DeepSeek bietet tageszeitabhängige Preise; der GLM Coding Plan bündelt monatliche Kontingente, die offiziell über 20 Coding-Tools unterstützen.
Können Codex CLI / Claude Code chinesische Modelle nutzen?
Ja – Claude Code über den GLM Coding Plan (offizieller Support) und die Open-Source-Codex-CLI über benutzerdefinierte OpenAI-kompatible Provider: GLM-5.3, Kimi K2.6/K3 und DeepSeek V4 sind alle über kompatible Endpunkte erreichbar.
Ändert dies etwas an den Preisen chinesischer APIs?
Nicht direkt – dies sind kontingentseitige Änderungen bei Abonnements. Eine strengere westliche Kontingentierung gepaart mit anhaltenden chinesischen Preissenkungen bewegt preissensible Coding-Workloads erfahrungsgemäß jedoch hin zu verbrauchsbasierten chinesischen Modell-APIs.