Notizie / Model Watch · Economia degli strumenti di coding
Codex ripristina il limite di 5 ore, Claude Code taglia del 25%: l'ansia da quota in abbonamento incontra le API cinesi pay-per-token
Aggiornato il 31 ago: il 30 ago OpenAI ha reimpostato nuovamente le quote, svelando la sfilza di bug che ne era la causa (dettagli sotto). Due annunci in sei giorni fanno da cornice a un mese insolito per i tool di coding AI. Il 25 ago OpenAI ha ripristinato in sordina il limite di 5 ore di Codex — dopo aver trascorso agosto a distribuire reset delle quote a pioggia — e Claude Code di Anthropic ridurrà i limiti del 25% a partire dal 14 set. Se il tuo flusso di lavoro dipende da queste quote, ecco la cronologia di agosto, cosa è cambiato ufficialmente e l'alternativa con API a consumo offerta dall'ecosistema dei modelli cinesi.
Il 25 ago Codex ha ripristinato il limite di utilizzo di 5 ore per gli utenti Plus (annunciato il 24 ago su X dal responsabile ingegneristico Tibo Sottiaux, che ha ammesso: "Ne avevo parlato tempo fa, ma poi l'avevo rimandato"). Ad agosto si sono verificati tre reset completi delle quote (8, 13 e 21 ago), oltre a una funzionalità a pagamento per il reset che sarebbe in fase di test. Aggiornamento del 30 ago: le quote sono state azzerate ancora una volta — la 4ª volta ad agosto — e OpenAI ha rivelato di aver corretto 8 bug che prosciugavano le quote (un task /goal bloccato è arrivato a consumare il 15-70% della soglia settimanale); a parità di quota, la disponibilità effettiva aumenta ora del 10-50%, ed è in fase di sviluppo un dettaglio dei consumi in-app. I limiti di Claude Code scendono del 25% a partire dal 14 set (post ufficiale di ClaudeDevs del 29 ago). Le API dei modelli cinesi fatturano a consumo per token con tariffe pubbliche — nessuna finestra di 5 ore, nessun limite settimanale — e supportano ufficialmente Claude Code, CLI in stile Codex e oltre 20 tool di sviluppo.
La cronologia di agosto, dai post ufficiali
- 8 ago — reset n. 1. Sottiaux ha azzerato i consumi per tutti gli utenti a pagamento di Codex e ChatGPT Work, celebrando il rilascio di GPT-5.6 Sol e chiarendo, in modo memorabile, che non sta passando ad Anthropic.
- 13 ago — reset n. 2. Raggiunto il traguardo di 15 milioni di utenti attivi; un altro reset "in arrivo nella prossima ora".
- 21 ago — reset n. 3. 20 milioni di utenti attivi; a ogni utente Codex/Work è stato accreditato un reset salvato utilizzabile a piacimento (i reset accumulati scadono 30 giorni dopo l'accredito).
- 24-25 ago — torna il limite di 5 ore. Dopo settimane con il solo tetto settimanale, gli account Plus tornano ad avere la finestra mobile di 5 ore. Motivazione ufficiale: distribuire il carico di calcolo consente di mantenere generose le quote settimanali, ed evitare che gli utenti occasionali esauriscano per sbaglio l'intera settimana in una volta. Separatamente, Business Insider ha segnalato che è in fase di test per alcuni utenti Plus un pulsante non annunciato pay-to-reset da $8.
- 30 ago — reset #4, svelate le cause. Sottiaux ha azzerato nuovamente tutte le quote a pagamento dopo una serie di correzioni su 8 problemi di conteggio dell'utilizzo: la compattazione manteneva immagini obsolete nel contesto (+~10% di utilizzo per chi usa molte immagini), i task /goal completati continuavano a girare, i tool con errori eseguivano tentativi all'infinito — un singolo task fuori controllo ha consumato il 15-70% della soglia settimanale; un processo in background per la memoria è stato eseguito quasi 15.000 volte. Effetto netto: la stessa quota dura ora il 10-50% in più. Sono state introdotte protezioni a livello di architettura e avvisi automatici, è in sviluppo un dettaglio dei consumi in-app — e Tibo ha anticipato che "tra due o tre mesi, il Codex di oggi sembrerà primitivo".
- 29 ago — il taglio di Claude Code. L'account ClaudeDevs di Anthropic ha annunciato una riduzione dei limiti del 25% a partire dal 14 settembre; i calcoli della community leggono tra le righe che il moltiplicatore settimanale passa da +50% a +25%, con un taglio effettivo di circa il 17%.
Contesto: si tratta di un pattern ricorrente, non di una notizia isolata. A fine giugno, una "war room" ufficiale ha indagato sui consumi di Codex che si esaurivano più velocemente del previsto — la nota di fix ha ammesso che le funzioni in background (auto-review, subagenti) a volte venivano eseguite due volte o riprovavano in modo aggressivo, mentre le dashboard mostravano attività mai addebitate. A marzo, i limiti sono stati azzerati sei volte in un solo mese. Un tracker della community (codex-resets.com) ora archivia ogni singolo annuncio.
Quote in abbonamento vs API a consumo dei modelli cinesi
| Dimensione | Piani Codex / Claude Code | API dei modelli cinesi |
|---|---|---|
| Modello di fatturazione | Abbonamento mensile; calcolo opaco delle quote (crediti, moltiplicatori, finestre nascoste) | A token, tariffe pubbliche — es. GLM-5.3 $1.40/$4.40 per 1M; DeepSeek V4 con sconti fuori picco del ~50% |
| Finestre di utilizzo | Finestre mobili di 5 ore (in ripristino), tetti settimanali, cambi di policy di mese in mese | Nessuna — esegui 100 task alle 3 di notte se vuoi; solo limiti di concorrenza |
| Quando si raggiunge il limite | Aspettare il reset, acquistare crediti (reset a $8 apparentemente in fase di test) o conservare reset che scadono in 30 giorni | Ricaricare il saldo; il tetto effettivo è il tuo budget, non una finestra temporale |
| Compatibilità degli strumenti | Ecosistema nativo (VS Code, JetBrains, CLI) | GLM Coding Plan supporta ufficialmente Claude Code, Cline, Roo Code e +20 strumenti; Codex CLI è open source con provider personalizzati |
Tariffe verificate sulla documentazione ufficiale al 30 agosto 2026; meccaniche delle quote secondo gli annunci ufficiali su X e la copertura stampa linkata sotto.
Le conclusioni pratiche per i carichi di lavoro di coding
Nulla di tutto questo rende Codex o Claude Code strumenti scadenti — sono eccellenti, e i reset sono stati davvero generosi. Ma queste meccaniche contano per chiunque gestisca carichi di lavoro in produzione: quando i tuoi costi dipendono dalle policy di quota di terzi, la pianificazione della tua capacità operativa dipende dal loro changelog. L'offerta delle API dei modelli cinesi — GLM-5.3 e il più economico GLM-5.3-Flash, Kimi K2.6/K3, DeepSeek V4 Flash/Pro, Qwen3.8 — tariffa lo stesso lavoro a token, con listini verificabili e senza finestre che si azzerano a sorpresa. Per i picchi di traffico imprevisti, i job di CI o i flussi di lavoro che le quote in abbonamento continuano a comprimere, il vantaggio strutturale è chiaro: si scambia l'ansia da quota con un contatore sotto il proprio controllo.
Fonti primarie
- Tibo Sottiaux su X (24 ago) — ritorno del limite di 5h il 25 ago, annuncio ufficiale
- ClaudeDevs su X (29 ago) — limiti di Claude Code −25% dal 14 set, annuncio ufficiale
- codex-resets.com — archivio della community di ogni annuncio di reset (voci dell'8/13/21 ago testuali)
- 9to5Mac (24 ago) — dettagli sul ripristino e motivazioni ufficiali
- Business Insider — war room di giugno sul bug dei consumi, nota di fix ufficiale · test del pay-to-reset da $8
- Hacker News — thread sul ripristino (119 punti)
Domande frequenti (2026)
Quando è tornato il limite di 5 ore?
Il 25 agosto, per gli account Plus su Codex e ChatGPT Work. Annunciato il 24 agosto su X — ammettendo che era già stato rinviato in precedenza. Motivazioni ufficiali: carico di calcolo più uniforme, protezione per gli utenti occasionali.
Quanti reset ci sono stati ad agosto?
Quattro: 8 ago (GPT-5.6 Sol), 13 ago (15M di utenti), 21 ago (20M di utenti + reset accumulato), 30 ago (con la rivelazione della correzione degli 8 bug che vale un +10-50% di utilizzo effettivo). Il bug di utilizzo di giugno ha portato a una war room, un fix e un indennizzo; a marzo ci sono stati sei reset in un solo mese.
Claude Code: quanto è consistente il taglio?
Ufficialmente del 25%, a partire dal 14 settembre. I calcoli della community sul moltiplicatore (dal +50% al +25% rispetto alla base) stimano il taglio effettivo intorno al 17%. Fonte: post ufficiale di ClaudeDevs su X del 29 agosto.
Le API cinesi hanno finestre di utilizzo?
No. Solo tariffe pubbliche a token — nessuna finestra di 5 ore, nessun tetto settimanale. DeepSeek aggiunge una tariffazione per fasce orarie; GLM Coding Plan include quote mensili che supportano ufficialmente oltre 20 strumenti di coding.
Codex CLI / Claude Code possono usare i modelli cinesi?
Sì — Claude Code tramite GLM Coding Plan (supporto ufficiale) e Codex CLI open source tramite provider personalizzati compatibili con OpenAI: GLM-5.3, Kimi K2.6/K3, DeepSeek V4 sono tutti accessibili tramite endpoint compatibili.
Questo influisce sui prezzi delle API cinesi?
Non direttamente — si tratta di modifiche alle quote lato abbonamento. Tuttavia, restrizioni più severe sui consumi in Occidente unite ai continui tagli di prezzo cinesi spingono storicamente i carichi di lavoro di coding più sensibili ai costi verso le API a consumo dei modelli cinesi.