Il 31 agosto 2026 OpenAI ritira GPT-5.4 e GPT-5.4 mini da Codex per gli utenti che accedono con un account ChatGPT. La sostituzione ufficiale è chiara: GPT-5.4 → GPT-5.6 Terra e GPT-5.4 mini → GPT-5.6 Luna.[1]
La precisazione più importante: non è un retirement di GPT-5.4 da OpenAI API. OpenAI afferma esplicitamente che API e Codex con una propria API key non sono interessati.[1]
Dire semplicemente:
GPT-5.4 viene ritirato il 31 agosto 2026.
sarebbe quindi impreciso.
La formulazione corretta è:
GPT-5.4 e GPT-5.4 mini lasciano Codex
quando l'accesso avviene con un account ChatGPT.
API e Codex con API key propria non sono coinvolti.
OpenAI raccomanda di aggiornare workspace defaults, saved model settings, managed configurations e automations.[1]
Terra mantiene il context window da 1.050.000 token di GPT-5.4 e riduce il prezzo API standard da $2.50/$15 a $2/$12 per milione di token input/output. Luna porta il context di GPT-5.4 mini da 400K a 1.05M e abbassa fortemente i costi standard.[6][7][8][9]
Non è però un drop-in totalmente neutro. GPT-5.6 introduce reasoning max, default API diversi per reasoning e nuove capability. OpenAI consiglia evals rappresentativi.[10]
Stato delle informazioni: 31 agosto 2026. Le fonti ufficiali utilizzate indicano la data, ma non un'ora precisa e verificata di spegnimento.
TL;DR
| Domanda | Risposta verificata |
|---|---|
| Cosa cambia il 31 agosto? | GPT-5.4 e mini lasciano Codex con login ChatGPT |
| Sostituto GPT-5.4 | GPT-5.6 Terra |
| Sostituto GPT-5.4 mini | GPT-5.6 Luna |
| OpenAI API coinvolta? | No per questo cambiamento |
| Codex con API key propria? | Non coinvolto |
| Cosa controllare | defaults, saved settings, managed configs, automations |
| Priorità Enterprise | requirements.toml gestito > workspace default > scelta locale |
| Context GPT-5.4 | 1.05M |
| Context Terra | 1.05M |
| Context GPT-5.4 mini | 400K |
| Context Luna | 1.05M |
| Max output Terra/Luna | 128K |
| Cutoff Terra/Luna | 16 febbraio 2026 |
| GPT-5.4 API | $2.50 / $0.25 cached / $15 |
| Terra API | $2.00 / $0.20 / $12 |
| GPT-5.4 mini API | $0.75 / $0.075 / $4.50 |
| Luna API | $0.20 / $0.02 / $1.20 |
| Reasoning Terra/Luna | none, low, medium, high, xhigh, max |
| Default API Terra/Luna | medium |
| Default API GPT-5.4 / mini | none |
gpt-5.6 significa Terra? | No, punta a GPT-5.6 Sol |
| Prezzo API = limite Codex? | No |
Cosa ritira esattamente OpenAI?
GPT-5.4 e GPT-5.4 mini non saranno più disponibili in Codex con autenticazione ChatGPT dal 31 agosto 2026.[1]
Codex è disponibile tramite desktop app, CLI, IDE extension e web.[1]
Questo non equivale a un retirement globale dei modelli.
Mapping ufficiale
GPT-5.4 → GPT-5.6 Terra
GPT-5.4 mini → GPT-5.6 Luna
Terra è il modello bilanciato tra intelligence e cost; Luna è pensato per workload cost-sensitive e high-volume.[5][6][7]
Cosa NON cambia
OpenAI API
Codex con API key propria
Una produzione che usa gpt-5.4 via API non deve essere considerata automaticamente interrotta da questo avviso Codex.
Conviene comunque migrare l'API?
Può essere opportuno, ma è una scelta separata.
OpenAI consiglia, migrando da GPT-5.4, di mantenere prima lo stesso reasoning effort e poi testare anche un livello più basso.[10]
La famiglia GPT-5.6 è stata inizialmente presentata con la preview di GPT-5.6 Sol il 26 giugno, mentre OpenAI ha annunciato il lancio più ampio di GPT-5.6 il 9 luglio 2026.[11][12]
GPT-5.4 vs GPT-5.6 Terra
| Parametro | GPT-5.4 | Terra |
|---|---|---|
| Context | 1,050,000 | 1,050,000 |
| Max output | 128,000 | 128,000 |
| Knowledge cutoff | 31 ago 2025 | 16 feb 2026 |
| Input / 1M | $2.50 | $2.00 |
| Cached input | $0.25 | $0.20 |
| Output / 1M | $15.00 | $12.00 |
| Reasoning | none–xhigh | none–max |
| Default API documentato | none | medium |
Terra costa 20% in meno nei prezzi standard token.
GPT-5.4 mini vs GPT-5.6 Luna
| Parametro | GPT-5.4 mini | Luna |
|---|---|---|
| Context | 400,000 | 1,050,000 |
| Max output | 128,000 | 128,000 |
| Knowledge cutoff | 31 ago 2025 | 16 feb 2026 |
| Input / 1M | $0.75 | $0.20 |
| Cached input | $0.075 | $0.02 |
| Output / 1M | $4.50 | $1.20 |
| Reasoning | none–xhigh | none–max |
| Default API documentato | none | medium |
Luna costa circa 73% in meno di GPT-5.4 mini e offre un context 2,625× maggiore.
API pricing e limiti Codex sono diversi
Il pricing Codex mostra attualmente range indicativi per local messages in una finestra di 5 ore:[2]
GPT-5.4: 20–100 / 5h
Terra: 20–110 / 5h
GPT-5.4 mini: 60–350 / 5h
Luna: 50–280 / 5h
Sono range, non garanzie, e possono valere limiti settimanali aggiuntivi.[2]
Credit pricing Business / Enterprise
Current rate card:[3]
| Modello | Input credits / 1M | Cached | Output |
|---|---|---|---|
| GPT-5.4 | 62.5 | 6.25 | 375 |
| Terra | 50 | 5 | 300 |
| GPT-5.4 mini | 18.75 | 1.875 | 113 |
| Luna | 5 | 0.5 | 30 |
Il consumo effettivo dipende dai token.[3]
Rischio principale: reasoning default
GPT-5.4 e mini documentano none come API default.[8][9]
Terra e Luna documentano medium.[6][7]
Cambiare solo model slug senza fissare reasoning.effort può cambiare latency, token usage e comportamento.
I default del Codex workspace possono essere diversi
Gli admin possono configurare starting model, reasoning level, speed, Fast Mode e comportamento dei nuovi chat.[1]
Il default API non descrive quindi ogni sessione Codex.
requirements.toml ha precedenza
Ordine documentato:[1]
managed requirements.toml
→ workspace starting defaults
→ local member starting choice
Cambiare solo il default UI può non bastare.
Cosa inventariare
OpenAI elenca:[1]
workspace defaults
saved model settings
managed configurations
automations
POLPROG suggerisce inoltre CLI scripts, CI/CD, template, env vars, wrapper interni, documentazione e onboarding.
Cercare riferimenti vecchi
rg -n --hidden \
-g '!node_modules' \
-g '!.git' \
'gpt-5\.4(-mini)?|GPT-5\.4( mini)?' .
E opzionalmente:
rg -n 'gpt-5\.4(-mini)?' ~/.codex 2>/dev/null
È un suggerimento di audit POLPROG, non un comando ufficiale OpenAI.
Evitare replace globale cieco
Nomi storici possono essere corretti in changelog, docs, snapshot test e log. Cambiare solo configurazioni attive.
Attenzione all'alias gpt-5.6
OpenAI documenta:
gpt-5.6 → GPT-5.6 Sol
Per Terra usare gpt-5.6-terra; per Luna gpt-5.6-luna.[6][7]
Esempio API con Terra
from openai import OpenAI
client = OpenAI()
response = client.responses.create(
model="gpt-5.6-terra",
reasoning={"effort": "medium"},
input="Review this pull request and identify correctness regressions."
)
print(response.output_text)
OpenAI raccomanda Responses API per reasoning, tool calling e multi-turn con GPT-5.6.[10]
Esempio high-volume con Luna
from openai import OpenAI
client = OpenAI()
response = client.responses.create(
model="gpt-5.6-luna",
reasoning={"effort": "low"},
input="Classify this issue and return the owning engineering team."
)
print(response.output_text)
Luna è pensato per workload high-volume e cost-sensitive.[7]
Non cambiare prompt e modello insieme
OpenAI consiglia di cambiare prima il modello lasciando funzionalmente stabile il prompt, poi fare tuning dopo gli eval.[10]
Come tarare il reasoning
vecchio effort
→ stesso effort su GPT-5.6
→ test un livello sotto
→ confronto qualità, latency e costo
GPT-5.6 supporta none, low, medium, high, xhigh, max.
Terra o Luna?
Terra: ex workload GPT-5.4, multi-file tasks, istruzioni complesse, equilibrio qualità/costo.
Luna: ex GPT-5.4 mini, alto volume, subagent, classificazione, task ben delimitati.
Questo segue il mapping ufficiale Codex.[1]
E Sol?
Sol è il flagship GPT-5.6 per lavoro professionale complesso.[5]
Ma il replacement ufficiale di GPT-5.4 in questo retirement Codex è Terra, non Sol.[1]
Context window
GPT-5.4 1.05M → Terra 1.05M
GPT-5.4 mini 400K → Luna 1.05M
Un context più grande non garantisce da solo migliore repo-level reasoning.
Long context e costo API
Per Terra e Luna, prompt oltre 272K input tokens hanno per l'intera request:
2× input price
1.5× output price
Cutoff più recente non sostituisce i tools
GPT-5.4/mini: 31 agosto 2025.
Terra/Luna: 16 febbraio 2026.[6][7][8][9]
Repo context, file search, web search e documentazione reale restano essenziali.
Disponibilità per piano
OpenAI documenta accesso Terra limitato in Free/Go attraverso Work/Codex e accesso più ampio alla famiglia GPT-5.6 nei piani Plus, Pro, Business ed Enterprise.[4]
Verificare sempre i limiti correnti nel pricing.[2][4]
Automations
Un'automazione può mantenere un modello vecchio fino alla prossima esecuzione. OpenAI cita esplicitamente automations tra gli elementi da aggiornare.[1]
Enterprise: tre livelli
L'audit deve coprirli tutti.
Migration eval
Selezionare 20–50 task reali: bugfix, refactor, test, dependency migration, regression analysis, feature, code review, documentazione.
Misurare:
task success
test pass rate
retry rate
diff size
out-of-scope changes
tool calls
latency
tokens
credits
Piano minimo in un giorno
- Inventario riferimenti GPT-5.4.
- GPT-5.4 → Terra e GPT-5.4 mini → Luna per Codex con auth ChatGPT.
- Verifica workspace e managed config.
- Aggiorna automations.
- Fissa reasoning quando conta la stabilità.
- Esegui smoke tests.
- Ottimizza dopo prompt e costi.
Cosa non fare
- Non dire che GPT-5.4 sparisce dall'API.
- Non usare
gpt-5.6pensando che sia Terra. - Non confondere API pricing e Codex limits.
- Non cambiare modello, prompt e reasoning insieme senza baseline.
- Non ignorare automations.
- Non inventare un'ora precisa di retirement.
Checklist produzione
Inventory
- Tutti i riferimenti
gpt-5.4trovati. - Tutti i riferimenti
gpt-5.4-minitrovati. - Workspace defaults controllati.
- Saved settings controllati.
- Managed configs controllate.
- Automations controllate.
- CLI scripts controllati.
- CI/CD controllato.
Configurazione
- GPT-5.4 sostituito con Terra in Codex/ChatGPT auth.
- GPT-5.4 mini sostituito con Luna.
-
requirements.tomlcontrollato. - Starting model controllato.
- Reasoning level controllato.
- Fast Mode policy controllata.
- Alias
gpt-5.6evitato quando serve Terra. - ID espliciti usati in API dove serve stabilità.
Evals
- Vecchio prompt mantenuto come baseline.
- Stesso reasoning effort testato.
- Un livello inferiore testato.
- Test pass rate misurato.
- Retry rate misurato.
- Latency misurata.
- Token usage misurato.
- Credit usage misurato.
- Out-of-scope changes controllati.
- Long agent sessions testate.
Operations
- Documentazione aggiornata.
- Onboarding aggiornato.
- Template aggiornati.
- Scheduled tasks aggiornati.
- Monitoring post-migrazione attivo.
- Fallback model definito.
- Codex pricing corrente verificato.
- Limiti correnti verificati.
Verdetto POLPROG
Il cambiamento del 31 agosto è importante ma più circoscritto del titolo “OpenAI ritira GPT-5.4”.
GPT-5.4 e GPT-5.4 mini
→ retirement in Codex con login ChatGPT
GPT-5.4 → GPT-5.6 Terra
GPT-5.4 mini → GPT-5.6 Luna
OpenAI API → non coinvolta da questo specifico cambiamento
Codex + API key propria → non coinvolto
Terra mantiene 1.05M di context e riduce del 20% il token pricing standard.[6][8]
Luna porta 400K a 1.05M rispetto a GPT-5.4 mini e riduce i prezzi standard di circa 73%.[7][9]
La migrazione più sicura è:
Applicare il mapping ufficiale, mantenere inizialmente prompt e reasoning attuali come baseline, eseguire eval e solo dopo ottimizzare costo e latency.

