Le 31 août 2026, OpenAI retire GPT-5.4 et GPT-5.4 mini de Codex pour les utilisateurs qui se connectent à Codex avec leur compte ChatGPT. La migration officielle est explicite : GPT-5.4 doit être remplacé par GPT-5.6 Terra et GPT-5.4 mini par GPT-5.6 Luna.[1]
La nuance essentielle est la suivante : il ne s'agit pas d'un retrait de GPT-5.4 de l'OpenAI API. OpenAI précise que l'API et l'utilisation de Codex avec sa propre clé API ne sont pas affectées.[1]
Dire simplement :
GPT-5.4 est supprimé le 31 août 2026.
serait donc trompeur.
Formulation correcte :
GPT-5.4 et GPT-5.4 mini quittent Codex
pour les sessions authentifiées avec ChatGPT.
L'API et Codex avec une clé API personnelle ne sont pas concernés.
Pour les équipes, la migration ne se limite pas au model selector. OpenAI demande de vérifier workspace defaults, paramètres de modèles enregistrés, configurations gérées et automatisations.[1]
Sur le plan technique, Terra conserve la fenêtre de contexte 1 050 000 tokens de GPT-5.4, réduit le tarif API standard de $2.50/$15 à $2/$12 par million de tokens input/output et dispose d'un knowledge cutoff plus récent. Luna réduit fortement les coûts face à GPT-5.4 mini et augmente le contexte de 400K à 1.05M.[6][7][8][9]
La migration n'est toutefois pas un simple drop-in. GPT-5.6 ajoute notamment le niveau de reasoning max, documente un default API différent pour le reasoning et introduit de nouvelles capacités. OpenAI recommande donc des evals représentatifs.[10]
État des informations : 31 août 2026. Les sources OpenAI utilisées donnent la date, mais pas une heure précise et vérifiée de coupure.
TL;DR
| Question | Réponse vérifiée |
|---|---|
| Que se passe-t-il le 31 août ? | GPT-5.4 et GPT-5.4 mini quittent Codex avec login ChatGPT |
| Remplaçant GPT-5.4 | GPT-5.6 Terra |
| Remplaçant GPT-5.4 mini | GPT-5.6 Luna |
| OpenAI API concernée ? | Non pour ce changement |
| Codex avec sa propre clé API ? | Non concerné |
| À auditer | workspace defaults, saved settings, managed configs, automations |
| Priorité Enterprise | requirements.toml géré > workspace default > choix local |
| Contexte GPT-5.4 | 1.05M |
| Contexte Terra | 1.05M |
| Contexte GPT-5.4 mini | 400K |
| Contexte Luna | 1.05M |
| Max output Terra/Luna | 128K |
| Knowledge cutoff Terra/Luna | 16 février 2026 |
| API GPT-5.4 | $2.50 / $0.25 cache / $15 |
| API Terra | $2.00 / $0.20 / $12 |
| API GPT-5.4 mini | $0.75 / $0.075 / $4.50 |
| API Luna | $0.20 / $0.02 / $1.20 |
| Reasoning Terra/Luna | none, low, medium, high, xhigh, max |
| Default API Terra/Luna | medium |
| Default API GPT-5.4 / mini | none |
gpt-5.6 = Terra ? | Non. L'alias pointe vers GPT-5.6 Sol |
| Prix API = limite Codex ? | Non |
Que retire exactement OpenAI ?
OpenAI annonce qu'au 31 août 2026, GPT-5.4 et GPT-5.4 mini ne seront plus disponibles dans Codex lorsqu'on se connecte avec un compte ChatGPT.[1]
Codex est utilisé via notamment :
- l'application desktop ChatGPT en mode Codex,
- Codex CLI,
- l'extension Codex IDE,
- Codex sur le web.[1]
Il ne s'agit donc pas d'un retirement global de ces modèles.
Mapping officiel
GPT-5.4 → GPT-5.6 Terra
GPT-5.4 mini → GPT-5.6 Luna
Ce mapping est spécifique au produit Codex. Terra est positionné comme l'équilibre intelligence/coût et Luna pour les workloads sensibles au coût et à fort volume.[5][6][7]
Ce qui n'est pas concerné
OpenAI API
Codex avec votre propre API key
Un appel API vers gpt-5.4 ne doit donc pas être considéré comme automatiquement cassé le 31 août à cause de cette annonce.
Faut-il malgré tout migrer les workloads API ?
Éventuellement, mais c'est une décision séparée.
OpenAI recommande, lors d'une migration depuis GPT-5.4, de conserver d'abord le même reasoning effort puis de tester également un niveau inférieur sur des tâches représentatives.[10]
La famille GPT-5.6 a d’abord été présentée avec la preview de GPT-5.6 Sol le 26 juin, avant l’annonce du lancement plus large de GPT-5.6 par OpenAI le 9 juillet 2026.[11][12]
GPT-5.4 vs GPT-5.6 Terra
| Paramètre | GPT-5.4 | GPT-5.6 Terra |
|---|---|---|
| Contexte | 1,050,000 | 1,050,000 |
| Max output | 128,000 | 128,000 |
| Knowledge cutoff | 31 août 2025 | 16 févr. 2026 |
| Input / 1M | $2.50 | $2.00 |
| Cached input | $0.25 | $0.20 |
| Output / 1M | $15.00 | $12.00 |
| Reasoning | none–xhigh | none–max |
| Default API documenté | none | medium |
Terra coûte 20% de moins que GPT-5.4 sur les tarifs token standards.
GPT-5.4 mini vs GPT-5.6 Luna
| Paramètre | GPT-5.4 mini | GPT-5.6 Luna |
|---|---|---|
| Contexte | 400,000 | 1,050,000 |
| Max output | 128,000 | 128,000 |
| Knowledge cutoff | 31 août 2025 | 16 févr. 2026 |
| Input / 1M | $0.75 | $0.20 |
| Cached input | $0.075 | $0.02 |
| Output / 1M | $4.50 | $1.20 |
| Reasoning | none–xhigh | none–max |
| Default API documenté | none | medium |
Luna est environ 73% moins chère que GPT-5.4 mini en tarifs API standards, avec une fenêtre de contexte 2,625× plus grande.
Prix API et limites Codex sont deux systèmes différents
Le coût :
$ / 1M tokens
n'est pas égal au nombre de messages inclus dans un plan Codex.
Le pricing Codex affiche actuellement, pour l'une des vues de plan :[2]
GPT-5.4: 20–100 messages locaux / 5h
Terra: 20–110 / 5h
GPT-5.4 mini: 60–350 / 5h
Luna: 50–280 / 5h
Ce sont des plages indicatives, avec éventuelles limites hebdomadaires.[2]
Credit pricing Business / Enterprise
Le rate card indique actuellement :[3]
| Modèle | Input credits / 1M | Cached | Output |
|---|---|---|---|
| GPT-5.4 | 62.5 | 6.25 | 375 |
| Terra | 50 | 5 | 300 |
| GPT-5.4 mini | 18.75 | 1.875 | 113 |
| Luna | 5 | 0.5 | 30 |
Les coûts réels suivent la consommation de tokens.[3]
Piège principal : le default de reasoning
GPT-5.4 et GPT-5.4 mini documentent none comme default API.[8][9]
Terra et Luna documentent medium.[6][7]
Changer uniquement le model slug tout en laissant reasoning.effort implicite peut donc modifier simultanément latence, consommation et comportement.
Les defaults Codex Workspace peuvent être différents
Dans Codex, les admins peuvent configurer :
- starting model,
- reasoning level,
- speed,
- Fast Mode,
- comportement des nouveaux chats.[1]
Le default API ne décrit donc pas automatiquement chaque session Codex.
requirements.toml a la priorité
OpenAI documente l'ordre suivant :[1]
managed requirements.toml
→ workspace starting defaults
→ choix local initial du membre
Changer uniquement le default dans l'UI peut être insuffisant.
Inventaire à réaliser
OpenAI cite :[1]
workspace defaults
saved model settings
managed configurations
automations
POLPROG recommande également d'auditer CLI scripts, CI/CD, templates, variables d'environnement, wrappers internes, documentation et onboarding.
Rechercher les références GPT-5.4
Sur macOS/Linux :
rg -n --hidden \
-g '!node_modules' \
-g '!.git' \
'gpt-5\.4(-mini)?|GPT-5\.4( mini)?' .
Et éventuellement :
rg -n 'gpt-5\.4(-mini)?' ~/.codex 2>/dev/null
Il s'agit d'une recommandation d'audit POLPROG, pas d'une commande officielle OpenAI.
Éviter le search-and-replace global
Les noms anciens peuvent être légitimes dans des changelogs, articles historiques, tests snapshot ou documentation de migration.
Ne modifiez que les références actives qui doivent réellement changer.
Attention à l'alias gpt-5.6
OpenAI documente :
gpt-5.6 → GPT-5.6 Sol
Pour sélectionner Terra dans l'API, utilisez explicitement :
gpt-5.6-terra
Pour Luna : gpt-5.6-luna.[6][7]
Exemple API vers Terra
from openai import OpenAI
client = OpenAI()
response = client.responses.create(
model="gpt-5.6-terra",
reasoning={"effort": "medium"},
input="Review this pull request and identify correctness regressions."
)
print(response.output_text)
OpenAI recommande Responses API pour reasoning, tool calling et multi-turn avec GPT-5.6.[10]
Exemple high-volume avec Luna
from openai import OpenAI
client = OpenAI()
response = client.responses.create(
model="gpt-5.6-luna",
reasoning={"effort": "low"},
input="Classify this issue and return the owning engineering team."
)
print(response.output_text)
Luna est destiné aux workloads à fort volume et sensibles au coût.[7]
Ne changez pas prompt et modèle en même temps
La guidance OpenAI recommande de changer d'abord le modèle à prompt fonctionnellement stable, puis d'ajuster le prompt après evals.[10]
Cela permet d'identifier précisément l'origine d'une régression.
Régler le reasoning
Workflow conseillé :[10]
ancien effort
→ même effort sur GPT-5.6
→ tester un niveau inférieur
→ comparer qualité, latence et coût
GPT-5.6 supporte none, low, medium, high, xhigh, max.
Terra ou Luna ?
Terra : ancien usage GPT-5.4, tâches multi-file, instructions complexes, équilibre capacité/coût.
Luna : ancien GPT-5.4 mini, volume élevé, tâches bornées, subagents, classification, sensibilité au coût.
C'est cohérent avec le mapping officiel.[1]
Et Sol ?
Sol est le flagship GPT-5.6 pour les travaux professionnels complexes.[5]
Mais le remplacement officiel de GPT-5.4 dans cette annonce Codex est Terra, pas Sol.[1]
Sol doit être évalué séparément selon le compromis qualité/coût.
Fenêtres de contexte
GPT-5.4 1.05M → Terra 1.05M
GPT-5.4 mini 400K → Luna 1.05M
Plus de contexte nominal ne garantit pas une meilleure compréhension d'un repository entier.
Long context et prix API
Pour Terra et Luna, les prompts au-delà de 272K input tokens sont facturés pour l'ensemble de la requête à :
2× prix input
1.5× prix output
Knowledge cutoff plus récent ≠ informations live
GPT-5.4/mini : 31 août 2025.
Terra/Luna : 16 février 2026.[6][7][8][9]
Il faut toujours utiliser le contexte repository, la documentation réelle et les outils de recherche lorsque la fraîcheur est importante.
Disponibilité selon le plan
OpenAI documente un accès Terra limité pour Free/Go dans Work/Codex et un accès plus large à GPT-5.6 pour Plus, Pro, Business et Enterprise.[4]
Les limites exactes doivent être revérifiées dans le pricing courant.[2][4]
Les automations sont critiques
Une automation peut garder un ancien modèle sans être visible quotidiennement.
OpenAI cite donc explicitement automations parmi les configurations à mettre à jour.[1]
Enterprise : trois couches
L'audit doit couvrir les trois.
Construire un eval utile
Choisissez 20–50 tâches réelles : bugfix, refactor, tests, dependency migration, regression analysis, feature, code review, documentation.
Mesurez :
task success
test pass rate
retry rate
diff size
out-of-scope changes
tool calls
latency
tokens
credits
Plan minimum en une journée
- Inventorier les références GPT-5.4.
- GPT-5.4 → Terra, GPT-5.4 mini → Luna pour Codex avec auth ChatGPT.
- Vérifier workspace et managed config.
- Mettre à jour automations.
- Fixer reasoning si la stabilité compte.
- Exécuter smoke tests.
- Optimiser ensuite prompts et coûts.
À ne pas faire
- Ne pas dire que GPT-5.4 disparaît de l'API.
- Ne pas confondre
gpt-5.6avec Terra. - Ne pas assimiler prix API et limites Codex.
- Ne pas changer modèle, prompt et reasoning sans baseline.
- Ne pas oublier automations.
- Ne pas inventer une heure précise de coupure.
- Ne pas présenter Sol comme remplacement officiel dans cette annonce.
Checklist production
Inventaire
- Toutes les références
gpt-5.4trouvées. - Toutes les références
gpt-5.4-minitrouvées. - Workspace defaults vérifiés.
- Saved model settings vérifiés.
- Managed configs vérifiées.
- Automations vérifiées.
- Scripts CLI vérifiés.
- CI/CD vérifié.
Configuration
- GPT-5.4 remplacé par Terra pour Codex/ChatGPT auth.
- GPT-5.4 mini remplacé par Luna.
-
requirements.tomlvérifié. - Starting model vérifié.
- Reasoning level vérifié.
- Fast Mode policy vérifiée.
- Alias
gpt-5.6évité si Terra est requis. - IDs explicites utilisés dans l'API si nécessaire.
Evals
- Ancien prompt conservé comme baseline.
- Même reasoning effort testé.
- Un niveau inférieur testé.
- Test pass rate mesuré.
- Retry rate mesuré.
- Latence mesurée.
- Tokens mesurés.
- Credits mesurés.
- Out-of-scope changes revus.
- Longues sessions agentiques testées.
Opérations
- Documentation mise à jour.
- Onboarding mis à jour.
- Templates mis à jour.
- Scheduled tasks mis à jour.
- Monitoring post-migration activé.
- Fallback model défini.
- Pricing Codex actuel vérifié.
- Limites du plan vérifiées.
Verdict POLPROG
Le changement du 31 août est important mais plus précis que « OpenAI retire GPT-5.4 ».
La réalité :
GPT-5.4 et GPT-5.4 mini
→ retirement dans Codex avec login ChatGPT
GPT-5.4 → GPT-5.6 Terra
GPT-5.4 mini → GPT-5.6 Luna
OpenAI API → non affectée par ce changement précis
Codex + clé API personnelle → non affecté
Terra garde 1.05M de contexte et réduit les tarifs standards API de 20%.[6][8]
Luna passe de 400K à 1.05M de contexte par rapport à GPT-5.4 mini et baisse les prix tokens d'environ 73%.[7][9]
La migration la plus sûre est donc :
Appliquer le mapping officiel, conserver d'abord le prompt et le reasoning actuel comme baseline, lancer des evals, puis seulement optimiser coût et latence.

