El 31 de agosto de 2026 OpenAI retira GPT-5.4 y GPT-5.4 mini de Codex para los usuarios que acceden con una cuenta de ChatGPT. El reemplazo oficial es directo: GPT-5.4 → GPT-5.6 Terra y GPT-5.4 mini → GPT-5.6 Luna.[1]
La precisión más importante: esta retirada no afecta a OpenAI API ni a Codex cuando se usa con una API key propia.[1]
Por tanto, decir:
GPT-5.4 desaparece por completo el 31 de agosto de 2026.
sería incorrecto.
La formulación correcta es:
GPT-5.4 y GPT-5.4 mini dejan de estar disponibles en Codex
cuando Codex se autentica mediante una cuenta de ChatGPT.
La API y Codex con una clave API propia no están afectados.
OpenAI recomienda actualizar workspace defaults, saved model settings, managed configurations y automations.[1]
La migración aporta ventajas: Terra mantiene el contexto de 1.050.000 tokens de GPT-5.4 y baja el precio API estándar de $2.50/$15 a $2/$12 por millón de tokens input/output. Luna amplía el contexto de GPT-5.4 mini de 400K a 1.05M y reduce mucho el coste estándar.[6][7][8][9]
No obstante, no es un cambio completamente neutral. GPT-5.6 añade reasoning max, documenta un default API de reasoning diferente y nuevas capacidades. OpenAI recomienda evals representativos.[10]
Estado de la información: 31 de agosto de 2026. Las fuentes oficiales utilizadas indican la fecha, pero no una hora de desconexión concreta que podamos verificar.
TL;DR
| Pregunta | Respuesta verificada |
|---|---|
| ¿Qué cambia el 31 de agosto? | GPT-5.4 y GPT-5.4 mini salen de Codex con login ChatGPT |
| Sustituto GPT-5.4 | GPT-5.6 Terra |
| Sustituto GPT-5.4 mini | GPT-5.6 Luna |
| ¿Afecta a OpenAI API? | No en esta retirada |
| ¿Afecta a Codex con API key propia? | No |
| ¿Qué revisar? | defaults, saved settings, managed configs, automations |
| Prioridad Enterprise | requirements.toml gestionado > workspace default > selección local |
| Contexto GPT-5.4 | 1.05M |
| Contexto Terra | 1.05M |
| Contexto GPT-5.4 mini | 400K |
| Contexto Luna | 1.05M |
| Max output Terra/Luna | 128K |
| Cutoff Terra/Luna | 16 febrero 2026 |
| GPT-5.4 API | $2.50 / $0.25 cached / $15 |
| Terra API | $2.00 / $0.20 / $12 |
| GPT-5.4 mini API | $0.75 / $0.075 / $4.50 |
| Luna API | $0.20 / $0.02 / $1.20 |
| Reasoning Terra/Luna | none, low, medium, high, xhigh, max |
| Default API Terra/Luna | medium |
| Default API GPT-5.4 / mini | none |
¿gpt-5.6 es Terra? | No, el alias apunta a GPT-5.6 Sol |
| ¿Precio API = límite Codex? | No |
¿Qué retira exactamente OpenAI?
OpenAI indica que GPT-5.4 y GPT-5.4 mini dejan de estar disponibles en Codex al iniciar sesión con ChatGPT el 31 de agosto de 2026.[1]
Codex puede utilizarse mediante app de escritorio, CLI, extensión IDE y web.[1]
No es una retirada global de los modelos en todos los productos.
Mapa oficial de migración
GPT-5.4 → GPT-5.6 Terra
GPT-5.4 mini → GPT-5.6 Luna
Terra está posicionado para equilibrar inteligencia y coste; Luna para workloads de gran volumen sensibles al precio.[5][6][7]
Qué NO está afectado
OpenAI API
Codex con una API key propia
Un sistema que llama a gpt-5.4 vía API no debe considerarse automáticamente roto por este aviso de Codex.
¿Conviene migrar también la API?
Puede ser recomendable, pero es otra decisión.
OpenAI aconseja al migrar desde GPT-5.4 mantener primero el mismo reasoning effort y probar después un nivel inferior con tareas representativas.[10]
La familia GPT-5.6 se presentó primero con la preview de GPT-5.6 Sol el 26 de junio, y OpenAI anunció el lanzamiento más amplio de GPT-5.6 el 9 de julio de 2026.[11][12]
GPT-5.4 vs GPT-5.6 Terra
| Parámetro | GPT-5.4 | Terra |
|---|---|---|
| Contexto | 1,050,000 | 1,050,000 |
| Max output | 128,000 | 128,000 |
| Knowledge cutoff | 31 ago 2025 | 16 feb 2026 |
| Input / 1M | $2.50 | $2.00 |
| Cached input | $0.25 | $0.20 |
| Output / 1M | $15.00 | $12.00 |
| Reasoning | none–xhigh | none–max |
| Default API documentado | none | medium |
Terra es 20% más barato en las tarifas estándar de input, cached input y output.
GPT-5.4 mini vs GPT-5.6 Luna
| Parámetro | GPT-5.4 mini | Luna |
|---|---|---|
| Contexto | 400,000 | 1,050,000 |
| Max output | 128,000 | 128,000 |
| Knowledge cutoff | 31 ago 2025 | 16 feb 2026 |
| Input / 1M | $0.75 | $0.20 |
| Cached input | $0.075 | $0.02 |
| Output / 1M | $4.50 | $1.20 |
| Reasoning | none–xhigh | none–max |
| Default API documentado | none | medium |
Luna cuesta alrededor de 73% menos por token que GPT-5.4 mini en API estándar y ofrece 2,625× más contexto.
Precio API y límites Codex no son lo mismo
La página de Codex muestra actualmente rangos aproximados de mensajes locales en una ventana de cinco horas, por ejemplo:[2]
GPT-5.4: 20–100 / 5h
Terra: 20–110 / 5h
GPT-5.4 mini: 60–350 / 5h
Luna: 50–280 / 5h
Son rangos, no garantías, y pueden existir límites semanales adicionales.[2]
Créditos Business / Enterprise
Rate card actual:[3]
| Modelo | Input credits / 1M | Cached | Output |
|---|---|---|---|
| GPT-5.4 | 62.5 | 6.25 | 375 |
| Terra | 50 | 5 | 300 |
| GPT-5.4 mini | 18.75 | 1.875 | 113 |
| Luna | 5 | 0.5 | 30 |
El consumo real depende de tokens.[3]
Principal riesgo: defaults de reasoning
GPT-5.4 y mini documentan none como default API.[8][9]
Terra y Luna documentan medium.[6][7]
Cambiar solo el model slug sin fijar reasoning.effort puede cambiar a la vez latencia, tokens y comportamiento.
Codex Workspace puede tener otros defaults
Los admins pueden configurar starting model, reasoning level, speed, Fast Mode y new-chat behavior.[1]
El default API no describe necesariamente cada sesión Codex.
requirements.toml tiene prioridad
Orden oficial:[1]
managed requirements.toml
→ workspace starting defaults
→ local member starting choice
Por ello cambiar solo el default del workspace puede ser insuficiente.
Qué inventariar
OpenAI enumera:[1]
workspace defaults
saved model settings
managed configurations
automations
POLPROG recomienda añadir scripts CLI, CI/CD, templates, variables de entorno, wrappers internos, documentación y onboarding.
Buscar referencias antiguas
rg -n --hidden \
-g '!node_modules' \
-g '!.git' \
'gpt-5\.4(-mini)?|GPT-5\.4( mini)?' .
Y opcionalmente:
rg -n 'gpt-5\.4(-mini)?' ~/.codex 2>/dev/null
Es una recomendación de auditoría POLPROG, no un comando oficial de OpenAI.
Evita search-and-replace global
El nombre del modelo puede aparecer en documentación histórica, changelogs, logs o tests. Cambia solo referencias activas.
Cuidado con gpt-5.6
OpenAI documenta:
gpt-5.6 → GPT-5.6 Sol
Si quieres Terra usa gpt-5.6-terra; para Luna, gpt-5.6-luna.[6][7]
Ejemplo API con Terra
from openai import OpenAI
client = OpenAI()
response = client.responses.create(
model="gpt-5.6-terra",
reasoning={"effort": "medium"},
input="Review this pull request and identify correctness regressions."
)
print(response.output_text)
OpenAI recomienda Responses API para reasoning, tool calling y multi-turn con GPT-5.6.[10]
Ejemplo high-volume con Luna
from openai import OpenAI
client = OpenAI()
response = client.responses.create(
model="gpt-5.6-luna",
reasoning={"effort": "low"},
input="Classify this issue and return the owning engineering team."
)
print(response.output_text)
Luna está orientado a workloads de alto volumen y coste sensible.[7]
No cambies prompt y modelo al mismo tiempo
OpenAI recomienda cambiar primero el modelo manteniendo funcionalmente estable el prompt y ajustar después según los evals.[10]
Así puedes atribuir correctamente cualquier regresión.
Cómo ajustar reasoning
old effort
→ mismo effort en GPT-5.6
→ probar un nivel inferior
→ comparar calidad, latencia y coste
GPT-5.6 soporta none, low, medium, high, xhigh, max.
Terra o Luna
Terra: workloads anteriores GPT-5.4, cambios multi-file, instrucciones complejas, equilibrio calidad/coste.
Luna: workloads GPT-5.4 mini, alto volumen, subagents, clasificación y tareas bien acotadas.
Es la ruta oficial Codex.[1]
¿Y Sol?
Sol es el flagship GPT-5.6 para trabajo complejo.[5]
Pero el reemplazo oficial de GPT-5.4 en este aviso de Codex es Terra, no Sol.[1]
Ventanas de contexto
GPT-5.4 1.05M → Terra 1.05M
GPT-5.4 mini 400K → Luna 1.05M
Más contexto nominal no garantiza mejor razonamiento sobre un repo completo.
Long context y pricing
En Terra y Luna, prompts por encima de 272K input tokens se cobran para toda la request a:
2× input
1.5× output
Knowledge cutoff más reciente no sustituye tools
GPT-5.4/mini: 31 agosto 2025.
Terra/Luna: 16 febrero 2026.[6][7][8][9]
Para datos actuales sigue siendo necesario contexto de repo, documentación y herramientas.
Disponibilidad depende del plan
OpenAI documenta acceso limitado a Terra en Free/Go mediante Work/Codex y acceso más amplio a GPT-5.6 en Plus, Pro, Business y Enterprise.[4]
Los límites exactos deben revisarse en pricing.[2][4]
Automations son críticas
Una automatización puede conservar el modelo antiguo hasta su próxima ejecución. OpenAI las incluye explícitamente en la lista de elementos que hay que actualizar.[1]
Enterprise: tres niveles
Hay que auditar los tres.
Evals de migración
Selecciona 20–50 tareas reales: bugfix, refactor, tests, dependency migration, regression analysis, feature, code review y documentación.
Mide:
task success
test pass rate
retry rate
diff size
out-of-scope changes
tool calls
latency
tokens
credits
Plan mínimo en un día
- Inventariar referencias GPT-5.4.
- GPT-5.4 → Terra; GPT-5.4 mini → Luna para Codex con auth ChatGPT.
- Revisar workspace y managed config.
- Actualizar automations.
- Fijar reasoning donde importe estabilidad.
- Ejecutar smoke tests.
- Optimizar después prompts y coste.
Qué no hacer
- No afirmar que GPT-5.4 desaparece de API.
- No usar
gpt-5.6pensando que es Terra. - No equiparar precio API con límites Codex.
- No cambiar model, prompt y reasoning sin baseline.
- No olvidar automations.
- No inventar una hora exacta de apagado.
Checklist de producción
Inventario
- Todas las referencias
gpt-5.4encontradas. - Todas las referencias
gpt-5.4-miniencontradas. - Workspace defaults revisados.
- Saved settings revisados.
- Managed configs revisadas.
- Automations revisadas.
- Scripts CLI revisados.
- CI/CD revisado.
Configuración
- GPT-5.4 sustituido por Terra en Codex/ChatGPT auth.
- GPT-5.4 mini sustituido por Luna.
-
requirements.tomlrevisado. - Starting model revisado.
- Reasoning revisado.
- Fast Mode policy revisada.
- No se usó alias
gpt-5.6cuando se necesita Terra. - IDs explícitos usados en API cuando importa estabilidad.
Evals
- Prompt anterior conservado como baseline.
- Mismo reasoning effort probado.
- Un nivel inferior probado.
- Test pass rate medido.
- Retry rate medido.
- Latency medida.
- Tokens medidos.
- Credits medidos.
- Out-of-scope changes revisados.
- Long agent sessions probadas.
Operaciones
- Documentación actualizada.
- Onboarding actualizado.
- Templates actualizados.
- Scheduled tasks actualizados.
- Monitoring post-migración activo.
- Fallback model definido.
- Pricing Codex actual comprobado.
- Límites actuales comprobados.
Veredicto POLPROG
La noticia del 31 de agosto es importante, pero más estrecha que “OpenAI retira GPT-5.4”.
GPT-5.4 y GPT-5.4 mini
→ retirement en Codex con login ChatGPT
GPT-5.4 → GPT-5.6 Terra
GPT-5.4 mini → GPT-5.6 Luna
OpenAI API → no afectada por este cambio concreto
Codex + API key propia → no afectado
Terra mantiene 1.05M de contexto y baja 20% los precios API estándar.[6][8]
Luna pasa de 400K a 1.05M de contexto frente a GPT-5.4 mini y reduce tarifas token alrededor del 73%.[7][9]
La migración segura es:
Aplicar el mapping oficial, mantener primero prompt y reasoning actuales como baseline, ejecutar evals y solo después optimizar coste y latencia.

