31 серпня 2026 року OpenAI припиняє доступ до GPT-5.4 і GPT-5.4 mini в Codex для користувачів, які входять через акаунт ChatGPT. Офіційна заміна чітка: GPT-5.4 → GPT-5.6 Terra, а GPT-5.4 mini → GPT-5.6 Luna.[1]
Найважливіше уточнення: це не retirement GPT-5.4 з OpenAI API. OpenAI прямо зазначає, що ця зміна не впливає на API або використання Codex із власним API key.[1]
Тому твердження:
GPT-5.4 повністю зникає 31 серпня 2026 року.
було б неточним.
Правильно:
GPT-5.4 і GPT-5.4 mini припиняють бути доступними в Codex
при аутентифікації через ChatGPT account.
API і Codex з власним API key не входять у цю зміну.
OpenAI рекомендує оновити workspace defaults, saved model settings, managed configurations і automations.[1]
Terra зберігає 1 050 000 token context window GPT-5.4 і знижує стандартну API ціну з $2.50/$15 до $2/$12 за мільйон input/output tokens. Luna збільшує context відносно GPT-5.4 mini з 400K до 1.05M і суттєво знижує стандартну вартість.[6][7][8][9]
Однак це не повністю нейтральний drop-in. GPT-5.6 додає max reasoning, має інші documented API defaults для reasoning і нові capabilities. OpenAI рекомендує representative evals.[10]
Стан інформації: 31 серпня 2026 року. Офіційні джерела вказують дату, але ми не публікуємо непідтверджену точну годину вимкнення.
TL;DR
| Питання | Перевірена відповідь |
|---|---|
| Що змінюється 31 серпня? | GPT-5.4 і mini залишають Codex при ChatGPT login |
| Заміна GPT-5.4 | GPT-5.6 Terra |
| Заміна GPT-5.4 mini | GPT-5.6 Luna |
| OpenAI API affected? | Ні цією зміною |
| Codex з власним API key? | Не affected |
| Що перевірити | defaults, saved settings, managed configs, automations |
| Enterprise priority | managed requirements.toml > workspace default > local choice |
| Context GPT-5.4 | 1.05M |
| Context Terra | 1.05M |
| Context GPT-5.4 mini | 400K |
| Context Luna | 1.05M |
| Max output Terra/Luna | 128K |
| Cutoff Terra/Luna | 16 лютого 2026 |
| GPT-5.4 API | $2.50 / $0.25 cached / $15 |
| Terra API | $2.00 / $0.20 / $12 |
| GPT-5.4 mini API | $0.75 / $0.075 / $4.50 |
| Luna API | $0.20 / $0.02 / $1.20 |
| Reasoning Terra/Luna | none, low, medium, high, xhigh, max |
| API default Terra/Luna | medium |
| API default GPT-5.4 / mini | none |
gpt-5.6 = Terra? | Ні, alias веде на GPT-5.6 Sol |
| API price = Codex limit? | Ні |
Що саме припиняє OpenAI?
GPT-5.4 і GPT-5.4 mini перестають бути доступними в Codex 31 серпня 2026 при вході через ChatGPT account.[1]
Codex доступний через desktop app, CLI, IDE extension і web.[1]
Це не global retirement моделей.
Офіційний mapping
GPT-5.4 → GPT-5.6 Terra
GPT-5.4 mini → GPT-5.6 Luna
Terra позиціонується як balance intelligence/cost, Luna як cost-sensitive high-volume model.[5][6][7]
Що НЕ зачіпає зміна
OpenAI API
Codex з власним API key
API request до gpt-5.4 не слід вважати автоматично broken лише через цей Codex notice.
Чи варто все одно мігрувати API?
Можливо, але це окреме рішення.
OpenAI рекомендує при migration from GPT-5.4 спочатку залишити той самий reasoning effort, а потім протестувати також на один рівень нижче.[10]
Сімейство GPT-5.6 спочатку було представлено preview-версією GPT-5.6 Sol 26 червня, а ширший запуск GPT-5.6 OpenAI оголосила 9 липня 2026 року.[11][12]
GPT-5.4 vs GPT-5.6 Terra
| Параметр | GPT-5.4 | Terra |
|---|---|---|
| Context | 1,050,000 | 1,050,000 |
| Max output | 128,000 | 128,000 |
| Knowledge cutoff | 31.08.2025 | 16.02.2026 |
| Input / 1M | $2.50 | $2.00 |
| Cached input | $0.25 | $0.20 |
| Output / 1M | $15.00 | $12.00 |
| Reasoning | none–xhigh | none–max |
| Documented API default | none | medium |
Terra на стандартних token rates на 20% дешевша.
GPT-5.4 mini vs GPT-5.6 Luna
| Параметр | GPT-5.4 mini | Luna |
|---|---|---|
| Context | 400,000 | 1,050,000 |
| Max output | 128,000 | 128,000 |
| Knowledge cutoff | 31.08.2025 | 16.02.2026 |
| Input / 1M | $0.75 | $0.20 |
| Cached input | $0.075 | $0.02 |
| Output / 1M | $4.50 | $1.20 |
| Reasoning | none–xhigh | none–max |
| Documented API default | none | medium |
Luna приблизно на 73% дешевша і має 2,625× більший context window, ніж GPT-5.4 mini.
API pricing і Codex limits — різні системи
Codex pricing зараз показує орієнтовні ranges local messages у п'ятигодинному window:[2]
GPT-5.4: 20–100 / 5h
Terra: 20–110 / 5h
GPT-5.4 mini: 60–350 / 5h
Luna: 50–280 / 5h
Це ranges, не guarantee; можуть діяти additional weekly limits.[2]
Business / Enterprise credits
Current rate card:[3]
| Model | Input credits / 1M | Cached | Output |
|---|---|---|---|
| GPT-5.4 | 62.5 | 6.25 | 375 |
| Terra | 50 | 5 | 300 |
| GPT-5.4 mini | 18.75 | 1.875 | 113 |
| Luna | 5 | 0.5 | 30 |
Фактичне споживання залежить від tokens.[3]
Найбільший ризик: reasoning defaults
GPT-5.4 і mini мають documented API default none.[8][9]
Якщо змінити тільки model slug і не зафіксувати reasoning.effort, можна одночасно змінити latency, token usage і behavior.
Codex Workspace може мати інші defaults
Admins можуть налаштувати starting model, reasoning level, speed, Fast Mode і new-chat behavior.[1]
Тому API default не описує автоматично кожну Codex session.
requirements.toml має пріоритет
OpenAI документує порядок:[1]
managed requirements.toml
→ workspace starting defaults
→ local member starting choice
Зміна лише workspace default може бути недостатньою.
Що інвентаризувати
OpenAI називає:[1]
workspace defaults
saved model settings
managed configurations
automations
POLPROG також рекомендує перевірити CLI scripts, CI/CD, templates, env vars, internal wrappers, docs і onboarding.
Пошук старих references
rg -n --hidden \
-g '!node_modules' \
-g '!.git' \
'gpt-5\.4(-mini)?|GPT-5\.4( mini)?' .
І за потреби:
rg -n 'gpt-5\.4(-mini)?' ~/.codex 2>/dev/null
Це рекомендація audit від POLPROG, а не офіційна OpenAI migration command.
Не робіть blind global replace
Старі model names можуть бути правильними у changelog, historical docs, logs і snapshot tests. Змінюйте лише active configuration.
Обережно з alias gpt-5.6
OpenAI документує:
gpt-5.6 → GPT-5.6 Sol
Для Terra використовуйте gpt-5.6-terra, для Luna — gpt-5.6-luna.[6][7]
API приклад з Terra
from openai import OpenAI
client = OpenAI()
response = client.responses.create(
model="gpt-5.6-terra",
reasoning={"effort": "medium"},
input="Review this pull request and identify correctness regressions."
)
print(response.output_text)
OpenAI рекомендує Responses API для reasoning, tool calling і multi-turn workflows з GPT-5.6.[10]
High-volume приклад з Luna
from openai import OpenAI
client = OpenAI()
response = client.responses.create(
model="gpt-5.6-luna",
reasoning={"effort": "low"},
input="Classify this issue and return the owning engineering team."
)
print(response.output_text)
Luna призначена для high-volume, cost-sensitive workloads.[7]
Не змінюйте prompt і model одночасно
OpenAI рекомендує спершу змінити модель із функціонально стабільним prompt, а tuning робити після evals.[10]
Як налаштовувати reasoning
old effort
→ same effort on GPT-5.6
→ test one level lower
→ compare quality, latency, cost
GPT-5.6 підтримує none, low, medium, high, xhigh, max.
Terra чи Luna?
Terra: попередні GPT-5.4 workloads, multi-file tasks, complex instructions, balance quality/cost.
Luna: GPT-5.4 mini workloads, high volume, subagents, classification і well-bounded tasks.
Це відповідає official Codex mapping.[1]
А Sol?
Sol — flagship GPT-5.6 для complex professional work.[5]
Але official replacement GPT-5.4 у цьому Codex notice — Terra, не Sol.[1]
Context windows
GPT-5.4 1.05M → Terra 1.05M
GPT-5.4 mini 400K → Luna 1.05M
Більший nominal context не гарантує кращий repo-level reasoning.
Long context і API cost
Для Terra і Luna prompts понад 272K input tokens тарифікуються для всієї request як:
2× input price
1.5× output price
Новіший cutoff не замінює tools
GPT-5.4/mini: 31 серпня 2025.
Terra/Luna: 16 лютого 2026.[6][7][8][9]
Repo context, актуальна документація, file search і web search залишаються важливими.
Availability залежить від plan
OpenAI документує limited Terra access у Free/Go через Work/Codex і ширший GPT-5.6 access у Plus, Pro, Business та Enterprise.[4]
Точні limits треба перевіряти у current pricing.[2][4]
Automations критичні
Automation може використати old model лише під час наступного scheduled run. Саме тому OpenAI прямо називає automations серед елементів для update.[1]
Enterprise: три layers
Audit має покрити всі три.
Migration evals
Візьміть 20–50 real tasks: bugfix, refactor, tests, dependency migration, regression analysis, feature, code review, docs.
Вимірюйте:
task success
test pass rate
retry rate
diff size
out-of-scope changes
tool calls
latency
tokens
credits
Мінімальний план на один день
- Inventory усіх GPT-5.4 references.
- GPT-5.4 → Terra; GPT-5.4 mini → Luna для Codex з ChatGPT auth.
- Check workspace і managed config.
- Update automations.
- Pin reasoning там, де важлива stability.
- Run smoke tests.
- Потім optimize prompts і cost.
Чого не робити
- Не казати, що GPT-5.4 зникає з API.
- Не плутати
gpt-5.6з Terra. - Не прирівнювати API pricing до Codex limits.
- Не змінювати model, prompt і reasoning одночасно без baseline.
- Не забувати automations.
- Не вигадувати точну годину retirement.
Production checklist
Inventory
- Усі
gpt-5.4references знайдено. - Усі
gpt-5.4-minireferences знайдено. - Workspace defaults checked.
- Saved settings checked.
- Managed configs checked.
- Automations checked.
- CLI scripts checked.
- CI/CD checked.
Configuration
- GPT-5.4 replaced by Terra for Codex/ChatGPT auth.
- GPT-5.4 mini replaced by Luna.
-
requirements.tomlchecked. - Starting model checked.
- Reasoning level checked.
- Fast Mode policy checked.
-
gpt-5.6alias not used when Terra is required. - Explicit API model IDs used where stability matters.
Evals
- Old prompt preserved as baseline.
- Same reasoning effort tested.
- One lower effort tested.
- Test pass rate measured.
- Retry rate measured.
- Latency measured.
- Token usage measured.
- Credit usage measured.
- Out-of-scope changes reviewed.
- Long agent sessions tested.
Operations
- Documentation updated.
- Onboarding updated.
- Templates updated.
- Scheduled tasks updated.
- Post-migration monitoring enabled.
- Fallback model defined.
- Current Codex pricing checked.
- Current limits checked.
Висновок POLPROG
Зміна 31 серпня важлива, але вужча за твердження «OpenAI retires GPT-5.4».
GPT-5.4 і GPT-5.4 mini
→ retirement у Codex з ChatGPT login
GPT-5.4 → GPT-5.6 Terra
GPT-5.4 mini → GPT-5.6 Luna
OpenAI API → не affected цією конкретною зміною
Codex + own API key → не affected
Terra зберігає 1.05M context і знижує стандартний API token pricing на 20%.[6][8]
Luna збільшує context з 400K до 1.05M і знижує стандартну ціну приблизно на 73%.[7][9]
Найбезпечніший підхід:
Застосувати official mapping, спершу залишити prompt і reasoning як baseline, виконати evals і лише потім оптимізувати cost та latency.

