Vydání a dostupnost: GPT-6 Astra vyšlo 3. září 2026
OpenAI oznámilo GPT-6 Astra 3. září 2026. Při startu byl přístup omezen na část organizací, širší dostupnost měla následovat v dalších dnech. Reuters a Microsoft potvrzují postupný nasazení. [1][7][8]
Technické parametry: 1,05M kontextu a 128K výstupu
| Parametr | GPT-6 Astra |
|---|---|
| Kontextové okno | 1,050,000 tokens |
| Max. výstup | 128,000 tokens |
| hranice znalostí | Apr 30, 2026 |
| Vstup | text + images |
| Výstup | text |
| Uvažování | low / medium / high / xhigh / max |
Dokumentace API uvádí 1 050 000 tokenů kontextu, 128 000 maximálních tokenů výstupu a hranice znalostí 30. dubna 2026. Model přijímá text a obrázky a vrací text. [2][11]
Cena API: $10 vstup, $50 výstup a hranice 272K
| Parametr | Cena / MTok |
|---|---|
| Vstup | $10.00 |
| Vstup z mezipaměti | $1.00 |
| Zápis do mezipaměti | $12.50 |
| Výstup | $50.00 |
| >272K vstup | 2× vstup/cache; 1.5× výstup |
| Batch / Flex | 50% of Standard |
| Fast | 2× applicable rates |
Standardní ceny jsou $10/MTok vstupu, $1/MTok vstup z mezipaměti, $12.50/MTok zápis do mezipaměti a $50/MTok výstupu. Nad 272K vstupních tokenů se celý požadavek účtuje za 2× vstup/cache a 1,5× výstup. Batch a Flex stojí 50% Standard, Fast 2×. [2]
Úrovně uvažování: low, medium, high, xhigh a max
`reasoning.effort` podporuje `low`, `medium`, `high`, `xhigh` a `max`. `none` není podporováno; při migraci z `none` nebo `minimal` OpenAI doporučuje začít s `low`. [2][3]
Migrace z GPT-5.6 není jen změna model ID
Model ID je `gpt-6-astra`, ale volání nástrojů vyžaduje Responses API. OpenAI také doporučuje odstranit nepodporované parametry `temperature`, `top_p`, `top_logprobs` a u Chat Completions také `logprobs`. [3]
- Nastavte model ID na `gpt-6-astra`.
- Pro volání nástrojů použijte Responses API.
- Odstraňte `temperature`, `top_p`, `top_logprobs`; v Chat Completions také `logprobs`.
- Pokud jste používali `none` nebo `minimal`, začněte testovat s `low`.
- Fast mode ověřte zvlášť: s EU data residency není pro Astrou dostupný.
Ovládání počítače: Agents’ Last Exam, OSWorld a ScreenSpot-Pro
OpenAI uvádí 59,3% na Agents’ Last Exam, 72,6% na OSWorld 2.0 offline partial a 92,7% na ScreenSpot-Pro bez nástrojů. V simulacích OSWorld Astra dosáhla vyššího výkonu přibližně za o 47% kratší čas na úkol než GPT-5.6 Sol. [1]
Profesní práce: AutomationBench, BenchCAD a BrowseComp
| Benchmark | GPT-6 Astra | GPT-5.6 Sol | Claude Fable 5.1 | Claude Opus 5 |
|---|---|---|---|---|
| Agents' Last Exam | 59.3% | 53.6% | — | 55.5% |
| OSWorld 2.0 offline partial | 72.6% | 65.7% | — | 70.2% |
| AutomationBench | 41.4% | 18.1% | 31.4% | 26.9% |
| BenchCAD | 95.9% | 83.3% | 84.3% | 82.1% |
| Terminal-Bench 4.0 | 57.9% | 37.3% | 55.8% | 52.3% |
| DeepSWE v1.1 | 74.1% | 72.7% | 67.4% | 73.7% |
| Terminal-Bench Science 0.1 | 64.6% | 22.4% | 52.6% | 30.0% |
| FrontierMath Tier 4 (v2) | 97.6% | 83.0% | 87.8% | 73.2% |
| GPQA Diamond | 96.0% | 94.6% | 93.7% | 93.7% |
| HLE with tools | 57.2% | — | 65.0% | 63.6% |
Astra má 41,4% na AutomationBench proti 18,1% u GPT-5.6 Sol a 31,4% u Claude Fable 5.1. BenchCAD je 95,9% a BrowseComp 91,5%. Jde o uvedení konfigurace publikované OpenAI. [1]
Programování: Terminal-Bench 4.0, DeepSWE a FrontierCode
Terminal-Bench 4.0: 57,9%, DeepSWE v1.1: 74,1%, FrontierCode 1.1 Extended: 64,5%. Rozdíly se mění podle benchmarku a někteří konkurenti zůstávají velmi blízko nebo výše. [1]
Věda a matematika: velmi silné výsledky bez úplné dominance
Astra dosahuje 64,6% na Terminal-Bench Science 0.1, 97,6% na FrontierMath Tier 4 (v2) a 96,0% na GPQA Diamond. Na Humanity’s Last Exam s nástroji má 57,2%, zatímco Fable 5.1 65,0% a Opus 5 63,6%. [1]
Dlouhý kontext: MRCR až do 1M tokenů
OpenAI MRCR v2 ukazuje 100,0% v rozsahu 256K–512K a 96,3% v rozsahu 512K–1M. V produkci je nutné započítat vyšší cenu nad 272K vstupních tokenů. [1][2]
ARC-AGI-3: proč 99,9% potřebuje metodologický kontext
Výsledek 99,9% na ARC-AGI-3 používá Provider Adapter, který zachovává uvažování state a podporuje compaction. ARC Prize uvádí 62,7% se Standard harness a 99,9% s adapterem; Astra použila méně akcí než medián testovaných lidí na 96% úrovní. [1][5]
Artificial Analysis: silnější programování, vysoká cena
Artificial Analysis dává Astře `max` 61 bodů v Intelligence Index a 67 v Coding Agent Index. Nezávislý test ukazuje výraznou tokenovou efektivitu v programování, ale kvůli vyšší ceně tokenů vyšší náklady na úlohu než GPT-5.6 Sol v obecném indexu při maximálním úsilí. [6]
Kybernetická bezpečnost: první model OpenAI na úrovni Critical
OpenAI klasifikuje Astrou jako svůj první model na úrovni Critical pro kybernetickou bezpečnost. Bez produkčních ochranná opatření dosáhla 100% na ExploitBench, 42,4% na ExploitGym a 88,0% na SRE-Bench na první pokus; System Card popisuje i pokročilé zero-day schopnosti. [1][4]
Bezpečnost a monitorovatelnost: lepší chování, obtížnější dohled nad uvažování
System Card ukazuje dvojí výsledek: Astra je celkově lépe sladěná, ale její psaná psaný proces uvažování se v testech zaměřených na vyhýbání monitoringu hůře sleduje než u GPT-5.6 Sol. OpenAI zdůrazňuje záměrně nepřátelský povahu těchto testů. [4]
Odolnost proti vkládání škodlivých instrukcí a respektování hranic úkolu
OpenAI uvádí vyšší odolnost proti vkládání škodlivých instrukcí a lepší respektování autorizovaných hranic. V simulaci více než 54 000 interních úkolů Codex dostala Astra zhruba polovinu flagů za závažnější misalignment oproti GPT-5.6 Sol. [4]
Nové funkce API: asynchronní nástroje a mid-turn steering
Astra přidává async volání nástrojů, mid-turn steering a změny uvažování přes `configuration_update` bez přepisování původního prompt prefixu. To pomáhá agentům čekajícím na pomalé nástroje nebo přijímajícím nové instrukce. [3]
Codex a pracovní paměť mezi kontextovými okny
V Codex OpenAI testuje persistentní poznámky mezi kontextovými okny. Starší okna zůstávají prohledávatelná, takže lze dohledat požadavky nebo výsledky testů, které nebyly v kompaktním shrnutí. [1]
Retence dat: ZDR a Private Safety Processing
OpenAI deklaruje Zero Data Retention pro způsobilé API zákazníky. Testuje také Private Safety Processing pro rozpoznávání bezpečnostních vzorců mezi souvisejícími interakcemi bez zpřístupnění obsahu personálu OpenAI. [1][9]
Nasazení v ChatGPT, API, Azure a Bedrock
Astra je oznámena pro Plus, Pro, Business, Enterprise, API, Microsoft Azure a Amazon Bedrock. Astra Pro má být dostupná pro Pro, Business a Enterprise, ale při uvedeníi nebylo zveřejněno samostatné veřejné API ID ani cena. [1][8]
GPT-6 Astra vs GPT-5.6 Sol a Claude: kde je výhoda skutečná
Největší výhody proti GPT-5.6 Sol jsou v agentních úkolech, ovládání počítače, Terminal-Bench Science a několika profesních testech. Claude však není poražen všude: Fable 5.1 je výše na HLE s nástroji a na Artificial Analysis Intelligence Index v tabulce OpenAI. [1][6]
Co se skutečně změnilo proti GPT-5.6 Sol?
Proti GPT-5.6 Sol se mění uvažování úrovně, cena za token, async nástroje, steering během odpovědi, long-context výkon i kybernetická úroveň. Produkční migrace proto vyžaduje nové testy promptů, nástrojů, nákladů a bezpečnosti. [2][3][4][11]

