GPT-6 Astra: benchmarky, cena, API a srovnání 2026 | POLPROG Přejít na obsah

GPT-6 Astra je venku: benchmarky, cena, kontext 1,05M, API a srovnání s GPT-5.6 Sol a Claude Fable 5.1

OpenAI oficiálně oznámilo GPT-6 Astra 3. září 2026. Nasazení probíhá postupně: nejprve pro omezenou skupinu organizací a podle OpenAI v následujících dnech pro ChatGPT Plus, Pro, Business a Enterprise, stejně jako přes API, Microsoft Azure a Amazon Bedrock. Astra nabízí 1 050 000 tokenů kontextu, až 128 000 tokenů výstupu a cenu Standard API $10/MTok vstupu a $50/MTok výstupu. Článek odděluje údaje OpenAI, nezávislé testy a metodologická omezení.

AI
Publikováno Autor Čas čtení 19 min čtení

OpenAI oficiálně oznámilo GPT-6 Astra 3. září 2026. Nasazení probíhá postupně: nejprve pro omezenou skupinu organizací a podle OpenAI v následujících dnech pro ChatGPT Plus, Pro, Business a Enterprise, stejně jako přes API, Microsoft Azure a Amazon Bedrock. Astra nabízí 1 050 000 tokenů kontextu, až 128 000 tokenů výstupu a cenu Standard API $10/MTok vstupu a $50/MTok výstupu. Článek odděluje údaje OpenAI, nezávislé testy a metodologická omezení.

Na této stránce
  1. 1Vydání a dostupnost: GPT-6 Astra vyšlo 3. září 2026
  2. 2Technické parametry: 1,05M kontextu a 128K výstupu
  3. 3Cena API: $10 vstup, $50 výstup a hranice 272K
  4. 4Úrovně uvažování: low, medium, high, xhigh a max
  5. 5Migrace z GPT-5.6 není jen změna model ID
  6. 6Ovládání počítače: Agents’ Last Exam, OSWorld a ScreenSpot-Pro
  7. 7Profesní práce: AutomationBench, BenchCAD a BrowseComp
  8. 8Programování: Terminal-Bench 4.0, DeepSWE a FrontierCode
  9. 9Věda a matematika: velmi silné výsledky bez úplné dominance
  10. 10Dlouhý kontext: MRCR až do 1M tokenů
  11. 11ARC-AGI-3: proč 99,9% potřebuje metodologický kontext
  12. 12Artificial Analysis: silnější programování, vysoká cena
  13. 13Kybernetická bezpečnost: první model OpenAI na úrovni Critical
  14. 14Bezpečnost a monitorovatelnost: lepší chování, obtížnější dohled nad uvažování
  15. 15Odolnost proti vkládání škodlivých instrukcí a respektování hranic úkolu
  16. 16Nové funkce API: asynchronní nástroje a mid-turn steering
  17. 17Codex a pracovní paměť mezi kontextovými okny
  18. 18Retence dat: ZDR a Private Safety Processing
  19. 19Nasazení v ChatGPT, API, Azure a Bedrock
  20. 20GPT-6 Astra vs GPT-5.6 Sol a Claude: kde je výhoda skutečná
  21. 21Co se skutečně změnilo proti GPT-5.6 Sol?

Vydání a dostupnost: GPT-6 Astra vyšlo 3. září 2026

OpenAI oznámilo GPT-6 Astra 3. září 2026. Při startu byl přístup omezen na část organizací, širší dostupnost měla následovat v dalších dnech. Reuters a Microsoft potvrzují postupný nasazení. [1][7][8]

Technické parametry: 1,05M kontextu a 128K výstupu

ParametrGPT-6 Astra
Kontextové okno1,050,000 tokens
Max. výstup128,000 tokens
hranice znalostíApr 30, 2026
Vstuptext + images
Výstuptext
Uvažovánílow / medium / high / xhigh / max

Dokumentace API uvádí 1 050 000 tokenů kontextu, 128 000 maximálních tokenů výstupu a hranice znalostí 30. dubna 2026. Model přijímá text a obrázky a vrací text. [2][11]

Cena API: $10 vstup, $50 výstup a hranice 272K

ParametrCena / MTok
Vstup$10.00
Vstup z mezipaměti$1.00
Zápis do mezipaměti$12.50
Výstup$50.00
>272K vstup2× vstup/cache; 1.5× výstup
Batch / Flex50% of Standard
Fast2× applicable rates

Standardní ceny jsou $10/MTok vstupu, $1/MTok vstup z mezipaměti, $12.50/MTok zápis do mezipaměti a $50/MTok výstupu. Nad 272K vstupních tokenů se celý požadavek účtuje za 2× vstup/cache a 1,5× výstup. Batch a Flex stojí 50% Standard, Fast 2×. [2]

Úrovně uvažování: low, medium, high, xhigh a max

`reasoning.effort` podporuje `low`, `medium`, `high`, `xhigh` a `max`. `none` není podporováno; při migraci z `none` nebo `minimal` OpenAI doporučuje začít s `low`. [2][3]

Migrace z GPT-5.6 není jen změna model ID

Model ID je `gpt-6-astra`, ale volání nástrojů vyžaduje Responses API. OpenAI také doporučuje odstranit nepodporované parametry `temperature`, `top_p`, `top_logprobs` a u Chat Completions také `logprobs`. [3]

  • Nastavte model ID na `gpt-6-astra`.
  • Pro volání nástrojů použijte Responses API.
  • Odstraňte `temperature`, `top_p`, `top_logprobs`; v Chat Completions také `logprobs`.
  • Pokud jste používali `none` nebo `minimal`, začněte testovat s `low`.
  • Fast mode ověřte zvlášť: s EU data residency není pro Astrou dostupný.

Ovládání počítače: Agents’ Last Exam, OSWorld a ScreenSpot-Pro

OpenAI uvádí 59,3% na Agents’ Last Exam, 72,6% na OSWorld 2.0 offline partial a 92,7% na ScreenSpot-Pro bez nástrojů. V simulacích OSWorld Astra dosáhla vyššího výkonu přibližně za o 47% kratší čas na úkol než GPT-5.6 Sol. [1]

Profesní práce: AutomationBench, BenchCAD a BrowseComp

BenchmarkGPT-6 AstraGPT-5.6 SolClaude Fable 5.1Claude Opus 5
Agents' Last Exam59.3%53.6%55.5%
OSWorld 2.0 offline partial72.6%65.7%70.2%
AutomationBench41.4%18.1%31.4%26.9%
BenchCAD95.9%83.3%84.3%82.1%
Terminal-Bench 4.057.9%37.3%55.8%52.3%
DeepSWE v1.174.1%72.7%67.4%73.7%
Terminal-Bench Science 0.164.6%22.4%52.6%30.0%
FrontierMath Tier 4 (v2)97.6%83.0%87.8%73.2%
GPQA Diamond96.0%94.6%93.7%93.7%
HLE with tools57.2%65.0%63.6%

Astra má 41,4% na AutomationBench proti 18,1% u GPT-5.6 Sol a 31,4% u Claude Fable 5.1. BenchCAD je 95,9% a BrowseComp 91,5%. Jde o uvedení konfigurace publikované OpenAI. [1]

Programování: Terminal-Bench 4.0, DeepSWE a FrontierCode

Terminal-Bench 4.0: 57,9%, DeepSWE v1.1: 74,1%, FrontierCode 1.1 Extended: 64,5%. Rozdíly se mění podle benchmarku a někteří konkurenti zůstávají velmi blízko nebo výše. [1]

Věda a matematika: velmi silné výsledky bez úplné dominance

Astra dosahuje 64,6% na Terminal-Bench Science 0.1, 97,6% na FrontierMath Tier 4 (v2) a 96,0% na GPQA Diamond. Na Humanity’s Last Exam s nástroji má 57,2%, zatímco Fable 5.1 65,0% a Opus 5 63,6%. [1]

Dlouhý kontext: MRCR až do 1M tokenů

OpenAI MRCR v2 ukazuje 100,0% v rozsahu 256K–512K a 96,3% v rozsahu 512K–1M. V produkci je nutné započítat vyšší cenu nad 272K vstupních tokenů. [1][2]

ARC-AGI-3: proč 99,9% potřebuje metodologický kontext

Výsledek 99,9% na ARC-AGI-3 používá Provider Adapter, který zachovává uvažování state a podporuje compaction. ARC Prize uvádí 62,7% se Standard harness a 99,9% s adapterem; Astra použila méně akcí než medián testovaných lidí na 96% úrovní. [1][5]

Artificial Analysis: silnější programování, vysoká cena

Artificial Analysis dává Astře `max` 61 bodů v Intelligence Index a 67 v Coding Agent Index. Nezávislý test ukazuje výraznou tokenovou efektivitu v programování, ale kvůli vyšší ceně tokenů vyšší náklady na úlohu než GPT-5.6 Sol v obecném indexu při maximálním úsilí. [6]

Kybernetická bezpečnost: první model OpenAI na úrovni Critical

OpenAI klasifikuje Astrou jako svůj první model na úrovni Critical pro kybernetickou bezpečnost. Bez produkčních ochranná opatření dosáhla 100% na ExploitBench, 42,4% na ExploitGym a 88,0% na SRE-Bench na první pokus; System Card popisuje i pokročilé zero-day schopnosti. [1][4]

Bezpečnost a monitorovatelnost: lepší chování, obtížnější dohled nad uvažování

System Card ukazuje dvojí výsledek: Astra je celkově lépe sladěná, ale její psaná psaný proces uvažování se v testech zaměřených na vyhýbání monitoringu hůře sleduje než u GPT-5.6 Sol. OpenAI zdůrazňuje záměrně nepřátelský povahu těchto testů. [4]

Odolnost proti vkládání škodlivých instrukcí a respektování hranic úkolu

OpenAI uvádí vyšší odolnost proti vkládání škodlivých instrukcí a lepší respektování autorizovaných hranic. V simulaci více než 54 000 interních úkolů Codex dostala Astra zhruba polovinu flagů za závažnější misalignment oproti GPT-5.6 Sol. [4]

Nové funkce API: asynchronní nástroje a mid-turn steering

Astra přidává async volání nástrojů, mid-turn steering a změny uvažování přes `configuration_update` bez přepisování původního prompt prefixu. To pomáhá agentům čekajícím na pomalé nástroje nebo přijímajícím nové instrukce. [3]

Codex a pracovní paměť mezi kontextovými okny

V Codex OpenAI testuje persistentní poznámky mezi kontextovými okny. Starší okna zůstávají prohledávatelná, takže lze dohledat požadavky nebo výsledky testů, které nebyly v kompaktním shrnutí. [1]

Retence dat: ZDR a Private Safety Processing

OpenAI deklaruje Zero Data Retention pro způsobilé API zákazníky. Testuje také Private Safety Processing pro rozpoznávání bezpečnostních vzorců mezi souvisejícími interakcemi bez zpřístupnění obsahu personálu OpenAI. [1][9]

Nasazení v ChatGPT, API, Azure a Bedrock

Astra je oznámena pro Plus, Pro, Business, Enterprise, API, Microsoft Azure a Amazon Bedrock. Astra Pro má být dostupná pro Pro, Business a Enterprise, ale při uvedeníi nebylo zveřejněno samostatné veřejné API ID ani cena. [1][8]

GPT-6 Astra vs GPT-5.6 Sol a Claude: kde je výhoda skutečná

Největší výhody proti GPT-5.6 Sol jsou v agentních úkolech, ovládání počítače, Terminal-Bench Science a několika profesních testech. Claude však není poražen všude: Fable 5.1 je výše na HLE s nástroji a na Artificial Analysis Intelligence Index v tabulce OpenAI. [1][6]

Co se skutečně změnilo proti GPT-5.6 Sol?

Proti GPT-5.6 Sol se mění uvažování úrovně, cena za token, async nástroje, steering během odpovědi, long-context výkon i kybernetická úroveň. Produkční migrace proto vyžaduje nové testy promptů, nástrojů, nákladů a bezpečnosti. [2][3][4][11]

GPT-6 Astra je výrazný krok vpřed pro agentní práci, ovládání počítače, programování a dlouhý kontext, ale data nepodporují tvrzení, že je nejlepší pro každý pracovní scénář. ARC Prize a Artificial Analysis ukazují význam konfigurace testu, efektivity tokenů a ceny. V produkci je nutné měřit dokončení úkolu, opakování, latenci, spotřebu tokenů, spolehlivost nástrojů a celkové náklady, zejména nad 272K vstupních tokenů.

AI GPT-6 GPT-6 Astra OpenAI Benchmarks Coding AI Agents Computer Use Cybersecurity API

Často kladené otázky

Bylo GPT-6 Astra opravdu vydáno?

Ano. OpenAI ho oznámilo 3. září 2026 s postupným nasazeníem. [1][7]

Jaké je API model ID?

gpt-6-astra. [2][3]

Jak velký je kontext?

1 050 000 tokenů. [2]

Jaký je maximální výstup?

128 000 tokenů. [2]

Jaký je hranice znalostí?

30. dubna 2026. [2]

Kolik stojí API?

Standard: $10/MTok vstupu, $1/MTok vstup z mezipaměti, $12.50/MTok zápis do mezipaměti a $50/MTok výstupu. [2]

Je velmi dlouhý kontext dražší?

Ano. Nad 272K vstupních tokenů má celý požadavek 2× vstup/cache a 1,5× výstup. [2]

Podporuje Astra hodnotu none u reasoning.effort?

Ne. K dispozici jsou low, medium, high, xhigh a max. [2][3]

Lze použít Chat Completions?

Ano, ale volání nástrojů s Astrou vyžaduje Responses API. [3]

Je 99,9% ARC-AGI-3 přímo srovnatelné?

Ne. Využívá Provider Adapter; ARC Prize uvádí 62,7% se Standard harness. [5]

Je Astra lepší než Claude Fable 5.1?

Vyhrává řadu agentních a programování testů, ale ne všechny; Fable 5.1 je výše na HLE s nástroji. [1]

Co znamená Critical v kybernetické bezpečnosti?

Jde o úroveň OpenAI Preparedness Framework pro pokročilé schopnosti hledání a vývoje exploitů. [4]

Podporuje Astra Zero Data Retention?

Ano, pro způsobilé API zákazníky. [1][9]

Co je GPT-6 Astra Pro?

OpenAI oznámilo Pro variantu pro Pro, Business a Enterprise, ale při uvedeníi nezveřejnilo samostatné veřejné API ID ani cenu. [1]

Má smysl migrovat z GPT-5.6 Sol?

POC dává smysl pro agenty, programování, ovládání počítače a dlouhý kontext, ale je nutné znovu testovat náklady, volání nástrojů, uvažování a bezpečnost. [2][3][4]

Zdroje a reference

  1. OpenAI, GPT-6 Astra: A new generation of intelligence12345678910111213141516
  2. OpenAI API, GPT-6 Astra model12345678910111213
  3. OpenAI API, Model guidance: GPT-6 Astra12345678
  4. OpenAI Deployment Safety Hub, GPT-6 Astra System Card123456
  5. ARC Prize, OpenAI's GPT-6 Astra on ARC-AGI-312
  6. Artificial Analysis, Benchmarking GPT-6 Astra12
  7. Reuters, OpenAI launches new Astra model amid growing scrutiny over agents' safety12
  8. Microsoft Azure, GPT-6 Astra: Frontier intelligence for work, now available in Microsoft Foundry12
  9. OpenAI, Offering Zero Data Retention for frontier models12
  10. OpenAI, The Hugging Face incident and the road aheaddoplňující materiál
  11. OpenAI API, Models12

Bylo to užitečné?

Odebírejte nové články e-mailem

Jeden krátký e-mail na každý nový článek znalostní báze. Žádný spam, odhlášení jedním kliknutím.

Váš e-mail používáme pouze k zasílání nových článků. Žádné sdílení s třetími stranami.

Zpět do znalostní báze