GPT-6 Astra: benchmarks, prijs, API & vergelijking 2026 | POLPROG Naar de inhoud

GPT-6 Astra is beschikbaar: benchmarks, prijs, 1,05M context, API en vergelijking met GPT-5.6 Sol en Claude Fable 5.1

OpenAI kondigde GPT-6 Astra officieel aan op 3 september 2026. De uitrol verloopt gefaseerd: eerst voor een beperkte groep organisaties en volgens OpenAI in de daaropvolgende dagen voor ChatGPT Plus, Pro, Business en Enterprise, plus API, Microsoft Azure en Amazon Bedrock. Astra heeft 1.050.000 contexttokens, maximaal 128.000 uitvoertokens en Standard API-prijzen van $10/MTok invoer en $50/MTok uitvoer. Dit artikel scheidt OpenAI-resultaten van onafhankelijke tests en methodologische kanttekeningen.

AI
Gepubliceerd Geschreven door Leestijd 8 min lezen

OpenAI kondigde GPT-6 Astra officieel aan op 3 september 2026. De uitrol verloopt gefaseerd: eerst voor een beperkte groep organisaties en volgens OpenAI in de daaropvolgende dagen voor ChatGPT Plus, Pro, Business en Enterprise, plus API, Microsoft Azure en Amazon Bedrock. Astra heeft 1.050.000 contexttokens, maximaal 128.000 uitvoertokens en Standard API-prijzen van $10/MTok invoer en $50/MTok uitvoer. Dit artikel scheidt OpenAI-resultaten van onafhankelijke tests en methodologische kanttekeningen.

Op deze pagina
  1. 1Release en beschikbaarheid: GPT-6 Astra verscheen op 3 september 2026
  2. 2Specificaties: 1,05M context en 128K uitvoer
  3. 3API-prijs: $10 invoer, $50 uitvoer en de 272K-grens
  4. 4Redeneerniveaus: low, medium, high, xhigh en max
  5. 5Migreren vanaf GPT-5.6 is meer dan een model-ID wijzigen
  6. 6Computergebruik: Agents’ Last Exam, OSWorld en ScreenSpot-Pro
  7. 7Professioneel werk: AutomationBench, BenchCAD en BrowseComp
  8. 8Programmeren: Terminal-Bench 4.0, DeepSWE en FrontierCode
  9. 9Wetenschap en wiskunde: zeer sterke resultaten zonder volledige dominantie
  10. 10Lange context: MRCR tot 1M tokens
  11. 11ARC-AGI-3: waarom 99,9% methodologische context nodig heeft
  12. 12Artificial Analysis: sterker programmeren, hoge prijs
  13. 13Cybersecurity: OpenAI’s eerste Critical-model
  14. 14Veiligheid en monitorability: beter gedrag, moeilijker redeneren-toezicht
  15. 15Prompt-injection-robuustheid en taakgrenzen
  16. 16Nieuwe API-functies: async tools en mid-turn steering
  17. 17Codex en werkgeheugen over contextvensters
  18. 18Dataretentie: ZDR en Private Safety Processing
  19. 19Uitrol via ChatGPT, API, Azure en Bedrock
  20. 20GPT-6 Astra vs GPT-5.6 Sol en Claude: waar het voordeel echt zit
  21. 21Wat veranderde echt ten opzichte van GPT-5.6 Sol?

Release en beschikbaarheid: GPT-6 Astra verscheen op 3 september 2026

OpenAI kondigde GPT-6 Astra aan op 3 september 2026. Bij de start was toegang beperkt tot enkele organisaties; uitbreiding naar betaalde ChatGPT-plannen en API werd voor de volgende dagen aangekondigd. Reuters en Microsoft bevestigen de gefaseerde uitrol. [1][7][8]

Specificaties: 1,05M context en 128K uitvoer

ParameterGPT-6 Astra
Contextvenster1,050,000 tokens
Max. uitvoer128,000 tokens
kennisgrensApr 30, 2026
Invoertext + images
Uitvoertext
Redenerenlow / medium / high / xhigh / max

De API-documentatie noemt 1.050.000 contexttokens, 128.000 maximale uitvoertokens en een kennisgrens van 30 april 2026. Het model accepteert tekst en afbeeldingen en genereert tekst. [2][11]

API-prijs: $10 invoer, $50 uitvoer en de 272K-grens

ParameterPrijs / MTok
Invoer$10.00
Gecachete invoer$1.00
Cacheschrijving$12.50
Uitvoer$50.00
>272K invoer2× invoer/cache; 1.5× uitvoer
Batch / Flex50% of Standard
Fast2× applicable rates

Standard kost $10/MTok invoer, $1/MTok gecachete invoer, $12.50/MTok cacheschrijving en $50/MTok uitvoer. Boven 272K invoertokens wordt de hele verzoek gefactureerd tegen 2× invoer/cache en 1,5× uitvoer. Batch en Flex zijn 50% van Standard, Fast 2×. [2]

Redeneerniveaus: low, medium, high, xhigh en max

`reasoning.effort` ondersteunt `low`, `medium`, `high`, `xhigh` en `max`. `none` wordt niet ondersteund; bij migratie vanaf `none` of `minimal` adviseert OpenAI te starten met `low`. [2][3]

Migreren vanaf GPT-5.6 is meer dan een model-ID wijzigen

De model-ID is `gpt-6-astra`, maar toolaanroepen vereist Responses API. OpenAI vraagt ook niet-ondersteunde parameters zoals `temperature`, `top_p`, `top_logprobs` en bij Chat Completions `logprobs` te verwijderen. [3]

  • Zet de model-ID op `gpt-6-astra`.
  • Gebruik Responses API voor toolaanroepen.
  • Verwijder `temperature`, `top_p`, `top_logprobs`; bij Chat Completions ook `logprobs`.
  • Als je `none` of `minimal` gebruikte, begin met `low`.
  • Controleer Fast mode apart: niet beschikbaar met EU data residency.

Computergebruik: Agents’ Last Exam, OSWorld en ScreenSpot-Pro

OpenAI rapporteert 59,3% op Agents’ Last Exam, 72,6% op OSWorld 2.0 offline partial en 92,7% op ScreenSpot-Pro zonder tools. In OSWorld-simulaties behaalde Astra ook hogere prestaties in ongeveer 47% minder tijd per taak dan GPT-5.6 Sol. [1]

Professioneel werk: AutomationBench, BenchCAD en BrowseComp

BenchmarkGPT-6 AstraGPT-5.6 SolClaude Fable 5.1Claude Opus 5
Agents' Last Exam59.3%53.6%55.5%
OSWorld 2.0 offline partial72.6%65.7%70.2%
AutomationBench41.4%18.1%31.4%26.9%
BenchCAD95.9%83.3%84.3%82.1%
Terminal-Bench 4.057.9%37.3%55.8%52.3%
DeepSWE v1.174.1%72.7%67.4%73.7%
Terminal-Bench Science 0.164.6%22.4%52.6%30.0%
FrontierMath Tier 4 (v2)97.6%83.0%87.8%73.2%
GPQA Diamond96.0%94.6%93.7%93.7%
HLE with tools57.2%65.0%63.6%

Astra scoort 41,4% op AutomationBench tegenover 18,1% voor GPT-5.6 Sol en 31,4% voor Claude Fable 5.1. BenchCAD is 95,9% en BrowseComp 91,5%. Dit zijn door OpenAI gepubliceerde introductie-configuraties. [1]

Programmeren: Terminal-Bench 4.0, DeepSWE en FrontierCode

Terminal-Bench 4.0: 57,9%; DeepSWE v1.1: 74,1%; FrontierCode 1.1 Extended: 64,5%. Het verschil varieert per programmeren-evaluatie en sommige concurrenten blijven dichtbij of hoger. [1]

Wetenschap en wiskunde: zeer sterke resultaten zonder volledige dominantie

Astra scoort 64,6% op Terminal-Bench Science 0.1, 97,6% op FrontierMath Tier 4 (v2) en 96,0% op GPQA Diamond. Op Humanity’s Last Exam met tools scoort Astra 57,2%, tegenover 65,0% voor Fable 5.1 en 63,6% voor Opus 5. [1]

Lange context: MRCR tot 1M tokens

OpenAI MRCR v2 toont 100,0% tussen 256K–512K en 96,3% tussen 512K–1M. Voor productie moet de hogere prijs boven 272K invoertokens worden meegerekend. [1][2]

ARC-AGI-3: waarom 99,9% methodologische context nodig heeft

De 99,9% op ARC-AGI-3 gebruikt een Provider Adapter die redeneren state bewaart en compaction ondersteunt. ARC Prize rapporteert 62,7% met de Standard harness en 99,9% met de adapter; Astra gebruikte op 96% van de levels minder acties dan de mediane geteste mens. [1][5]

Artificial Analysis: sterker programmeren, hoge prijs

Artificial Analysis geeft Astra `max` 61 punten op de Intelligence Index en 67 op de Coding Agent Index. De onafhankelijke test ziet grote tokenefficiëntie in programmeren, maar door de hogere tokenprijs zijn de kosten per taak op de algemene index hoger dan bij GPT-5.6 Sol op maximale redeneerinspanning. [6]

Cybersecurity: OpenAI’s eerste Critical-model

OpenAI classificeert Astra als zijn eerste model op Critical-niveau voor cybersecurity. Zonder production beveiligingsmaatregelen scoorde het 100% op ExploitBench, 42,4% op ExploitGym en 88,0% op SRE-Bench in één poging; de System Card beschrijft ook geavanceerde zero-day-capaciteiten. [1][4]

Veiligheid en monitorability: beter gedrag, moeilijker redeneren-toezicht

De System Card laat een dubbel beeld zien: Astra is gemiddeld beter afgestemd, maar de geschreven geschreven redeneerproces is in doelbewuste evasietests moeilijker te monitoren dan die van GPT-5.6 Sol. OpenAI benadrukt dat dit doelbewust vijandig tests waren. [4]

Prompt-injection-robuustheid en taakgrenzen

OpenAI meldt betere prompt-injection-robuustheid en betere naleving van toegestane taakgrenzen. In een simulatie van meer dan 54.000 interne Codex-taken kreeg Astra ongeveer half zoveel flags voor ernstigere misalignment als GPT-5.6 Sol. [4]

Nieuwe API-functies: async tools en mid-turn steering

Astra introduceert async toolaanroepen, mid-turn steering en redeneren-wijzigingen via `configuration_update` zonder de oorspronkelijke promptprefix te herschrijven. Dit is nuttig voor agents die op trage tools wachten of nieuwe instructies krijgen. [3]

Codex en werkgeheugen over contextvensters

In Codex test OpenAI persistente notities over contextvensters heen. Oudere vensters blijven doorzoekbaar zodat eisen of testresultaten kunnen worden teruggevonden die niet in een compacte samenvatting stonden. [1]

Dataretentie: ZDR en Private Safety Processing

OpenAI ondersteunt Zero Data Retention voor in aanmerking komende API-klanten. Private Safety Processing wordt getest om veiligheidspatronen over gerelateerde interacties te detecteren zonder onderliggende klantinhoud aan OpenAI-medewerkers bloot te stellen. [1][9]

Uitrol via ChatGPT, API, Azure en Bedrock

Astra is aangekondigd voor Plus, Pro, Business, Enterprise, API, Microsoft Azure en Amazon Bedrock. Astra Pro komt voor Pro, Business en Enterprise, maar bij de lancering is geen apart publiek API-ID of tarief gepubliceerd. [1][8]

GPT-6 Astra vs GPT-5.6 Sol en Claude: waar het voordeel echt zit

De grootste voordelen tegenover GPT-5.6 Sol zitten in agentic werk, computergebruik, Terminal-Bench Science en diverse professionele tests. Claude wordt niet overal verslagen: Fable 5.1 staat hoger op HLE met tools en op de Artificial Analysis Intelligence Index in OpenAI’s tabel. [1][6]

Wat veranderde echt ten opzichte van GPT-5.6 Sol?

Ten opzichte van GPT-5.6 Sol veranderen redeneren-niveaus, prijs per token, async tools, steering tijdens de response, long-context-prestaties en het cyber-capabilityniveau. Een productiemigratie vereist nieuwe tests van prompts, tools, kosten en veiligheid. [2][3][4][11]

GPT-6 Astra is een duidelijke stap vooruit voor agentic werk, computergebruik, programmeren en lange context, maar de data tonen geen universele winnaar. ARC Prize en Artificial Analysis laten zien dat harness-configuratie, tokenefficiëntie en prijs de interpretatie sterk beïnvloeden. In productie zijn taakvoltooiing, retries, latency, tokengebruik, toolbetrouwbaarheid en totale kosten belangrijk, vooral boven 272K invoertokens.

AI GPT-6 GPT-6 Astra OpenAI Benchmarks Coding AI Agents Computer Use Cybersecurity API

Veelgestelde vragen

Is GPT-6 Astra echt uitgebracht?

Ja. OpenAI kondigde het op 3 september 2026 aan met een gefaseerde uitrol. [1][7]

Wat is de API model-ID?

gpt-6-astra. [2][3]

Hoe groot is de context?

1.050.000 tokens. [2]

Wat is de maximale uitvoer?

128.000 tokens. [2]

Wat is de kennisgrens?

30 april 2026. [2]

Wat kost Astra in de API?

Standard: $10/MTok invoer, $1/MTok gecachete invoer, $12.50/MTok cacheschrijving en $50/MTok uitvoer. [2]

Kost zeer lange context meer?

Ja. Boven 272K invoertokens geldt voor de hele verzoek 2× invoer/cache en 1,5× uitvoer. [2]

Ondersteunt Astra none voor reasoning.effort?

Nee. Beschikbaar zijn low, medium, high, xhigh en max. [2][3]

Kan ik Chat Completions gebruiken?

Ja, maar toolaanroepen met Astra vereist Responses API. [3]

Is 99,9% ARC-AGI-3 direct vergelijkbaar?

Nee. Het gebruikt Provider Adapter; ARC Prize rapporteert 62,7% met de Standard harness. [5]

Is Astra beter dan Claude Fable 5.1?

Het wint veel agentic- en programmerentests, maar niet allemaal; Fable 5.1 scoort hoger op HLE met tools. [1]

Wat betekent Critical voor cybersecurity?

Het is een OpenAI Preparedness Framework-niveau voor geavanceerde exploitdetectie en -ontwikkeling. [4]

Ondersteunt Astra Zero Data Retention?

Ja, voor in aanmerking komende API-klanten. [1][9]

Wat is GPT-6 Astra Pro?

OpenAI kondigde een Pro-variant aan voor Pro, Business en Enterprise, zonder apart publiek API-ID of prijs bij introductie. [1]

Moet ik migreren vanaf GPT-5.6 Sol?

Een POC is zinvol voor agents, programmeren, computergebruik en lange context, maar kosten, toolaanroepen, redeneren en veiligheid moeten opnieuw worden getest. [2][3][4]

Bronnen en referenties

  1. OpenAI, GPT-6 Astra: A new generation of intelligence12345678910111213141516
  2. OpenAI API, GPT-6 Astra model12345678910111213
  3. OpenAI API, Model guidance: GPT-6 Astra12345678
  4. OpenAI Deployment Safety Hub, GPT-6 Astra System Card123456
  5. ARC Prize, OpenAI's GPT-6 Astra on ARC-AGI-312
  6. Artificial Analysis, Benchmarking GPT-6 Astra12
  7. Reuters, OpenAI launches new Astra model amid growing scrutiny over agents' safety12
  8. Microsoft Azure, GPT-6 Astra: Frontier intelligence for work, now available in Microsoft Foundry12
  9. OpenAI, Offering Zero Data Retention for frontier models12
  10. OpenAI, The Hugging Face incident and the road aheadaanvullend materiaal
  11. OpenAI API, Models12

Was dit nuttig?

Ontvang nieuwe artikelen per e-mail

Eén korte e-mail per nieuw blogartikel. Geen spam, uitschrijven in één klik.

We gebruiken je e-mail alleen om nieuwe artikelen te sturen. Geen delen met derden.

Terug naar de blog