AI & computing › Generatieve AI & synthetische media

OpenAI lanceert GPT-6 Astra en spreekt van begin AGI-tijdperk

· Bijgewerkt 3 september 2026, 22:11 · 2 min leestijd

Generatieve AI & synthetische media
Beeld: The Decoder

OpenAI heeft zijn krachtigste taalmodel ooit gelanceerd: GPT-6 Astra. Het model scoort fors hoger dan voorganger GPT-5.6 Sol en concurrent Fable 5.1 van Anthropic op wiskunde, programmeren en cyberbeveiliging. President Greg Brockman noemt de release het begin van het 'AGI-tijdperk', al erkent hij dat er geen scherpe grens bestaat tussen gewone AI en kunstmatige algemene intelligentie.

OpenAI brengt GPT-6 Astra uit, het nieuwste en volgens het bedrijf meest capabele taalmodel dat het ooit heeft gemaakt. Het model rolt eerst uit naar geselecteerde organisaties via het Daybreak-programma van OpenAI. Betalende ChatGPT-gebruikers met een Plus-, Pro-, Business- of Enterprise-abonnement krijgen de komende dagen toegang, net als ontwikkelaars via de API en cloudplatforms zoals AWS Bedrock en Microsoft Azure. Pro-, Business- en Enterprise-klanten kunnen ook gebruikmaken van GPT-6 Astra Pro, een zwaardere variant van het model.

Astra is getraind op meer dan honderdduizend GPU's in het Stargate-datacenter in Texas, de grootste trainingsrun die OpenAI ooit heeft uitgevoerd. Onderzoeker Aidan Clark zegt dat de sprong van Sol naar Astra groter is dan de vorige generatiesprong, deels omdat eerdere AI-modellen zelf meehielpen bij het toezicht op de training.

Fors betere scores op vrijwel elke test

Op de benchmarks die OpenAI publiceerde, verslaat Astra zowel zijn voorganger GPT-5.6 Sol als de Fable-modellen van Anthropic. Het model haalt 99,9 procent op de redeneertest ARC-AGI-3, 97,6 procent op de wiskundetest FrontierMath Tier 4, 96 procent op de kennistest GPQA Diamond en 74,1 procent op de programmeertest DeepSWE. Ook op het besturen van een computer als een mens scoort Astra beter: 72,6 procent op OSWorld 2.0, in gemiddeld veertig minuten per taak tegenover 65,7 procent en 75 minuten voor Sol. Volgens OpenAI verbeterde het model tijdens de evaluatie zelfs een wiskundig resultaat over priemgetallen.

Duurder per token, maar goedkoper per taak

Het gebruik van Astra kost 10 dollar per miljoen invoertokens en 50 dollar per miljoen uitvoertokens, ongeveer 2,5 keer meer dan Sol en vergelijkbaar met Fable 5.1 van Anthropic. Brockman noemt tokenprijzen inmiddels een slechte maatstaf om modellen te vergelijken, omdat tokens tussen aanbieders en zelfs tussen eigen modellen niet één-op-één vergelijkbaar zijn. Belangrijker is volgens hem de prijs per afgeronde taak: op de coderingstest DeepSWE zou Astra in de duurste configuratie ongeveer 57 procent goedkoper uitpakken dan Sol.

Eerste model in de zwaarste veiligheidscategorie

Astra is het eerste model dat OpenAI intern indeelt als 'kritiek' wat cyberbeveiliging betreft. Dat betekent dat het model zelfstandig onbekende kwetsbaarheden kan vinden en aanvalsketens kan bouwen tegen goed beveiligde systemen, zonder dat een mens elke stap begeleidt. Op de test ExploitBench scoort Astra een perfecte honderd procent en het model ontdekte tijdens de evaluatie twee eerder onbekende zero-day-kwetsbaarheden, die inmiddels zijn gemeld bij de betrokken softwaremakers. De meest geavanceerde cyberbeveiligingsfuncties blijven voorlopig beperkt tot vertrouwde partijen binnen het Daybreak Blue-programma. OpenAI had de release eerder al uitgesteld om extra veiligheidstests uit te voeren.

Brockman erkende tijdens de presentatie dat er geen eenduidig moment is waarop een model officieel 'AGI' wordt. Toch sloot hij de bijeenkomst af met de woorden: "Welkom in het AGI-tijdperk." OpenAI-topman Sam Altman had eerder al gezegd dit jaar nog een model te verwachten dat hij zelf AGI zou noemen.

Achtergrond & begrippen

Wat betekent dit voor de toekomst? Als taalmodellen steeds vaker zelfstandig computers bedienen, code schrijven en zelfs beveiligingslekken vinden, verschuift de grens tussen hulpmiddel en zelfstandig handelende technologie. Dat maakt AI-systemen krachtiger voor onderzoek en softwareontwikkeling, maar vergroot ook het risico op misbruik, bijvoorbeeld bij cyberaanvallen. De discussie over wanneer AI 'AGI' wordt, blijkt in de praktijk minder een technisch keerpunt dan een geleidelijke overgang.

AGI
Kunstmatige algemene intelligentie: een AI-systeem dat op de meeste economisch waardevolle taken beter presteert dan mensen.
Taalmodel
Een AI-systeem dat getraind is om tekst te begrijpen en te genereren, de basis onder chatbots zoals ChatGPT.
Benchmark
Een gestandaardiseerde test waarmee de prestaties van verschillende AI-modellen onderling vergeleken worden.
Zero-day-kwetsbaarheid
Een beveiligingslek in software dat nog onbekend is bij de fabrikant en dus nog niet is gedicht.
Token
Een stukje tekst, zoals een woorddeel, dat een taalmodel als basiseenheid gebruikt om taal te verwerken en waarop het gebruik van AI-diensten vaak wordt afgerekend.
GPU
Een grafische processor die door zijn parallelle rekenkracht wordt gebruikt om AI-modellen te trainen.

Bronnen

Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.

Meer over Generatieve AI & synthetische media