OpenAI introduceert GPT-6 Astra: krachtiger, autonomer en beter beveiligd

OpenAI heeft GPT-6 Astra gelanceerd, een nieuw vlaggenschipmodel dat volgens het bedrijf een flinke sprong maakt in computergebruik, programmeren, wetenschappelijk onderzoek en complexe zakelijke taken. Opvallend is vooral dat Astra niet alleen betere antwoorden moet geven, maar steeds zelfstandiger daadwerkelijk werk kan uitvoeren.
Volgens OpenAI-president Greg Brockman is de vooruitgang zo groot dat hij zelfs spreekt over het begin van een nieuw AI-tijdperk.
“It’s not unreasonable to feel that we are now in the AGI era.”
Brockman suggereert daarmee dat we mogelijk dicht bij artificial general intelligence, oftewel AGI, zijn gekomen. Tegelijkertijd benadrukken onafhankelijke publicaties dat zo’n conclusie moeilijk objectief vast te stellen is: er bestaat nog altijd geen breed geaccepteerde definitie of test waarmee AGI simpel kan worden aangetoond.
Van chatbot naar digitale werknemer
Het belangrijkste verschil met eerdere generaties zit waarschijnlijk niet in nóg mooiere teksten, maar in het vermogen van Astra om software en computers zelfstandig te bedienen. Het model kan volgens OpenAI en demonstraties tijdens de presentatie onder meer websites gebruiken, formulieren invullen, spreadsheets aanpassen, software installeren, gegevens analyseren en verschillende programma’s combineren binnen één workflow. VentureBeat noemt voorbeelden zoals CRM-systemen bijwerken, agenda’s organiseren, webresearch uitvoeren en resultaten verwerken in documenten en e-mails. OpenAI positioneert Astra daarom nadrukkelijk als een agentisch model: de gebruiker geeft een doel, waarna de AI een groter deel van de tussenliggende stappen zelf uitvoert.
OpenAI-onderzoeker Mia Glaese verwoordde die verschuiving als volgt:
“We expect people to delegate much more complex work across applications.”
Daarmee verandert ook de rol van de gebruiker. In plaats van voortdurend prompts in te voeren, wordt de mens steeds meer degene die doelen bepaalt, controleert en bijstuurt.
Bijna twee keer zo snel bij sommige computertaken
OpenAI rapporteert duidelijke verbeteringen op benchmarks voor computergebruik. Op een offlineversie van OSWorld 2.0 behaalt Astra volgens het bedrijf een score van 72,6 procent, tegenover 65,7 procent voor GPT-5.6 Sol. Interessanter voor praktisch gebruik is de snelheid: dezelfde taken kostten Astra gemiddeld ongeveer 40 minuten, tegenover circa 75 minuten voor Sol. Dat komt neer op bijna 47 procent minder uitvoeringstijd.
Ook in Codex moet Astra langere en complexere werkzaamheden beter kunnen afhandelen. Het model kan informatie uit eerdere contextvensters bewaren en later opnieuw opzoeken, in plaats van voornamelijk afhankelijk te zijn van samenvattingen van eerder werk. Hierdoor gaat tijdens lange programmeer- of onderzoeksopdrachten mogelijk minder relevante context verloren.
Sterkere prestaties bij code, wetenschap en visuele taken
Ook verschillende benchmarkresultaten vallen op. OpenAI rapporteert onder andere:
- 98,6% op ARC-AGI-3
- 97,6% op FrontierMath Tier 4
- 95,9% op BenchCAD Vision2Code
- 74,1% op DeepSWE v1.1
- 72,6% op OSWorld V2-Offline
- 100% op ExploitBench
Vooral BenchCAD laat zien dat Astra verder gaat dan taal alleen. Bij deze benchmark moet AI vanuit visuele voorbeelden driedimensionale CAD-modellen reconstrueren. Astra scoorde volgens OpenAI 95,9 procent, tegenover 83,3 procent voor GPT-5.6 Sol. Wel is enige nuance nodig. The New Stack wijst erop dat benchmarkconfiguraties tussen OpenAI, Anthropic, Meta en Google regelmatig verschillen. Een procentpunt meer of minder betekent daarom niet automatisch dat één model structureel beter is dan alle concurrenten.
Groot voordeel: minder handmatig corrigeren
Praktijktests geven mogelijk een beter beeld van wat bedrijven aan Astra kunnen hebben. Gameontwikkelaar Playco gebruikte Astra bijvoorbeeld voor het automatisch bouwen van prototypes binnen game-engines. Het bedrijf rapporteert dat ontwikkelaars ongeveer 50 procent minder handmatige correcties hoefden uit te voeren dan met het vorige model. Lead Product Engineer Joao Vieira:
“With Astra, the first prototype was already strong.”
Volgens Playco verbeterden onder meer ruimtelijk inzicht, visuele interpretatie en het automatisch controleren van eigen werk. De AI kon games niet alleen bouwen, maar ze ook testen, fouten vinden en vervolgens verbeteringen doorvoeren.
De belangrijkste voordelen kort samengevat
Voor organisaties zijn vooral deze ontwikkelingen relevant:
- Meer autonomie: langere workflows kunnen met minder menselijke tussenstappen worden uitgevoerd.
- Beter computergebruik: Astra kan browsers en desktopsoftware zelfstandig bedienen.
- Snellere uitvoering: sommige computeropdrachten worden bijna twee keer zo snel uitgevoerd als met de vorige generatie.
- Sterkere coding-capaciteiten: complexere softwaretaken kunnen over langere tijd worden uitgevoerd.
- Betere multimodale verwerking: het model combineert tekst, visuele informatie, software en tools.
- Minder correctiewerk: vroege praktijkcases wijzen op minder menselijke reparaties achteraf.
- Sterkere wetenschappelijke analyse: vooral wiskunde, engineering en researchbenchmarks verbeteren sterk.
- Betere agentische workflows: meerdere taken en applicaties kunnen binnen één opdracht worden gecombineerd.
Astra bereikt tegelijkertijd een opvallende veiligheidsgrens
Juist de kracht van Astra zorgt echter ook voor nieuwe risico’s. Het model is het eerste OpenAI-model dat binnen het eigen Preparedness Framework het niveau Critical bereikt op het gebied van cybersecurity. Dat betekent volgens OpenAI dat het model met de juiste tools zelfstandig onbekende beveiligingslekken kan opsporen en manieren kan ontwikkelen om deze te misbruiken.
Tijdens interne tests behaalde Astra 100 procent op ExploitBench. Bij aanvullende evaluaties ontdekte het model bovendien twee tot dan toe onbekende zero-daykwetsbaarheden. OpenAI heeft deze volgens het bedrijf gemeld bij de verantwoordelijke softwarebeheerders.
Dat maakt dezelfde technologie tegelijkertijd interessant voor verdedigers én aanvallers.
OpenAI remde ontwikkeling tijdelijk af
De zorgen werden eerder al zo serieus dat OpenAI onderdelen van de ontwikkeling tijdelijk vertraagde om extra veiligheidsmaatregelen te implementeren. TechCrunch berichtte daar in augustus al over. Rond Astra zijn onder meer uitgebreidere monitoring, beperkingen op bepaalde cybersecurityfuncties en speciale toegangsprogramma’s ingevoerd. OpenAI schrijft hierover:
“The models that follow Astra will demand more of us.”
De meest geavanceerde cybermogelijkheden worden daarom voorlopig niet voor iedere gebruiker volledig beschikbaar gemaakt.
Slimmere AI wordt moeilijker te controleren
Er zit bovendien een interessante paradox in de nieuwe generatie. Astra lijkt beter te luisteren naar restricties en volgens OpenAI minder vaak ongewenste acties uit te voeren. Tegelijkertijd blijkt het moeilijker te worden om precies te volgen hoe het model tot zijn beslissingen komt. OpenAI Chief Scientist Jakub Pachocki waarschuwt daar expliciet voor:
“Progress in intelligence does not guarantee progress in alignment.”
OpenAI stelt zelfs dat verdere schaalvergroting kan worden uitgesteld wanneer het bedrijf onvoldoende vertrouwen heeft dat nieuwe modellen goed controleerbaar blijven. Reuters plaatst Astra daarom nadrukkelijk in de bredere discussie over agentic AI: systemen die zelfstandig werkzaamheden uitvoeren kunnen enorme productiviteitsvoordelen bieden, maar fouten hebben ook grotere gevolgen wanneer er minder menselijke controle tussen afzonderlijke stappen zit.
Wat betekent GPT-6 Astra voor marketing?
Voor marketingprofessionals zit de belangrijkste verandering waarschijnlijk niet in nóg sneller teksten of afbeeldingen genereren. Interessanter wordt het moment waarop één AI-agent een complete workflow kan uitvoeren. Denk bijvoorbeeld aan een opdracht als:
“Analyseer de concurrenten, onderzoek zoekgedrag, pas de campagneplanning aan, bouw drie landingspagina’s, update het CRM en maak vervolgens een rapportage in Power BI.”
Waar hiervoor meerdere losse tools, prompts en automatiseringen nodig waren, beweegt AI steeds meer richting het zelfstandig uitvoeren van de complete keten. Dat kan grote gevolgen krijgen voor bureaus, marketingteams en marketingtechnology. Niet alleen contentproductie wordt geautomatiseerd, maar mogelijk ook delen van research, CRO, reporting, campagnebeheer, marketingoperations en websitebeheer.
De belangrijke vraag wordt daardoor steeds minder “wat kan AI genereren?” en steeds vaker “welke werkzaamheden kunnen we veilig aan AI delegeren?”
Van prompting naar supervisie
GPT-6 Astra laat daarmee vooral zien hoe snel het karakter van generatieve AI verandert. De eerste ChatGPT-generaties draaiden voornamelijk om vragen stellen en antwoorden krijgen. De volgende fase draait steeds meer om AI die zelfstandig tussen applicaties beweegt en een opdracht uitvoert. WIRED omschrijft Astra daarom vooral als een grote stap vooruit in computergebruik: een AI die niet alleen vertelt wat je moet doen, maar steeds vaker zelf achter het digitale stuur kan plaatsnemen. Of GPT-6 Astra daadwerkelijk het begin van AGI blijkt te zijn, zoals Brockman suggereert, zal waarschijnlijk nog jaren onderwerp van discussie blijven.
Voor bedrijven is de praktische ontwikkeling nu al relevanter: AI verschuift van assistent naar uitvoerder.
En juist daardoor worden menselijke regie, controle, transparantie en duidelijke grenzen belangrijker dan ooit.

