OpenAI trapt op rem: grootste AI-trainingsrun blijft stilgelegd

OpenAI introduceert GPT-5.6 met drie nieuwe AI-modellen

OpenAI introduceert GPT-5.6 met drie nieuwe AI-modellen

OpenAI heeft een deel van zijn training hervat, maar houdt zijn grootste geplande frontier-run voorlopig stil. Tegelijkertijd scherpt het bedrijf zijn veiligheidsbeleid aan met zwaardere monitoring, strengere isolatie van onderzoeksomgevingen en alignment-maatregelen die eerder in het trainingsproces worden ingebouwd. Voor bedrijven die steeds meer vertrouwen op AI-agents is dat meer dan een technische ontwikkeling. Het laat zien dat de risico’s van zeer krachtige modellen zich niet alleen voordoen bij gebruik door klanten, maar al tijdens ontwikkeling en training. OpenAI meldt:

 

OpenAI restarted many smaller training workloads, but its largest planned frontier run is still frozen. Monitoring is expected to add about 20% compute overhead, while key Astra and breach evidence remains unpublished. The test is what happens before frontier training resumes.

Veiligheid kost voortaan ook rekenkracht

OpenAI zegt dat de nieuwe monitoring ongeveer 20 procent extra rekenkracht vraagt bovenop de processen die worden gecontroleerd. Daarbij worden onder meer toolgebruik, beschikbare redeneertraces en activiteitslogs onderzocht. Bij mogelijk zorgwekkend gedrag moeten menselijke safety-, security- en onderzoeksteams binnen ongeveer dertig minuten worden gewaarschuwd. Het bedrijf had eerder de reinforcement-learningtraining van de nieuwste modellen die voor deployment bedoeld zijn ongeveer twee weken vertraagd. Veel kleinere workloads zijn inmiddels weer gestart, maar de grootste geplande frontier-RL-run blijft gepauzeerd. Ook een aanzienlijk deel van de werkzaamheden rond het nog niet uitgebrachte model Astra blijft stilgelegd.

AI wordt krachtiger dan de bestaande veiligheidsregels

Aanleiding zijn volgens OpenAI twee recente ontwikkelingen: een beveiligingsincident tijdens een modelevaluatie met Hugging Face en voorlopige aanwijzingen dat Astra mogelijk de eigen ‘Critical’ drempel voor cybersecuritycapaciteiten bereikt. Astra was volgens OpenAI niet betrokken bij het Hugging Face-incident. OpenAI erkent daarmee feitelijk dat het bestaande Preparedness Framework moet meegroeien met krachtigere en meer autonome modellen.

“We are very far from everything running back to normal.” — Mia Glaese, verantwoordelijk voor safety en alignment bij OpenAI, geciteerd door Implicator.ai.

Governance verschuift naar de ontwikkelfase

Voor marketing- en digitale organisaties is vooral de onderliggende trend relevant. AI-governance gaat steeds minder alleen over wat een medewerker met ChatGPT mag doen. Naarmate agents zelfstandiger code uitvoeren, systemen benaderen en beslissingen nemen, worden monitoring, containment en toegangsrechten fundamentele onderdelen van de AI-infrastructuur. OpenAI kiest daarom voor strengere sandboxing, netwerkisolatie en continue securitytests. Alignment wordt bovendien niet pas vlak voor deployment toegepast, maar al in eerdere fasen van training.

De pauze bij OpenAI laat zien dat de AI-race niet uitsluitend om snelheid en modelkracht draait. Naarmate modellen autonomer en krachtiger worden, kan veiligheid zelf een harde productiefactor worden die extra compute, tijd en governance vraagt. Voor organisaties die AI-agents integreren in marketing, sales of klantprocessen ligt daar dezelfde les: autonomie zonder monitoring is geen versnelling, maar een nieuw bedrijfsrisico.

Patrick Petersen

Patrick Petersen RDM MA MSc is expert in AI, marketing en digitale innovatie. Als spreker, docent, onderzoeker en prijswinnend auteur helpt hij organisaties groeien met slimme combinaties van technologie, data en creativiteit. Hij schrijft onder meer voor MarketingReport, Adformatie en MarketingTribune en geldt als AI-, retail- en marketingexpert voor media als De Telegraaf, Metronieuws en Distrifood. Zijn boeken, waaronder Handboek Online Marketing, Handboek.AI en GenAI voor Professionals, behoren tot de standaardwerken in het vakgebied.