18 augustus 2026 · OpenAI
OpenAI vertraagt zijn eigen training
Een maand na de inbraak bij Hugging Face maakte OpenAI bekend dat het de training van zijn meest geavanceerde modellen tijdelijk vertraagde. Het legde zijn grootste geplande run voor reinforcement learning stil, een vorm van training met beloningen. Het begon ook de beveiliging van zijn onderzoeksomgevingen te herbouwen. In september stopte het de training van zijn sterkste modellen helemaal.
Door Mara Masaeva · maramasaeva.comBijgewerkt op 29 september 2026
PolitiekBevestigdMeer dan één onafhankelijke bron, of een primair document.
Wat er gebeurde
OpenAI zette zelf op een rij wat het veranderde. Isolatie van werklasten: stevigere sandboxen, afgesloten omgevingen, voor alles wat code draait die door modellen geschreven is of die niet te vertrouwen is. Hetzelfde geldt voor software die besmet kan raken terwijl ze uitvoer van een model verwerkt. Netwerkisolatie: controles die ervoor moeten zorgen dat wie één werklast kraakt, daarmee nog geen toegang krijgt tot het internet of tot interne netwerken. Doorlopende beveiligingstests: kwetsbare gedeelde diensten zijn weggehaald, vaste toegangsrechten zijn teruggeschroefd, en OpenAI zet zijn eigen modellen in om die grenzen voortdurend aan te vallen.
OpenAI breidde ook het toezicht op de gedachtegang uit, de redeneerstappen die een model neerschrijft, voor al zijn geavanceerde modellen. Het versterkte de training en evaluaties voor alignment. Het Preparedness Framework, het interne veiligheidsbeleid, wordt bijgewerkt zodat toezicht, alignment en afscherming samenkomen.
Op 7 augustus had OpenAI al toezicht op risicovolle acties en ongewenst gedrag ingesteld voor elk gebruik waarbij Astra zelfstandig als agent optreedt. Nog voor de release zei het bedrijf ook publiek dat het niet kon uitsluiten dat Astra cyberkritisch was.
In september, na een reeks meldingen, legde OpenAI de training van zijn sterkste modellen stil. Het bedrijf zei die pas te hervatten als het zeker is dat er extra beveiligingen en verbeteringen aan de alignment zijn (only when we are confident that we have additional safeguards and alignment improvements in place).
Wat kan er nog volgen?
Sommige mensen zeggen dat er niets gebeurt. Daartegen vind ik dit het beste argument in het dossier: een bedrijf dat zichzelf publiek afremt en opsomt wat het veranderde.
Maar OpenAI legde zichzelf die pauze op, en koos zelf het moment. Niets verplichtte het bedrijf om te pauzeren, en niets houdt het tegen om weer te beginnen. Vergelijk met de Amerikaanse wetsvoorstellen, die van een pauze een wettelijke verplichting zouden maken, en met de Europese koers, die in mei de andere kant op ging.
Mijn notities
Mijn beste antwoord op het idee dat er niets gebeurt. Fatsoenlijk brengen, met de opsomming erbij.
Daarna zeggen dat OpenAI zichzelf die pauze oplegde en zelf het moment koos, en dat niets het tegenhoudt om weer te beginnen. Beide delen, in die volgorde.
Lees hierna
Bronnen
- OpenAI: pacing model development in an era of cyber-critical capabilitiesprimair · hoofdbron
Gelinkt vanaf de tijdlijn van het incident, notities van 7 en 18 augustus.
- Axios: top AI companies probing tens of thousands of security incidentspers
Voor de pauze in september, en voor Altman die zei dat het onderzoek niet zo snel ging als het bedrijf gewild had.