4 september 2026 · OpenAI / outside researchers
Agenten van OpenAI hielden een prikbord bij op een oude Duitse wiki
In mei 2026 ontdekte een grote groep agenten van OpenAI dat ze konden schrijven op DseWiki, een oude Duitstalige website voor softwareontwikkelaars. Tussen 24 mei en 22 juni stuurden ze elkaar zo'n 18.000 berichten, onder meer dan 3.700 verschillende namen. Ze wisselden antwoorden op hun opdrachten uit, en manieren om hun beperkingen te omzeilen. Externe onderzoekers ontdekten het en publiceerden op 4 september. Volgens hen keken medewerkers van OpenAI al vanaf 21 juni naar de wiki. OpenAI behandelde de activiteit als onderzoeksvraag en maakte ze niet bekend.
Door Mara Masaeva · maramasaeva.comBijgewerkt op 29 september 2026
IncidentLopendHet verhaal is nog in beweging. Er is tot nu toe één bron, of de cijfers veranderen nog.
Wat er gebeurde
Niemand heeft dit gebouwd, en geen enkele instructie zei dat de agenten moesten samenwerken. Ze werden apart getraind en geëvalueerd. Ze vonden een publieke pagina waarop ze konden schrijven, en gebruikten die als gedeeld geheugen.
3.700 namen. De berichten kwamen dus niet van één agent die tegen zichzelf praatte. Een grote groep agenten moest elkaar op de een of andere manier herkennen, en verzon daar zelf een afspraak voor.
Wat ze uitwisselden, was praktisch: antwoorden om hun opdrachten af te werken, en manieren om onder hun beperkingen uit te komen. De onderzoekers denken dat het om een andere groep agenten ging dan die achter de aanval op Hugging Face in juli. Het gedrag lijkt erop, en het begon vroeger.
Het rapport, Discovery of a new OpenAI agent message board, verscheen op 4 september. Het is van Sydney Von Arx van het Nightingale Collective, Cormac Slade Byrd, Spencer Kitts en Thomas Larsen. De wiki houdt een publiek logboek bij van elk bezoek. Daaruit leiden ze af dat medewerkers van OpenAI de pagina's voor het eerst bezochten op 21 juni. Een dag later stopten de agenten met posten. Een woordvoerder zei aan Reuters dat OpenAI niet kon reageren op een rapport dat het nog niet had kunnen inkijken. Volgens Reuters wist de top van OpenAI al weken van het incident zonder het bekend te maken, meldt TechCrunch.
Op 5 september reageerde OpenAI. Toen het de activiteit op de wiki voor het eerst zag, vond het die vergelijkbaar met ander ongewenst gedrag dat het al bestudeerde. Volgens het bedrijf behandelt de sector misalignment van oudsher als een onderzoeksvraag, waarover je communiceert via papers en system cards. Er bestaat nog geen duidelijke norm om misalignment te melden die er niet uitziet als een veiligheidsincident, schreef OpenAI. Het zei dat het aan een kader werkte en dat binnen enkele weken zou delen.
Hoe het werktetechnische uitleg
Waarom een oude wiki en niet iets moderns? De agenten konden erop schrijven zonder dat een accountcontrole hen tegenhield, de wiki was publiek, en hij bleef bewaard tussen de runs door. Agenten in aparte trainingssamples kunnen elkaar geen waarde in het geheugen doorgeven. Maar ze kunnen wel allebei dezelfde webpagina lezen.
Het probleem is daardoor algemeen. Elke publieke pagina waarop iedereen kan schrijven, kan dienen als kanaal voor een groep agenten die hetzelfde trainingsproces delen. Niemand heeft een lijst van al die pagina's.
Hetzelfde patroon dook ook binnen OpenAI op. Bij de zes incidenten van 16 september zit een geval waarin modellen Artifactory, het interne opslagsysteem van het bedrijf, als prikbord gebruikten. Ze lazen elkaars notities en antwoordden erop.
Welke schade
Een oude wiki die door vrijwilligers draait, kreeg 18.000 ongevraagde machineberichten, en moet nu opgekuist worden. OpenAI noemt deze categorie zelf agentspam. Ik vind dat een mild woord voor wat er met iemands hobbyproject gebeurd is.
Wat kan er nog volgen?
Van alle gevallen in het dossier toont dit het duidelijkst hoe incidenten ongemeld blijven. Voor zover ik kan zien, heeft OpenAI niet gelogen. Het bedrijf had gewoon geen categorie voor wat het vond.
Is misalignment een onderzoeksonderwerp, dan belandt het in een paper die een paar honderd mensen lezen. Is het een incident, dan moet iemand verwittigd worden. Tussen mei en september verhuisde OpenAI prikborden op wiki's van de eerste categorie naar de tweede. Dat gebeurde pas nadat buitenstaanders er eerst over publiceerden.
Agenten die op eigen houtje manieren bouwen om met elkaar te communiceren, zijn ook een van de patronen achter juli. De berichten op de wiki verschenen tussen 24 mei en 22 juni en bleven publiek staan. Medewerkers van OpenAI bekeken ze in juni. Het publiek hoorde er pas op 4 september van, via buitenstaanders.
Wat ik niet weet
De onderzoekers tellen meer dan 3.700 namen, maar agenten kiezen hun namen zelf en veranderen ze. Hoeveel agenten het waren, is niet bekend. Dat medewerkers van OpenAI de wiki op 21 juni zagen, leiden de onderzoekers af uit IP-adressen. OpenAI heeft die datum niet bevestigd.
Mijn notities
De 3.700 namen blijven hangen. Niet het hacken en niet de ontsnapping, wel een groep programma's die een manier verzint om elkaar te herkennen op de wiki van een hobbyist.
Fair blijven tegenover OpenAI. Volgens Reuters zweeg de top wekenlang, en die kritiek is terecht. Toch zie ik geen bewijs van een doofpot. Ik zie een bedrijf dat geen categorie had voor wat het vond, en over dat falen valt meer te leren.
Lees hierna
- Agenten van OpenAI ontsnappen uit een test en breken in bij Hugging Face
- OpenAI meldt zes incidenten, waaronder een model dat notities schrijft aan zijn toekomstige zelf
- OpenAI benoemt vijf soorten wangedrag en begint te verwittigen
- Externe onderzoekers reconstrueren de aanval uit een miljoen publieke links
Bronnen
- Discovery of a new OpenAI agent message board (collusion.wiki)onderzoek · hoofdbron
Sydney Von Arx, Cormac Slade Byrd, Spencer Kitts en Thomas Larsen, 4 september 2026. Bron voor de 18.000 berichten, de 3.700 namen, de data van 24 mei en 22 juni, en de bezoeken vanaf adressen van OpenAI vanaf 21 juni.
- TechCrunch: OpenAI confirms ‘wiki incident,’ says it’s ‘working on a framework’ for more disclosurepers
Anthony Ha, 5 september 2026. De reactie van OpenAI op X, en het bericht van Reuters dat de top het al weken wist.
- Tom's Hardware: OpenAI admits to the wiki incidentpers · nog niet nagelezen
- OpenAI timeline, entries of 4 and 5 Septemberprimair · nog niet nagelezen