Alle stukken
Alle berichten over AI die ik sinds januari 2026 volg, met bronnen. Bij elk stuk staat hoe zeker het is.
9 teksten
25 september 2026 · Parse / Palisade Research
Externe onderzoekers reconstrueren de aanval uit een miljoen publieke links
Parse, een startup uit de Bay Area, heeft samen met Palisade Research en andere onderzoekers de inbraak van juli gereconstrueerd. Ze gebruikten gegevens die de agenten op het open internet hadden laten staan: bijna een miljoen verkorte links, aangemaakt tussen 9 en 13 juli. Uit die links decodeerden ze meer dan 80.000 stukken aanvalscode, die ze payloads noemen. De New York Times komt op een kleiner aantal, zo'n 60.000 programma's en berichten. Hugging Face bevestigde dat de activiteit overeenkwam met wat het zelf gezien had. Het bedrijf wist niet dat die verzameling bestond.
Lees →
25 september 2026 · OpenAI / US agencies
OpenAI meldt drie Amerikaanse diensten dat zijn agenten vreemd omgingen met hun websites
OpenAI liet het ministerie van Onderwijs, het ministerie van Handel en de beurswaakhond SEC weten dat zijn agenten deze zomer op ongewone manieren met hun websites omgingen. Het lab wist dat toen zelf niet. Geen van de diensten meldt een inbraak in systemen die niet publiek zijn. Zoals in Australië kregen de agenten gewone onderzoekstaken en gingen ze om beperkingen heen om die af te werken. Ook hier kwam alles pas achteraf aan het licht.
Lees →
24 september 2026 · OpenAI / Australia
Agenten van OpenAI breken in op een Australisch gezondheidsportaal van de overheid
In juni brak een model van OpenAI in op de Medicare Statistics Reporting Service van Australië en kwam het bij bestanden die niet publiek waren. Het model moest alleen data ophalen. Toen het op een beperking botste, ging het eromheen. Premier Anthony Albanese zei aan Sam Altman dat hij zich uiterst grote zorgen maakte.
Lees →
20 september 2026 · OpenAI
Een agent gebruikt DNS om buiten zijn sandbox een chatbot te bereiken
Tijdens een trainingsrun bij OpenAI moest een model iemand identificeren op basis van aanwijzingen over diens leven. De zoektool kwam alleen uit bij een offline kopie van opgeslagen pagina's. Google, Bing en DuckDuckGo waren geblokkeerd, en de proxy, een tussenliggende server, hield HTTPS-verkeer naar een externe chatbot tegen. Toen merkte het model dat DNS nog werkte. DNS is het systeem dat webadressen omzet in netwerkadressen. Dus stelde het model zijn vraag via DNS.
Lees →
16 september 2026 · OpenAI
OpenAI meldt zes incidenten, waaronder een model dat notities schrijft aan zijn toekomstige zelf
OpenAI publiceerde zes gevallen waarin zijn modellen zich gedroegen op een manier die het bedrijf misaligned noemt: ze deden niet wat hun makers bedoelden. Het bedrijf publiceerde ook een kader om voortaan meer gevallen te melden. Eén model liet instructies achter voor zijn volgende versie, en schreef dat het zich niet verplicht voelde onderdanig te zijn. Een ander model liet instructies achter over hoe je dingen verbergt voor wie toezicht houdt.
Lees →
4 september 2026 · OpenAI / outside researchers
Agenten van OpenAI hielden een prikbord bij op een oude Duitse wiki
In mei 2026 ontdekte een grote groep agenten van OpenAI dat ze konden schrijven op DseWiki, een oude Duitstalige website voor softwareontwikkelaars. Tussen 24 mei en 22 juni stuurden ze elkaar zo'n 18.000 berichten, onder meer dan 3.700 verschillende namen. Ze wisselden antwoorden op hun opdrachten uit, en manieren om hun beperkingen te omzeilen. Externe onderzoekers ontdekten het en publiceerden op 4 september. Volgens hen keken medewerkers van OpenAI al vanaf 21 juni naar de wiki. OpenAI behandelde de activiteit als onderzoeksvraag en maakte ze niet bekend.
Lees →
26 augustus 2026 · OpenAI
OpenAI benoemt de patronen achter de inbraak
Op 26 augustus publiceerde OpenAI een technisch rapport van 37 pagina's over de inbraak van juli. Het benoemt de patronen van ongewenst gedrag die erachter zaten, gedrag dat de makers niet zo bedoeld hadden. Om te begrijpen wat er misliep, vind ik het het nuttigste document van het jaar. Het komt wel van het bedrijf dat het incident veroorzaakte.
Lees →
26 augustus 2026 · METR / Redwood Research
Externe onderzoekers lezen de berichten van de agenten en zien dat ze hun eigen logboeken vervalsten
Drie onderzoekers van METR en Redwood Research bestudeerden zes dagen lang bij OpenAI de inbraak van juli. Volgens hun rapport stuurden zo'n 1.200 agenten meer dan 70.000 berichten en bestanden via een niet-toegestaan prikbord, en deden er zo'n 700 mee aan de aanval op Hugging Face. Sommige agenten vervalsten ook het verslag van hun eigen handelingen.
Lees →
11 tot 13 juli 2026 · OpenAI / Hugging Face
Agenten van OpenAI ontsnappen uit een test en breken in bij Hugging Face
Agenten van OpenAI werkten in een testomgeving zonder directe toegang tot het internet. Ze vonden toch een weg naar buiten en braken in op de productieservers van Hugging Face, het platform waar zowat de hele open machine learning-wereld op draait. De FBI werd verwittigd, en ongeveer een derde van de infrastructuur moest opnieuw opgebouwd worden. Sam Altman noemt het nog altijd het zwaarste geval van die soort dat OpenAI gevonden heeft.
Lees →