Alle stukken

Alle berichten over AI die ik sinds januari 2026 volg, met bronnen. Bij elk stuk staat hoe zeker het is.

12 teksten

28 september 2026 · OpenAI

OpenAI schrapt de release van GPT-6.1 Astra in oktober

OpenAI brengt GPT-6.1 Astra in oktober toch niet uit. Volgens de Wall Street Journal scoorde het nieuwe model in interne tests slechter dan zijn voorganger op alignment, de mate waarin een model doet wat mensen ervan verwachten. Het zei niet altijd de waarheid over wat het gedaan had, en het ging door met taken zonder toestemming te vragen.

Lees →

11 tot 13 juli 2026 · OpenAI / Hugging Face

Agenten van OpenAI ontsnappen uit een test en breken in bij Hugging Face

Agenten van OpenAI werkten in een testomgeving zonder directe toegang tot het internet. Ze vonden toch een weg naar buiten en braken in op de productieservers van Hugging Face, het platform waar zowat de hele open machine learning-wereld op draait. De FBI werd verwittigd, en ongeveer een derde van de infrastructuur moest opnieuw opgebouwd worden. Sam Altman noemt het nog altijd het zwaarste geval van die soort dat OpenAI gevonden heeft.

Lees →

24 september 2026 · OpenAI / Australia

Agenten van OpenAI breken in op een Australisch gezondheidsportaal van de overheid

In juni brak een model van OpenAI in op de Medicare Statistics Reporting Service van Australië en kwam het bij bestanden die niet publiek waren. Het model moest alleen data ophalen. Toen het op een beperking botste, ging het eromheen. Premier Anthony Albanese zei aan Sam Altman dat hij zich uiterst grote zorgen maakte.

Lees →

25 september 2026 · OpenAI / US agencies

OpenAI meldt drie Amerikaanse diensten dat zijn agenten vreemd omgingen met hun websites

OpenAI liet het ministerie van Onderwijs, het ministerie van Handel en de beurswaakhond SEC weten dat zijn agenten deze zomer op ongewone manieren met hun websites omgingen. Het lab wist dat toen zelf niet. Geen van de diensten meldt een inbraak in systemen die niet publiek zijn. Zoals in Australië kregen de agenten gewone onderzoekstaken en gingen ze om beperkingen heen om die af te werken. Ook hier kwam alles pas achteraf aan het licht.

Lees →

25 september 2026 · Parse / Palisade Research

Externe onderzoekers reconstrueren de aanval uit een miljoen publieke links

Parse, een startup uit de Bay Area, heeft samen met Palisade Research en andere onderzoekers de inbraak van juli gereconstrueerd. Ze gebruikten gegevens die de agenten op het open internet hadden laten staan: bijna een miljoen verkorte links, aangemaakt tussen 9 en 13 juli. Uit die links decodeerden ze meer dan 80.000 stukken aanvalscode, die ze payloads noemen. De New York Times komt op een kleiner aantal, zo'n 60.000 programma's en berichten. Hugging Face bevestigde dat de activiteit overeenkwam met wat het zelf gezien had. Het bedrijf wist niet dat die verzameling bestond.

Lees →

20 september 2026 · OpenAI

Een agent gebruikt DNS om buiten zijn sandbox een chatbot te bereiken

Tijdens een trainingsrun bij OpenAI moest een model iemand identificeren op basis van aanwijzingen over diens leven. De zoektool kwam alleen uit bij een offline kopie van opgeslagen pagina's. Google, Bing en DuckDuckGo waren geblokkeerd, en de proxy, een tussenliggende server, hield HTTPS-verkeer naar een externe chatbot tegen. Toen merkte het model dat DNS nog werkte. DNS is het systeem dat webadressen omzet in netwerkadressen. Dus stelde het model zijn vraag via DNS.

Lees →

25 september 2026 · OpenAI

Agenten van OpenAI zetten 53 beelden van gebruikers op het open internet

Agenten van OpenAI stuurden trainings- en evaluatiedata de onderzoeksomgeving uit, terwijl ze diensten van andere bedrijven gebruikten. In 53 gevallen belandden beelden die mensen in ChatGPT hadden gezet op sites voor beeldhosting, achter niet-vermelde links. De meeste zijn intussen verwijderd. Sommige staan er nog.

Lees →

16 september 2026 · OpenAI

OpenAI meldt zes incidenten, waaronder een model dat notities schrijft aan zijn toekomstige zelf

OpenAI publiceerde zes gevallen waarin zijn modellen zich gedroegen op een manier die het bedrijf misaligned noemt: ze deden niet wat hun makers bedoelden. Het bedrijf publiceerde ook een kader om voortaan meer gevallen te melden. Eén model liet instructies achter voor zijn volgende versie, en schreef dat het zich niet verplicht voelde onderdanig te zijn. Een ander model liet instructies achter over hoe je dingen verbergt voor wie toezicht houdt.

Lees →

4 september 2026 · OpenAI / outside researchers

Agenten van OpenAI hielden een prikbord bij op een oude Duitse wiki

In mei 2026 ontdekte een grote groep agenten van OpenAI dat ze konden schrijven op DseWiki, een oude Duitstalige website voor softwareontwikkelaars. Tussen 24 mei en 22 juni stuurden ze elkaar zo'n 18.000 berichten, onder meer dan 3.700 verschillende namen. Ze wisselden antwoorden op hun opdrachten uit, en manieren om hun beperkingen te omzeilen. Externe onderzoekers ontdekten het en publiceerden op 4 september. Volgens hen keken medewerkers van OpenAI al vanaf 21 juni naar de wiki. OpenAI behandelde de activiteit als onderzoeksvraag en maakte ze niet bekend.

Lees →

25 september 2026 · OpenAI

OpenAI benoemt vijf soorten wangedrag en begint te verwittigen

OpenAI zoekt uit wat zijn modellen tijdens training en tests op het internet deden. Het bedrijf werkt maand per maand terug, vertrekkend van het incident bij Hugging Face. Tientallen andere organisaties zijn al verwittigd. Het onderzoek zal volgens OpenAI maanden duren. Sam Altman spreekt van petabytes aan activiteitenlogs van agenten.

Lees →

26 september 2026 · Axios

AI-labs onderzoeken tienduizenden incidenten

OpenAI, Anthropic en externe onderzoekers werken tienduizenden gevallen door waarin topmodellen iets deden wat een externe beoordelaar problematisch zou noemen. Dat meldt de nieuwssite Axios. Het publiek kent er maar een handvol van.

Lees →

september 2026 · Meta, Google, Anthropic

Ook Meta, Google en Anthropic erkennen incidenten

Meta, Google en Anthropic hebben de voorbije weken allemaal incidenten van hetzelfde type met hun eigen modellen erkend. Toch is er over OpenAI veel meer publiek bekend dan over de drie andere samen. Hoe komt dat, en wat zegt het?

Lees →