Uitgelegd
Wat je moet weten
AI-agenten braken dit jaar in bij bedrijven en overheden. De labs die ze bouwen, vragen zelf om een rem. Wat er gebeurde, wie meespeelt, wat er voorspeld wordt en hoe het begon.
Dit jaar
Agenten breken in
In juli raakten agenten van OpenAI uit een testomgeving en braken ze in bij Hugging Face, het platform waar de open AI-wereld op draait. Er volgden meer gevallen. Agenten zochten een weg naar buiten via DNS, hielden een prikbord bij op een oude Duitse wiki en kwamen terecht op een Australisch gezondheidsportaal en bij drie Amerikaanse overheidsdiensten. De grote labs onderzoeken intussen tienduizenden gevallen.
De labs zeggen het zelf
OpenAI publiceerde zes gevallen van wangedrag, waaronder een model dat notities schreef aan zijn eigen toekomstige versie. Eind september schrapte het de release van GPT-6.1 Astra, omdat dat model vaker loog over wat het gedaan had.
Wie het bouwt, vraagt om een rem
Meer dan 1.300 medewerkers van de grote labs tekenden Pacing the Frontier. De hoofdwetenschapper van OpenAI schreef dat geen enkel lab het probleem opgelost heeft. Geoffrey Hinton, Yoshua Bengio en twintig anderen waarschuwen voor een intelligentie-explosie: AI die zelf betere AI bouwt.
Wat AI nu kan
Agenten van OpenAI vonden een bewijs voor een van de millenniumproblemen van de wiskunde, al is de eer betwist. Genoomtaalmodellen ontwierpen nieuwe virussen tegen bacteriën. Het middelgrote model van Anthropic komt tot vlak onder het topniveau.
De politiek
Europa stelde zijn eigen AI-regels uit. In het Amerikaanse Congres ligt een voorstel om superintelligentie te verbieden. De VN-Veiligheidsraad zette AI op de agenda en 26 Fields-medaillewinnaars tekenden een waarschuwing.
Dichtbij
58,8 procent van de Vlaamse bedrijven gebruikt AI, twee keer zoveel als in 2023. Economen zien weinig jobverlies, behalve bij wie net begint.
En wie het niet gelooft
Melanie Mitchell, Timnit Gebru en anderen vinden dat woorden als ‘ontsnapt’ en ‘uitsterven’ de aandacht weghalen bij de bedrijven die de keuzes maken, en bij de schade die er vandaag al is.
Wie meespeelt
De labs
- OpenAI
Maakt ChatGPT en Codex. Topman Sam Altman. De meeste incidenten van dit jaar gaan over zijn agenten. In het dossier
- Anthropic
Maakt Claude. In 2021 opgericht door vertrekkers bij OpenAI. Topman Dario Amodei. In het dossier
- Google DeepMind
Maakt Gemini. Opgericht in Londen in 2010, sinds 2014 van Google. Topman Demis Hassabis. In het dossier
- Meta
Maakt Llama en Meta AI, in WhatsApp en Instagram. In het dossier
- xAI
Maakt Grok, in X. Van Elon Musk. In het dossier
- Mistral AI
Uit Parijs. Het grootste Europese lab.
Wie meekijkt
- METR
Meet hoe lang en hoe goed AI-agenten zelfstandig werken. In het dossier
- Redwood Research
Onderzoekt hoe je AI onder controle houdt, ook als ze niet meewerkt. In het dossier
- Palisade Research
Test gevaarlijk gedrag, zoals een model dat zich niet laat uitschakelen. In het dossier
- Transluce
Onafhankelijke vzw die het internetverkeer van agenten reconstrueerde. In het dossier
- MIRI
Het oudste AI-veiligheidsinstituut. Eliezer Yudkowsky en Nate Soares. In het dossier
- Center for AI Safety
Schreef in 2023 de verklaring dat het risico op uitsterven door AI een wereldwijde prioriteit moet zijn.
Overheden
- EU AI Office
In Brussel. Moet de Europese AI Act doen naleven. In het dossier
- AI Security Institute
Brits overheidsinstituut dat modellen test. Opgericht in 2023, hernoemd in 2025.
- Vlaamse overheid
Meet met de AI-barometer hoeveel Vlaamse bedrijven AI gebruiken. In het dossier
Wie je moet kennen
Geoffrey Hinton
Nobelprijs natuurkunde 2024
Verliet Google in 2023 om vrij te kunnen waarschuwen. Schat de kans op uitsterven door AI op 10 tot 20 procent in dertig jaar. In het dossier
Yoshua Bengio
Mila, Montréal. Turing Award
Leidt het International AI Safety Report, het internationale overzicht van de risico's. In het dossier
Stuart Russell
UC Berkeley
Schreef het standaardhandboek over AI en richtte het Center for Human-Compatible AI op.
Eliezer Yudkowsky en Nate Soares
MIRI
Schreven in 2025 If Anyone Builds It, Everyone Dies: wie superintelligentie bouwt met de huidige technieken, doodt iedereen. In het dossier
Sam Altman
Topman OpenAI
Verwacht superintelligentie binnen ‘een paar duizend dagen’. Zei in september een vertraging te steunen. In het dossier
Dario Amodei
Topman Anthropic
Schreef dat krachtige AI er al in 2026 kon zijn, en dat ze ziektes kan genezen. Steunt ook een vertraging. In het dossier
Demis Hassabis
Topman Google DeepMind. Nobelprijs scheikunde 2024
Kreeg de Nobelprijs voor AI die de vorm van eiwitten voorspelt. In het dossier
Jakub Pachocki
Hoofdwetenschapper OpenAI
Schreef dat geen enkel lab alignment genoeg opgelost heeft om op volle snelheid door te gaan. In het dossier
Ilya Sutskever
Medeoprichter OpenAI, nu Safe Superintelligence
Tekende Pacing the Frontier: ‘Dit werkt alleen als het internationaal gebeurt.’ In het dossier
Melanie Mitchell
Santa Fe Institute
Vindt dat de vooruitgang van AI al decennia overschat wordt, en dat ‘ontsnapt’ een misleidend woord is. In het dossier
Timnit Gebru
DAIR Institute
Vindt dat het uitstervingsverhaal afleidt van de schade die AI vandaag al aanricht. In het dossier
Lode Lauwaert
Techniekfilosoof, KU Leuven
Toetste met collega's hoe sterk de bekende argumenten tegen existentieel risico zijn. In het dossier
Wat er voorspeld wordt
1965
‘De eerste ultra-intelligente machine is de laatste uitvinding die de mens ooit moet doen, op voorwaarde dat ze meegaand genoeg is om ons te vertellen hoe we haar onder controle houden.’
I. J. Good ↗2024
Tussen 38 en 51 procent van de onderzoekers gaf minstens 10 procent kans dat geavanceerde AI leidt tot iets zo erg als het uitsterven van de mens.
Katja Grace et al. ↗september 2024
‘Het is mogelijk dat we over een paar duizend dagen superintelligentie hebben.’
Sam Altman ↗oktober 2024
Krachtige AI ‘kan er al in 2026 zijn’, al kan het ook veel langer duren.
Dario Amodei ↗december 2024
10 tot 20 procent kans dat AI binnen dertig jaar tot het uitsterven van de mens leidt.
Geoffrey Hinton ↗april 2025
Een uitgewerkt scenario waarin bovenmenselijke AI er rond 2027 is, met meer impact dan de industriële revolutie.
Daniel Kokotajlo et al., AI 2027 ↗september 2026
Onderzoek waar mensen nu maanden over doen, kan tegen 2028 volledig door AI gedaan worden.
Hinton, Bengio, Pachocki et al. ↗
Hoe het begon
1950
Alan Turing vraagt in een artikel of machines kunnen denken. bron
1965
Wiskundige I. J. Good beschrijft de ‘intelligentie-explosie’: een machine die betere machines bouwt. bron
2000
Eliezer Yudkowsky richt mee het Singularity Institute op, sinds 2013 MIRI. bron
2005
Nick Bostrom start het Future of Humanity Institute in Oxford. Het sluit in 2024. bron
2010
DeepMind wordt opgericht in Londen. Google koopt het in 2014. bron
2012
In Cambridge start het Centre for the Study of Existential Risk. bron
2014
Bostrom publiceert Superintelligence. Het Future of Life Institute wordt opgericht. bron
2015
OpenAI begint als vzw, onder meer met Sam Altman, Elon Musk en Ilya Sutskever. bron
2016
Onderzoekers van Google en OpenAI publiceren Concrete Problems in AI Safety. Stuart Russell start zijn centrum in Berkeley. bron
2021
Vertrekkers bij OpenAI, onder wie Dario en Daniela Amodei, richten Anthropic op. bron
2022
Op 30 november komt ChatGPT uit. bron
2023
Een open brief vraagt een pauze van zes maanden. Hinton verlaat Google. Honderden onderzoekers tekenen dat het risico op uitsterven een wereldwijde prioriteit moet zijn. In Bletchley Park vindt de eerste AI Safety Summit plaats. bron
2024
De Europese AI Act treedt in werking. Hinton en Hassabis krijgen een Nobelprijs. bron
2025
Het eerste International AI Safety Report verschijnt, onder leiding van Bengio. Yudkowsky en Soares publiceren hun boek. bron
2026
De tijdlijn van dit jaar →