← Terug naar het dossier

8 september 2026 · OpenAI

OpenAI-agenten lossen een millenniumprobleem op, en twee wiskundigen vragen waar de route vandaan kwam

OpenAI maakte op 8 september bekend dat zo'n 10.000 agenten, draaiend op een intern model, in 88 uur een bewijs vonden dat oplossingen van de Navier-Stokes-vergelijkingen in drie dimensies kunnen ontsporen. Het bewijs is machinaal nagerekend in Lean. Een halve dag eerder had Tristan Buckmaster van New York University verwante resultaten gepubliceerd, samen met Levent Alpöge, plus een verklaring over hoe OpenAI na geruchten over hun werk op hetzelfde probleem sprong. Het is een ruzie over erkenning en over wat er met gebruikersdata gebeurt. Dat er iets gestolen is, heeft niemand aangetoond.

Door Mara Masaeva · Bijgewerkt op 29 september 2026

Wat het kanLopendHet verhaal is nog in beweging. Er is tot nu toe één bron, of de cijfers veranderen nog.

Wat er gebeurde

Het probleem. De Navier-Stokes-vergelijkingen beschrijven hoe water en lucht stromen. Het Clay Mathematics Institute zette er in 2000 een miljoen dollar op: blijven de oplossingen altijd glad, of kan een stroming op één punt in eindige tijd oneindig snel worden? OpenAI zegt dat zijn systeem een geval vond waarin dat gebeurt, een draaikolk die naar binnen spiraalt en steeds langer wordt, aangedreven door een gladde externe kracht. Daarmee zouden de varianten C en D uit de officiële probleemstelling van Charles Fefferman (Princeton) beslecht zijn.

De run. Op 1 september, na geruchten dat twee millenniumproblemen opgelost waren, zette OpenAI een nieuw intern model tegelijk op alle open problemen. Voor Navier-Stokes alleen stuurden de agenten 2,7 miljoen berichten en genereerden ze zo'n 130 miljard tokens. Na 88 uur lag er een bewijs. GPT-6 Astra had daarna nog 17 uur nodig om het in Lean te formaliseren. Die cijfers komen uit de aankondiging van OpenAI, die ik lees via de citaten bij Simon Willison, want de pagina van OpenAI blokkeert geautomatiseerd lezen. Mark Chen, onderzoekschef bij OpenAI, zei aan WIRED dat het ‘miljoenen dollars’ kostte.

Waarom Lean telt. Lean is een bewijsassistent. Die controleert elke stap machinaal, ongeacht wie of wat het bewijs schreef. Eén menselijke controle blijft over, schrijft Quanta. Iemand moet nagaan of de stelling die Lean aanvaardt ook de stelling is die wiskundigen bewezen wilden zien. Het Clay-instituut wil daarnaast een gepubliceerd artikel met peer review. Volgens het overzicht op Wikipedia noemde het instituut het probleem op 11 september ‘blijkbaar beslecht’, met een procedure die bewust traag verloopt.

Buckmaster en Alpöge. Tristan Buckmaster (Courant Institute, New York University) en Levent Alpöge, wiskundige in dienst van Anthropic, werkten bijna een jaar samen, privé en buiten hun werkgevers om, schrijft Buckmaster. Ze gebruikten Claude van Anthropic en Codex van OpenAI, vooral met GPT-5.6 Sol. Ze bouwden verder op het programma van Diego Córdoba (Institute for Mathematical Sciences, Madrid) en Luis Martínez-Zoroa (CUNEF), een methode waar volgens Quanta beide AI-teams op steunden. Op 15 augustus hadden ze een singulariteit met gladde kracht voor de Euler- en de Boussinesq-vergelijkingen. Euler is Navier-Stokes zonder wrijving. Lean bevestigde het op 22 augustus. Ze maakten de resultaten bekend op 7 september, vlak voor middernacht, zo'n twaalf uur voor OpenAI.

Wat Buckmaster vertelt. Op 3 september ging het gerucht rond dat Anthropic een groot open probleem had opgelost, en Alpöge had tips gekregen dat informatie over hun werk bij OpenAI beland was. Buckmaster mailde een wiskundige bij OpenAI. Op zondag 6 september volgden twee gesprekken, waarbij ook Sébastien Bubeck van OpenAI aanschoof. Buckmaster hoorde daar dat een intern model een singulariteit met gladde kracht voor Navier-Stokes bewezen had. Dat was de route die hij en Alpöge in stilte gekozen hadden, en hij kende bijna niemand anders die eraan werkte. Uiteindelijk werd erkend dat de eerste prompt van OpenAI pas enkele dagen oud was, verstuurd nadat informatie over hun werk het bedrijf bereikt had.

Hij vroeg of het model getraind was op, of toegang had tot, hun Codexsessies, waar ze het hele project lang al hun ontwerpen in zetten. Het antwoord was dat het model ‘geen gebruikersdata opzoekt’. Toen hij opnieuw naar training vroeg, kwam er geen antwoord. Hij schrijft ook dat Bubeck Alpöge als auteur weg wilde, omdat die bij Anthropic werkt. Bubeck ontkent dat hij dat vroeg.

Buckmaster zegt er uitdrukkelijk bij wat hij niet beweert. Hij heeft het bewijs van OpenAI niet gezien. Hij weet niet wat het model deed en ook niet of hun data gebruikt werd. “Ik beschuldig niemand van iets,” schrijft hij. USA Today citeert die passage voluit.

Hoe het werktetechnische uitleg

Wat OpenAI zei, en wanneer. De aankondiging van 8 september zegt dat de onderzoekers en de agenten het werk van het duo ‘op geen enkele manier’ gezien hadden voor het publiek was, en dat er ‘geen specifieke gebruikersdata geraadpleegd’ werd. In dezelfde alinea staat het voorbehoud: ‘hoewel onwaarschijnlijk’ kan OpenAI niet uitsluiten dat geanonimiseerde data uit hun gebruik van de producten de modellen mee verbeterd heeft. TechCrunch en The Verge citeren de volledige passage.

Daarna schoof de lijn op. Op 9 september zei woordvoerder Laurance Fauconnet dat OpenAI ‘categorisch’ kan zeggen dat het ‘onmogelijk’ is dat Buckmasters Codexprompts van de voorbije twee maanden het systeem ‘op enige manier’ beïnvloed hebben, ‘ook via training’. The Verge drukt die verklaring volledig af. Op 10 september zei een bijgewerkte aankondiging dat een onderzoek dat bevestigde. Op 13 september klonk het dat geen enkele gebruikersinput van na 3 juli het systeem beïnvloed kan hebben. De data en de laatste twee uitspraken haal ik uit Wikipedia, dat verwijst naar de New York Times, de Washington Post en de bijgewerkte aankondiging. Die drie heb ik zelf niet gelezen.

Wie die zinnen naast elkaar legt, ziet dat ze niet over hetzelfde gaan. ‘Geen specifieke gebruikersdata geraadpleegd’ gaat over opzoeken. De latere uitspraken gaan over training, maar telkens over een recente periode. Over het Codexgebruik van het duo van voor 3 juli, toen ze al maanden bezig waren, zei OpenAI volgens Wikipedia niets meer. TechCrunch wijst erop dat OpenAI zich het recht voorbehoudt om op Codex-interacties te trainen, tenzij de gebruiker dat uitzet.

Over de wiskunde. De resultaten zijn niet dezelfde. Buckmaster en Alpöge bewezen een singulariteit voor Euler mét een gladde externe kracht. OpenAI had een Euler-resultaat zonder kracht, en een Navier-Stokes-bewijs dat het zelf wezenlijk anders noemt. Alpöge zegt dat het bewijs van OpenAI eerder lijkt op een ander Euler-bewijs dat zij hadden, meldt Wikipedia. Buckmasters vraag gaat over de gekozen route. Een verschil in de details van het bewijs beantwoordt die vraag volgens mij niet.

Wat kan er nog volgen?

In juli zaten er achter de inbraak bij Hugging Face veel agenten die lang en hardnekkig zochten naar alles wat als vooruitgang telde. In september loste dezelfde soort opstelling een open wiskundeprobleem op.

De ruzie zegt volgens mij vooral iets over hoe onderzoekers voortaan zullen werken. Terence Tao (UCLA) schreef op Mastodon dat zelfs het gerucht dat iemand aan een probleem werkt nu een enorme AI-inspanning kan uitlokken om er eerst te zijn, meldt Analytics India Magazine. Als dat klopt, vertellen wiskundigen minder over waar ze mee bezig zijn. Wiskundigen die The Verge sprak, vrezen hetzelfde. Op 11 september publiceerden Fields-medaillewinnaars een open brief over AI in de wiskunde.

Wat ik niet weet

Of er werk van Buckmaster en Alpöge in het systeem van OpenAI terechtkwam, langs welke weg ook, staat niet vast. OpenAI ontkent dat er iets opgezocht werd en sluit invloed via training uit voor de periode na 3 juli. Over de maanden daarvoor zei het niets meer. Niemand buiten het bedrijf kan dat controleren.

Het bewijs is nog niet door vakgenoten beoordeeld, en het Clay-instituut heeft niemand erkend.

Buckmaster en Bubeck geven elk een andere versie van de gesprekken van 6 september, onder meer over het auteurschap van Alpöge.

De aankondiging van OpenAI en het artikel in Science heb ik zelf niet kunnen lezen. Beide pagina's blokkeren geautomatiseerd ophalen. Wat ik van OpenAI citeer, komt via Simon Willison, TechCrunch, The Verge, WIRED en Wikipedia.

Mijn notities

Ik zette dit eerst op de site als goed nieuws. Dat was te rap.

Voor een zaal begin ik bij Lean, want dat is het nieuwe en het is makkelijk uit te leggen. Daarna zet ik de uitspraken van OpenAI op een rij, met hun data. Ik zeg niet dat OpenAI hun werk gebruikt heeft. Dat staat niet vast, en Buckmaster zegt het zelf ook niet.

En iets praktisch. Wie onuitgegeven werk in Codex of ChatGPT stopt, kijkt best vandaag na of trainen op die gesprekken uitstaat.

“Ik vroeg of het model getraind was op, of toegang had tot, onze sessies in Codex, waar we het hele project lang al onze ontwerpen in stopten. Ik kreeg te horen dat het model geen gebruikersdata opzoekt. Ik vroeg het opnieuw, over training, en ik kreeg geen antwoord.”

Tristan Buckmaster · Wiskundige, Courant Institute, NYU

“We hebben nu gezien dat zelfs het gerucht dat iemand aan een probleem werkt, een enorme AI-inspanning kan uitlokken om het plat te walsen voor het oorspronkelijke onderzoek de kans krijgt om volledig tot bloei te komen.”

Terence Tao · Wiskundige, UCLA, Fields-medaille 2006

Lees hierna

Bronnen

  1. Tristan Buckmaster: statement of 7 September 2026 (PDF)primair · hoofdbron

    Het verslag van Buckmaster zelf: de samenwerking, de gesprekken met OpenAI, de vraag over Codex, en wat hij uitdrukkelijk niet beweert. Eén kant van het verhaal.

  2. OpenAI: On the Navier-Stokes Millennium Prize Problemprimair · nog niet nagelezen

    De aankondiging en het artikel. Blokkeert geautomatiseerd ophalen. Ik heb het twee keer geprobeerd. Hier geciteerd via Simon Willison, TechCrunch, The Verge en Wikipedia.

  3. Wikipedia: Navier-Stokes priority controversyonderzoek

    Een overzicht op één plek, met bronnen. Hier de bron voor de uitspraken van OpenAI van 9, 10 en 13 september, de reactie van het Clay-instituut en het antwoord van Alpöge. Die steunen op de pers die het citeert, en die heb ik niet allemaal gelezen.

  4. Quanta: AI has solved one of math's $1 million Millennium Prize Problemspers

    Konstantin Kakaes, 8 september. De wiskunde, het programma van Córdoba en Martínez-Zoroa, en wat Lean wel en niet beslecht.

  5. Simon Willison: some thoughts on the Navier-Stokes Millennium Prize Problemargument

    Citeert de aankondiging van OpenAI uitgebreid, met de cijfers van de run en de alinea over data.

  6. The Verge: OpenAI's sly mathematical breakthrough sends a chill through academiapers

    Robert Hart, 9 september. Reacties van wiskundigen, en Bubecks ontkenning over het auteurschap.

  7. The Verge: OpenAI just wants to winpers

    Robert Hart, 12 september. Drukt de verklaring af van OpenAI-woordvoerder Laurance Fauconnet over de Codexprompts van Buckmaster, en de zin van het Clay-instituut dat zijn procedure bewust traag verloopt.

  8. WIRED: OpenAI just claimed a huge math discovery. Some academics are crying foulpers

    Will Knight en Maxwell Zeff, 8 september. De persbriefing van OpenAI: kosten, aantallen agenten, en Bubecks ontkenning.

  9. USA Today: OpenAI touts math breakthrough. Mathematicians dispute creditpers

    Greta Reich, 8 september. Citeert Buckmaster over de Codexvraag en over wat hij niet beweert, en het antwoord van Bubeck.

  10. TechCrunch: OpenAI fought dirty on career-making math problem, says NYU mathematicianpers

    Russell Brandom, 8 september. Volledig citaat van de data-alinea van OpenAI, en de opmerking over trainen op Codexdata.

  11. Analytics India Magazine: the OpenAI Navier-Stokes controversy explainedpers

    Supreeth Koundinya, 9 september. Bron voor het citaat van Tao en de beschrijving van de constructie van OpenAI.

  12. Science: how an AI math breakthrough ignited a controversypers · nog niet nagelezen

    Blokkeert geautomatiseerd ophalen. Ik heb het twee keer geprobeerd. Ik steun hier nergens op dit artikel.