AI & computing › AI-gestuurde wetenschappelijke ontdekkingen
OpenAI-onderzoeker zette wiskundige onder druk om Anthropic-collega te schrappen
Een Amerikaanse wiskundige beschuldigt OpenAI van intimidatie nadat hij met hulp van AI vooruitgang boekte op een van de beroemdste onopgeloste problemen in de wiskunde. OpenAI zou hebben geprobeerd zijn coauteur, die voor concurrent Anthropic werkt, van het onderzoek te laten schrappen. OpenAI ontkent de beschuldigingen en zegt inmiddels zelf een doorbraak op hetzelfde probleem te hebben gepubliceerd.
Wiskundige Tristan Buckmaster doet ernstige beschuldigingen aan het adres van AI-bedrijf OpenAI. Hij en zijn coauteur Levent Alpöge boekten met hulp van AI-modellen grote vooruitgang op de Navier-Stokesvergelijkingen, een van de zeven beroemde Millennium-problemen van het Clay Mathematics Institute. Op elk van die problemen staat een miljoen dollar prijzengeld. Volgens Buckmaster zette OpenAI-onderzoeker Sébastien Bubeck hem vervolgens onder druk om Alpöge, die bij concurrent Anthropic werkt, als coauteur te schrappen.
Vooruitgang via AI-modellen
Buckmaster en Alpöge werkten maandenlang met verschillende AI-modellen, waaronder Anthropics Claude en OpenAI's Codex met GPT-5.6 Sol. Medio augustus hadden ze naar eigen zeggen meerdere doorbraken geboekt, onder meer een resultaat voor een specifieke variant van de Navier-Stokesvergelijkingen. Dat resultaat is nog niet gepubliceerd of formeel geverifieerd. De vergelijkingen beschrijven hoe vloeistoffen en gassen stromen en spelen een sleutelrol in natuurkunde en techniek. Al hun conceptversies hadden de onderzoekers gedurende het project geüpload naar OpenAI's Codex.
Begin september gingen er geruchten rond over een grote wiskundige doorbraak. Buckmaster nam zelf contact op met OpenAI om te benadrukken dat het om een privésamenwerking ging, zonder institutionele afspraken. OpenAI reageerde diezelfde dag en drong steeds sterker aan op een telefoongesprek. Tijdens dat gesprek met Bubeck vertelde OpenAI dat een intern model een bewijs van ongeveer honderd pagina's had geproduceerd voor de Navier-Stokesvergelijkingen met een externe kracht ('forcing'), volgens dezelfde ongebruikelijke aanpak die Buckmaster en Alpöge hadden gekozen.
Druk om coauteur te schrappen
Volgens Buckmaster deed OpenAI twee voorstellen: in het ene zouden hij en Alpöge hun resultaat publiceren, gevolgd door OpenAI's eigen resultaat een dag later. In het andere zou Buckmaster alleen publiceren, met alleen een verwijzing naar een intern OpenAI-model. In beide scenario's zou Bubeck er twee keer op hebben aangedrongen dat Alpöge als auteur werd geschrapt, omdat die voor Anthropic werkt. Toen Buckmaster weigerde en dreigde de kwestie openbaar te maken, zou Bubeck hebben gezegd: "Waarom zou je je carrière verpesten?"
OpenAI ontkent en publiceert eigen resultaat
OpenAI heeft de beschuldigingen inmiddels tegengesproken. Bubeck zei in een persbriefing dat het bedrijf geen toegang had tot het werk van Buckmaster en Alpöge voordat dit publiek werd. OpenAI benadrukt de prioriteit van hun werk te erkennen. Het bedrijf maakte intussen bekend dat een intern model, dat het "aanzienlijk krachtiger dan GPT-6 Astra" noemt, het Navier-Stokes-probleem met forcing heeft opgelost. Zo'n tienduizend samenwerkende AI-agents werkten er 88 uur aan, met een rekenkostenpost van naar eigen zeggen miljoenen dollars. Het bewijs is ook geformaliseerd in Lean, zodat een computer de logische stappen kan controleren. Deze vorm van autoformalisatie geldt als belangrijke stap om AI-bewijzen betrouwbaar te maken.
OpenAI-onderzoeker Noam Brown wijst op de snelle vooruitgang: waar het behalen van een hoge score op de ARC-AGI-benchmark vorig jaar nog zo'n 500.000 dollar aan rekenkracht kostte, kan het nieuwste model soortgelijke prestaties nu voor ongeveer twintig dollar leveren.
Achtergrond & begrippen
Wat betekent dit voor de toekomst? Deze episode laat zien hoe AI-modellen steeds vaker meewerken aan academische doorbraken, tot en met de beroemdste onopgeloste problemen in de wiskunde. Tegelijk toont de rel tussen OpenAI en een onafhankelijke wiskundige hoe fel de concurrentie tussen AI-bedrijven is geworden, zelfs als het gaat om erkenning voor wetenschappelijk werk.
- Navier-Stokesvergelijkingen
- Wiskundige vergelijkingen die beschrijven hoe vloeistoffen en gassen stromen; een van de zeven Millennium-problemen met een miljoen dollar prijzengeld voor een sluitend bewijs.
- Millennium-problemen
- Zeven beroemde onopgeloste wiskundige vraagstukken die het Clay Mathematics Institute in 2000 aanwees, elk met een prijs van een miljoen dollar.
- Lean-formalisering
- Het omzetten van een wiskundig bewijs naar de programmeertaal Lean, zodat een computer elke logische stap kan controleren.
- Autoformalisatie
- Het automatisch vertalen van menselijke wiskundige redeneringen naar een formele, door computers controleerbare taal.
- Agentzwerm
- Een groep AI-programma's die gecoördineerd samenwerkt om een complexe taak, zoals een wiskundig bewijs, op te lossen.
- Benchmark
- Een gestandaardiseerde test waarmee de prestaties van AI-modellen onderling vergelijkbaar worden gemaakt.
Bronnen
Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.