AI & computing › AI-gestuurde wetenschappelijke ontdekkingen
OpenAI beticht van vals spel bij bewijs beroemd wiskundeprobleem
Een NYU-wiskundige beschuldigt OpenAI ervan stiekem mee te hebben gelift op zijn onderzoek naar een van de beroemdste onopgeloste problemen in de wiskunde. Terwijl hij en een Anthropic-onderzoeker met AI-hulp een doorbraak voorbereidden, dook OpenAI plotseling op met een eigen, compleet bewijs.
Wiskundige Tristan Buckmaster van de New York University maakte deze week drie belangrijke bewijzen bekend voor de zogeheten Navier-Stokesvergelijkingen, een van de zeven Millennium-problemen waarop het Clay Mathematics Institute een miljoen dollar heeft gezet. Buckmaster werkte samen met Levent Alpöge, een wiskundige die in dienst is van AI-bedrijf Anthropic, en gebruikte daarbij zowel Codex van OpenAI als Claude van Anthropic. Bij de aankondiging voegde Buckmaster een opvallende waarschuwing toe: hij zegt dat informatie over hun voortgang OpenAI had bereikt, waarna dat bedrijf plotseling claimde het probleem al volledig te hebben opgelost.
Verdachte timing
Volgens Buckmaster koos hij samen met Alpöge bewust voor een aanpak die nauwelijks door andere onderzoekers werd gevolgd. Toen hij OpenAI vroeg hoe lang het bedrijf al met deze specifieke methode bezig was, kreeg hij ontwijkende antwoorden. Uiteindelijk erkende OpenAI dat de eerste opdracht aan het AI-model pas enkele dagen eerder was verstuurd, nadat informatie over Buckmasters werk het bedrijf al had bereikt. Er zou een heel team met enorme rekenkracht op zijn gezet. "Dit is niet de richting waar je in een paar dagen op uitkomt door een model simpelweg de probleemstelling te geven," schrijft Buckmaster.
Beschuldigingen over druk en credits
Sébastien Bubeck, die het wiskundig onderzoek bij OpenAI leidt, noemt de beschuldigingen "vals en opruiend" en zegt dat hij zich aan de academische spelregels heeft gehouden. Buckmaster stelt echter dat Bubeck hem vroeg om de naam van Alpöge – werkzaam bij concurrent Anthropic – uit het bewijs te schrappen als onderdeel van een compromis. Toen Buckmaster erop aandrong de zaak openbaar te maken, zou Bubeck hebben gereageerd met: "Waarom zou je je carrière verpesten?" Buckmaster maakt zich bovendien zorgen dat zijn eigen gebruik van Codex, waarvan OpenAI de interacties mag gebruiken om modellen te trainen, onbedoeld input heeft geleverd voor het eigen onderzoek van OpenAI. Het bedrijf reageerde niet op vragen hierover.
Waarom dit probleem zo belangrijk is
De Navier-Stokesvergelijkingen beschrijven hoe vloeistoffen en gassen stromen en worden wereldwijd gebruikt in de techniek, van vliegtuigontwerp tot weersvoorspellingen. Toch is nooit wiskundig bewezen of de vergelijkingen in alle gevallen wel een oplossing hebben zonder dat de uitkomst instort in oneindige waarden. Een sluitend bewijs zou een grote stap zijn in het begrijpen van de natuurkunde achter stroming. De zaak zet ook een schijnwerper op de rol van taalmodellen in serieus wetenschappelijk werk: onderzoekers zetten steeds vaker grote hoeveelheden rekenkracht in om AI te laten meedenken over onopgeloste vraagstukken, met alle vragen over eigendom en eerlijke competitie van dien. Buckmaster benadrukt dat hij het bewijs van OpenAI zelf niet heeft gezien en niemand ergens formeel van beschuldigt. "Ik zeg wat mij is verteld, wanneer, en wat mij is voorgesteld," schrijft hij, "omdat het alternatief is een reeks aankondigingen te laten staan waarvan ik weet dat ze onwaar zijn."
Achtergrond & begrippen
Wat betekent dit voor de toekomst? Deze episode laat zien dat AI-bedrijven wiskundig onderzoek serieus als wedstrijd zijn gaan behandelen, waarbij enorme rekenkracht wordt ingezet om als eerste een doorbraak te claimen. Dat roept nieuwe vragen op over eigendom van ideeën, academische eerlijkheid en de vraag wie credit verdient wanneer mens en machine samen een probleem oplossen.
- Navier-Stokesvergelijkingen
- Wiskundige formules die beschrijven hoe vloeistoffen en gassen stromen, essentieel in natuurkunde en techniek.
- Millennium-probleem
- Een van de zeven beroemde onopgeloste wiskundeproblemen waarop het Clay Mathematics Institute een beloning van een miljoen dollar heeft gezet.
- Taalmodel
- Een AI-systeem, zoals Codex of Claude, dat getraind is om tekst en logische redeneringen te genereren op basis van patronen in enorme hoeveelheden data.
- Rekenkracht (compute)
- De hoeveelheid computercapaciteit die nodig is om een AI-model te laten werken; hoe complexer de taak, hoe meer rekenkracht vereist is.
Bronnen
Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.