AI & computing › AI-gestuurde wetenschappelijke ontdekkingen
OpenAI's wiskundige doorbraken zorgen voor onrust in de wetenschap
OpenAI claimt dat zijn nieuwste AI-model al meer dan honderd lastige wiskundige problemen heeft opgelost, waaronder een onderdeel van het miljoenendollar-Millennium-prijsprobleem rond de Navier-Stokesvergelijkingen. Het bedrijf wil de resultaten nu in bulk op GitHub zetten, terwijl wiskundigen vinden dat doorbraken eerst grondig wetenschappelijk gepubliceerd moeten worden. De ruzie zet kwaad bloed bij de wiskundige gemeenschap, die OpenAI en concurrent Anthropic verwijt het vak als marketinginstrument te gebruiken op weg naar hun beursgang.
In augustus riep OpenAI ongeveer veertig wiskundigen bijeen om te bespreken wat er moet gebeuren als kunstmatige intelligentie het vakgebied voorbij dreigt te lopen. Aanwezigen zeggen dat het bedrijf liet doorschemeren dat zijn modellen honderden lang onopgeloste problemen hadden gekraakt, en vroeg om advies over hoe die resultaten het beste gepubliceerd konden worden. Volgens wiskundige Bryna Kra van Northwestern University drongen de aanwezigen er toen op aan dat OpenAI geen losse blogposts zou plaatsen, maar volledige wetenschappelijke papers zou schrijven zodat vakgenoten de bewijzen konden narekenen. "Dat advies is gewoon genegeerd," zegt ze tegen Wired.
Honderden bewijzen in één keer online
Volgens bronnen is OpenAI van plan binnenkort honderden oplossingen voor open wiskundige vraagstukken in een keer te publiceren op de ontwikkelaarswebsite GitHub. Het bedrijf bevestigt dat een nieuw intern model sinds eind augustus al meer dan honderd langlopende problemen heeft opgelost, waaronder een onderdeel van het beroemde Millennium-prijsprobleem rond de Navier-Stokesvergelijkingen, goed voor een beloning van een miljoen dollar. Om dat laatste probleem te kraken zette OpenAI naar eigen zeggen duizenden AI-agenten tegelijk aan het werk, nadat het bedrijf geruchten had gehoord dat anderen al dicht bij een oplossing zaten.
Voor veel wiskundigen is vooral de manier van publiceren een doorn in het oog. Resultaten verschijnen via blogposts in plaats van via peer review, waardoor vakgenoten ze moeilijk kunnen controleren en eerder werk van anderen vaak onvermeld blijft. Ook onderzoeker Levent Alpöge, verbonden aan concurrent Anthropic, kondigde zelf via een tweet aan dat hij een 87 jaar oud wiskundig vermoeden had weerlegd. Critici noemen dat soort aankondigingen 'wiskunde per tweet', een trend die volgens hen haaks staat op hoe de wetenschap normaal gesproken werkt.
Beschuldigingen van 'mobster'-gedrag
De spanningen liepen in september verder op. Wiskundige Tristan Buckmaster van New York University beschuldigt OpenAI ervan zijn ongepubliceerde werk aan een deel van het Millennium-probleem te hebben overgenomen, zonder zijn onderzoekspartner bij Anthropic de credits te geven. Volgens gespreksnotities die Wired heeft ingezien, suggereerde een OpenAI-onderzoeker daarbij dat een persbericht over de kwestie slecht zou zijn voor Buckmasters carrière. OpenAI ontkent dat er is gevraagd om een medeauteur weg te laten. Andere wiskundigen spreken van een ongezonde wedloop tussen OpenAI en Anthropic, die beide naar een beursgang toewerken. "Er is een gevoel van maffiapraktijken," zegt NYU-gastdocent Nestor Guillen.
Niet iedereen is somber
OpenAI zegt samen met een adviesgroep van het Institute for Advanced Study te werken aan een verantwoorde manier om toekomstige resultaten te delen, al is er nog geen concrete datum. Sommige wiskundigen blijven ondanks de onenigheid positief over de technologie zelf. Kra ziet AI als een nieuw gereedschap waarmee grotere vragen aangepakt kunnen worden, zolang bedrijven transparanter zijn over herkomst en verificatie van hun resultaten. Binnen OpenAI zouden sommige medewerkers intussen denken dat het vak wiskunde door AI feitelijk is 'doodverklaard' — een conclusie die het bedrijf zelf nadrukkelijk afwijst.
Achtergrond & begrippen
Wat betekent dit voor de toekomst? Als AI steeds meer onopgeloste wiskundige problemen oplost, verandert dat fundamenteel hoe wetenschappelijke kennis ontstaat en wie daar de credits voor krijgt. Zonder heldere afspraken over publicatie en verificatie dreigt het vertrouwen tussen onderzoekers en AI-bedrijven verder te eroderen, terwijl de technologie zelf wiskundigen juist kan helpen om grotere en praktischer problemen aan te pakken.
- Millennium-prijsprobleem
- Een van zeven beroemde onopgeloste wiskundige raadsels waarvoor een beloning van een miljoen dollar staat; de Navier-Stokesvergelijkingen zijn er één van.
- Navier-Stokesvergelijkingen
- Een stelsel vergelijkingen dat de stroming van vloeistoffen en gassen beschrijft, en waarvan nog niet bewezen is of er altijd een nette oplossing bestaat.
- Peer review
- De gebruikelijke wetenschappelijke controle waarbij onafhankelijke vakgenoten een onderzoek beoordelen voordat het als betrouwbaar geldt.
- AI-agent
- Een AI-programma dat zelfstandig stappen zet en taken uitvoert, zoals het doorrekenen van wiskundige deelproblemen, zonder dat een mens elke stap aanstuurt.
- Wiskundig vermoeden
- Een wiskundige stelling waarvan wordt aangenomen dat ze waar is, maar die nog niet formeel is bewezen of weerlegd.
- Beursgang
- Het moment waarop een bedrijf voor het eerst aandelen aanbiedt op de openbare aandelenmarkt, vaak gepaard met grote publieke aandacht.
Bronnen
Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.