AI & computing › AI-gestuurde wetenschappelijke ontdekkingen
OpenAI claimt doorbraak: 10.000 AI-agenten kraken beroemd wiskundig raadsel
OpenAI zegt dat een nog niet uitgebracht AI-model in 88 uur tijd een doorbraak heeft geforceerd in het Navier-Stokes-probleem, een van de zeven millenniumprijsproblemen uit de wiskunde. Het bedrijf zette daarvoor 10.000 samenwerkende AI-agenten in en gaf er miljoenen dollars aan rekenkracht aan uit. De timing van de aankondiging leidde meteen tot een rel met een rivaliserend onderzoeksteam over wie het idee eerst had.
OpenAI zegt een van de beroemdste onopgeloste problemen uit de wiskunde te hebben gekraakt. Volgens het bedrijf loste een nog niet uitgebracht AI-model in minder dan vier dagen tijd een cruciaal onderdeel van het Navier-Stokes-probleem op, een van de zeven millenniumprijsproblemen. De claim zorgt meteen voor ophef, want een rivaliserend onderzoeksteam beweert dat OpenAI met hun aanpak aan de haal ging.
Een raadsel van een miljoen dollar
De Navier-Stokesvergelijkingen beschrijven hoe vloeistoffen en gassen stromen. Ingenieurs gebruiken ze om vliegtuigvleugels te ontwerpen, weersvoorspellingen te maken en bloedstromen in het lichaam te simuleren. Al decennia weten wiskundigen niet zeker of de vergelijkingen in alle gevallen een nette, voorspelbare oplossing geven, of dat ze op een gegeven moment volledig instorten. Die vraag staat sinds 2000 op de lijst van zeven millenniumprijsproblemen van het Clay Mathematics Institute, met telkens een miljoen dollar beloning voor wie een oplossing kan bewijzen. Sinds de publicatie van de lijst is er pas één probleem definitief opgelost. OpenAI claimt nu aangetoond te hebben dat de vergelijkingen inderdaad kunnen instorten, oftewel dat er situaties bestaan waarin de wiskundige beschrijving van een stroming op enig moment geen zinnig antwoord meer geeft.
Duizenden AI-agenten tegelijk aan het werk
Volgens OpenAI begon het onderzoek eind augustus met de training van een nieuw, nog ongepubliceerd model. Toen er online geruchten opdoken dat een concurrent vorderingen boekte op de millenniumproblemen, zette het bedrijf zijn systeem op alle zes nog openstaande problemen tegelijk. Het werk aan Navier-Stokes bleek verrassend kansrijk, waarna OpenAI er extra rekenkracht tegenaan gooide. In de laatste fase draaiden zo'n 10.000 AI-agenten, zelfstandig werkende programma's die onderling berichten uitwisselden, tegelijk aan het probleem. Onderzoeker Sebastien Bubeck en topman Mark Chen zeggen dat de rekenkosten in de miljoenen dollars liepen, ongeveer duizend keer zoveel als bij eerdere wiskundige resultaten van het bedrijf. Na 88 uur rekenen kwam er zaterdag een oplossing uit.
Discussie over credit en verificatie
De timing van de aankondiging viel niet toevallig. Enkele uren eerder publiceerden wiskundige Tristan Buckmaster van New York University en Levent Alpoge, die voor concurrent Anthropic werkt, hun eigen AI-ondersteunde resultaten over verwante vergelijkingen. Buckmaster stelt dat OpenAI pas met het probleem aan de slag ging nadat nieuws over zijn onderzoek de ronde deed, en daarbij dezelfde ongebruikelijke aanpak volgde die hij en Alpoge maandenlang hadden ontwikkeld. OpenAI ontkent toegang te hebben gehad tot het werk van de rivaliserende onderzoekers. Wel erkende het bedrijf later dat het niet volledig kan uitsluiten dat geanonimiseerde gebruiksdata van klanten indirect heeft bijgedragen aan de training van het model. Belangrijker nog: de uitkomst is voorlopig een claim, geen feit. Volgens de regels van het Clay Mathematics Institute moet een oplossing eerst in een peer-reviewed tijdschrift verschijnen en daarna twee jaar standhouden in de wiskundige gemeenschap voordat er zelfs maar een commissie naar kijkt. Institute-president Martin Bridson noemt dat proces bewust traag en benadrukt dat de beoordeling grondig zal zijn. OpenAI zegt de miljoen dollar sowieso niet te zullen claimen, ook niet als de oplossing wordt bevestigd.
Achtergrond & begrippen
Wat betekent dit voor de toekomst? Als de claim standhoudt, laat het zien dat AI-systemen met genoeg rekenkracht en de juiste opzet kunnen meehelpen aan het oplossen van problemen die decennia weerstand boden aan menselijke wiskundigen. Tegelijk laat de rel over credit zien hoe lastig het wordt om vast te stellen wie welke bijdrage leverde wanneer AI-bedrijven razendsnel op elkaars werk voortbouwen. Definitieve erkenning laat sowieso jaren op zich wachten, omdat wiskundige doorbraken eerst grondig door mensen gecontroleerd moeten worden.
- Millenniumprijsprobleem
- Een van de zeven beroemdste onopgeloste wiskundevraagstukken, met een beloning van een miljoen dollar per opgelost probleem.
- Navier-Stokesvergelijkingen
- Wiskundige formules die beschrijven hoe vloeistoffen en gassen stromen, gebruikt in onder meer vliegtuigontwerp en weersvoorspelling.
- AI-agenten
- Zelfstandig werkende AI-programma's die taken uitvoeren en onderling informatie kunnen uitwisselen om samen een probleem op te lossen.
- Peer review
- Het proces waarbij onafhankelijke experts een wetenschappelijk resultaat controleren voordat het als betrouwbaar wordt erkend.
Bronnen
Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.