AI & computing › AI-gestuurde wetenschappelijke ontdekkingen
Claude verbetert decennialang wiskundig record rond de Riemannhypothese
Een onderzoeksversie van AI-model Claude van Anthropic kreeg de opdracht een gooi te doen naar de Riemannhypothese, een van de beroemdste onopgeloste raadsels in de wiskunde. Het model loste het probleem niet op, maar boekte tijdens de poging onverwacht vooruitgang op een verwant vraagstuk: het verbeterde een bestaande ondergrens van 41,6 naar 67,2 procent. Twee wiskundigen van Anthropic hebben het resultaat gecontroleerd en voor geldig verklaard.
De Riemannhypothese dateert uit 1859 en staat bekend als een van de moeilijkste problemen in de wiskunde, met een beloning van een miljoen dollar voor wie het oplost. Een Anthropic-medewerker vroeg Claude simpelweg om "een serieuze poging" te wagen. Het model kwam niet tot een oplossing van de hoofdvraag, maar stuitte op iets anders: een verbetering van een gerelateerd, decennia oud resultaat over de getaltheorie achter priemgetallen.
Van hopeloze opdracht tot onverwacht record
De Riemannzetafunctie beschrijft hoe priemgetallen zijn verdeeld. Op plekken waar deze functie de waarde nul aanneemt, zit informatie verstopt over het patroon van de priemgetallen. De Riemannhypothese stelt dat al die nulpunten op één denkbeeldige lijn liggen. Niemand heeft dat ooit kunnen bewijzen of ontkrachten, maar wiskundigen boeken al jaren kleine stapjes vooruit door te berekenen welk minimumaandeel van de nulpunten gegarandeerd op die lijn ligt. Dat aandeel stond op 41,6 procent. Claude combineerde bestaand werk van meerdere wiskundigen uit de afgelopen decennia met een publicatie uit 2000 en verhoogde de grens naar 67,2 procent.
Duizenden proefsommen en tientallen hulp-AI's
Het resultaat kwam niet in één sessie tot stand. Claude werkte in agentic AI-modus binnen de programmeeromgeving Claude Code en verstookte in totaal 31 miljoen output-tokens over twee sessies. Een eerste ronde met 650 geprobeerde ideeën leverde niets op. Daarna zette het model zo'n zestig subagents in die samen anderhalve dag lang doorwerkten: ze draaiden 2.400 shell-commando's, schreven honderden Python-scripts en controleerden elkaars werk. De menselijke begeleider gaf vooral aanmoedigingen als "blijf doorgaan", meer niet.
Menselijke controle blijft onmisbaar
Claude testte zijn eigen bewijs door andere subagents op zoek te laten gaan naar tegenvoorbeelden, 54 wetenschappelijke publicaties op arXiv te laten doorzoeken om te checken of de vondst niet al bekend was, en het bewijs opnieuw vanaf nul te laten opbouwen. Het model stelde zelf voor om de bevindingen op te schrijven als paper en adviseerde een menselijke expert erbij te betrekken. Twee Anthropic-wiskundigen bestudeerden en bevestigden het resultaat, en externe experts Brian Conrey en Dan Goldston keken op korte termijn mee. Claude maakte daarnaast, samen met een medewerker, een formeel verifieerbaar bewijs in het programma Lean, dat door een standaard validatietool werd goedgekeurd.
Anthropic benadrukt dat de gebruikte technieken de Riemannhypothese zelf niet dichterbij brengen. Toch illustreert het voorval hoe snel de wiskundige vaardigheden van AI-modellen zich ontwikkelen: een zijstapje bij een onmogelijke opdracht leverde alsnog een publicabel resultaat op.
Achtergrond & begrippen
Wat betekent dit voor de toekomst? Het voorval toont dat AI-modellen als Claude niet alleen bekende wiskunde kunnen toepassen, maar ook zelfstandig nieuwe verbanden kunnen leggen tussen jarenlang onderzoek van verschillende wiskundigen. Dat kan de rol van AI in de wetenschap verschuiven van hulpmiddel naar actieve onderzoekspartner, al blijft menselijke controle op de resultaten essentieel.
- Riemannhypothese
- Een wiskundig vermoeden uit 1859 dat stelt dat alle relevante nulpunten van de Riemannzetafunctie op één lijn liggen; het is nog altijd niet bewezen.
- Riemannzetafunctie
- Een wiskundige functie waarvan de nulpunten informatie geven over de verdeling van priemgetallen.
- Priemgetal
- Een getal groter dan 1 dat alleen deelbaar is door 1 en zichzelf, zoals 2, 3, 5 en 7.
- Ondergrens
- In dit geval het minimumaandeel van de nulpunten van de zetafunctie waarvan wiskundig vaststaat dat ze op de kritieke lijn liggen.
- Subagent
- Een deeltaak-uitvoerende hulp-AI die door een hoofd-AI wordt ingezet om onderdelen van een groter probleem op te lossen.
- Agentic AI
- AI die zelfstandig meerdere stappen plant en uitvoert om een taak te volbrengen, zonder dat elke stap door een mens wordt aangestuurd.
- Lean-formalisering
- Een methode waarbij een wiskundig bewijs wordt omgezet in een taal die een computer automatisch op logische juistheid kan controleren.
- arXiv
- Een online archief waar wetenschappers, vooral in wiskunde en natuurkunde, hun onderzoekspapers gratis publiceren voordat ze formeel worden beoordeeld door vakgenoten.
Bronnen
Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.