AI & computing › Generatieve AI & synthetische media
OpenAI halveert prijs van AI-modellen Sol en Luna, prestaties amper beter
OpenAI heeft twee nieuwe AI-modellen uitgebracht die tot 50 procent goedkoper zijn dan hun voorgangers. De prestaties van GPT-6 Sol en Luna blijven echter grotendeels gelijk aan die van de vorige versie, blijkt uit onafhankelijk onderzoek.
OpenAI breidt zijn modellenlijnup uit met GPT-6 Sol en GPT-6 Luna, twee redeneermodellen die vooral opvallen door hun prijs. Sol kost nu 2 dollar per miljoen invoertokens en 10 dollar per miljoen uitvoertokens, tegenover 4 en 20 dollar voor voorganger GPT-5.6 Sol. Luna is nog goedkoper: 0,10 dollar voor invoer en 0,50 dollar voor uitvoer, de helft van wat het vorige model kostte. Terra, tot dusver het goedkoopste model van OpenAI, verdwijnt uit het aanbod.
Volgens OpenAI zijn de lagere prijzen te danken aan verbeteringen in caching en inferentie, het proces waarbij een AI-model daadwerkelijk een antwoord genereert. Op herhaalde invoer, zogeheten prompt caching, geeft OpenAI nu tot 90 procent korting. Sol is bedoeld voor complexere, terugkerende taken zoals het bouwen van software en het debuggen van code. Luna moet grote hoeveelheden eenvoudige taken snel en goedkoop afhandelen, zoals het samenvatten van documenten.
Prijs daalt, prestaties blijven gelijk
OpenAI presenteert de modellen vooral op basis van prijs-kwaliteitverhouding ten opzichte van concurrent Anthropic. Op verschillende benchmarks, tests waarmee de prestaties van AI-modellen worden vergeleken, zou Sol dicht in de buurt komen van Anthropics duurdere Claude-modellen, tegen een fractie van de kosten. Op een test voor softwareontwikkeling scoort Sol op het hoogste inspanningsniveau 68,8 procent, nauwelijks lager dan Claude Fable 5 met 69,9 procent.
Onafhankelijk onderzoeksbureau Artificial Analysis trekt echter een kritischer conclusie. Volgens hun metingen blijft de algehele intelligentiescore van de nieuwe modellen nagenoeg gelijk aan die van de vorige generatie: Sol stijgt van 47 naar 48 punten, Luna blijft steken op 37. Op specifieke onderdelen zijn er zelfs achteruitgangen. Op een test voor kantoorwerk verliest Sol circa 100 punten en Luna zo'n 75 punten, wat volgens de onderzoekers vooral komt door een lagere kwaliteit van de gepresenteerde resultaten.
OpenAI concurreert met zichzelf
Opvallend is dat Luna op het hoogste inspanningsniveau bijna dezelfde score haalt als Sol, tegen 78 procent lagere kosten. Dat maakt de keuze tussen de twee eigen modellen voor ontwikkelaars lastig: waarom zou je het duurdere model gebruiken als het goedkopere bijna hetzelfde presteert? Critici wijzen er bovendien op dat OpenAI in zijn eigen testresultaten enkele veelgebruikte benchmarks weglaat, wat het beeld mogelijk gunstiger maakt dan de werkelijkheid.
Met GPT-6 Sol en Luna zet OpenAI vooral in op toegankelijkheid: goedkopere AI voor bedrijven en ontwikkelaars die grote volumes taken willen verwerken. Of de modellen zich in de praktijk bewijzen, moet nog blijken. Beide modellen zijn beschikbaar via de API en worden geleidelijk uitgerold in ChatGPT voor betalende abonnees.
Achtergrond & begrippen
Wat betekent dit voor de toekomst? Deze lancering laat zien dat de concurrentie tussen AI-bedrijven zich steeds meer verplaatst van pure prestaties naar prijs. Voor gebruikers en bedrijven betekent dit dat krachtige AI-toepassingen goedkoper en toegankelijker worden, ook al verbetert de onderliggende technologie maar mondjesmaat. Op termijn kan dit de drempel voor grootschalige toepassing van AI in bedrijfsprocessen verder verlagen.
- Redeneermodel
- Een AI-model dat expliciet stappen doorloopt om tot een antwoord te komen, vaak geschikt voor complexere taken dan standaardmodellen.
- Inferentie
- Het proces waarbij een getraind AI-model daadwerkelijk wordt gebruikt om een antwoord of resultaat te genereren.
- Benchmark
- Een gestandaardiseerde test waarmee de prestaties van verschillende AI-modellen onderling vergeleken kunnen worden.
- Inspanningsniveau (effort-niveau)
- Een instelling die bepaalt hoeveel rekenkracht en 'nadenktijd' een AI-model besteedt aan het beantwoorden van een vraag.
- Prompt caching
- Een techniek waarbij eerder verwerkte invoer wordt opgeslagen, zodat een AI-model deze niet opnieuw hoeft te verwerken en kosten dalen.
- Token
- Een stukje tekst, vaak een woord of woorddeel, dat de basiseenheid vormt waarmee AI-taalmodellen tekst verwerken en waarop de prijs van AI-diensten wordt gebaseerd.
Bronnen
Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.