AI & computing › Generatieve AI & synthetische media
OpenAI lanceert GPT-6 Sol en Luna: goedkoper en minder fouten
OpenAI heeft twee nieuwe AI-modellen uitgebracht: GPT-6 Sol en GPT-6 Luna. Ze moeten goedkoper zijn dan hun voorgangers en minder fouten maken, terwijl de concurrentie met Anthropic ondertussen verder oploopt.
OpenAI breidt zijn nieuwste generatie kunstmatige intelligentie uit. Na de lancering van het krachtige topmodel GPT-6 Astra eerder deze maand, volgen nu updates van twee kleinere taalmodellen: Sol en Luna. Beide modellen zijn al eerder dit jaar geïntroduceerd, maar krijgen nu een grondige opfrisbeurt binnen de GPT-6-serie.
Sol en Luna zijn geen concurrenten van elkaar, maar vullen elkaar aan. Sol is bedoeld voor zwaardere klussen, zoals programmeren en het oplossen van complexe problemen. Luna richt zich juist op simpeler, veelvoorkomend werk: het samenvatten van documenten, het uit teksten halen van informatie, of het snel beantwoorden van vragen. OpenAI noemt dat laatste 'hoogvolume-taken met een duidelijk doel'.
Fors goedkoper via de API
Het grootste verschil met de vorige versies zit in de prijs. Ontwikkelaars die de modellen aanspreken via de API - de technische verbinding waarmee software van bedrijven en particulieren toegang krijgt tot OpenAI's modellen - betalen voortaan nog maar de helft van wat de vorige generatie (versie 5.6) kostte. OpenAI zegt dat die besparing komt door technische verbeteringen in caching en inference. Caching betekent dat het model vaker teruggrijpt op eerder verwerkte informatie in plaats van alles opnieuw te berekenen. Inference is het proces waarbij een AI-model daadwerkelijk een antwoord genereert nadat het is getraind. Door dat proces efficiënter te maken, kan OpenAI de rekenkosten drukken en die besparing doorberekenen aan klanten.
Minder fouten, feller duel met Anthropic
Naast lagere kosten claimt OpenAI ook een hogere betrouwbaarheid. Het bedrijf test zijn modellen met een interne factualiteitsevaluatie, gebaseerd op geanonimiseerde gesprekken waarin gebruikers zelf fouten van de chatbot aangaven. Volgens die meting maakt GPT-6 Sol ongeveer half zoveel fouten als zijn voorganger. Daarmee zou het model qua betrouwbaarheid in de buurt komen van het veel duurdere topmodel Astra, maar dan tegen een fractie van de kosten. Fouten van AI-modellen, ook wel AI-hallucinaties genoemd, zijn al jaren een van de grootste zwaktes van chatbots: ze presenteren onjuiste informatie soms met net zoveel zelfvertrouwen als correcte feiten.
OpenAI positioneert de nieuwe modellen nadrukkelijk tegenover concurrent Anthropic, en stelt dat Sol en Luna beter presteren dan diens modellen Fable en Opus. Opvallend detail: Anthropic bracht slechts negentig minuten vóór de aankondiging van OpenAI zelf een nieuwe versie van Opus uit, Opus 5.5. Het toont hoe close de twee AI-bedrijven inmiddels tegen elkaar opboksen, met releases die soms bijna gelijktijdig verschijnen.
De nieuwe versies van Sol en Luna zijn per direct beschikbaar in ChatGPT Work en de programmeertool Codex, voor de meeste betalende gebruikers, en via de API. Luna volgt ook in de desktop-app van ChatGPT en wordt daar zelfs beschikbaar voor gratis gebruikers en het goedkopere Go-abonnement. OpenAI rolt de modellen de komende tijd geleidelijk uit naar de ChatGPT-app en -website.
Achtergrond & begrippen
Wat betekent dit voor de toekomst? Doordat AI-modellen goedkoper en betrouwbaarder worden, kunnen meer bedrijven en particulieren ze inzetten voor dagelijkse taken, van klantenservice tot programmeerwerk. De felle concurrentie tussen OpenAI en Anthropic, die elkaar bijna op de minuut af beconcurreren met nieuwe releases, versnelt die ontwikkeling verder. Op termijn kan dit ertoe leiden dat krachtige AI steeds toegankelijker wordt voor kleinere organisaties die eerder de kosten niet konden dragen.
- Large language model (taalmodel)
- Een AI-systeem dat is getraind op grote hoeveelheden tekst en op basis daarvan mensachtige taal kan begrijpen en genereren.
- API
- Een technische koppeling waarmee andere software of ontwikkelaars een AI-model kunnen aanspreken zonder de onderliggende techniek zelf te bouwen.
- Inference
- Het proces waarbij een getraind AI-model daadwerkelijk een antwoord of resultaat genereert op basis van een nieuwe vraag.
- Caching
- Een techniek waarbij eerder verwerkte informatie wordt hergebruikt, zodat een systeem niet telkens hetzelfde werk opnieuw hoeft te doen.
- Factualiteitsevaluatie
- Een interne test waarmee OpenAI meet hoe vaak een model feitelijk onjuiste antwoorden geeft, gebaseerd op door gebruikers gemelde fouten.
- AI-hallucinatie
- Het verschijnsel waarbij een AI-model met overtuiging informatie presenteert die feitelijk onjuist of verzonnen is.
Bronnen
Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.