AI & computingGeneratieve AI & synthetische media

Anthropic en OpenAI verlagen prijzen fors met nieuwe AI-modellen

· Bijgewerkt 24 september 2026, 01:43 · 2 min leestijd

Generatieve AI & synthetische media
Beeld: Ars Technica

Anthropic en OpenAI hebben deze week nieuwe versies van hun AI-modellen gelanceerd die vooral op één punt uitblinken: ze zijn een stuk goedkoper dan hun voorgangers. Opus 5.5 van Anthropic en GPT-6 Sol en Luna van OpenAI leveren maar bescheiden prestatieverbeteringen, maar besparen bedrijven tot wel veertig procent op hun rekening.

Anthropic bracht Opus 5.5 uit, de nieuwste versie van het model dat bedrijven vooral gebruiken voor programmeerwerk en complexe denktaken. OpenAI kwam met GPT-6 Sol en Luna, twee goedkopere varianten in de GPT-6-familie. Beide bedrijven benadrukken niet dat hun modellen ineens veel slimmer zijn geworden. De nadruk ligt op efficiëntie: meer werk verzetten voor minder geld.

Die verschuiving is geen toeval. Grote bedrijven experimenteren steeds vaker met modelroutering, een techniek waarbij software automatisch het goedkoopste AI-model kiest dat een taak nog net aankan. Daarnaast groeit de concurrentie van gratis te downloaden open-weightmodellen. Voor Anthropic en OpenAI, die vooral verdienen aan zakelijke klanten, is dat een directe bedreiging. Wie te duur is, verliest klanten aan alternatieven.

Opus 5.5: goedkoper en iets sneller

Volgens Anthropic kost het gebruik van Opus 5.5 twintig procent minder dan zijn voorganger Opus 5: vier dollar per miljoen invoer-tokens en twintig dollar per miljoen uitvoertokens. Nog opvallender is de prijsdaling bij zogeheten cache reads, ofwel het hergebruiken van eerder verwerkte informatie via promptcaching. Dat wordt zestig procent goedkoper, tot 0,20 dollar per miljoen tokens. Omdat dit type verwerking een groot deel van de kosten bij programmeer- en agenttaken uitmaakt, telt die besparing extra zwaar. Anthropic claimt dat de totale kostenbesparing voor een gemiddelde taak zelfs kan oplopen tot veertig procent, omdat het model ook nog eens minder tokens nodig heeft om een taak af te ronden. Opus 5.5 werkt bovendien dertig procent sneller dan Opus 5. Wel geldt: bij vragen die raken aan gevoelige gebieden zoals cyberbeveiliging of biologie, schakelt het systeem automatisch en onopgemerkt over naar een ouder, voorzichtiger model.

GPT-6 Sol en Luna: de goedkope broertjes

OpenAI positioneert Sol als een krachtig maar betaalbaar alternatief voor dagelijks gebruik, en Luna als de snelste en goedkoopste optie voor eenvoudige taken. Beide zijn opvolgers binnen de GPT-6-lijn, die verder bestaat uit het topmodel Astra en het middenmodel Terra. Sol kost 2 dollar per miljoen invoertokens en 10 dollar per miljoen uitvoertokens; Luna is met 0,10 en 0,50 dollar nog goedkoper. OpenAI zegt dat beide modellen met vergelijkbare technieken zijn getraind als het krachtigere Astra, en op sommige benchmarks een paar procentpunten beter scoren dan hun voorgangers. De belangrijkste verandering blijft echter de prijs: ongeveer de helft van wat de vorige generatie kostte.

Waarom kosten nu belangrijker zijn dan kracht

De timing van beide releases valt niet toevallig samen. Steeds meer bedrijven die AI dagelijks inzetten, geven aan dat ze niet per se het allerslimste model nodig hebben, maar wel voorspelbare kosten. Complexe AI-taken vereisen vaak uitgebreide 'orkestratie': systemen en werkwijzen eromheen die bepalen hoe een model wordt ingezet. Die operationele kant weegt voor veel klanten inmiddels zwaarder dan een paar procentpunten extra intelligentie. Dat betekent niet dat de vooruitgang aan de frontier, de absolute grens van wat AI-modellen kunnen, stilstaat. Wel verschuift de concurrentiestrijd tussen Anthropic en OpenAI zichtbaar van 'wie is het slimst' naar 'wie is het voordeligst voor structureel gebruik'.

Achtergrond & begrippen

Wat betekent dit voor de toekomst? Nu AI-modellen elkaar qua kwaliteit steeds dichter naderen, wordt de prijs per taak een doorslaggevende factor voor bedrijven. Dat kan de markt voor AI-diensten toegankelijker maken voor kleinere organisaties, maar zet ook druk op aanbieders om voortdurend efficiënter te werken in plaats van alleen krachtiger.

Token
De kleinste taaleenheid (ongeveer een woorddeel) waarmee AI-taalmodellen tekst verwerken en waarop de meeste prijsmodellen zijn gebaseerd.
Modelroutering
Een techniek waarbij software automatisch het goedkoopste of meest geschikte AI-model kiest voor een specifieke taak, in plaats van altijd het duurste topmodel te gebruiken.
Promptcaching (cache reads)
Het hergebruiken van eerder door het model verwerkte informatie, waardoor herhaalde taken sneller en goedkoper worden afgehandeld.
Open-weightmodel
Een AI-model waarvan de onderliggende parameters openbaar beschikbaar zijn, waardoor het gratis of goedkoop door iedereen gebruikt en aangepast kan worden.
Frontier (AI)
De term voor de absolute grens van wat de meest geavanceerde AI-modellen op een bepaald moment kunnen.

Bronnen

Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.

Meer over Generatieve AI & synthetische media