AI & computing › Generatieve AI & synthetische media
OpenAI lanceert Ultrafast: GPT-5.6 Sol werkt tot 14 keer sneller
OpenAI introduceert een nieuwe modus genaamd Ultrafast, waarmee het taalmodel GPT-5.6 Sol tot veertien keer sneller reageert dan normaal. De functie moet AI bruikbaarder maken voor taken waarbij elke seconde telt, zoals klantenservice en financiële analyse. Vooralsnog is de modus alleen beschikbaar voor een select groepje klanten.
OpenAI heeft een nieuwe versnelde modus gepresenteerd voor zijn nieuwste en krachtigste model, GPT-5.6 Sol. De modus heet Ultrafast en levert volgens het bedrijf tot 750 AI-tokens per seconde op, veertien keer zoveel als de standaardinstelling. Tokens zijn de kleine tekstfragmenten waarin een taalmodel zijn antwoorden opbouwt; hoe meer tokens per seconde, hoe vlotter een chatbot of applicatie aanvoelt.
In een blogpost die donderdag verscheen, schrijft OpenAI dat snelheid tot nu toe vooral werd bereikt door een kleiner of specialistischer model te gebruiken, met verlies van kwaliteit als gevolg. Ultrafast moet die afweging omzeilen: hetzelfde krachtige grondmodel blijft actief, maar wordt geoptimaliseerd om meer werk per seconde te verzetten. Mogelijk gemaakt wordt dit door de samenwerking van OpenAI met chipmaker Cerebras, dat gespecialiseerde inferentiechips bouwt die specifiek zijn ontworpen om AI-modellen razendsnel te laten reageren in plaats van te trainen.
Voor wie is Ultrafast bedoeld?
OpenAI noemt een aantal praktische toepassingen waarvoor de nieuwe modus geschikt zou zijn. Denk aan incidentrespons bij storingen, klantenservice waarbij gebruikers direct antwoord verwachten, financiële marktanalyse waar seconden het verschil kunnen maken, en e-commerceplatforms die razendsnel producten moeten aanbevelen of vragen moeten beantwoorden. In al die sectoren kan vertraging klanten of bedrijven geld kosten, en daar speelt OpenAI met Ultrafast op in.
De functie is nu nog in preview en wordt slechts aan een kleine groep klanten aangeboden. OpenAI belooft de toegang uit te breiden zodra er meer rekencapaciteit beschikbaar komt. Dat geeft ook aan dat de hoge snelheid nog relatief kostbaar is om op grote schaal te leveren.
Concurrentie doet ook mee
OpenAI is niet de enige partij die op snelheid inzet. Concurrent Anthropic heeft voor zijn Claude-modellen eerder al een 'fast mode' geïntroduceerd, maar volgens OpenAI haalt die niet dezelfde snelheden als Ultrafast. De wedloop om snellere AI-modellen past in een bredere trend: naast steeds slimmere modellen wordt reactietijd een steeds belangrijker verkoopargument, zeker nu bedrijven AI inzetten in processen waar mensen realtime antwoorden verwachten.
Achtergrond & begrippen
Wat betekent dit voor de toekomst? Snellere AI-modellen maken het mogelijk om kunstmatige intelligentie in te zetten op plekken waar tot nu toe alleen mensen of eenvoudigere software snel genoeg konden reageren, zoals live klantenservice of acute storingsanalyse. Als deze snelheid betaalbaar en breed beschikbaar wordt, kan dat de manier veranderen waarop bedrijven AI in hun dagelijkse processen inbouwen.
- AI-token
- Het kleinste stukje tekst dat een taalmodel tegelijk verwerkt of genereert; het aantal tokens per seconde bepaalt hoe snel een antwoord verschijnt.
- Taalmodel (large language model)
- Een AI-systeem dat is getraind op grote hoeveelheden tekst en op basis daarvan mensachtige antwoorden kan genereren.
- Grondmodel (foundation model)
- Een breed inzetbaar AI-model dat als basis dient voor allerlei specifieke toepassingen, zonder dat het speciaal voor één taak is gemaakt.
- Inferentiechip
- Een computerchip die specifiek is ontworpen om getrainde AI-modellen snel antwoorden te laten geven, in plaats van om ze te trainen.
Bronnen
Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.