AI & computing › Generatieve AI & synthetische media
StepFun brengt taalmodel Step 5 Preview uit: pienter en betaalbaar
Het Chinese AI-bedrijf StepFun heeft een nieuw taalmodel gelanceerd: Step 5 Preview. Onafhankelijke tests van analysebureau Artificial Analysis laten zien dat het model bovengemiddeld presteert tegen een relatief lage prijs, al geeft het wel opvallend lange antwoorden.
StepFun, een Chinese ontwikkelaar van kunstmatige intelligentie, heeft Step 5 Preview uitgebracht. Het gaat om een zogeheten redeneermodel: een large language model dat eerst inwendig 'nadenkt' voordat het een antwoord geeft. Het model verwerkt zowel tekst als afbeeldingen als invoer, maar geeft alleen tekst terug als uitvoer.
Sterke score tegen scherpe prijs
Artificial Analysis, een onafhankelijk bureau dat AI-modellen test en vergelijkt, plaatst Step 5 Preview op de 24e plek van tweehonderd onderzochte modellen op hun Intelligence Index. Die index combineert tien verschillende benchmarks, waaronder testen voor programmeren, kennis, wiskundig redeneren en het uitvoeren van kantoortaken. Step 5 Preview haalt een score van 44 punten, ruim boven het gemiddelde van 24 voor modellen in dezelfde prijsklasse.
Die prijsklasse is niet onbelangrijk: het model kost 1 dollar per miljoen invoertokens en 2,70 dollar per miljoen uitvoertokens. Ter vergelijking: vergelijkbare modellen vragen gemiddeld 1,88 en 10 dollar. Het volledig doorlopen van de complete testreeks kostte Artificial Analysis in totaal 922,84 dollar. Daarmee scoort StepFun in wat onderzoekers de 'Pareto-grens' noemen: de combinatie van prestatie en prijs waarbij je voor hetzelfde geld geen beter model kunt vinden.
Snel, maar wel breedsprakig
Op snelheid doet het model het ook goed: Step 5 Preview verwerkt gemiddeld honderd tokens per seconde, tegenover een mediaan van 71 tokens per seconde bij vergelijkbare modellen. Tokens zijn de tekstfragmenten waarin AI-taal opknipt om taal te verwerken; hoe meer tokens per seconde, hoe sneller een antwoord verschijnt.
Toch heeft het model ook een duidelijke tekortkoming: het is opvallend uitgebreid in zijn antwoorden. Voor het doorlopen van de Intelligence Index-testen produceerde Step 5 Preview 160 miljoen tokens aan tekst, tegenover een mediaan van 92 miljoen tokens bij andere modellen. Dat betekent dat het model vaak meer woorden gebruikt dan nodig, wat de praktische kosten in gebruik alsnog kan opdrijven ondanks de lage prijs per token.
Groot geheugen voor lange documenten
Step 5 Preview beschikt over een contextvenster van 1 miljoen tokens, omgerekend ongeveer 1.500 pagina's tekst in een gangbaar lettertype. Daarmee kan het model in één keer grote documenten, codebases of lange gesprekken verwerken zonder eerdere informatie te 'vergeten'. StepFun voegt zich met deze release bij grote spelers als OpenAI, Anthropic, Google en het Chinese DeepSeek in de race om betaalbare maar krachtige AI-modellen.
Achtergrond & begrippen
Wat betekent dit voor de toekomst? De lancering van Step 5 Preview laat zien dat de concurrentie tussen AI-bedrijven zich steeds meer verplaatst naar de balans tussen prestatie en prijs. Voor gebruikers en bedrijven betekent dit dat krachtige AI-modellen goedkoper en toegankelijker worden, al blijft het belangrijk te letten op verborgen kosten zoals overbodig lange antwoorden.
- Redeneermodel
- Een AI-taalmodel dat eerst inwendig stappen doorloopt om tot een antwoord te komen, vergelijkbaar met hardop nadenken voordat je iets zegt.
- Large language model (LLM)
- Een AI-systeem dat is getraind op enorme hoeveelheden tekst en daardoor mensachtige taal kan begrijpen en genereren.
- Benchmark
- Een gestandaardiseerde test waarmee de prestaties van verschillende AI-modellen eerlijk met elkaar vergeleken kunnen worden.
- Contextvenster
- De hoeveelheid tekst die een AI-model tegelijk kan 'onthouden' en verwerken tijdens een gesprek of taak.
- Token
- Een klein tekstfragment, vaak een deel van een woord, waarin AI-modellen taal opknippen om deze te kunnen verwerken.
- Pareto-grens
- De denkbeeldige lijn van modellen die voor hun prijs de best mogelijke prestatie leveren, zonder dat een goedkoper model dezelfde kwaliteit haalt.
Bronnen
Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.