AI & computing › Generatieve AI & synthetische media
OpenAI toont Jalapeño-chip: sneller en zuiniger dan Nvidia's beste AI-chip
OpenAI heeft op de chipconferentie Hot Chips voor het eerst benchmarkresultaten van zijn eigen AI-chip Jalapeño gepresenteerd. De chip verwerkt AI-taken sneller en zuiniger dan de huidige topchips van Nvidia, al moet de eerste grote uitrol nog tot 2027 wachten.
OpenAI bouwt aan zijn eigen computerchip voor het draaien van AI-modellen, met de interne naam Jalapeño. Tijdens de Hot Chips-conferentie liet het bedrijf dinsdag de eerste testresultaten zien. Op de InferenceX-benchmark van onderzoeksbureau SemiAnalysis scoorde de chip beter dan een vergelijkbaar systeem van marktleider Nvidia, zowel in snelheid als in energiezuinigheid.
Sneller antwoord, minder stroom
Jalapeño is speciaal ontworpen voor inferentie: de fase waarin een getraind AI-model daadwerkelijk antwoorden genereert, bijvoorbeeld als iemand een vraag stelt aan ChatGPT. Dat is een ander proces dan het trainen van een model, en vraagt om andere eigenschappen van een chip. Richard Ho, hoofd hardware bij OpenAI, zei tijdens een persgesprek dat de chip 'aanzienlijk' beter presteert dan de huidige stand van de techniek. Jalapeño kan volgens hem meer AI-werk verzetten per eenheid stroom, en geeft tegelijk sneller antwoord. Dat is belangrijk voor bedrijven die AI-diensten aan grote groepen gebruikers tegelijk aanbieden: hoe meer klanten een chip tegelijk kan bedienen zonder trager te worden, hoe voordeliger de dienst.
De vergelijking werd gemaakt met een Blackwell-systeem van Nvidia, de huidige topchip van die producent. OpenAI erkent zelf dat de concurrentie tegen de tijd dat Jalapeño op volle schaal draait, waarschijnlijk alweer een stap verder is. Ho verwacht dat de chip eind 2026 in kleine aantallen wordt ingezet, met een grotere uitrol in 2027.
Ontwikkeld met Broadcom
Jalapeño werd voor het eerst aangekondigd in oktober vorig jaar. OpenAI ontwikkelde de chip in nauwe samenwerking met chipbedrijf Broadcom, waarbij OpenAI's eigen AI-modellen meehielpen bij het ontwerpproces. Het bedrijf wil van Jalapeño geen eenmalig project maken, maar de basis voor een reeks chips die steeds worden doorontwikkeld samen met nieuwe AI-modellen, software en geheugentechniek.
Minder vertraging bij het verwerken
Doordat OpenAI de hele keten in eigen hand heeft, kon het bedrijf knelpunten aanpakken die vaak voor vertraging zorgen tijdens inferentie. Jalapeño is vooral ontworpen om oponthoud te beperken tijdens de zogeheten prefill-fase en tijdens de communicatie tussen verschillende onderdelen van het systeem. In die fasen wordt een binnenkomende vraag eerst verwerkt voordat het model daadwerkelijk begint met het genereren van een antwoord, en dat proces vormt vaak een bottleneck. Volgens OpenAI is de chip ontworpen om dataverplaatsing en communicatievertraging tot een minimum te beperken. Daardoor kan informatie die het model nodig heeft tijdens het genereren van een antwoord, de zogeheten KV-cache, dicht bij de rekeneenheid blijven staan in plaats van steeds heen en weer te reizen. Dat scheelt tijd en energie, en is precies waar een gespecialiseerde AI-versnellerchip zoals Jalapeño zijn voordeel haalt ten opzichte van meer algemene chips.
Achtergrond & begrippen
Wat betekent dit voor de toekomst? Als OpenAI erin slaagt zijn eigen chips op grote schaal in te zetten, wordt het bedrijf minder afhankelijk van Nvidia en kan het zelf bepalen hoe snel en goedkoop zijn AI-diensten draaien. Dat kan de kosten van AI-gebruik voor consumenten en bedrijven drukken, maar versterkt ook de macht van een handjevol techbedrijven dat de onderliggende infrastructuur van AI beheerst.
- Inferentie
- Het moment waarop een al getraind AI-model daadwerkelijk een antwoord genereert, bijvoorbeeld op een vraag van een gebruiker.
- Token
- Een klein stukje tekst, vaak een woord of woorddeel, dat een AI-model als bouwsteen gebruikt om tekst te lezen en te schrijven.
- Doorvoer (throughput)
- De hoeveelheid werk die een chip in een bepaalde tijd kan verwerken, bijvoorbeeld het aantal tokens per seconde.
- Nvidia Blackwell
- De nieuwste generatie AI-chips van marktleider Nvidia, die als vergelijkingsmateriaal diende in de tests.
- Broadcom
- Amerikaans chipbedrijf dat samen met OpenAI de Jalapeño-chip heeft ontwikkeld.
Bronnen
Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.