AI & computing › Neuromorfe & fotonische chips
Geheugentekort duwt prijzen van Nvidia AI-servers zo'n 15 procent omhoog
Servers met de nieuwste AI-chips van Nvidia worden de komende maanden fors duurder. Volgens Bloomberg stijgen de prijzen met ongeveer 15 procent doordat geheugenchips schaars en duur zijn geworden. De rekening komt terecht bij techreuzen als Microsoft, Google en Amazon, die toch al miljarden investeren in AI-datacenters.
Wie binnenkort een server met de nieuwste Nvidia-chips bestelt, betaalt flink meer dan een paar maanden geleden. Bloomberg meldt dat de prijzen van deze systemen met ongeveer 15 procent stijgen. Het gaat vooral om servers met de chips Vera Rubin en Grace Blackwell, de nieuwste generaties AI-hardware van Nvidia. De prijsverhogingen gelden voor leveringen begin volgend jaar.
De oorzaak ligt niet bij Nvidia zelf, maar bij een tekort aan geheugenchips. Fabrikanten Samsung, SK Hynix en Micron vragen aanzienlijk meer geld voor DRAM, het type geheugenchip dat computers en servers nodig hebben om snel gegevens te verwerken. Deze chips zijn onmisbaar in elke AI-server: ze werken samen met de rekenversnellerchips van Nvidia en bepalen mede hoe snel een systeem grote hoeveelheden data kan verwerken.
Wie draait op voor de rekening?
De hogere kosten worden niet door Nvidia zelf doorberekend, maar door de bedrijven die de servers daadwerkelijk in elkaar zetten. Deze contractfabrikanten bouwen complete serverrekken voor techreuzen als Microsoft, Google en Oracle, en hebben hun klanten inmiddels laten weten dat de prijzen omhoog gaan. Nvidia zelf heeft nog niet gereageerd op de berichtgeving.
Uiteindelijk komt de rekening terecht bij een select groepje bedrijven: de clouddiensten van Amazon, Microsoft, Google en Meta, en AI-labs als OpenAI en Anthropic. Dit zijn precies de partijen die de afgelopen jaren enorme bedragen hebben gestoken in hyperscale-datacenters vol Nvidia-hardware.
Een netelige afhankelijkheid
De prijsstijging legt een ongemakkelijke spanning bloot. Alle genoemde bedrijven werken zelf aan eigen AI-chips om minder afhankelijk te worden van Nvidia. Toch blijven ze voorlopig grootschalig rekencapaciteit van Nvidia inkopen, simpelweg omdat er geen volwaardig alternatief is. Daarmee financieren ze onbedoeld de marktmacht van precies de leverancier waarvan ze willen loskomen.
De hogere serverprijzen zetten bovendien extra druk op de businesscase achter de miljardeninvesteringen in AI. Om die investeringen terug te verdienen, moet de omzet uit AI-diensten de komende jaren fors blijven groeien. Dat geldt des te sterker omdat Nvidia zelf ook aanzienlijke financiële verplichtingen op de balans heeft staan, onder meer door leveringsafspraken en investeringen in klanten. Een langdurig geheugentekort kan dat kwetsbare evenwicht tussen investeren en terugverdienen verder onder druk zetten.
Achtergrond & begrippen
Wat betekent dit voor de toekomst? Dit nieuws laat zien dat de AI-boom niet alleen wordt bepaald door rekenchips, maar ook door schaarse onderdelen als geheugen. Als grondstoffen zoals DRAM duurder blijven, stijgen de kosten van AI-diensten voor iedereen in de keten, van clouddienst tot eindgebruiker. Het onderstreept ook hoe afhankelijk de hele AI-industrie nog is van een handvol chip- en geheugenleveranciers.
- DRAM
- Een veelgebruikt type computergeheugen dat gegevens tijdelijk opslaat terwijl een chip ermee rekent; onmisbaar in vrijwel elke computer en server.
- Geheugenchip
- Een chip die data opslaat en snel beschikbaar maakt voor de processor, essentieel voor de snelheid van een computersysteem.
- AI-versnellerchip
- Een gespecialiseerde chip, zoals die van Nvidia, die is ontworpen om de zware rekenwerklast van kunstmatige intelligentie snel te verwerken.
- Hyperscale-datacenter
- Een extreem groot datacenter, gebouwd door techreuzen als Microsoft en Google, met duizenden servers om clouddiensten en AI op grote schaal te draaien.
- Compute-infrastructuur
- De verzameling servers, chips en netwerken die samen de rekenkracht leveren waarop AI-diensten draaien.
Bronnen
Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.