AI & computing › Neuromorfe & fotonische chips
Nvidia levert eerste Vera-chip: een processor speciaal voor AI-agents
Nvidia is begonnen met de grootschalige levering van Vera, zijn eerste zelfontworpen processor die specifiek is gebouwd voor AI-agents. Techtopman Ian Buck bracht de eerste systemen persoonlijk langs bij onder meer Amazon, Oracle, Anthropic en OpenAI. De chip moet AI die zelfstandig taken uitvoert, sneller en efficiënter laten werken.
Nvidia begint met de grootschalige levering van Vera, zijn eerste zelfontworpen processor (CPU) die specifiek is gebouwd voor agentic AI: kunstmatige intelligentie die niet alleen antwoord geeft, maar ook zelfstandig taken uitvoert. Het bedrijf bracht de eerste Vera-systemen persoonlijk langs bij cloudreuzen en AI-labs, van Amazon tot OpenAI.
Waarom AI-agents om een nieuwe chip vragen
Grafische chips (GPU's) krijgen meestal alle aandacht als het over AI gaat, maar elke AI-agent leunt minstens zo zwaar op de processor. Wanneer een AI-model bijvoorbeeld zelf programmeercode moet schrijven om een vraag te beantwoorden, gereedschap moet aanroepen of grote hoeveelheden tekst moet doorzoeken, is dat werk voor de CPU. Nvidia-vicepresident Ian Buck noemt dit een nieuw 'CPU-moment': nu AI-modellen steeds vaker zelfstandig handelen in plaats van alleen te chatten, groeit de vraag naar processors die dat soepel bijbenen.
Vera pakt dat aan met 88 zelfontworpen rekenkernen, genaamd Olympus, en een geheugenbandbreedte van 1,2 terabyte per seconde. Volgens Nvidia is de chip tot 1,8 keer sneller per kern dan eerdere ontwerpen bij taken die kenmerkend zijn voor AI-agents. Dat moet vooral verschil maken in datacenters die continu onder hoge belasting draaien, de zogeheten AI-fabrieken waar bedrijven duizenden AI-verzoeken tegelijk verwerken.
Van Seattle tot Palo Alto: de eerste ontvangers
Nvidia leverde de eerste Vera-CPU's niet via de gewone weg, maar liet Buck de systemen zelf afgeven bij klanten. In mei kregen de AI-labs Anthropic, OpenAI en SpaceXAI, en cloudbedrijf Oracle Cloud Infrastructure (OCI), al een Vera-server. Deze week volgde Amazon Web Services (AWS) in Seattle, in het kader van een uitgebreide samenwerking tussen Amazon en Nvidia waarbij ook twee miljoen extra GPU's zijn aangekondigd.
Oracle is voorlopig de eerste cloudaanbieder die Vera op grote schaal gaat inzetten: het bedrijf wil er vanaf 2026 honderdduizenden uitrollen in zijn datacenters. Ook techbedrijven als Anthropic en SpaceXAI testen de chip al voor eigen toepassingen, zoals trainingsprocessen voor AI-modellen en simulaties.
Samenwerking met grafische chip Rubin
Vera werkt niet alleen zelfstandig, maar vormt ook het hart van Nvidia's nieuwe supercomputersysteem Vera Rubin NVL72. Daarin is de CPU gekoppeld aan twee Rubin-GPU's via een snelle chipverbinding, waarbij processor en grafische chips hetzelfde geheugen delen. Dat voorkomt dat gegevens onnodig heen en weer moeten tussen verschillende geheugenchips, wat rekenkracht bespaart. Volgens Nvidia werkt deze combinatie twee keer zo energiezuinig als eerdere generaties compute-infrastructuur.
Met Vera zet Nvidia, dat van oudsher vooral bekendstaat om zijn GPU's, dus ook een stap in de markt voor processors. Voor bedrijven die AI-agents grootschalig willen inzetten, moet dat straks vooral betekenen dat taken sneller worden afgerond en dat meer gebruikers tegelijk bediend kunnen worden.
Achtergrond & begrippen
Wat betekent dit voor de toekomst? Nu AI-modellen steeds vaker zelfstandig taken uitvoeren in plaats van alleen te antwoorden, verschuift een deel van de rekenlast van grafische chips naar processors. Chips zoals Vera moeten datacenters efficiënter maken en de weg vrijmaken voor grootschalige inzet van AI-agents bij cloudbedrijven en techbedrijven wereldwijd. Dat kan uiteindelijk zorgen voor snellere en goedkopere AI-diensten voor eindgebruikers.
- CPU
- De centrale processor van een computersysteem, verantwoordelijk voor algemene rekentaken en besturing.
- GPU
- Een gespecialiseerde chip die oorspronkelijk voor beeldbewerking werd gebruikt en nu vooral AI-berekeningen versnelt.
- Agentic AI
- Kunstmatige intelligentie die zelfstandig taken uitvoert, zoals code schrijven of gegevens opzoeken, in plaats van alleen vragen te beantwoorden.
- Geheugenbandbreedte
- De hoeveelheid data die een chip per seconde kan uitwisselen met zijn geheugen; hogere bandbreedte betekent minder wachttijd.
- AI-fabriek
- Een datacenter dat volledig is ingericht op het continu verwerken van grote hoeveelheden AI-taken.
- Chipverbinding (interconnect)
- De technische verbinding waarmee twee of meer chips razendsnel gegevens met elkaar uitwisselen.
- Gedeelde geheugenarchitectuur
- Een ontwerp waarbij processor en grafische chip hetzelfde geheugen gebruiken, zodat data niet onnodig hoeft te worden gekopieerd.
- Compute-infrastructuur
- De verzameling servers, chips en netwerken die samen de rekenkracht leveren voor onder meer AI-toepassingen.
Bronnen
Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.