AI & computing › Generatieve AI & synthetische media
Nvidia's nieuwe AI-model moet biljoen parameters krijgen, China is al verder
Nvidia bouwt met Nemotron 4 een nieuw open AI-taalmodel van minstens duizend miljard parameters, twee keer zo groot als zijn voorganger. Toch blijft het bedrijf daarmee nog altijd kleiner dan de nieuwste Chinese modellen, die al ruim boven die grens uitkomen.
Chipgigant Nvidia werkt aan een nieuw open taalmodel dat moet uitgroeien tot het grootste in zijn soort buiten China. Nemotron 4, de opvolger van Nemotron 3 Ultra, krijgt volgens ingewijden minstens duizend miljard parameters — twee keer zoveel als zijn voorganger. Daarmee wil Nvidia de concurrentie aangaan met de sterkste vrij beschikbare modellen ter wereld, al blijft het bedrijf daarmee nog altijd achter op de Chinese koplopers.
Verdubbeling van de omvang
Parameters zijn de instelbare rekenwaarden waarmee een taalmodel taal verwerkt en genereert. Meer parameters betekenen doorgaans meer benodigde rekenkracht en trainingsdata, maar kunnen ook leiden tot krachtigere en veelzijdigere modellen. Nemotron 3 Ultra, dat afgelopen juni verscheen, gold destijds als het sterkste open Amerikaanse model op de Artificial Analysis Intelligence Index, een veelgebruikte ranglijst voor AI-prestaties. Toch moest het toen al buigen voor het Chinese Kimi K2.6 van Moonshot AI. Op de huidige ranglijst staat Nemotron 3 Ultra op 38 punten, tegenover ongeveer 60 voor het inmiddels uitgebrachte Kimi K3.
Dat verschil is niet toevallig. Moonshot AI's Kimi K3 telt 2,8 biljoen parameters en DeepSeek's V4 Pro 1,6 biljoen. Zelfs met een biljoen parameters zou Nemotron 4 dus nog altijd kleiner zijn dan de grootste Chinese modellen. Nvidia mikt op een release deze herfst, als de planning standhoudt.
Waarom Nvidia zelf modellen bouwt
Nvidia verdient traditioneel aan de verkoop van gpu's, de gespecialiseerde chips waarop AI-modellen worden getraind en gebruikt. Een open-weightmodel — waarbij de onderliggende parameters vrij te downloaden zijn — stimuleert bedrijven om zulke modellen zelf te draaien op eigen hardware. Hoe meer partijen dat doen, hoe meer chips Nvidia verkoopt. Volgens The Information heeft het bedrijf zijn clouduitgaven voor de training van eigen modellen verdrievoudigd, tot 28 miljard dollar tot en met 2031.
Die strategie plaatst Nvidia wel in een ongemakkelijke positie. Het bedrijf is namelijk ook leverancier van grote klanten als OpenAI, dat zelf taalmodellen ontwikkelt en daarvoor Nvidia-chips inkoopt. Met Nemotron 4 wordt Nvidia dus tegelijk leverancier en concurrent van eigen klanten.
Discussie over open modellen
Nvidia behoort verder tot de ondertekenaars van een petitie die pleit tegen strengere regulering van open AI-modellen. Dat gebeurt terwijl de regering-Trump overweegt gerichte beperkingen in te voeren voor specifieke Chinese AI-modellen, uit zorgen over veiligheid en geopolitieke afhankelijkheid. Het voorbeeld van Nemotron 4 laat zien hoe nauw technologische vooruitgang, handelsbelangen en geopolitiek inmiddels met elkaar verweven zijn: een Amerikaans bedrijf dat probeert bij te blijven bij Chinese modellen, terwijl diezelfde Chinese modellen mogelijk om andere redenen aan banden worden gelegd.
Achtergrond & begrippen
Wat betekent dit voor de toekomst? De race om steeds grotere open AI-modellen laat zien dat de technologische voorsprong van Amerikaanse bedrijven op dit vlak kleiner wordt: Chinese labs bouwen inmiddels grotere en beter scorende modellen. Voor gebruikers en bedrijven betekent dit meer keuze in krachtige, gratis te downloaden AI-modellen, maar ook een groeiende geopolitieke spanning rond wie welke technologie mag gebruiken of verkopen.
- Taalmodel
- Een AI-systeem dat getraind is om tekst te begrijpen en te genereren, de basis van chatbots en veel andere AI-toepassingen.
- Parameter
- Een instelbare rekenwaarde binnen een AI-model; hoe meer parameters, hoe meer informatie een model in theorie kan vastleggen.
- Open-weightmodel
- Een AI-model waarvan de getrainde parameters vrij beschikbaar zijn, zodat iedereen het model zelf kan downloaden en draaien.
- Gpu
- Een gespecialiseerde chip, oorspronkelijk ontwikkeld voor grafische taken, die inmiddels de motor vormt achter het trainen en draaien van AI-modellen.
- Benchmark (Intelligence Index)
- Een gestandaardiseerde test of ranglijst waarmee de prestaties van verschillende AI-modellen onderling worden vergeleken.
Bronnen
Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.