AI & computingNeuromorfe & fotonische chips

Saturn Cloud bouwt commerciële laag bovenop NVIDIA's nieuwe AI-serversoftware

· Bijgewerkt 13 augustus 2026, 13:18 · 2 min leestijd

Neuromorfe & fotonische chips
Foto: Steve Jurvetson (CC BY, via Openverse)

Cloudbedrijf Saturn Cloud heeft NVIDIA's nieuwe besturingssysteem DSX OS in zijn platform ingebouwd. Daarmee kunnen kleinere cloudaanbieders, zogeheten neoclouds, straks eenvoudiger geld verdienen aan het draaien van AI-modellen op NVIDIA-hardware, zonder dat ze zelf een complete facturatie- en beheerlaag hoeven te bouwen.

NVIDIA bracht onlangs DSX OS uit: open, modulaire software waarmee bedrijven grote hoeveelheden GPU's kunnen inzetten voor het draaien van AI-modellen. Het systeem regelt de technische kant van zo'n AI-fabriek: welke taak op welke chip komt, hoe een model over meerdere machines wordt verdeeld en wat er gebeurt als een server uitvalt. Wat NVIDIA bewust niet meelevert, is de laag die nodig is om dat allemaal daadwerkelijk als dienst te verkopen. Precies daar springt Saturn Cloud in.

Wat NVIDIA's software regelt

DSX OS bestaat uit een reeks onderdelen. NVIDIA Dynamo verzorgt het uitserveren van AI-modellen en splitst dat proces op in twee stappen: het inlezen van een vraag en het daadwerkelijk genereren van het antwoord, verdeeld over verschillende GPU's voor meer snelheid. Dynamo werkt samen met bestaande serversoftware zoals vLLM, SGLang en TensorRT-LLM. NVIDIA Grove stemt workloads af die over meerdere machines tegelijk lopen, terwijl de KAI Scheduler bepaalt welke taak welke GPU-capaciteit krijgt en per klant quota afdwingt. NVSentinel en Fleet Intelligence houden de gezondheid van een heel GPU-cluster in de gaten en signaleren storingen voordat ze problemen veroorzaken. Operators kunnen op dit fundament NVIDIA's eigen Nemotron-modellen draaien, naast open modellen van derden.

De commerciële laag van Saturn Cloud

Voor een cloudaanbieder is het runnen van GPU's op zich niet genoeg om er een verdienmodel van te maken. Er moet ook worden bijgehouden welke klant hoeveel gebruikt, tegen welk tarief, en binnen welke grenzen. Saturn Cloud voegt daarom metingen per verwerkt taalfragment toe, samen met facturatie en quotabeheer per klant. Klanten van een neocloud kunnen zo gebruikmaken van een gedeelde, meerdere klanten tegelijk bedienende omgeving voor een goedkopere dienst, of juist een volledig geïsoleerde, exclusieve omgeving afnemen als dat vanwege veiligheid of regelgeving nodig is. In beide gevallen bewaakt Saturn Cloud de grens tussen klanten en de bijbehorende afrekening. Bedrijven kunnen bovendien eigen modellen laten trainen op hun eigen infrastructuur en die vervolgens naast de standaardmodellen aanbieden, zonder een aparte trainingsomgeving te hoeven optuigen.

Voor telecombedrijven en overheden

Saturn Cloud richt zich met deze combinatie vooral op telecomaanbieders, overheden die een eigen 'soevereine' AI-infrastructuur willen opzetten, en grote bedrijven die hun eigen AI-diensten aanbieden. Het platform draait zowel in publieke cloudomgevingen als op eigen servers, bij elke partij die NVIDIA-hardware met de DSX-softwarestack gebruikt. Data en berekeningen blijven daarbij binnen de eigen infrastructuur van de operator, wat belangrijk is voor sectoren met strenge privacyregels. Het samenwerkingsverband is per direct beschikbaar voor cloudaanbieders die het willen testen.

Achtergrond & begrippen

Wat betekent dit voor de toekomst? Naarmate meer bedrijven zelf AI-diensten willen aanbieden in plaats van alleen bij grote techgiganten in te kopen, groeit de vraag naar kant-en-klare software die rekenkracht omzet in een verkoopbaar product. Combinaties zoals die van Saturn Cloud en NVIDIA maken het voor kleinere cloudaanbieders, telecombedrijven en overheden haalbaarder om een eigen, onafhankelijke AI-infrastructuur op te zetten zonder alles zelf te hoeven bouwen.

DSX OS
Open besturingssysteem van NVIDIA voor het beheren en inzetten van grote hoeveelheden GPU's voor AI-taken.
Neocloud
Een nieuwe generatie cloudaanbieders die zich specifiek richt op het verhuren van GPU-rekenkracht voor AI.
GPU-cluster
Een groep grafische processoren die samenwerkt om zware rekentaken, zoals AI-modellen, te verwerken.
AI-fabriek
Een grootschalige, gespecialiseerde infrastructuur die volledig is ingericht op het trainen en draaien van AI-modellen.
Prefill-decode disaggregatie
Een techniek waarbij het inlezen van een AI-vraag en het genereren van het antwoord over verschillende GPU's worden verdeeld, om de verwerking te versnellen.
Multi-tenant
Een opzet waarbij meerdere klanten dezelfde onderliggende infrastructuur delen, met technische scheidingen tussen hun data en gebruik.
Per-token metering
Het meten van AI-gebruik op basis van het aantal verwerkte taalfragmenten (tokens), als basis voor facturatie.

Bronnen

Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.

Meer over Neuromorfe & fotonische chips