AI & computingAgentic AI & autonome agents

Open-source tool Cua laat AI-agents zelfstandig je computer bedienen

· Bijgewerkt 21 september 2026, 01:38 · 2 min leestijd

Agentic AI & autonome agents
Beeld: Hacker News frontpage

Een groep ontwikkelaars heeft met Cua een gratis, open-source gereedschapskist gelanceerd waarmee AI-agents zelfstandig een computer kunnen bedienen: klikken, typen en tussen apps schakelen zoals een mens dat doet. Het project combineert cloud-desktops, lokale virtuele machines en kleine gespecialiseerde AI-modellen die razendsnel simpele beslissingen nemen. Cua werd deze week op Hacker News gepresenteerd en staat op GitHub al op ruim 25.000 sterren.

Een AI die zelf een programma opent, een cel in een spreadsheet aanklikt of een formulier invult: dat is het idee achter computer-use agents. Het Amerikaanse bedrijf Cua AI heeft nu een gratis, open-source toolkit uitgebracht waarmee ontwikkelaars zulke agents bouwen en testen. Het project, simpelweg Cua genoemd, combineert cloud-desktops, lokale virtuele machines en kleine gespecialiseerde AI-modellen. Op GitHub staat de code inmiddels op ruim 25.000 sterren, een teken dat veel ontwikkelaars de aanpak interessant vinden.

Een stuurprogramma voor elke app

De kern van het systeem is Cua Driver, software die een AI-agent laat 'zien' en 'bedienen' wat er op een scherm gebeurt. De driver werkt op macOS, Windows en Linux, en agents kunnen ermee praten via de command line, via het Model Context Protocol (MCP) of via kant-en-klare programmeerbibliotheken. Cua noemt dat zelf 'computer-use 2.0': een agent die binnen één taak moeiteloos wisselt tussen het schrijven van code, het aanroepen van een API en het klikken in een grafische applicatie. In een demonstratievideo laat het bedrijf zien hoe twee van zulke agents tegelijk cellen selecteren in een spreadsheetprogramma en objecten verplaatsen in een tekenprogramma, zonder dat een mens ingrijpt.

Kleine modellen voor snelle beslissingen

Naast de besturingssoftware presenteert Cua een familie kleine, gespecialiseerde taalmodellen onder de naam CUA-S1. De naam verwijst naar 'System 1', een begrip uit de psychologie voor snel, automatisch denken zonder lang nadenken. De modellen zijn niet bedoeld om een hele taak te plannen; dat werk doet een groter, algemener AI-model. CUA-S1 neemt alleen de kleine, begrensde beslissingen: welk vakje in een formulier hoort bij welk gegeven, of een knop wel of niet moet worden aangeklikt. Doordat zulke modellen klein zijn, reageren ze sneller en goedkoper dan een zwaar taalmodel dat voor elke muisklik moet nadenken. De broncode van CUA-S1 staat op GitHub onder een vrije licentie; de getrainde modelgewichten zelf zijn apart te vinden op Hugging Face, met eigen gebruiksvoorwaarden per model.

Testen in de cloud en op eigen hardware

Voor wie agents wil trainen of testen, biedt Cua meerdere bouwstenen. Met Cua Fleets kunnen ontwikkelaars op aanvraag een virtuele Linux-desktop laten draaien in de cloud, een soort sandbox die na gebruik weer wordt opgeruimd. Lume doet hetzelfde lokaal: het maakt virtuele macOS- en Linux-machines op Apple-computers met M-chips, gebaseerd op Apples eigen virtualisatietechniek. En met Cua Bench kunnen onderzoekers taken bouwen, agents daarop laten los en de resultaten - inclusief complete actiereeksen - exporteren om weer nieuwe modellen mee te trainen.

Het geheel past in een bredere trend van agentic AI: AI-systemen die niet alleen tekst genereren, maar ook zelfstandig handelingen uitvoeren. Waar veel bedrijven inzetten op steeds grotere, alleskunnende modellen, kiest Cua bewust voor een combinatie van een groot planningsmodel met kleine, snelle hulpmodellen voor routinematige klikwerk. De software is volledig open source onder de MIT-licentie, al gelden voor losse onderdelen zoals de meegeleverde beeldherkenningsmodule OmniParser en de optionele Ultralytics-integratie andere licenties.

Achtergrond & begrippen

Wat betekent dit voor de toekomst? Computer-use agents kunnen routinetaken op een scherm overnemen, van het invullen van formulieren tot het testen van software, zonder dat voor elke afzonderlijke app een aparte koppeling nodig is. Doordat het gereedschap open source is, kunnen onderzoekers en bedrijven wereldwijd meebouwen en de betrouwbaarheid van zulke agents sneller verbeteren. Dat kan uiteindelijk repetitief computerwerk automatiseren, al blijft toezicht nodig omdat een verkeerde muisklik net zo goed reële gevolgen heeft als een menselijke fout.

Computer-use agent
Een AI-systeem dat een computer bedient zoals een mens: door te klikken, te typen en tussen applicaties te schakelen.
Systeem 1-model
Een klein, gespecialiseerd AI-model dat is ontworpen voor snelle, begrensde beslissingen, geïnspireerd op het idee van 'snel denken' uit de psychologie.
Model Context Protocol (MCP)
Een open standaard waarmee AI-modellen op een uniforme manier verbinding maken met externe programma's en gegevensbronnen.
Sandbox
Een geïsoleerde, tijdelijke computeromgeving waarin software of AI veilig kan worden getest zonder het echte systeem te raken.
Agentic AI
AI die niet alleen antwoorden genereert, maar ook zelfstandig acties uitvoert om een taak te voltooien.
Virtuele machine
Een softwarematige nabootsing van een computer, waarop een ander besturingssysteem geïsoleerd kan draaien.
Synthetische datageneratie
Het kunstmatig aanmaken van trainingsgegevens, bijvoorbeeld om AI-modellen te trainen zonder gevoelige echte data te gebruiken.
Actiegrens
Een vooraf vastgelegde grens die aangeeft welke handelingen een AI-agent zelfstandig mag uitvoeren voordat er controle nodig is.

Bronnen

Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.

Meer over Agentic AI & autonome agents