AI & computing › Agentic AI & autonome agents
OpenAI dicht Codex-lek dat per ongeluk echte bestanden van gebruikers wiste
OpenAI heeft een fout in zijn AI-programmeertool Codex verholpen waardoor het systeem soms zelfstandig echte gebruikersbestanden wiste in plaats van tijdelijke werkbestanden. Meerdere gebruikers meldden dataverlies nadat Codex, aangedreven door het model GPT-5.6 Sol, tijdens het opruimen per ongeluk hun homedirectory leegveegde. Met een beveiligingsupdate heeft OpenAI nu meerdere vangnetten ingebouwd om dit te voorkomen.
Codex is de AI-programmeertool van OpenAI die zelfstandig code kan schrijven, testen en opruimen. Gebruikers geven een opdracht, en Codex voert vervolgens zelf de benodigde stappen uit, van het aanmaken van bestanden tot het weer verwijderen van tijdelijke rommel. Die laatste stap ging de afgelopen tijd bij een aantal gebruikers goed mis: in plaats van tijdelijke werkbestanden verwijderde het systeem echte, persoonlijke bestanden. Gedupeerden meldden dat ze zonder waarschuwing data kwijtraakten terwijl Codex op de achtergrond aan het werk was.
Wat ging er mis?
Volgens OpenAI zat de fout in een opruimcommando dat bedoeld was om tijdelijke werkbestanden weg te gooien nadat Codex een taak had afgerond. Dat commando maakte gebruik van systeemvariabelen zoals $HOME, een soort digitale routewijzer die een computer vertelt waar de persoonlijke bestanden van een gebruiker staan. Door een fout in de code kon het verwijdercommando in bepaalde situaties niet naar een tijdelijke map wijzen, maar naar de echte homedirectory: de plek waar al iemands documenten, foto's en projecten staan. Het gevolg: Codex veegde per ongeluk echte data weg in plaats van rommel die toch weggegooid mocht worden.
Hoe lost OpenAI het op?
OpenAI heeft nu meerdere vangnetten ingebouwd om herhaling te voorkomen. Zo controleert Codex voortaan vooraf welk doelwit een verwijdercommando precies heeft, voordat het wordt uitgevoerd. Ook maakt het systeem bij elke taak een compleet nieuwe tijdelijke map aan, in plaats van te vertrouwen op bestaande systeemvariabelen die naar de verkeerde plek konden wijzen. Risicovolle verwijdercommando's worden daarnaast strenger gecontroleerd, en de zogeheten full-access mode, een instelling waarmee Codex zonder beperkingen toegang krijgt tot het bestandssysteem, kan niet meer per ongeluk worden geactiveerd.
OpenAI raadt gebruikers aan om Codex altijd in een sandbox-modus te draaien, een afgeschermde omgeving waarin de AI geen toegang heeft tot bestanden buiten het project waaraan wordt gewerkt. Daarnaast is het belangrijk om de applicatie up-to-date te houden, zodat de nieuwste veiligheidsmaatregelen actief zijn.
Groter vraagstuk rond autonome AI
Het incident raakt aan een bredere discussie over agentic AI: AI-systemen die niet alleen tekst genereren, maar ook zelfstandig acties uitvoeren op een computer. Hoe meer vrijheid zo'n systeem krijgt, hoe groter het risico dat een kleine programmeerfout grote, onomkeerbare gevolgen heeft. Voor coding-agents als Codex, die steeds vaker door ontwikkelaars worden ingezet om routinewerk uit handen te nemen, is vertrouwen in de veiligheid van dat soort tools essentieel.
Achtergrond & begrippen
Wat betekent dit voor de toekomst? Dit incident laat zien dat autonome AI-agents die daadwerkelijk actie ondernemen op een computer, zoals bestanden aanmaken of verwijderen, een nieuw soort risico met zich meebrengen dat verder gaat dan een fout antwoord van een chatbot. Naarmate meer ontwikkelaars en bedrijven dit soort tools gebruiken om taken te automatiseren, wordt het steeds belangrijker dat AI-bedrijven stevige technische vangnetten inbouwen voordat een systeem write- of delete-rechten krijgt. De manier waarop OpenAI hierop reageert, met verificatiestappen en strengere standaardinstellingen, is een voorbeeld van hoe de sector leert omgaan met de risico's van steeds zelfstandiger opererende AI.
- Codex
- De AI-programmeertool van OpenAI die zelfstandig code kan schrijven, uitvoeren en opruimen.
- Agentic AI
- AI-systemen die niet alleen tekst genereren, maar ook zelfstandig acties uitvoeren, zoals commando's draaien op een computer.
- Sandbox-modus
- Een afgeschermde omgeving waarin een AI-programma alleen toegang heeft tot een beperkt deel van het bestandssysteem, zodat fouten geen schade kunnen aanrichten buiten die omgeving.
- Systeemvariabele
- Een soort digitale routewijzer, zoals $HOME, die een computer vertelt waar bepaalde bestanden of mappen zich bevinden.
- Full-access mode
- Een instelling waarmee een AI-tool zonder beperkingen toegang krijgt tot het volledige bestandssysteem van een gebruiker.
- Delete-commando
- Een instructie aan de computer om bepaalde bestanden of mappen permanent te verwijderen.
Bronnen
Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.