AI & computingGeneratieve AI & synthetische media

OpenAI vangt misbruik op zonder data van klanten te bewaren

· Bijgewerkt 20 augustus 2026, 10:15 · 2 min leestijd

Generatieve AI & synthetische media
Beeld: The Decoder

OpenAI heeft een nieuw veiligheidssysteem gebouwd dat verdacht gebruik van zijn AI-modellen kan opsporen, ook bij zakelijke klanten die geen data laten opslaan. Het systeem, Private Safety Processing genoemd, moet een oplossing bieden voor een lastig dilemma: hoe herken je misbruik als je de inhoud van gesprekken niet mag zien?

Grote bedrijven die AI-modellen van OpenAI gebruiken, willen vaak dat hun gegevens nergens worden opgeslagen. Dat is begrijpelijk: gevoelige bedrijfsinformatie moet niet op servers van een externe partij blijven staan. Tegelijk wil OpenAI kunnen ingrijpen als iemand een model gebruikt voor bijvoorbeeld fraude, hacking of andere schadelijke doeleinden. Met het nieuwe systeem Private Safety Processing zegt het bedrijf beide te kunnen combineren.

Het systeem werkt met wat OpenAI een nul-data-retentie-afspraak noemt: na verwerking van een verzoek wordt er niets bewaard. Toch kan het systeem patronen van misbruik herkennen die zich over meerdere, met elkaar samenhangende interacties afspelen. Volgens Aleah Houze, hoofd productbeleid bij OpenAI, worden risico's namelijk vaak pas zichtbaar als je meerdere gesprekken naast elkaar legt, en niet bij een los bericht.

Alleen een signaal, geen inhoud

Om dat voor elkaar te krijgen, ontvangt OpenAI naar eigen zeggen alleen een smal 'veiligheidssignaal'. Dat signaal geeft aan om wat voor soort activiteit het gaat en hoe ernstig die is, zonder dat OpenAI de daadwerkelijke vragen of antwoorden van gebruikers te zien krijgt. De brondata van de klant blijft op de eigen infrastructuur staan, of wordt versleuteld opgeslagen. Bij die versleutelde opslag houdt de klant zelf de sleutels in handen, wat betekent dat OpenAI zelf niet bij de gegevens kan zonder toestemming.

Dit soort constructies wordt ook wel privacy by design genoemd: privacybescherming die al vanaf de bouwtekening van een systeem is ingebouwd, in plaats van er achteraf aan toegevoegd. Door alleen een samengevat signaal te delen in plaats van ruwe data, probeert OpenAI misbruik te detecteren zonder de vertrouwelijkheid van klantgegevens op het spel te zetten.

Concurrentie kiest andere aanpak

Niet elk AI-bedrijf lost dit probleem op dezelfde manier op. Concurrent Anthropic hanteert voor zijn krachtigste modellen, zoals Fable 5, juist een bewaartermijn van dertig dagen. Die data wordt dus wel tijdelijk vastgehouden, wat controle op misbruik eenvoudiger maakt maar meer vraagt van klanten die om zero data retention geven.

OpenAI's aanpak past in een bredere trend waarbij AI-aanbieders AI-guardrails proberen te combineren met strengere privacy-eisen van zakelijke klanten, zoals banken, overheden en zorginstellingen. Deze partijen willen vaak de krachtigste modellen gebruiken, maar mogen om wet- en regelgeving geen gevoelige data laten opslaan bij een externe leverancier.

Een technisch document waarin OpenAI precies uitlegt hoe Private Safety Processing werkt, moet in september verschijnen. Pas dan wordt duidelijk hoeveel informatie het 'veiligheidssignaal' exact bevat en hoe goed het systeem in de praktijk misbruik weet te onderscheiden van onschuldig gebruik.

Achtergrond & begrippen

Wat betekent dit voor de toekomst? Als AI-bedrijven veiligheid en privacy tegelijk kunnen waarborgen, verlaagt dat de drempel voor gevoelige sectoren zoals de zorg en de financiële wereld om krachtige AI-modellen te gaan gebruiken. Dat kan de opmars van generatieve AI in gereguleerde bedrijfstakken versnellen, mits toezichthouders en klanten vertrouwen krijgen in dit soort technische constructies.

Zero data retention (ZDR)
Een afspraak waarbij een dienst geen gegevens van gebruikers bewaart nadat een verzoek is verwerkt.
Veiligheidssignaal
Een samengevat stukje informatie over de aard en ernst van een activiteit, zonder de onderliggende inhoud prijs te geven.
Encryptie
Het versleutelen van gegevens zodat alleen iemand met de juiste sleutel ze kan lezen.
Privacy by design
Een ontwerpprincipe waarbij privacybescherming vanaf het begin in een systeem wordt ingebouwd, in plaats van er later aan toe te voegen.
AI-guardrails
Technische en beleidsmatige maatregelen die moeten voorkomen dat een AI-systeem wordt misbruikt of ontspoort.

Bronnen

Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.

Meer over Generatieve AI & synthetische media