AI & computing › Generatieve AI & synthetische media
OpenAI belooft privacybescherming zonder dataopslag, als tegenzet naar Anthropic
OpenAI test een nieuw controlesysteem dat verdacht gebruik van zijn AI-modellen moet opsporen zonder dat klantgegevens worden bewaard. Het bedrijf presenteert de dienst nadrukkelijk als privacyvriendelijker alternatief voor het bewaarbeleid dat rivaal Anthropic sinds juli hanteert.
OpenAI heeft een nieuwe beveiligingsdienst aangekondigd onder de naam Private Safety Processing. Het systeem moet misbruik van AI-modellen herkennen zonder dat gesprekken van klanten worden opgeslagen. De dienst wordt voorlopig alleen getest bij een select aantal zakelijke klanten, meldt TechCrunch.
De timing is opvallend. Anthropic, de maker van chatbot Claude, kondigde in juli een beleid aan waarbij gesprekken met zogeheten 'covered models' zoals het model Fable dertig dagen worden bewaard. Dat gebeurt om mogelijk misbruik te kunnen onderzoeken, maar stuitte op weerstand bij bedrijven die gevoelige data liever niet langer dan nodig bij een AI-leverancier laten liggen.
Hoe het systeem werkt
OpenAI bouwt voort op een bestaand principe dat de meeste grote AI-bedrijven al toepassen: Zero Data Retention. Daarbij scant een geautomatiseerde AI-guardrail individuele gesprekken op verdacht gedrag, zonder dat een medewerker meekijkt en zonder dat de data bewaard blijft. Private Safety Processing breidt dit uit: het systeem kan signalen uit meerdere gesprekken van dezelfde gebruiker met elkaar verbinden, ook als die over langere tijd zijn verspreid.
Dat is relevant omdat kwaadwillenden hun vragen soms bewust opknippen om aan controle te ontsnappen. Iemand die bijvoorbeeld stap voor stap malware probeert te laten ontwerpen, zou dat in aparte, onschuldig ogende sessies kunnen doen. Het nieuwe systeem legt dat patroon alsnog bloot, aldus OpenAI, zonder dat er ooit een mens de onderliggende gesprekken hoeft te lezen. Wordt er iets verdachts gevonden, dan stuurt het systeem een beperkt signaal naar OpenAI, waarna het bedrijf kan besluiten contact op te nemen met de klant. Die klant kan er dan zelf voor kiezen om gegevens alsnog te delen.
Verschil met Anthropic
Anthropic werkt met een andere aanpak: menselijke controleurs mogen onder strikte voorwaarden gesprekken inzien, via wat het bedrijf een 'gecontroleerd toegangspad' noemt. Iedere inzage wordt vastgelegd in een audit trail die achteraf niet kan worden aangepast of gewist. OpenAI kiest dus voor een model zonder opslag en zonder mensen die meelezen, terwijl Anthropic juist transparantie belooft over de momenten waarop mensen wél meekijken.
De aankondiging valt in een periode van felle concurrentie tussen de twee AI-bedrijven. Anthropic groeide de afgelopen periode sneller dan OpenAI en zou inmiddels een jaarlijks omzettempo van 65 miljard dollar hebben. Beide bedrijven bereiden zich bovendien voor op een beursgang, wat de druk om zich te onderscheiden op punten als veiligheid en privacy by design vergroot.
Achtergrond & begrippen
Wat betekent dit voor de toekomst? Naarmate AI-modellen krachtiger worden, groeit ook de kans dat ze voor kwaadaardige doelen worden ingezet, denk aan het ontwerpen van malware of desinformatie. Systemen die misbruik opsporen zonder gegevens te bewaren, kunnen bedrijven met gevoelige data over de streep trekken om AI te gaan gebruiken, en zetten de norm voor hoe de hele sector veiligheid en privacy in de toekomst combineert.
- Private Safety Processing
- De nieuwe dienst van OpenAI die meerdere gesprekken van een gebruiker met elkaar vergelijkt om misbruik op te sporen, zonder de inhoud van die gesprekken op te slaan.
- Zero Data Retention (ZDR)
- Een beleid waarbij een AI-dienst gesprekken direct na gebruik verwijdert en alleen automatisch, per sessie, op misbruik controleert.
- Covered models
- De term die Anthropic gebruikt voor krachtige AI-modellen, zoals de Mythos- en Fable-reeks, waarvoor een langer bewaarbeleid van dertig dagen geldt.
- Audit trail
- Een onwijzigbaar logboek waarin elke handeling, zoals de inzage van klantgegevens door een medewerker, wordt vastgelegd.
- Langetermijnveiligheidsmonitoring
- Een controlemethode die niet naar één gesprek kijkt, maar naar patronen over meerdere sessies heen, om misbruik te herkennen dat over tijd is uitgesmeerd.
Bronnen
Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.