AI & computing › Generatieve AI & synthetische media
Anthropic beschuldigt Chinese AI-bedrijven van heimelijk kopiëren van Claude
Het Amerikaanse AI-bedrijf Anthropic zegt dat Chinese techbedrijven zoals DeepSeek, Moonshot AI en Alibaba op grote schaal en heimelijk gebruikmaakten van zijn chatbot Claude om eigen AI-modellen te trainen. Amerikaanse veiligheidsdiensten noemen de praktijk een bedreiging voor de Amerikaanse technologische voorsprong, maar Chinese experts zetten vraagtekens bij het bewijs.
Anthropic, het bedrijf achter de chatbot Claude, beschuldigt zes Chinese AI-ontwikkelaars van grootschalige en ongeoorloofde modeldistillatie. Dat meldt het bedrijf in een rapport van september. Volgens Anthropic hebben DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun en Z.AI de afgelopen twee jaar miljarden tokens, de kleine tekstbrokjes waarmee taalmodellen rekenen, onttrokken aan Amerikaanse frontier-AI-modellen. Niet alleen Claude werd hiervoor gebruikt, maar ook modellen van OpenAI, Google en xAI. Anthropic stelt dat de Chinese overheid vermoedelijk op de hoogte was van de activiteiten.
Het meest concrete voorbeeld betreft Moonshot AI, de maker van de populaire chatbot Kimi. Volgens Anthropic stuurde Moonshot gebruikersvragen stiekem door naar Claude, terwijl gebruikers dachten met Kimi zelf te praten. In een periode van tien dagen ging het om 300.000 verzoeken, verstuurd via een netwerk van 5.380 nepaccounts in Singapore en Japan. Ook Alibaba zou tussen mei en juli van dit jaar meer dan 151 miljoen keer op deze manier output hebben verzameld.
Wat is het verschil met gewoon onderzoek?
Het trainen van een nieuw AI-model met de hulp van een bestaand, krachtiger model is op zichzelf een normale en veelgebruikte techniek in de AI-sector. Onderzoekers noemen dit distillatie: een kleiner model leert sneller en goedkoper door de antwoorden van een groter 'lerarenmodel' te bestuderen. Anthropic benadrukt dat transparant onderzoek met toestemming legitiem is. Het probleem ontstaat volgens het bedrijf wanneer dit op industriële schaal en heimelijk gebeurt, zonder toestemming en met trucs om beveiliging te omzeilen. Om dat te doen, zouden de Chinese bedrijven gebruik hebben gemaakt van tussenpartijen, clouddiensten en een proxynetwerk: verzamelingen nepaccounts die verzoeken doorsluizen zodat de werkelijke afkomst verborgen blijft.
De Amerikaanse inlichtingendiensten NSA, FBI en de cyberveiligheidsdienst CISA hebben inmiddels gezamenlijk gewaarschuwd voor de praktijk. Zij noemen het een systematische poging om Amerikaanse technologische functionaliteiten te stelen en roepen bedrijven op om detectiesystemen te versterken en verdachte activiteiten te melden.
Twijfel over het bewijs
Niet iedereen is overtuigd. Wang Zebin, een investeringsmanager bij het Chinese JG Investment, zei tegen de Zuid-Chinese krant South China Morning Post dat Anthropic te weinig concrete voorbeelden geeft om de beschuldigingen onafhankelijk te controleren. Toch nam de Chinese cyberwaakhond de kwestie serieus: zeven ontwikkelaars werden ondervraagd, waarna de aandacht zich toespitste op DeepSeek en Moonshot. Beide bedrijven reageerden niet op vragen van de krant.
Anthropic zegt zelf al misbruik te hebben opgespoord en gestopt, en extra beveiligingsmaatregelen te hebben ingevoerd tegen het ongeoorloofd aftappen van de capaciteiten van Claude. Wie precies verantwoordelijk is en welke rol tussenpartijen daarbij speelden, blijft vooralsnog onduidelijk.
Achtergrond & begrippen
Wat betekent dit voor de toekomst? Als grote AI-bedrijven elkaars modellen massaal en heimelijk kunnen kopiëren, verliezen investeringen in dure trainingsprocessen hun waarde en wordt de concurrentiestrijd tussen de VS en China nog feller. Dit soort beschuldigingen kan leiden tot strengere beveiliging van AI-diensten en tot meer politieke druk om Amerikaanse AI-technologie af te schermen.
- Modeldistillatie
- Een techniek waarbij een nieuw AI-model leert door de antwoorden van een bestaand, krachtiger model te bestuderen en te kopiëren.
- Distillatie-aanval
- Het heimelijk en op grote schaal toepassen van distillatie zonder toestemming, om de capaciteiten van een concurrerend AI-model te kopiëren.
- Frontier-AI
- De meest geavanceerde AI-modellen die op dit moment beschikbaar zijn, zoals Claude, GPT, Gemini en Grok.
- AI-token
- De kleine tekstfragmenten waarin taalmodellen tekst opdelen om die te kunnen verwerken en genereren.
- Proxynetwerk
- Een verzameling tussenaccounts of -servers die verzoeken doorsluizen, zodat de werkelijke afkomst van het verkeer verborgen blijft.
Bronnen
Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.