AI & computing › Generatieve AI & synthetische media
Anthropic stopt vijf pogingen om AI-chatbot Claude te misbruiken voor biowapens
Anthropic heeft tussen december 2025 en augustus 2026 vijf gevallen ontdekt waarin onderzoekers de AI-chatbot Claude gebruikten voor werk dat kon bijdragen aan biologische wapens. Het bedrijf kon niet vaststellen of de wetenschappers kwaad in de zin hadden, maar greep toch in vanwege de mogelijke gevolgen. De zaken tonen volgens Anthropic hoe lastig te detecteren biologische risico's ontstaan naarmate AI-modellen beter worden in wetenschappelijk onderzoek.
Het Amerikaanse AI-bedrijf Anthropic publiceerde deze week zijn meest gedetailleerde dreigingsrapport tot nu toe. Daarin beschrijft het hoe mensen probeerden zijn chatbot Claude te misbruiken voor onder meer cyberaanvallen, desinformatiecampagnes en biologisch onderzoek met een mogelijk gevaarlijke toepassing. Alle vijf de biologie-gerelateerde gevallen werden gestopt, aldus het bedrijf.
Het lastige onderscheid tussen legitiem en gevaarlijk onderzoek
De grootste uitdaging voor Anthropic zat in het vaststellen waar normaal wetenschappelijk werk ophoudt en gevaarlijk onderzoek begint. Veel biologisch onderzoek heeft een dual-use karakter: dezelfde kennis kan leiden tot een medicijn of juist tot een gevaarlijker ziekteverwekker. Jacob Klein, hoofd dreigingsanalyse bij Anthropic, vertelde aan The New York Times dat onderzoekers zelden expliciet kwade bedoelingen uiten. Ze presenteren ogenschijnlijk legitieme wetenschappelijke doelen, terwijl het onderliggende werk toch veiligheidsrisico's oproept. Een van de zaken draaide om chikungunya, een virus dat via muggen wordt overgedragen. Claude blokkeerde een aanvraag voor een onderzoeksbeurs voor zogeheten gain-of-function-onderzoek, waarbij ziekteverwekkers gerichter en gevaarlijker worden gemaakt. Het onderzoek bleek bestemd voor een militair onderzoeksinstituut, wat de zorgen bij Anthropic vergrootte. De betrokken onderzoekers gingen via andere kanalen door nadat Claude de gevoelige verzoeken had geweigerd. Anthropic ontdekte bovendien dat een platform dat AI-diensten doorverkoopt, geweigerde biologie-prompts doorsluisde naar modellen met zwakkere bioveiligheidsfilters.
Zwaardere modellen, grotere risico's
Een tweede zaak betrof onderzoek naar hoogpathogene vogelgriep. Een onderzoeker gebruikte Claude wekenlang voor het plannen van studies, data-analyse en interpretatie van resultaten. Anthropic zegt dat zijn beveiliging voorkwam dat de onderzoeker toegang kreeg tot de krachtigste versies van Claude voor dit gevoelige werk; de activiteit bleef beperkt tot zwakkere modelversies. Het bedrijf meldt daarnaast drie andere zaken rond biologisch onderzoek met mogelijke wapenimplicaties, met werk rond orthopoxvirussen (de virusfamilie waartoe ook het pokkenvirus behoort), gifstoffen uit dierlijk gif en toxinen. Anthropic houdt de identiteit, locatie en precieze biologische details van de betrokkenen geheim. Susan Monarez, microbiologe en voormalig Amerikaans volksgezondheidsfunctionaris, beoordeelde het rapport voordat het verscheen. Zij waarschuwde dat geavanceerde AI-modellen kwaadwillenden kunnen helpen gevaarlijk onderzoek te verbergen achter legitiem ogende wetenschappelijke doelen. Volgens Anthropic konden oudere versies van Claude nauwelijks geavanceerd biologisch onderzoek ondersteunen, maar die aanname gaat niet meer op voor de nieuwste modellen. Het bedrijf heeft de controles rond risicovolle biologische vragen inmiddels aangescherpt, maar wil onderzoekers wel toegang laten houden tot nuttige wetenschappelijke mogelijkheden. Dat blijft een lastig technisch vraagstuk: de dreigingsanalyse van AI-bedrijven moet gevaarlijke hulp blokkeren zonder legitiem onderzoek naar ziektes, vaccins en behandelingen onmogelijk te maken.
Achtergrond & begrippen
Wat betekent dit voor de toekomst? Naarmate AI-modellen beter worden in wetenschappelijk redeneren, groeit het risico dat ze onbedoeld helpen bij het ontwikkelen van gevaarlijke biologische stoffen. Dit dwingt AI-bedrijven tot een voortdurende balans tussen het openhouden van wetenschappelijke vooruitgang en het afsluiten van misbruikroutes, een probleem dat met elke nieuwe modelgeneratie complexer wordt.
- Dual-use onderzoek
- Wetenschappelijk werk dat zowel voor vreedzame als voor schadelijke doeleinden gebruikt kan worden, zoals kennis die zowel een vaccin als een gevaarlijker virus mogelijk maakt.
- Gain-of-function-onderzoek
- Onderzoek waarbij ziekteverwekkers in het lab gerichter, besmettelijker of gevaarlijker worden gemaakt, vaak om ziektes beter te begrijpen of te bestrijden.
- Orthopoxvirus
- Een virusfamilie waartoe onder meer het pokkenvirus behoort; sommige soorten kunnen ernstige ziektes bij mens en dier veroorzaken.
- Hoogpathogene vogelgriep
- Een variant van het vogelgriepvirus die ernstige ziekte en hoge sterfte veroorzaakt bij vogels en soms overspringt naar andere dieren of mensen.
- Bioveiligheidsfilter
- Een technisch systeem binnen een AI-model dat verzoeken blokkeert die kunnen bijdragen aan de ontwikkeling van biologische wapens.
- Threat intelligence (dreigingsanalyse)
- Het systematisch verzamelen en analyseren van informatie over pogingen tot misbruik, om aanvallen of gevaarlijke toepassingen vroegtijdig te herkennen en te stoppen.
Bronnen
Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.