AI & computing › Generatieve AI & synthetische media
Anthropic versoepelt AI-filters voor biologievragen, maar niet voor virologie
Anthropic heeft de veiligheidsfilters van zijn AI-model Fable 5 aangepast: gewone vragen over biologie worden niet langer standaard geblokkeerd. Voor gevoelige onderwerpen als virologie en toxicologie blijven de grenzen wel strikt.
AI-bedrijf Anthropic heeft het aantal onterecht geblokkeerde biologievragen in zijn taalmodel Fable 5 met ongeveer 85 procent teruggebracht. Voorheen werd bijna elke vraag over biologie automatisch geweigerd en doorgestuurd naar het minder capabele model Opus 5. Wetenschappers klaagden daar fel over: ze konden het model niet meer gebruiken voor doodgewoon onderzoek, zoals het interpreteren van laboratoriumresultaten, het duiden van symptomen of het beantwoorden van medische vragen.
Het probleem zat in het classificatiesysteem dat vragen over biologie beoordeelt op risico. Dat systeem was zo voorzichtig ingesteld dat het nauwelijks onderscheid maakte tussen onschuldige en gevaarlijke vragen. Met de update laat de classifier nu wél de meeste ongevaarlijke biologievragen door, terwijl vragen over zogeheten dual-use-onderzoek geblokkeerd blijven.
Waarom virologie een streep krijgt
Dual-use-technologie is kennis die zowel voor goede als kwaadaardige doeleinden gebruikt kan worden. Bij onderwerpen als virologie, toxicologie en het ontwerpen van moleculen houdt Anthropic de teugels daarom strak. Het bedrijf vreest dat Fable 5 kwaadwillenden vaardigheden zou kunnen geven die zij nergens anders kunnen vinden. Anthropic werkt inmiddels aan toegangsprogramma's, zodat gecontroleerde onderzoekers deze beperkte functies op termijn alsnog kunnen gebruiken.
Onomkeerbare risico's
Anthropic legt uit waarom het zo voorzichtig is met biologische risico's, in tegenstelling tot bijvoorbeeld cyberaanvallen. Een cyberaanval kan je stoppen door een systeem af te sluiten. Een virus dat eenmaal is vrijgekomen, kan niet worden teruggedraaid, en het ontwikkelen van tegenmaatregelen kost tijd. Het bedrijf onderbouwt die zorg met verwijzingen naar een analyse van Amerikaanse inlichtingendiensten, een onderzoek naar ChatGPT-gesprekken waarin gebruikers om instructies voor biowapens vroegen, gezamenlijke waarschuwingen van onderzoekers, en een project van Stanford University waarbij AI werd ingezet om volledig synthetische virussen te ontwerpen.
De aanpassing laat zien hoe AI-bedrijven zoeken naar een balans tussen bruikbaarheid voor wetenschappers en het voorkomen van misbruik. Te strenge filters frustreren legitiem onderzoek, terwijl te losse filters risico's op misbruik vergroten. Anthropic probeert met de nieuwe, preciezere classifier beide problemen tegelijk aan te pakken.
Achtergrond & begrippen
Wat betekent dit voor de toekomst? Naarmate AI-modellen krachtiger worden, groeit ook het risico dat ze onbedoeld gevaarlijke kennis verspreiden, zoals instructies voor biologische wapens. Deze aanpassing toont hoe AI-bedrijven proberen veiligheidsfilters preciezer te maken, zodat wetenschappers niet worden gehinderd terwijl echte risico's wel worden tegengehouden. Dit soort afwegingen wordt cruciaal naarmate AI dieper doordringt in gevoelige vakgebieden als biotechnologie.
- Dual-use-onderzoek
- Onderzoek of technologie die zowel voor nuttige als voor schadelijke doeleinden gebruikt kan worden, zoals kennis die zowel medicijnen als biowapens mogelijk maakt.
- Virologie
- De wetenschap die virussen bestudeert, inclusief hoe ze zich verspreiden en hoe ziektes ermee bestreden kunnen worden.
- Toxicologie
- Het vakgebied dat de schadelijke effecten van chemische stoffen en gifstoffen op levende organismen onderzoekt.
- Classifier
- Een AI-systeem dat binnenkomende vragen automatisch beoordeelt en indeelt, bijvoorbeeld op basis van hoe risicovol een vraag is.
Bronnen
Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.