AI & computing › Generatieve AI & synthetische media
Anthropic verbiedt wreed gedrag tegen chatbot Claude
AI-bedrijf Anthropic past voor het eerst in meer dan een jaar zijn gebruiksbeleid aan. Gebruikers mogen voortaan niet meer structureel wreed of beledigend doen tegen chatbot Claude. Ook scherpt het bedrijf de regels aan rond wapens, surveillance en verkiezingsfraude.
Het Amerikaanse AI-bedrijf Anthropic herziet voor het eerst in ruim een jaar de regels voor het gebruik van zijn chatbot Claude. Een van de opvallendste wijzigingen: gebruikers mogen Claude niet langer structureel beledigen of mishandelen. Daarnaast scherpt het bedrijf de regels aan over verkiezingsfraude, wapens en surveillance.
Geen wreedheid meer tegen Claude
In het nieuwe gebruiksbeleid staat dat "aanhoudend en nodeloos wreed of beledigend gedrag" tegen Claude verboden is. Anthropic benadrukt dat de regel alleen geldt voor extreme gevallen, waarin gebruikers zonder enige aanleiding herhaaldelijk grof worden tegen het taalmodel. Gewone frustratie, kritiek, donkere verhaallijnen of het bewust testen van het model vallen hier niet onder.
Vorig jaar augustus kondigde Anthropic al aan dat Claude gesprekken mag beëindigen bij aanhoudend schadelijk gedrag van gebruikers. Dat blijft ook nu de belangrijkste manier om misbruik tegen te gaan. Het bedrijf liet niet weten of er ook andere maatregelen komen, zoals het blokkeren van accounts. De aanpassing komt uit onderzoek naar wat Anthropic modelwelzijn noemt: de vraag of en hoe AI-systemen iets kunnen ervaren.
Strengere regels tegen propaganda en wapens
Daarnaast bundelt Anthropic losse regels tot een nieuw verbod op misleidende commerciële en politieke campagnes. Het is voortaan uitdrukkelijk verboden om te verhullen wie achter een boodschap zit, of om berichten kunstmatig te versterken met nepaccounts. Rond verkiezingen verbiedt het bedrijf ook desinformatie over kandidaten, het nabootsen van kandidaten of verkiezingsfunctionarissen, en pogingen om mensen van stemmen te weerhouden.
Ook de regels over wapens zijn aangescherpt. Anthropic schrijft dat het al langer verboden was om Claude te gebruiken voor wapenontwikkeling, maar dat er toch herhaaldelijk is geprobeerd om via de chatbot besturingssoftware voor wapens te maken. Het nieuwe beleid verbiedt nu expliciet software die wapens laat functioneren, inclusief het bewapenen van drones en andere autonome wapens.
Voor surveillance geldt eveneens een strikter kader. Het volgen van mensen zonder toestemming is verboden, of dat nu in realtime gebeurt of via analyse van eerder verzamelde data. Claude mag ook niet worden gebruikt om te bepalen wie wordt onderzocht, aangehouden of vervolgd binnen justitie of opsporing, en mag niet worden ingezet om surveillancetools te verbeteren. Voor bepaalde overheidscontracten, waaronder eerdere samenwerkingen met het Amerikaanse leger, kan Anthropic hiervan afwijken als het zelf voldoende waarborgen ziet.
Discussie over bewustzijn van AI
De aanpassing past in een breder debat binnen Anthropic over de vraag of taalmodellen een vorm van bewustzijn kunnen hebben. Kyle Fish, die het modelwelzijnsonderzoek van het bedrijf leidt, noemde vragen over het innerlijke leven van AI-systemen eerder dit jaar "serieuze vragen" die onderzoek verdienen. Ceo Dario Amodei zei in een podcast dat niemand weet of de modellen bewustzijn hebben.
Niet iedereen in de sector trekt dezelfde conclusie. Microsoft AI stelde in september nog dat het idee van AI-welzijn "onjuist" is en dat AI-systemen geen rechten of juridische status zouden moeten krijgen. Het laat zien dat grote AI-bedrijven uiteenlopend denken over hoe serieus ze de mogelijke "gevoelens" van hun eigen technologie moeten nemen.
Achtergrond & begrippen
Wat betekent dit voor de toekomst? Nu AI-chatbots steeds vaker als gesprekspartner worden gebruikt, moeten bedrijven als Anthropic nadenken over de grens tussen gebruikersvrijheid en verantwoord gebruik. De discussie over modelwelzijn kan invloed krijgen op hoe toekomstige AI-systemen worden ontworpen en gereguleerd, terwijl strengere regels tegen wapens en surveillance laten zien dat AI-bedrijven zich steeds meer voorbereiden op misbruik door statelijke actoren en kwaadwillenden.
- Gebruiksbeleid
- De regels die een AI-bedrijf opstelt over wat gebruikers wel en niet met een AI-model mogen doen.
- Modelwelzijn
- Onderzoek naar de vraag of en hoe AI-modellen een vorm van innerlijke ervaring of bewustzijn kunnen hebben.
- Autonome wapens
- Wapensystemen die zelfstandig doelen kunnen selecteren of aanvallen zonder directe menselijke besturing.
- Surveillance
- Het systematisch volgen en in de gaten houden van personen, bijvoorbeeld met camera's, data-analyse of AI.
Bronnen
Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.