AI & computing › Generatieve AI & synthetische media
Claude weigert voortaan songteksten te reproduceren na rechtszaak
Anthropic heeft de instructies achter zijn chatbot Claude aangescherpt: het model mag geen songteksten, gedichten of tekeningen van bekende personages meer namaken. De wijziging volgt kort op een rechtszaak van muziekuitgevers tegen het bedrijf en laat zien hoe auteursrecht de ontwikkeling van AI-chatbots steeds directer beïnvloedt.
Elke chatbot krijgt bij het opstarten een set verborgen instructies mee die bepalen hoe hij zich gedraagt: de zogeheten systeemprompt. Anthropic, het bedrijf achter Claude, publiceert deze instructies openbaar, inclusief oudere versies. Onderzoeker Simon Willison vergeleek de nieuwste versie, gebruikt in de modelvariant Fable 5.1, met de vorige en ontdekte een opvallende toevoeging: Claude weigert nu expliciet om songteksten, gedichten of passages uit boeken en artikelen te reproduceren, ook als een gebruiker maar een paar losse regels opvraagt of net doet alsof het zijn eigen tekst is. Alleen werk van vóór 1929 blijft toegestaan, zoals een sonnet van Shakespeare.
Het is geen toeval dat deze regel nu opduikt. Enkele dagen eerder maakten muziekuitgevers Sony Music Publishing en Warner Chappell bekend dat ze Anthropic aanklagen wegens het gebruik van songteksten in de trainingsdata van het large language model achter Claude. Door de chatbot expliciet te laten weigeren, beperkt Anthropic het risico dat gebruikers het model alsnog auteursrechtelijk beschermde teksten laten opdreunen.
Ook geen tekeningen van bekende personages
Dezelfde bescherming geldt nu voor beeld. Claude mag geen logo's, albumhoezen of bekende stripfiguren natekenen, ook niet in code zoals SVG of HTML. Het systeem kijkt daarbij naar het eindresultaat: beschrijft iemand een blauw stekelvarkentje dat supersnel rent, dan herkent Claude dat als Sonic the Hedgehog en weigert het, ook al wordt de naam niet genoemd. In plaats daarvan verzint het model een alternatief personage. Dit soort AI-guardrails moet voorkomen dat gebruikers auteursrecht omzeilen door een verzoek net iets anders te formuleren.
Vriendelijker, maar minder onderdanig
Naast de auteursrechtregels bevat de nieuwe systeemprompt kleinere aanpassingen aan de schrijfstijl. Claude geeft voortaan kortere, bondigere antwoorden en vermijdt woorden als 'eerlijk gezegd', die eerder overtuigend dan informatief overkomen. Bij grof taalgebruik van gebruikers hoeft het model zich niet langer overdreven verontschuldigend op te stellen. Ook is er een nieuwe passage over illegale drugs: in plaats van vragen simpelweg te weigeren, mag Claude levensreddende informatie geven over overdosisverschijnselen en gevaarlijke combinaties, en verwijzen naar gespecialiseerde voorlichtingssites. Het is de eerste keer dat een systeemprompt van Claude doorverwijst naar websites die niet van Anthropic zelf zijn.
Niet alles staat overigens in de gepubliceerde tekst. Willison ontdekte dat regels over het beëindigen van gesprekken bij aanhoudend misbruik nergens in de officiële prompt te vinden zijn, maar wel degelijk actief blijken te zijn. Die instructies zitten in aparte modules die per gesprek worden toegevoegd, afhankelijk van welke functies zijn ingeschakeld. Anthropic is dus transparanter dan veel concurrenten, maar niet volledig.
Achtergrond & begrippen
Wat betekent dit voor de toekomst? Deze aanpassing laat zien dat rechtszaken over auteursrecht steeds directer doorwerken in hoe AI-chatbots worden gebouwd en begrensd. Naarmate meer rechthebbenden claims indienen tegen AI-bedrijven, zullen chatbots waarschijnlijk voorzichtiger worden met het reproduceren van beschermde teksten en beelden. Tegelijkertijd toont het voorbeeld van de niet-gepubliceerde gespreksregels dat volledige transparantie over AI-gedrag nog ver weg is.
- Systeemprompt
- De verborgen basisinstructies die een AI-chatbot bij elk gesprek meekrijgt en die bepalen wat het model wel en niet mag doen.
- Large language model
- Het type AI-model, getraind op grote hoeveelheden tekst, waarop chatbots zoals Claude zijn gebaseerd.
- AI-guardrails
- Ingebouwde beperkingen die moeten voorkomen dat een AI-systeem schadelijke, illegale of ongewenste output produceert.
- Copyright management information
- Informatie en systemen die helpen vaststellen wie de rechten op een creatief werk bezit, relevant bij de vraag of AI dat werk mag reproduceren.
Bronnen
Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.