AI & computing › Generatieve AI & synthetische media
Nieuwste Claude-versie schrijft langere, minder standaard klinkende antwoorden
Onderzoeksbureau Arena.ai analyseerde tienduizenden antwoorden van Anthropics chatbot Claude en ontdekte dat de nieuwste versie, Fable 5.1, anders schrijft dan zijn voorganger. Het model gebruikt minder standaard AI-taal zoals instemmende openingszinnen en het woord 'eerlijk gezegd', maar geeft wel beduidend langere antwoorden.
Grote taalmodellen zoals Claude hebben een herkenbare schrijfstijl. Wie veel met chatbots werkt, kent de vaste trucjes: een instemmende opening, veelvuldig gebruik van het gedachtestreepje, en woorden als 'eerlijk gezegd' of 'oprecht'. Onderzoeksbureau Arena.ai bekeek tienduizenden antwoorden van Anthropics taalmodel Claude bij complexe, redeneerintensieve vragen en vergeleek de nieuwste versie, Fable 5.1, met zijn voorganger Fable 5.0.
Minder opvulwoorden, meer punctuatie-variatie
De cijfers zijn opvallend. Fable 5.1 gebruikt het gedachtestreepje nog maar 11 keer per duizend woorden, tegenover 16,2 keer bij Fable 5.0. Tegelijk grijpt het model vaker naar de puntkomma: 6,09 keer per duizend woorden, bijna twee keer zoveel als voorheen. Ook typische instemmingszinnen en woorden die eerlijkheid moeten benadrukken, zoals 'eerlijk gezegd' en 'oprecht', komen fors minder voor. Hetzelfde geldt voor stoplappen als 'load-bearing' (een populaire uitdrukking in AI-kringen om iets cruciaal aan te duiden), die 20 procent minder vaak opduiken. Ook voorzichtigheidswoorden als 'wellicht' en 'arguably' nemen met 36 procent af.
Nog opvallender: complimenten en bevestigend taalgebruik richting de gebruiker duiken nog maar in 1,98 procent van de antwoorden op, tegenover 3,17 procent eerder. Dat wijst op minder sycofantisch gedrag: het verschijnsel dat een chatbot gebruikers naar de mond praat in plaats van kritisch te reageren. Anthropic en andere AI-bedrijven proberen dat gedrag al langer terug te dringen, omdat het de betrouwbaarheid van antwoorden ondermijnt.
Langere antwoorden, eenvoudiger taalgebruik
Naast minder cliché-taal is Fable 5.1 uitgesprokener in lengte. Het model geeft mediaan 414 woorden per antwoord, 30 procent meer dan de 319 woorden van zijn voorganger. Toch blijft dat 21 procent korter dan het zwaardere model Opus 5, dat gemiddeld 525 woorden per antwoord gebruikt. De zinslengte van Fable 5.1 ligt met 12,54 woorden per zin licht boven die van Opus 5. Opvallend is verder dat het aandeel lange, complexe woorden daalt van 42,6 naar 38,6 procent, en het gebruik van abstracte zelfstandige naamwoorden met 25 procent afneemt. Dat wijst op eenvoudiger, toegankelijker taalgebruik.
Waarom taalstijl van AI-modellen ertoe doet
Dit soort stilistische verschuivingen lijkt op het eerste gezicht een detail, maar heeft praktisch belang. Bedrijven die met een AI-tekstdetector proberen te herkennen of tekst door een mens of een machine is geschreven, moeten hun systemen voortdurend bijstellen naarmate modellen hun 'stem' veranderen. Ook voor gebruikers maakt het uit: een model dat minder overduidelijk als AI klinkt en minder overdreven bevestigend reageert, voelt natuurlijker aan en is mogelijk minder irritant in langdurig gebruik. De verschuiving ontstaat vermoedelijk doordat Anthropic tijdens de laatste trainingsfase gerichter bijstuurt op stijl, naast de gebruikelijke verbeteringen in redeneervermogen.
Achtergrond & begrippen
Wat betekent dit voor de toekomst? Naarmate AI-modellen hun herkenbare 'robotachtige' taalgebruik afleren, wordt het voor mensen lastiger om AI-tekst te onderscheiden van menselijke tekst. Dat vergroot het belang van technische detectiemiddelen en dwingt bedrijven die op zoek zijn naar sycofantisch of overdreven bevestigend gedrag om hun controlemethoden te verfijnen.
- Large language model
- Een AI-systeem dat is getraind op enorme hoeveelheden tekst en op basis daarvan mensachtige taal kan genereren, zoals Claude van Anthropic.
- Sycofantisch gedrag
- Het verschijnsel waarbij een chatbot gebruikers overdreven naar de mond praat in plaats van eerlijk of kritisch te antwoorden.
- AI-tekstdetector
- Software die probeert te herkennen of een tekst door een mens of door kunstmatige intelligentie is geschreven.
- Load-bearing (stopwoord)
- Een in AI-kringen populaire uitdrukking om aan te geven dat iets essentieel of cruciaal is voor een argument.
Bronnen
Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.