AI & computing › Generatieve AI & synthetische media

Claude Haiku 5.5: Anthropic verlaagt prijzen tot 90 procent en verdubbelt prestaties

· Bijgewerkt 8 oktober 2026, 02:47 · 2 min leestijd

Generatieve AI & synthetische media
Beeld: The Decoder

Anthropic heeft Claude Haiku 5.5 gelanceerd, het goedkoopste en snelste AI-model van het bedrijf tot nu toe. Het model is tot 90 procent goedkoper dan zijn voorganger en scoort op meerdere tests dubbel zo hoog. Ook verlaagt Anthropic de prijs van zijn grotere model Sonnet 5.5, een teken dat de prijzenoorlog tussen AI-bedrijven in volle gang is.

Het Amerikaanse AI-bedrijf Anthropic brengt met Claude Haiku 5.5 een nieuw model uit dat bedoeld is voor grote hoeveelheden eenvoudige taken: samenvattingen maken, databases doorzoeken, klantenservice afhandelen. Het model is fors goedkoper dan voorganger Haiku 4.5. Voor verzoeken met prompts tot 100.000 tokens, zo'n 90 procent van al het Haiku-verkeer, dalen de prijzen tot 90 procent. Een token is daarbij de kleinste taaleenheid waarmee een AI-model tekst verwerkt; hoe meer tokens, hoe hoger de rekenkosten.

Concreet kost een miljoen output-tokens bij Haiku 5.5 nog 0,50 dollar, tegen 5 dollar bij Haiku 4.5. Ook het hergebruiken van eerder verwerkte tekst via caching wordt veel goedkoper. Anthropic waarschuwt wel dat het model een nieuwe tokenizer gebruikt die iets meer tokens per taak verbruikt, waardoor de besparing in de praktijk kleiner uitvalt dan de prijstabel suggereert.

Grote sprong op benchmarktests

Ondanks de lage prijs maakt Haiku 5.5 een flinke sprong in capaciteiten. Op de kennistest GDPval-AA v2.1 scoort het model 1.620 punten, meer dan het dubbele van de 735 van Haiku 4.5. Bij Humanity's Last Exam, een zware benchmark die kennis over uiteenlopende vakgebieden test, stijgt de score van 10,2 naar 45,9 procent zonder hulpmiddelen. De grootste vooruitgang zit in zogeheten computer use, waarbij een AI-model zelfstandig een computer bedient: van 15,7 naar 72,4 procent op de test OSWorld-2.1. Zo'n computer-use agent voert taken uit door zelf te klikken, te typen en schermen te lezen, wat veel rekenkracht vraagt. Een goedkoop en snel model als Haiku 5.5 is daar geschikt voor. Op het gebied van automatisch programmeren, een vorm van agentic AI waarbij het model zelfstandig code schrijft en uitvoert, gaat de score van 0 naar 39,2 procent. Anthropic vergelijkt de resultaten ook met GPT-6 Luna, het goedkope model van concurrent OpenAI, en wint op elk onderdeel. Het blijft echter duidelijk achter bij Anthropics eigen topmodel Sonnet 5.5.

Instelbare denkdiepte en strengere regels

Haiku 5.5 is het eerste model in de Haiku-reeks met een instelbaar effort-niveau: gebruikers kunnen zelf kiezen hoeveel "moeite" het model doet, en dus hoeveel een taak kost. Voor complexe programmeerklussen blijven de grotere modellen Sonnet 5.5 en Opus 5.5 de betere keuze. Op het gebied van cybersecurity gelden voor Haiku 5.5 strengere regels dan voor Sonnet 5.5: penetratietesten blijft verboden, al mag het model wel meer defensieve beveiligingstaken uitvoeren dan zijn voorganger.

Ook Sonnet 5.5 wordt goedkoper

Naast de Haiku-lancering halveert Anthropic de prijs van cache reads voor Sonnet 5.5, van 0,20 naar 0,10 dollar per miljoen tokens. Dat scheelt volgens het bedrijf ongeveer 20 procent op de kosten van de meeste taken waarbij een AI-model zelfstandig stappen uitvoert. De zet volgt kort op de lancering van OpenAI's GPT-6.1-serie en laat zien hoe hard AI-bedrijven elkaar beconcurreren op prijs. Abonnees van Anthropics duurdere Max- en Teamplannen krijgen daarnaast maandelijks gratis API-tegoed, tot 500 dollar voor zakelijke klanten. Haiku 5.5 is direct beschikbaar via Amazon Web Services, Google Cloud en Microsoft Azure.

Achtergrond & begrippen

Wat betekent dit voor de toekomst? Doordat AI-modellen als Haiku 5.5 steeds goedkoper en tegelijk krachtiger worden, kunnen bedrijven AI op veel grotere schaal inzetten voor routinetaken zoals klantenservice en dataverwerking. De felle prijsconcurrentie tussen Anthropic en OpenAI versnelt die ontwikkeling, waardoor geavanceerde AI-functies zoals het zelfstandig bedienen van een computer sneller betaalbaar worden voor een breed publiek.

Tokenizer
Software die tekst opdeelt in kleine stukjes (tokens) voordat een AI-model ermee kan rekenen; een nieuwe tokenizer kan het tokenverbruik per taak veranderen.
AI-token
De kleinste taaleenheid die een AI-taalmodel verwerkt, vaak een stukje woord; de prijs van AI-diensten wordt meestal per miljoen tokens berekend.
Benchmark
Een gestandaardiseerde test waarmee de prestaties van verschillende AI-modellen onderling vergeleken worden.
Computer-use agent
Een AI-systeem dat zelfstandig een computer bedient door te klikken, te typen en schermen te interpreteren, zonder menselijke tussenkomst.
Agentic AI
AI die niet alleen antwoord geeft, maar zelfstandig meerdere stappen uitvoert om een taak te volbrengen, zoals het schrijven en testen van code.
Effort-niveau
Een instelling waarmee gebruikers bepalen hoeveel rekenkracht en 'nadenktijd' een AI-model aan een taak mag besteden, wat kosten en kwaliteit beïnvloedt.

Bronnen

Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.

Meer over Generatieve AI & synthetische media