Claude Haiku 5.5: Anthropic verlaagt prijzen tot 90%

Claude Haiku 5.5: Anthropic verlaagt prijzen tot 90%

Anthropic heeft Claude Haiku 5.5 gelanceerd, volgens het bedrijf het snelste en goedkoopste kleine model tot nu toe. Tegelijk worden de prijzen voor Sonnet 5.5 verlaagd en krijgen betalende abonnees voortaan maandelijks API-tegoed. Samen laten de aankondigingen zien dat de prijsstrijd tussen AI-labs nog altijd heviger wordt.

Goedkoper per token, met een addertje

Haiku 5.5 is gebouwd voor grote hoeveelheden werk waarbij de kosten het zwaarst wegen. Anthropic noemt samenvatten, databasequery's, classificatie en live klantenservice als typische toepassingen.

De prijs is het grote nieuws. Gemiddeld kost Haiku 5.5 ongeveer 75 procent minder dan Haiku 4.5. Voor prompts tot 100.000 tokens dalen de prijzen met maar liefst 90 procent. Volgens Anthropic viel ongeveer 90 procent van alle eerdere Haiku-verzoeken binnen die grens. Prompts boven de 100.000 tokens kosten vijf keer zoveel.

Er is wel een kanttekening. Haiku 5.5 gebruikt een vernieuwde tokenizer die voor dezelfde taak iets meer tokens nodig heeft. Anthropic zag een vergelijkbaar effect bij de Opus 4.x-modellen, waar de nieuwe tokenizer alleen al het tokengebruik met zo'n 30 procent liet stijgen. De werkelijke besparing valt dus waarschijnlijk lager uit dan de prijzen per token doen vermoeden.

Grote sprongen in benchmarks

Vergeleken met Haiku 4.5 is de vooruitgang groot:

  1. GDPval-AA v2.1 (kenniswerk): 1.620, tegenover 735.
  2. Humanity's Last Exam: 45,9 procent zonder tools en 57,4 procent met tools, tegenover 10,2 en 18,7 procent.
  3. OSWorld-2.1 (computergebruik): 72,4 procent, tegenover 15,7 procent.
  4. Terminal-Bench 4.0 (agentisch programmeren): 39,2 procent, waar Haiku 4.5 op nul uitkwam.

Computergebruik is het opvallendste resultaat. In deze modus bedient het model zelfstandig een computer, wat veel tokens verbruikt. Een snel en goedkoop model past daar uitstekend bij.

Anthropic vergelijkt Haiku 5.5 ook met GPT-6 Luna, het budgetmodel van OpenAI, en Haiku scoort in elke geteste categorie beter. De referentiescores van Sonnet 5.5 laten wel een duidelijk verschil zien. Het kleine model blijft ruim achter bij het grotere model van Anthropic.

Instelbaar redeneren en strengere cyberregels

Haiku 5.5 is het eerste model in de Haiku-klasse met instelbare redeneerniveaus, zodat gebruikers kosten tegen kwaliteit kunnen afwegen. Anthropic raadt het aan voor afgebakende taken zoals compaction, samenvatten of werk als subagent. Voor complex agentisch programmeren verwijst het bedrijf nog altijd naar Sonnet 5.5 en Opus 5.5.

De beveiligingsmaatregelen rond cybersecurity zijn strenger dan bij Haiku 4.5. Tegelijk staan ze een breder scala aan defensieve taken toe dan Sonnet 5.5, deels omdat Haiku over de hele linie minder krachtig is. Penetratietests blijven geblokkeerd. Organisaties met bredere behoeften kunnen zich aanmelden voor de verificatieprogramma's van Anthropic voor life sciences en cybersecurity.

Het model is vanaf nu beschikbaar op alle platforms, waaronder Amazon Web Services, Google Cloud en Microsoft Azure.

Prijsverlaging voor Sonnet en API-tegoed

Anthropic halveert daarnaast de prijs voor cache reads bij Sonnet 5.5, van 0,20 naar 0,10 dollar per miljoen tokens. Het bedrijf verwacht dat dit de kosten voor de meeste agentische taken met ongeveer 20 procent verlaagt. De timing wijst op een reactie op de nieuwe GPT-6.1-serie van OpenAI, waartoe ook GPT-6.1 Sol behoort, dat wordt aangeprezen tegen een fractie van de kosten van het vlaggenschip.

Abonnees krijgen voortaan maandelijks API-tegoed. Max-5x-gebruikers ontvangen 100 dollar, Max-20x-gebruikers 200 dollar en Team-abonnees tot 500 dollar per maand. Het tegoed kan worden gebruikt om via de API tools, apps en agents uit te proberen. Dit sluit aan op de eerdere stap van Anthropic met gratis tegoed voor startups.

Anthropic werkt ook de SDK's voor Python en TypeScript bij, met bètaondersteuning voor computergebruik en browsergebruik.

Onze analyse

Voor teams die agents op grote schaal inzetten, is deze release belangrijker dan zomaar een nieuw frontiermodel. Veel agentwerk is repetitief: context samenvatten, invoer classificeren, door interfaces klikken. Een goedkoop model dat die stappen goed afhandelt, kan de economie van een complete pipeline veranderen, vooral als het als subagent onder een groter model draait.

De kanttekening over de tokenizer herinnert eraan dat je moet meten in plaats van aannemen. De prijs per token is maar de helft van de rekening. Teams doen er goed aan de totale kosten per taak te vergelijken voordat ze overstappen.

Het grotere patroon is duidelijk. Labs concurreren fel op prijs, en de prijsverlaging voor Sonnet lijkt een rechtstreeks antwoord op OpenAI. Dat past bij signalen dat de AI-uitgaven van bedrijven dalen terwijl het gebruik groeit. Het is de moeite waard om te volgen of OpenAI met eigen prijsverlagingen reageert, en of onafhankelijke tests de scores van Haiku 5.5 voor computergebruik bevestigen buiten de eigen benchmarks van Anthropic.