7 oktober 2026
Het is woensdagavond, kwart over acht. Je hebt een map met 2.000 klantmails die je door Claude Haiku wilt laten samenvatten en labelen, en je hebt de rekensom al twee keer gemaakt.

Met Haiku 4.5 bleef het net te duur om er een vaste wekelijkse klus van te maken. Sinds vanavond klopt die rekensom niet meer.
Anthropic bracht om 20.01 uur Nederlandse tijd Claude Haiku 5.5 uit, het kleinste en goedkoopste model van de 5.5-familie. Voor verzoeken tot 100.000 tokens betaal je $0,10 per miljoen inputtokens en $0,50 per miljoen outputtokens. Bij Haiku 4.5 was dat $1 en $5.
Een tiende van de prijs dus, en volgens de benchmarks van Anthropic een flink slimmer model.
Anthropic zelf zet er “around 75% less” boven, ook in de aankondiging op X. Dat verschil tussen 90% en 75% is precies waar je moet opletten. Daarover zo meer.

Wat kost Claude Haiku 5.5 per miljoen tokens?
Haiku 5.5 heeft twee prijzen: één voor prompts tot 100.000 tokens en één voor alles daarboven. De bedragen hieronder komen uit de prijstabel in de aankondiging, in dollars per miljoen tokens, zonder btw.
| Onderdeel | Haiku 5.5 (tot / boven 100k) tegen Haiku 4.5 |
|---|---|
| Input | $0,10 / $0,50 tegen $1,00 |
| Output | $0,50 / $2,50 tegen $5,00 |
| Cache lezen | $0,01 / $0,05 tegen $0,10 |
| Cache schrijven | $0,125 / $0,625 tegen $1,25 |
Reken het voorbeeld van die 2.000 mails even na. Stel dat je elke mail als apart verzoek stuurt, met je instructie erbij 2.000 tokens, en dat de samenvatting 200 tokens terugkomt. Elk verzoek blijft dan ruim onder de grens van 100.000 tokens, want die grens geldt per verzoek.
Dan stuur je 4 miljoen tokens in en krijg je er 0,4 miljoen terug.
- Haiku 4.5: 4 × $1 + 0,4 × $5 = $4 + $2 = $6,00
- Haiku 5.5: 4 × $0,10 + 0,4 × $0,50 = $0,40 + $0,20 = $0,60
Doe je dat elke week, dan zakt de rekening van ruim $300 per jaar naar ruim $30.
Eén kanttekening die Anthropic zelf in een voetnoot zet: Haiku 5.5 heeft een nieuwe tokenizer en “uses slightly more tokens per task”. Hoeveel meer, staat er niet. Reken dus op iets meer dan $0,60.
75% goedkoper is een gemiddelde, geen prijs
Waar komt die 75% vandaan, als de tabel 90% laat zien? Uit dezelfde voetnoot. Onder de 100.000 tokens is Haiku 5.5 90% goedkoper, daarboven 50%. Anthropic middelt die twee over hoe klanten Haiku 4.5 gebruikten, en houdt rekening met het extra tokenverbruik. Zo kom je op gemiddeld zo’n 75%.
Voor korte, herhaalde klussen zoals mails labelen, samenvatten of een databasevraag beantwoorden is dit gewoon de goedkoopste Claude ooit. Daar is overstappen een makkelijke keuze. Voor lange documenten is de winst veel kleiner.
Neem een contract van 150.000 tokens met één vraag erover. Dan valt het hele verzoek in het hogere tarief:
| Model | Inputkosten voor 150.000 tokens |
|---|---|
| Haiku 4.5 | 0,15 × $1,00 = $0,15 |
| Haiku 5.5 | 0,15 × $0,50 = $0,075 |
Netjes, maar geen tiende.
Tim Duffy wees er op X op dat lange context bij Haiku 5.5 vijf keer zoveel kost als korte, tegen twee keer bij GPT-6 Luna. Wie veel met grote PDF’s werkt, moet die twee dus naast elkaar leggen voordat hij kiest.
De 100k-grens raakt negen op de tien verzoeken niet
Toch is “pas op voor de 100k-grens” ook een te makkelijke waarschuwing. Volgens Anthropic viel 90% van alle verzoeken aan Haiku 4.5 onder die grens. Voor het grootste deel van het Haiku-verkeer is het dus echt een tiende van de prijs.
Kanttekening: dat cijfer komt van Anthropic zelf en zegt niets over jouw eigen mix van korte en lange taken.
Van $0,25 naar $1 en nu naar $0,10
Dat Haiku goedkoper wordt, is niet vanzelfsprekend. Twee jaar geleden ging het juist de andere kant op. Zo liep de inputprijs per miljoen tokens:
- Maart 2024, Claude 3 Haiku: $0,25 input, $1,25 output.
- November 2024, Claude 3.5 Haiku: $1 en $5, vier keer duurder. Anthropic verhoogde de prijs omdat het model slimmer bleek dan verwacht, meldde TechCrunch. In december ging dat terug naar $0,80 en $4.
- Oktober 2025, Claude Haiku 4.5: weer $1 en $5.
- Oktober 2026, Claude Haiku 5.5: $0,10 en $0,50 tot 100.000 tokens.
Voor het eerst is Haiku goedkoper dan de allereerste Haiku: onder de 100.000 tokens ligt de inputprijs twee en een half keer lager dan in 2024. Wil je eerst snappen wat een token is en waarom modellen per token rekenen, lees dan onze uitleg over large language models.
Haiku 5.5 is geen goedkope Sonnet
Op de benchmarks van Anthropic gaat Haiku 5.5 met grote stappen vooruit. Bij computergebruik (OSWorld 2.1) haalt het 72,4% tegen 15,7% voor Haiku 4.5. Maar zet je het naast Sonnet 5.5, dan zie je ook waar het ophoudt.

- Agentisch programmeren (Terminal-Bench 4.0): 39,2% voor Haiku 5.5, 70,6% voor Sonnet 5.5. Anthropic schrijft zelf dat Sonnet en Opus “remain better choices for complex agentic coding tasks”.
- Tegen GPT-6 Luna: Haiku scoort hoger op elke test waar beide in staan, op FrontierCode nipt (46,4% tegen 42,4%). Op Humanity’s Last Exam staat bij Luna geen score, dus daar ontbreekt de vergelijking.
- Let op: dit zijn de cijfers van de maker. Onafhankelijke metingen volgen pas.
Haiku is dus het model voor de kleine, afgebakende klussen. Anthropic noemt samenvattingen, classificatie, databasevragen en het werk als subagent: een hulpje dat Opus of Sonnet een deeltaak uit handen neemt.
Lees je dit om te kiezen tussen de grote merken, kijk dan bij ChatGPT, Claude of Gemini: welke kies je? Voor zwaar programmeerwerk wijst Anthropic naar Sonnet 5.5 en Claude Opus 5.5.
Waar zit Haiku 5.5 en wat krijgen abonnees erbij?
Haiku 5.5 is volgens Anthropic vanaf vandaag beschikbaar via de API, AWS, Google Cloud en Microsoft Azure. Claude Code heeft het ook, en Cursor zette het meteen in zijn modellenlijst. Het is ook het eerste Haiku-model met een instelbare effort-stand, zodat je zelf kiest tussen goedkoop en slim.
Er zat meer in de aankondiging. Sonnet 5.5 wordt goedkoper bij cache reads: van $0,20 naar $0,10 per miljoen tokens, wat volgens Anthropic zo’n 20% scheelt op agentisch werk.
En wie Claude Max of Team heeft, krijgt maandelijks API-tegoed: $100 bij Max 5x, $200 bij Max 20x en tot $500 voor een Team, gedeeld over de gebruikers. Anthropic rolt het deze week uit, verspreid over een paar dagen.
Er zitten wel voorwaarden aan dat tegoed:
- Je zit minstens zeven dagen op een Max- of Team-abonnement. Bij een Team claimt een Owner of Primary Owner het voor iedereen.
- Je claimt het op claude.ai via Settings > Billing, bij API credits, met de knop “Link organization”. Daar koppel je één organisatie in de Claude Console.
- Kies die organisatie goed: je kunt er maar één koppelen en zelf niet meer wisselen.
- Wat je in een maand niet opmaakt, vervalt aan het eind van de factuurperiode.
Het tegoed is alleen voor de API. Volgens Anthropic kun je het niet gebruiken in Claude Code of de Claude-apps. Met $100 haal je bij het tarief tot 100.000 tokens 1 miljard inputtokens door Haiku 5.5, als je de output even vergeet. Die kost $0,50 per miljoen en gaat van hetzelfde tegoed af.
Een oude Claude Code kent het model nog niet
Bij een test op 7 oktober zagen we het verschil tussen twee versies van Claude Code. In versie 2.1.284 gaf --model claude-haiku-5-5 de melding unrecognized_model, en de ingebouwde kostenteller kende het tarief niet. In versie 2.1.293 komt de korte naam haiku meteen uit bij claude-haiku-5-5, met de gewone prijs erbij.
Gebruik je Claude Code? Zo controleer je in drie stappen of je al op Haiku 5.5 zit:
- Draai
claude updateen daarnaclaude --version. - Draai
claude -p --model haiku --output-format json "zeg ok". - Kijk in het onderdeel
modelUsage. Staat daarclaude-haiku-5-5, dan zit je goed. Staat er nogclaude-haiku-4-5, dan gebruikte dit verzoek nog Haiku 4.5: controleer je CLI-versie en je modelkeuze.
Wat het kost, hangt af van hoe je bent ingelogd. Met een Pro- of Max-abonnement valt je gebruik binnen de ruimte van je abonnement, zolang je geen API-credits aanzet. Staat er een ANTHROPIC_API_KEY op je systeem, dan gebruikt Claude Code die sleutel en betaal je wel API-tarieven, schrijft Anthropic.
Blijft die 90% staan op je eerste factuur?
De prijzen van kleine modellen zijn een wedstrijd geworden. VentureBeat zet in de kop dat Haiku 5.5 het tarief van GPT-6 Luna evenaart.
De echte toets is je eerste volle week: pas dan zie je hoeveel extra tokens de nieuwe tokenizer kost, en of een tiende van de prijs ook een tiende van je rekening wordt.
Zijn modellen en tokens nog nieuw voor je? Op de homepage lees je wat is ai en hoe je zulke keuzes maakt.