Kort antwoord
Kies Claude Sonnet 5 ($2 / $10 per miljoen tokens) voor het meeste dagelijkse werk in software: mails, offerteteksten, klantgesprekken en gewone code. Ga naar Opus 5 ($5 / $25) voor code review, lange contracten en agents die meerdere stappen zelfstandig afronden, en naar Fable 5.1 ($10 / $50) alleen als je evaluaties op Opus 5 tekortschieten bij urenlang redeneer- of onderzoekswerk. Haiku 4.5 ($1 / $5) is het snelste model en past bij classificatie en ander volumewerk waarvan je de uitkomst kunt controleren. Anthropic raadt zelf aan te starten op Opus 5 en daarna omlaag te optimaliseren; peildatum 18 september 2026.
Van lezen naar doen.
Op SWE-bench Pro loste Claude Fable 5.1 op de laagste effort-stand 88,6% van de taken op voor $0,54 per opgeloste taak, terwijl Claude Sonnet 5 op zijn standaardinstelling 77,4% haalde voor $0,84 (Anthropic, 2026). Het model met de vijf keer hogere tokenprijs was per afgeronde taak dus 35% goedkoper.
Dat is de reden dat "welk Claude-model" geen prijsvraag is maar een werkvraag. De tokenprijs zegt wat een miljoen tokens kost; het werk bepaalt hoeveel tokens, hoeveel herkansingen en hoeveel handmatige controle er nodig zijn voordat de taak af is.
Deze pagina zet de vier huidige modellen naast elkaar op de as die er in een bedrijf toe doet: welk werk, welk model, wat kost dat per maand, en wanneer je een trap omlaag of omhoog gaat. De versiegeschiedenis van de Claude-familie staat bewust niet hier, maar op welke Claude-versies er in 2026 zijn.
Voor de kale tarieventabel per model, inclusief cache- en batchtarieven, is onze pagina met de Claude API-tarieven per miljoen tokens de plek; hier gebruiken we alleen de basisprijzen. De keuze tussen Claude en de modellen van OpenAI, Google en Mistral staat op welk AI-model bij jouw bedrijf past, binnen onze index over AI-modellen vergelijken.
Vier modellen, één tabel: prijs, snelheid, context en de grens
Dit is onze eigen tabel, samengesteld uit het modeloverzicht en de prijspagina van Anthropic op 18 september 2026. De euro-kolom gebruikt dezelfde ECB-koers als onze API-kostenpagina (1,1537 dollar per euro, 16 september 2026), circa en exclusief btw.
| Model | Anthropics eigen typering | Prijs per miljoen tokens (input / output) | Circa in euro | Snelheidsklasse | Context / max. output | Kennis tot |
|---|---|---|---|---|---|---|
| Claude Haiku 4.5 | "The fastest model with near-frontier intelligence" | $1 / $5 | €0,87 / €4,33 | Snelste | 200.000 / 64.000 tokens | februari 2025 |
| Claude Sonnet 5 | "The best combination of speed and intelligence" | $2 / $10 | €1,73 / €8,67 | Snel | 1 miljoen / 128.000 | januari 2026 |
| Claude Opus 5 | "For complex agentic coding and enterprise work" | $5 / $25 | €4,33 / €21,67 | Gemiddeld | 1 miljoen / 128.000 | mei 2026 |
| Claude Fable 5.1 | "For demanding reasoning and long-horizon agentic work" | $10 / $50 | €8,67 / €43,34 | Langzaamst | 1 miljoen / 128.000 | juni 2026 |
De snelheidsklasse is Anthropics eigen relatieve indeling ("comparative latency"); de werkelijke responstijd hangt af van promptlengte, outputlengte en effort-niveau. De kenniskolom is de "reliable knowledge cutoff" uit hetzelfde overzicht.
Het tweede deel van de tabel is de beslisregel per model: waarvoor je het inzet, en wanneer je een trap lager of hoger gaat.
| Model | Zet het in voor | Ga een trap lager als | Ga een trap hoger als |
|---|---|---|---|
| Haiku 4.5 | Classificatie, extractie uit korte documenten, realtime antwoorden, deeltaken onder een groter model | n.v.t. (laagste trap) | het model in een lus van tools de draad kwijtraakt, of de invoer boven 200.000 tokens komt |
| Sonnet 5 | Offerteteksten, klantgesprekken, gewone codegeneratie, data-analyse | de uitkomst controleerbaar is en Haiku in je evaluatie hetzelfde scoort | code review op grote codebases of contracten van tientallen pagina's fouten oplevert |
| Opus 5 | Code review, lange contracten, agents van meerdere stappen, vision-zwaar werk, computer use | je evaluaties op Sonnet 5 al slagen | evaluaties op de hoogste effort-stand nog tekortschieten bij urenlang redeneer- of onderzoekswerk |
| Fable 5.1 | Agent-sessies van uren, diepgaand onderzoek, analyses die tot een compleet document of spreadsheet leiden | Opus 5 in je evaluatie binnen de ruis dezelfde score haalt (bij Anthropic zelf vaak het geval) | n.v.t. (hoogste trap) |
Vertrekpunt zijn de inzetgebieden uit Anthropics keuzegids; code review en lange contracten zijn onze eigen invulling, net als de kolommen "trap lager" en "trap hoger".
Waarom de tokenprijs de verkeerde maat is
Anthropic publiceert sinds de release van Fable 5.1 eigen metingen per opgeloste taak, en die maken korte metten met de intuïtie dat het duurste model het duurst is. Drie uitkomsten uit dezelfde bron:
- Op SWE-bench Pro: Fable 5.1 op
low$0,54 per opgeloste taak (88,6%), Sonnet 5 op standaard $0,84 (77,4%). - Op een verzadigde deelverzameling: Opus 5 91,7% tegen Fable 5.1 92,1%, binnen de meetruis, en Opus 5 daar 15% goedkoper per opgeloste taak ($1,01 tegen $1,19).
- Opus 5 op
low: 84,0% opgelost voor $0,25 per opgeloste taak.
De verklaring is niet magisch. Een sterker model heeft minder beurten, minder herkansingen en minder heen-en-weer met tools nodig, en in een agent-lus zijn juist die beurten de kostenpost.
Er zit een tegenkracht in, en Anthropic noemt die zelf. Op lange onderzoekslussen doet het topmodel méér werk: op DeepResearch Bench II scoorde Fable 5.1 op low 66% tegen 56% voor Sonnet 5, tegen ongeveer vier keer de kosten per taak ($4,66 tegen $1,20), "because it runs a longer research loop over a larger context".
De maat die telt, is daarom kosten per goedgekeurd resultaat: per verwerkt contract, per geaccepteerde codewijziging, per correct geclassificeerde mail. Die maat meet je alleen met een eigen evaluatieset op je eigen documenten, en dat is ook precies wat Anthropic als eerste stap voorschrijft.
Kanttekening bij de cijfers van de leverancier
Alle metingen hierboven komen van Anthropic zelf, op taken die Anthropic koos. De Intelligence Index van het onafhankelijke Artificial Analysis plaatst Fable 5.1 op max effort op 66 punten en Opus 5 op 63, en meet tegelijk dat Fable 5.1 per indextaak $3,76 kost tegen $2,34 voor Opus 5.
Het beeld is dus consistent: Fable is het sterkst, Opus komt dichtbij, en het verschil per taak is kleiner dan het verschil per token. Welke posten op de factuur bij de release van 5.1 verschoven, en voor welke workloads de goedkopere cache read niets oplevert, lees je in ons artikel over Claude Fable 5.1.
Effort: de knop die je eerder omzet dan het model
Sonnet 5, Opus 5 en Fable 5.1 kennen een effort-parameter met standaard high; Haiku 4.5 ondersteunt hem niet en gebruikt handmatig extended thinking (modeloverzicht). Anthropic schrijft letterlijk: "Tuning effort is often a better lever than switching models" (keuzegids).
De beslisvolgorde uit Anthropics Optimizing for cost and intelligence, vertaald naar vier situaties:
| Situatie | Eerste stap | Pas daarna |
|---|---|---|
| Kosten te hoog, kwaliteit goed | Effort omlaag op het huidige model | Trap lager |
| Kwaliteit niet goed genoeg | Effort terug omhoog als je hem verlaagd had | Volgende trap op low proberen |
| Goedkoper model loopt alleen vast op moeilijke beslissingen | Een sterker model als adviseur toevoegen | – |
| Werk past niet in één contextvenster | Delen uitbesteden aan goedkopere werkers | – |
De praktische consequentie: een integratie die overal op de standaard high staat en dan van Sonnet naar Opus springt, slaat de goedkoopste maatregel over. Effort omlaag op Opus 5 kostte in Anthropics meting een kwart van de standaardinstelling en hield 84% van de taken vast.
Routing per bedrijfsproces: welk model waar
De tabellen hierboven zeggen per model wat het kan; deze zegt per proces welk model wij als eerste inzetten. Het is onze eigen indeling, gebaseerd op de inzetgebieden van Anthropic en op hoe wij software met een AI-laag bouwen.
| Bedrijfsproces | Eerste keuze | Waarom dit model | Omhoog als |
|---|---|---|---|
| Inkomende mail classificeren en doorzetten | Haiku 4.5 | Kort, controleerbaar, hoog volume; snelste responstijd | de categorieën inhoudelijk oordeel vragen (klacht of vraag?) |
| Offerte- en mailteksten opstellen uit een briefing | Sonnet 5 | Tekstkwaliteit op niveau, snel genoeg voor interactief gebruik | Opus 5 bij juridisch of technisch zware offertes |
| Contracten en jaarverslagen samenvatten | Opus 5 | 1 miljoen tokens context, sterker in lange documenten | Fable 5.1 bij analyse die tot een compleet rapport moet leiden |
| Klantenservice-chat op eigen kennisbank | Sonnet 5 | Balans tussen antwoordkwaliteit en wachttijd voor de klant | Opus 5 als adviseur voor de lastige gesprekken |
| Code review op pull requests | Opus 5 | "Complex agentic coding" is het inzetgebied dat Anthropic zelf noemt | Fable 5.1 voor refactoring over een hele codebase |
| Agent die zelfstandig onderzoek doet en rapporteert | Fable 5.1 | Sessies van uren en lange context; cache read van $0,25 in plaats van $0,50 op Opus 5 | n.v.t. |
| Factuur- en formulierextractie in batch | Haiku 4.5 via Batch API | Gestructureerde output, halve prijs, geen wachttijd-eis | Sonnet 5 bij afwijkende lay-outs of handschrift |
Twee processen die je hierin mist, staan bewust elders. Documentverwerking over echt lange dossiers krijgt in november een eigen pagina met een vergelijking over leveranciers heen, net als de vraag wanneer je twee modellen combineert.
Rekenvoorbeeld: wat die routing per maand kost
Dit is een rekenvoorbeeld op de basistarieven van 18 september 2026, zonder caching en zonder batch tenzij vermeld; het is geen meting uit een project. De volumes zijn aannames voor een MKB-bedrijf, de tokenaantallen per stuk zijn afgerond.
| Proces | Volume per maand | Tokens per stuk (in / uit) | Eerste keuze | Kosten per maand | Op de trap erboven | Op de trap eronder |
|---|---|---|---|---|---|---|
| Mailclassificatie | 5.000 mails | 600 / 30 | Haiku 4.5 | $3,75 | $7,50 (Sonnet 5) | – |
| Offerteteksten | 200 offertes | 3.000 / 1.200 | Sonnet 5 | $3,60 | $9,00 (Opus 5) | $1,80 (Haiku 4.5) |
| Contractsamenvattingen | 300 contracten | 40.000 / 1.500 | Opus 5 | $71,25 | $142,50 (Fable 5.1) | $28,50 (Sonnet 5) |
| Klantenservice-chat | 3.000 gesprekken | 4.000 / 600 | Sonnet 5 | $42,00 | $105,00 (Opus 5) | $21,00 (Haiku 4.5) |
| Code review | 400 pull requests | 25.000 / 2.000 | Opus 5 | $70,00 | $140,00 (Fable 5.1) | $28,00 (Sonnet 5) |
| Onderzoeksagent | 40 runs | 400.000 / 30.000, waarvan 300.000 cache reads | Fable 5.1 | $103,00 | – | $56,00 (Opus 5) |
| Totaal eerste keuze | $293,60 |
Rekenwijze op de contractregel: 40.000 × $5 plus 1.500 × $25, gedeeld door een miljoen, is $0,2375 per contract; keer 300 is $71,25. Via de Batch API halveert dat naar circa $35,63, als een nachtelijke verwerking volstaat.
Omgerekend is het totaal circa €254 per maand exclusief btw, circa €308 inclusief. Alles op Fable 5.1 zetten zou in dit voorbeeld $651 kosten; alles op Sonnet 5 $132.
Bij de agentregel hoort een waarschuwing. Fable 5.1 schrijft volgens Artificial Analysis ongeveer 1,7 keer zoveel outputtokens als Fable 5; rekenen we dat door op de outputregel, dan wordt $103 ongeveer $145.
De echte les uit de tabel: het verschil tussen alles-op-Sonnet en de gerichte routing is ruim $160 per maand. Dat is minder dan één uur foutherstel per week kost, dus de keuze valt op foutkans, niet op tokenprijs.
Twee modellen combineren: uitvoerder en adviseur
Anthropic beschrijft twee vaste patronen om een goedkoop en een sterk model te combineren (documentatie). In het adviseurspatroon draait een goedkoper model de lus en roept het bij een lastige beslissing een sterker model aan; in het orkestratiepatroon houdt het sterke model de regie en delegeert het bulkwerk aan goedkopere werkers.
De metingen erbij zijn concreet. Een Opus 5-uitvoerder met Fable 5.1 als adviseur was de nauwkeurigste configuratie die Anthropic mat, $7,69 per poging, 3,5 punt boven Opus 5 alleen; een Fable 5-coördinator met één Sonnet 5-werker kostte op een bewust makkelijke BrowseComp-deelverzameling gemiddeld ongeveer de helft van Fable 5 alleen, op het 90e percentiel een derde ($12 tegen $33); op de volledige set keerde dat om.
Wanneer zo'n combinatie loont en wanneer één model volstaat, werken we uit in één AI-model of meerdere combineren. Hier volstaat de regel dat je er pas aan begint als een enkel model op een aantoonbaar deel van de taken vastloopt.
Hoe wij het zelf gebouwd hebben: de modeltrap als instelling
In ons eigen product Bijbel Assistent is de Claude API de redeneerlaag boven een RAG-opzet: PostgreSQL met pgvector haalt de relevante passages op, het model formuleert het antwoord met bronvermelding. Welk Claude-model die laag draait, is daar een configuratiekeuze, geen architectuurkeuze.
Dat is de opzet die we in elk traject aanhouden. De vraag "Sonnet of Opus" wordt dan een instelling per functie, die je met een evaluatieset kunt omzetten zonder de applicatie te herbouwen.
De les uit dat project sluit aan op de tabellen hierboven: het zwaartepunt van de kosten zat in het corpus, de embeddings en het toetsen of de juiste passage wordt opgehaald, niet in de keuze van de modeltrap. Cijfers uit die case noemen we hier niet; de case beschrijft de architectuur, geen kostenmeting.
Waar een Claude-model niet de juiste keuze is
Claude-first is onze default en dat zeggen we hardop, ook op deze pagina. Vier situaties waarin het antwoord tóch niet in de tabellen hierboven staat.
Bulkclassificatie tegen de allerlaagste prijs. Haiku 4.5 is het goedkoopste Claude-model, maar de kleinste modellen van OpenAI, Google en Mistral zitten daar met hun tokenprijs onder; de vergelijking per prijsklasse staat op welk AI-model voor jouw bedrijf.
Data die de EU niet mag verlaten. De Claude API kent alleen de inferentieregio's "global" en "us" (Anthropic, 2026), en Fable 5.1 vereist bovendien dertig dagen dataretentie en is "not available under ZDR unless expressly authorized by Anthropic" (Anthropic, 2026). Voor strikt EU-werk is een cloudroute via Google Cloud of Amazon Bedrock, of een Europees model, het alternatief.
Werk waarvoor een chatstoel volstaat. Voor mensen die zelf met Claude werken is geen van deze API-keuzes aan de orde; wat een Pro-, Max- of Team-seat kost, staat op wat kost Claude.
Kennis van na februari 2025 op het goedkoopste model. Haiku 4.5 heeft de oudste kennisgrens van de vier en de kortste uitfaseringsgarantie, niet vóór 15 oktober 2026 (Anthropic, 2026); wie erop bouwt, plant een modelwissel in.
Welk model zit in je abonnement en in Claude Code
De tabellen hierboven gaan over de API. Wie Claude via de app of via Claude Code gebruikt, krijgt de modellen per plan.
Fable 5 en Fable 5.1 zijn beschikbaar op alle betaalde plannen, maar op Pro en Team Standard "aren't included in your plan's usage limits" en lopen via usage credits; op Max, Team Premium en Enterprise Premium mag je tot 50% van je weeklimiet aan Fable besteden zonder bijbetaling (Claude Help Center, 2026). Voor een Pro-gebruiker is Fable daarmee een bewuste uitgave per gesprek.
Voor ontwikkelaars die deze tabellen voor Claude Code willen lezen, is wat Claude Code kost de vervolgpagina; daar staat per plan welke sessieruimte je krijgt.
Modelkeuze als onderdeel van beheer: onze prijsband
Bij AI-software op maat bouwen we, in de woorden van onze eigen dienstpagina, "standaard op Claude (Anthropic) met uitwisselbare modellaag", en "modelkosten meten we per functie, zodat je kunt bijsturen of zonder herbouw van model wisselt". De band loopt van €8.500 voor één ingebouwde AI-feature tot €75.000 en verder voor een compleet AI-platform, steeds tegen een vaste prijs na scoping.
Daarna is de modeltrap een beheervraag. Binnen Managed AI (Basis €500, Standaard €1.000, Premium €1.500 tot €2.500 per maand) geldt: "Nieuwe modelversies en beveiligingsupdates worden eerst getest in jouw opstelling en pas daarna doorgevoerd. Levert een ander model betere resultaten, dan schakelen we over zonder herbouw."
Concreet betekent dat: elk kwartaal draaien we de evaluatieset van een klant opnieuw over de huidige modellen, en pas als een goedkopere trap dezelfde score haalt, zetten we hem om. Zet je het rekenvoorbeeld van $294 per maand naast die beheerprijs, dan zie je meteen waarom de modelkeuze zelden de post is die het budget maakt.
Wat AI in totaal kost, van abonnementen tot bouw en beheer, staat in ons totaaloverzicht van wat AI een bedrijf kost; een prijsindicatie voor een eigen toepassing krijg je zonder verplichting.
Wil je weten welke trap jouw processen nodig hebben? Bel 085 016 0118 of stuur je vraag via contact; we leggen dan twee of drie van je echte documenten langs de modellen en laten zien waar het verschil zit.
Wanneer deze tabellen veranderen
Anthropic belooft Sonnet 5 niet vóór 30 juni 2027 uit te faseren, Opus 5 niet vóór 24 juli 2027 en Fable 5.1 niet vóór 1 september 2027; voor Haiku 4.5 reikt die garantie maar tot 15 oktober 2026 (modeloverzicht). Een opvolger van Haiku is daarmee de eerste wijziging die deze pagina te verwachten heeft.
Elk kwartaal lopen we prijzen, snelheidsklassen en inzetgebieden na; de datum van die controle zie je boven het artikel. Een nieuwe release krijgt geen eigen URL bij ons, maar wordt een sectie op de versiepagina van Claude.
Veelgestelde vragen over de keuze tussen Claude-modellen
De vragen die we bij de keuze tussen Haiku, Sonnet, Opus en Fable het vaakst krijgen. Peildatum voor alle prijzen en specificaties: 18 september 2026.
Opgesteld met AI-ondersteuning, geredigeerd en inhoudelijk verantwoord door Bram Dokman.










