Van lezen naar doen.
Anthropic zegt dat Claude Fable 5.1 typische workloads ongeveer 25 procent goedkoper maakt, en tot 45 procent bij sterk agentisch werk. Artificial Analysis mat bij dezelfde release dat één taak uit hun index 3,76 dollar kostte tegen 3,14 dollar bij Fable 5 — bijna 20 procent duurder.
Allebei waar. De prijsverlaging zit op één regel van je factuur, en het model schrijft tegelijk meer tokens dan zijn voorganger. Welke van die twee bewegingen wint, hangt niet af van het model maar van de samenstelling van jouw verbruik.
Dat is de rekensom die we in de Nederlandse berichtgeving over deze release nergens zijn tegengekomen. Hieronder staat hij, met de verhouding die je in je eigen facturen kunt opzoeken, plus wat je moet testen voordat je een productieworkload van 5 naar 5.1 zet. Voor de bredere vraag welk model bij welke taak past is onze vergelijking van AI-modellen de betere ingang.
Wat is Claude Fable 5.1?
Claude Fable 5.1 is het taalmodel dat Anthropic op 1 september 2026 uitbracht als opvolger van Claude Fable 5. Het draait onder model-ID claude-fable-5-1, heeft een contextvenster van 1 miljoen tokens, kost 10 dollar per miljoen inputtokens en 50 dollar per miljoen outputtokens, en kent een kennis-cutoff van juni 2026.
Niet te verwarren met de gameserie Fable van Lionhead, en ook niet met de 5.1 uit surround sound. Bij Anthropic is "Fable" de naam van de zwaarste modelklasse en is "5.1" een point-release daarbinnen.
| Kenmerk | Claude Fable 5.1 |
|---|---|
| Uitgebracht | 1 september 2026 |
| Model-ID | claude-fable-5-1 |
| Prijs per miljoen tokens | 10 dollar input, 50 dollar output |
| Cache read | 0,25 dollar per miljoen (was 1,00 dollar) |
| Contextvenster | 1.000.000 tokens |
| Maximale output | 128.000 tokens |
| Kennis-cutoff | juni 2026 |
| Uitfasering niet vóór | 1 september 2027 |
Bronnen: Anthropics modeloverzicht voor contextvenster, output en uitfasering, en de prijspagina voor de tarieven. Peildatum 6 september 2026.
Naast Fable 5.1 verscheen Claude Mythos 5.1. Dat is hetzelfde basismodel met andere safeguard-instellingen, alleen toegankelijk voor deelnemers aan Project Glasswing — voor het MKB dus geen keuze die op tafel ligt.
Waar de 25 procent vandaan komt, en waar hij weer verdwijnt
Er is precies één regel op je factuur veranderd. De cache-read-prijs zakte van 1,00 naar 0,25 dollar per miljoen tokens. Input, output en cache writes staan op exact dezelfde tarieven als bij Fable 5.
| Model | Input | Output | Cache read |
|---|---|---|---|
| Claude Fable 5.1 | 10 dollar | 50 dollar | 0,25 dollar |
| Claude Fable 5 | 10 dollar | 50 dollar | 1,00 dollar |
| Claude Opus 5 | 5 dollar | 25 dollar | 0,50 dollar |
| Claude Sonnet 5 | 2 dollar | 10 dollar | 0,20 dollar |
| GPT-6 Astra | 10 dollar | 50 dollar | 1,00 dollar |
Alle bedragen per miljoen tokens, exclusief btw. Bronnen: Anthropic pricing en llm-stats over GPT-6 Astra, 6 september 2026.
Een cache read gebeurt wanneer het model een stuk prompt terugleest dat het eerder al verwerkte: je systeemprompt, je toolbeschrijvingen, het gespreksverloop. Bij een agent die vijftig beurten lang dezelfde context meesleept, is dat verreweg de grootste post. Bij een eenmalige vraag zonder hergebruik is de besparing exact nul.
Een onafhankelijke analyse van eigen agent-transcripts door paddo.dev verdeelde de rekening bij Fable 5 als 67 procent cache reads, ongeveer 20 procent cache writes en ongeveer 12 procent outputtokens. Op zo'n verdeling landt de korting vrijwel volledig.
De tegenkracht. Artificial Analysis mat voor de volledige index 140 miljoen outputtokens op max effort, tegen 83 miljoen bij Fable 5 — ongeveer 1,7 keer zoveel. Het model denkt langer en schrijft langer, en dat gebeurt op de outputregel van 50 dollar die níet is verlaagd.
Die 1,7 is een indicatie uit hún testset, geen constante die op jouw workload van toepassing is. Stork.AI noemt dezelfde verhouding, maar zonder gepubliceerde methode — reden om Artificial Analysis als bron aan te houden en het getal als richting te lezen, niet als factor.
De verhouding waar het op neerkomt
Zet twee posten van je huidige Fable 5-factuur naast elkaar: het bedrag aan cache reads en het bedrag aan outputtokens.
De korting levert je 75 procent van de cache-read-post op. Het hogere tokenverbruik kost je ongeveer 70 procent van de output-post erbij, als de 1,7 van Artificial Analysis ook bij jou opgaat. Die twee zijn in evenwicht wanneer beide posten ongeveer even groot zijn.
Fable 5.1 verlaagt je factuur zodra je cache-read-post groter is dan je output-post, en verhoogt hem eronder. Dat is de hele beslisregel, en je kunt hem opzoeken in het usage-overzicht van je Claude-account of je cloudfactuur.
Eén nuance: in een agentische lus voedt die extra output ook je volgende cache-writes en cache-reads. Dat maakt het effect groter, niet anders van richting.
Profiel A: de cache-zware agent
Neem de verdeling van paddo.dev en reken één euro Fable 5-kosten om. De cache reads van 0,67 zakken naar 0,17, de cache writes van 0,20 blijven 0,20, en de output van 0,12 groeit naar 0,20.
Totaal: ongeveer 0,57 in plaats van 1,00, dus ruim veertig procent lager — inclusief het hogere tokenverbruik. Dit is een rekenvoorbeeld op een gepubliceerde verdeling, geen meting van ons.
Profiel B: lang redeneerwerk met veel output
Hier is de meting van Artificial Analysis zelf het profiel: 3,14 dollar per indextaak bij Fable 5, 3,76 dollar bij 5.1. Zonder de goedkopere cache reads was dat ongeveer 5,16 dollar geweest — de korting deed dus wel degelijk werk, alleen niet genoeg.
Ter vergelijking uit dezelfde meting: Claude Opus 5 kost 2,34 dollar voor die taak. Voor wie vooral op deze kant van de verhouding zit, is het goedkopere model uit dezelfde familie het echte antwoord, niet de nieuwere versie. Hoe zulke tokenkosten zich verhouden tot de totale AI-uitgaven van een MKB-bedrijf staat in ons overzicht van wat AI kost.
De knop die meer scheelt dan je modelkeuze
Adaptive thinking staat bij Fable 5.1 altijd aan; uitzetten geeft een 400-fout. Je stuurt in plaats daarvan op effort, in vijf niveaus van low tot max, met high als standaard.
Dat verschil is groot. Artificial Analysis mat over die vijf niveaus 13,1 miljoen outputtokens op low tegen 143,7 miljoen op max — een factor elf — bij indexscores van 58 tot 66.
Een integratie die overal op de default high staat, betaalt structureel te veel voor taken die dat niet nodig hebben. Volgens paddo.dev levert medium effort op 5.1 ongeveer de kwaliteit van Fable 5 tegen lagere kosten; dat is de eerste knop om aan te draaien voordat je over modelwissels nadenkt.
Wat je moet testen voordat je omzet
Van 5 naar 5.1 is geen configuratiewijziging. Anthropic documenteert drie breaking changes en een reeks gedragsveranderingen die zonder codewijziging opduiken — reden genoeg om eerst een regressieset te draaien in plaats van het model-ID te vervangen en te hopen.
De drie breaking changes:
- Forced tool use vervalt. Een tool_choice van het type "any" of een expliciete toolnaam geeft nu een 400. Vervang het door auto met een expliciete instructie, of door structured outputs.
- Thinking blocks zijn modelgebonden. Fable 5.1 leest de redenering van eerdere modellen wel, maar geen enkel eerder model leest die van 5.1. Een router die tussen modellen wisselt, gooit die blokken stil weg.
- Bewerk je de geschiedenis, dan vervallen de thinking blocks. Elke wijziging vóór een thinking block — in je systeemprompt, je tools of een eerder bericht — levert een 400 op. Dit wordt afgedwongen voor accounts die op of na 31 augustus 2026 zijn aangemaakt; oudere accounts krijgen alleen een logregel.
Die derde raakt elke zelfgebouwde harness die de berichtenlijst zelf samenstelt. Wie per request tekst injecteert en bij het volgende request weer weghaalt, moet dat patroon vervangen door append-only opbouw.
De gedragsveranderingen die je evalset moet afvangen, allemaal door Anthropic zelf gedocumenteerd:
- 5.1 doet vaker één tool-call per beurt waar Fable 5 er meerdere batchte: meer beurten, meer wachttijd.
- Bij low effort antwoordt het model vaker uit het geheugen in plaats van een zoek- of retrievaltool aan te roepen.
- De proza is dichter en de opmaak schaarser: minder koppen, minder lijsten, langere zinnen.
- Het model herschrijft hele bestanden waar een gerichte aanpassing volstaat — direct zichtbaar op je outputregel.
- Bij samenvatten reproduceert het vaker letterlijke passages zónder ze als citaat te markeren.
Die laatste is voor iedereen die AI inzet bij contentproductie geen detail maar een risico. Wie bronmateriaal laat samenvatten, moet expliciet om citaatmarkering vragen en het resultaat menselijk laten nakijken. Wij vangen dat af in de prompt én in de redactieronde; dat is precies waarom de verantwoordelijkheid voor gepubliceerde tekst bij een mens blijft liggen.
Benchmarks: wat de cijfers hier wel en niet zeggen
Op de Artificial Analysis Intelligence Index scoort Fable 5.1 op max effort 66 punten, de hoogste score die dat instituut tot nu toe mat, boven Opus 5 (63), Fable 5 (62) en GPT-5.6 Sol (61). Anthropics eigen cijfers laten de grootste sprong zien op agentisch coderen: Terminal-Bench 4.0 van 42,0 naar 55,8 procent.
Twee kanttekeningen die je erbij moet houden. De sprong is het grootst op max effort — precies het niveau waar het tokenverbruik ook het hoogst is. En vendor-benchmarks meten de taken die de vendor koos.
Onafhankelijk bevestigd wordt dat niet overal. Snorkel AI zette 5.1 naast Opus 5 op een eigen Terminal-Bench-variant en concludeert dat Fable "geen strikte upgrade" is: Opus 5 won vijf taken, Fable 5.1 er twee, achttien losten beide op.
De auteurs noemen hun eigen opzet beschrijvend en niet generaliseerbaar — een eerlijkheid die je in vendormateriaal zelden ziet. Hoe je zulke scores leest zonder erin te verdwalen, staat in AI-benchmarks en wat scores betekenen.
Anthropic zelf classificeert Fable 5.1 bovendien als het traagste model in de eigen line-up, tegenover "moderate" voor Opus 5 en "fast" voor Sonnet 5. Slimmer betekent hier expliciet langzamer.
Hoe goed is Claude Fable 5.1 in het Nederlands?
Even goed als Fable 5, en dat is geen slordige samenvatting: Anthropic schrijft in de release-notities letterlijk dat de meertalige prestaties gelijk zijn gebleven. De verbeteringen concentreren zich in agentisch coderen, kenniswerk met documenten, research, vision, long-context redeneren en computer use.
Voor Nederlandstalig werk — klantmails beantwoorden, offerteteksten opstellen, documenten samenvatten — voegt de upgrade dus niets toe aan de taalkwaliteit zelf. De tokenizer is ook ongewijzigd, dus dezelfde Nederlandse tekst kost hetzelfde aantal tokens als bij Fable 5.
Wat wél verandert, is de vorm. Dichtere proza en minder opmaak betekenen dat prompts die op Fable 5 nette, gestructureerde Nederlandse output gaven, op 5.1 langere lopende alinea's kunnen opleveren. Dat is een promptaanpassing, geen modelprobleem — maar je merkt het pas als je erop test.
Kortom: als je Claude vooral in het Nederlands inzet voor tekstwerk, is dit geen release die je hoeft te halen. Wat Claude in een Nederlandse MKB-context wél oplevert, staat in ons artikel over Claude zakelijk inzetten.
Waar je Fable 5.1 mag draaien met AVG-eisen
De directe Claude API biedt geen EU-optie: de instelling voor inference-geo accepteert alleen "global" en "us". Wie EU-dataresidentie nodig heeft, moet dus via een cloudplatform.
| Route | EU-residentie | Opmerking |
|---|---|---|
| Claude API (direct) | Nee | Alleen global en us |
| Google Cloud Vertex | Ja | Multi-region endpoint "eu", 10 procent toeslag |
| Amazon Bedrock | In de praktijk niet | Regionale endpoints voor 5.1 alleen in us-east-1 |
| Microsoft Foundry | Nee | 5.1 draait er alleen als Global Standard |
Bronnen: Anthropics platformdocumentatie voor Vertex, Bedrock en Microsoft Foundry, peildatum 6 september 2026.
Twee dingen om mee te nemen naar je DPIA. Fable 5.1 valt onder een verplichte dataretentie van 30 dagen en is niet beschikbaar onder zero data retention tenzij Anthropic dat expliciet toestaat — anders dan Opus 5 en Sonnet 5. En op Bedrock en Vertex is de cloudprovider de verwerker, wat betekent dat je bestaande verwerkersovereenkomst met AWS of Google de basis vormt.
Het volledige AVG-keuzevraagstuk per model behandelen we apart in welk AI-model AVG-proof is; dat is de pagina om te lezen voordat je een leverancier vastlegt.
Upgraden of niet: onze beslisregel
Anthropics eigen modeloverzicht adviseert te beginnen met Opus 5 en pas naar Fable te grijpen bij veeleisend redeneerwerk of langlopend agentisch werk. Dat advies staat haaks op hoe de release in de markt wordt gelezen, en het is het eerlijkste stuk van de documentatie.
Zet om naar 5.1 als je cache-read-post groter is dan je output-post, je agents lange sessies met herhaalde context draaien, of je op Fable 5 tegen de grenzen van lange, onbewaakte taken aanliep.
Blijf waar je bent als je vooral Nederlandstalig tekstwerk doet, je workload uit losse prompts zonder cachehergebruik bestaat, of je op een Claude-abonnement zit in plaats van de API — daar wordt per venster afgerekend, dus het hogere tokenverbruik komt bij jou terecht zonder dat de cachekorting iets compenseert.
Kijk eerst omlaag in plaats van omhoog als je huidige evals op Opus 5 of Sonnet 5 al slagen. Die modellen kosten de helft respectievelijk een vijfde, zijn sneller, en kennen de verplichte retentie van dertig dagen niet.
Claude-first is bij ons de huisstandaard, geen dogma: per project kijken we welk model de taak haalt tegen de laagste kosten per afgeronde taak, en dat is sinds deze release vaker Opus 5 dan de naamgeving doet vermoeden. Waarom die keuze niet aan één leverancier vast mag zitten, hebben we uitgewerkt naar aanleiding van de dag dat Fable 5 wereldwijd geblokkeerd werd. Het bredere beeld van het model waar 5.1 op voortbouwt staat in ons artikel over Claude Fable 5, en OpenAI's antwoord van drie dagen later behandelen we in GPT-6 Astra.
Wil je weten wat dit voor jouw eigen AI-workload betekent zonder zelf door facturen te spitten? Bij een AI-implementatietraject rekenen we je huidige verbruik door op modelkeuze en effort-niveau, of plan een gesprek waarin we die verhouding samen op je usage-overzicht opzoeken.
Veelgestelde vragen over Claude Fable 5.1
De vragen die we sinds de release het vaakst krijgen. Alle bedragen en specificaties hebben peildatum 6 september 2026.
Opgesteld met AI-ondersteuning, geredigeerd en inhoudelijk verantwoord door Bram Dokman.










