Ga naar hoofdinhoud
Terug naar AI Modellen Vergelijken
11 min lezen6 september 2026Bijgewerkt 7 september 2026

Claude Fable 5.1: wat er nieuw is en wat het kost

Anthropic belooft 25 tot 45 procent lagere kosten, een onafhankelijke meting kwam 20 procent hoger uit. Beide kloppen. Zo weet je aan welke kant jij staat.

Het Claude-sterretje in terracotta groot in beeld, met links het kleine ChatGPT-beeldmerk boven drie blauwe staafjes
AI Modellen Vergelijken

Anthropic zegt dat Claude Fable 5.1 typische workloads ongeveer 25 procent goedkoper maakt, en tot 45 procent bij sterk agentisch werk. Artificial Analysis mat bij dezelfde release dat één taak uit hun index 3,76 dollar kostte tegen 3,14 dollar bij Fable 5 — bijna 20 procent duurder.

Allebei waar. De prijsverlaging zit op één regel van je factuur, en het model schrijft tegelijk meer tokens dan zijn voorganger. Welke van die twee bewegingen wint, hangt niet af van het model maar van de samenstelling van jouw verbruik.

Dat is de rekensom die we in de Nederlandse berichtgeving over deze release nergens zijn tegengekomen. Hieronder staat hij, met de verhouding die je in je eigen facturen kunt opzoeken, plus wat je moet testen voordat je een productieworkload van 5 naar 5.1 zet. Voor de bredere vraag welk model bij welke taak past is onze vergelijking van AI-modellen de betere ingang.

Wat is Claude Fable 5.1?

Claude Fable 5.1 is het taalmodel dat Anthropic op 1 september 2026 uitbracht als opvolger van Claude Fable 5. Het draait onder model-ID claude-fable-5-1, heeft een contextvenster van 1 miljoen tokens, kost 10 dollar per miljoen inputtokens en 50 dollar per miljoen outputtokens, en kent een kennis-cutoff van juni 2026.

Niet te verwarren met de gameserie Fable van Lionhead, en ook niet met de 5.1 uit surround sound. Bij Anthropic is "Fable" de naam van de zwaarste modelklasse en is "5.1" een point-release daarbinnen.

Kenmerk Claude Fable 5.1
Uitgebracht 1 september 2026
Model-ID claude-fable-5-1
Prijs per miljoen tokens 10 dollar input, 50 dollar output
Cache read 0,25 dollar per miljoen (was 1,00 dollar)
Contextvenster 1.000.000 tokens
Maximale output 128.000 tokens
Kennis-cutoff juni 2026
Uitfasering niet vóór 1 september 2027

Bronnen: Anthropics modeloverzicht voor contextvenster, output en uitfasering, en de prijspagina voor de tarieven. Peildatum 6 september 2026.

Naast Fable 5.1 verscheen Claude Mythos 5.1. Dat is hetzelfde basismodel met andere safeguard-instellingen, alleen toegankelijk voor deelnemers aan Project Glasswing — voor het MKB dus geen keuze die op tafel ligt.

Waar de 25 procent vandaan komt, en waar hij weer verdwijnt

Er is precies één regel op je factuur veranderd. De cache-read-prijs zakte van 1,00 naar 0,25 dollar per miljoen tokens. Input, output en cache writes staan op exact dezelfde tarieven als bij Fable 5.

Model Input Output Cache read
Claude Fable 5.1 10 dollar 50 dollar 0,25 dollar
Claude Fable 5 10 dollar 50 dollar 1,00 dollar
Claude Opus 5 5 dollar 25 dollar 0,50 dollar
Claude Sonnet 5 2 dollar 10 dollar 0,20 dollar
GPT-6 Astra 10 dollar 50 dollar 1,00 dollar

Alle bedragen per miljoen tokens, exclusief btw. Bronnen: Anthropic pricing en llm-stats over GPT-6 Astra, 6 september 2026.

Een cache read gebeurt wanneer het model een stuk prompt terugleest dat het eerder al verwerkte: je systeemprompt, je toolbeschrijvingen, het gespreksverloop. Bij een agent die vijftig beurten lang dezelfde context meesleept, is dat verreweg de grootste post. Bij een eenmalige vraag zonder hergebruik is de besparing exact nul.

Een onafhankelijke analyse van eigen agent-transcripts door paddo.dev verdeelde de rekening bij Fable 5 als 67 procent cache reads, ongeveer 20 procent cache writes en ongeveer 12 procent outputtokens. Op zo'n verdeling landt de korting vrijwel volledig.

De tegenkracht. Artificial Analysis mat voor de volledige index 140 miljoen outputtokens op max effort, tegen 83 miljoen bij Fable 5 — ongeveer 1,7 keer zoveel. Het model denkt langer en schrijft langer, en dat gebeurt op de outputregel van 50 dollar die níet is verlaagd.

Die 1,7 is een indicatie uit hún testset, geen constante die op jouw workload van toepassing is. Stork.AI noemt dezelfde verhouding, maar zonder gepubliceerde methode — reden om Artificial Analysis als bron aan te houden en het getal als richting te lezen, niet als factor.

De verhouding waar het op neerkomt

Zet twee posten van je huidige Fable 5-factuur naast elkaar: het bedrag aan cache reads en het bedrag aan outputtokens.

De korting levert je 75 procent van de cache-read-post op. Het hogere tokenverbruik kost je ongeveer 70 procent van de output-post erbij, als de 1,7 van Artificial Analysis ook bij jou opgaat. Die twee zijn in evenwicht wanneer beide posten ongeveer even groot zijn.

Fable 5.1 verlaagt je factuur zodra je cache-read-post groter is dan je output-post, en verhoogt hem eronder. Dat is de hele beslisregel, en je kunt hem opzoeken in het usage-overzicht van je Claude-account of je cloudfactuur.

Eén nuance: in een agentische lus voedt die extra output ook je volgende cache-writes en cache-reads. Dat maakt het effect groter, niet anders van richting.

Profiel A: de cache-zware agent

Neem de verdeling van paddo.dev en reken één euro Fable 5-kosten om. De cache reads van 0,67 zakken naar 0,17, de cache writes van 0,20 blijven 0,20, en de output van 0,12 groeit naar 0,20.

Totaal: ongeveer 0,57 in plaats van 1,00, dus ruim veertig procent lager — inclusief het hogere tokenverbruik. Dit is een rekenvoorbeeld op een gepubliceerde verdeling, geen meting van ons.

Profiel B: lang redeneerwerk met veel output

Hier is de meting van Artificial Analysis zelf het profiel: 3,14 dollar per indextaak bij Fable 5, 3,76 dollar bij 5.1. Zonder de goedkopere cache reads was dat ongeveer 5,16 dollar geweest — de korting deed dus wel degelijk werk, alleen niet genoeg.

Ter vergelijking uit dezelfde meting: Claude Opus 5 kost 2,34 dollar voor die taak. Voor wie vooral op deze kant van de verhouding zit, is het goedkopere model uit dezelfde familie het echte antwoord, niet de nieuwere versie. Hoe zulke tokenkosten zich verhouden tot de totale AI-uitgaven van een MKB-bedrijf staat in ons overzicht van wat AI kost.

De knop die meer scheelt dan je modelkeuze

Adaptive thinking staat bij Fable 5.1 altijd aan; uitzetten geeft een 400-fout. Je stuurt in plaats daarvan op effort, in vijf niveaus van low tot max, met high als standaard.

Dat verschil is groot. Artificial Analysis mat over die vijf niveaus 13,1 miljoen outputtokens op low tegen 143,7 miljoen op max — een factor elf — bij indexscores van 58 tot 66.

Een integratie die overal op de default high staat, betaalt structureel te veel voor taken die dat niet nodig hebben. Volgens paddo.dev levert medium effort op 5.1 ongeveer de kwaliteit van Fable 5 tegen lagere kosten; dat is de eerste knop om aan te draaien voordat je over modelwissels nadenkt.

Wat je moet testen voordat je omzet

Van 5 naar 5.1 is geen configuratiewijziging. Anthropic documenteert drie breaking changes en een reeks gedragsveranderingen die zonder codewijziging opduiken — reden genoeg om eerst een regressieset te draaien in plaats van het model-ID te vervangen en te hopen.

De drie breaking changes:

  1. Forced tool use vervalt. Een tool_choice van het type "any" of een expliciete toolnaam geeft nu een 400. Vervang het door auto met een expliciete instructie, of door structured outputs.
  2. Thinking blocks zijn modelgebonden. Fable 5.1 leest de redenering van eerdere modellen wel, maar geen enkel eerder model leest die van 5.1. Een router die tussen modellen wisselt, gooit die blokken stil weg.
  3. Bewerk je de geschiedenis, dan vervallen de thinking blocks. Elke wijziging vóór een thinking block — in je systeemprompt, je tools of een eerder bericht — levert een 400 op. Dit wordt afgedwongen voor accounts die op of na 31 augustus 2026 zijn aangemaakt; oudere accounts krijgen alleen een logregel.

Die derde raakt elke zelfgebouwde harness die de berichtenlijst zelf samenstelt. Wie per request tekst injecteert en bij het volgende request weer weghaalt, moet dat patroon vervangen door append-only opbouw.

De gedragsveranderingen die je evalset moet afvangen, allemaal door Anthropic zelf gedocumenteerd:

  • 5.1 doet vaker één tool-call per beurt waar Fable 5 er meerdere batchte: meer beurten, meer wachttijd.
  • Bij low effort antwoordt het model vaker uit het geheugen in plaats van een zoek- of retrievaltool aan te roepen.
  • De proza is dichter en de opmaak schaarser: minder koppen, minder lijsten, langere zinnen.
  • Het model herschrijft hele bestanden waar een gerichte aanpassing volstaat — direct zichtbaar op je outputregel.
  • Bij samenvatten reproduceert het vaker letterlijke passages zónder ze als citaat te markeren.

Die laatste is voor iedereen die AI inzet bij contentproductie geen detail maar een risico. Wie bronmateriaal laat samenvatten, moet expliciet om citaatmarkering vragen en het resultaat menselijk laten nakijken. Wij vangen dat af in de prompt én in de redactieronde; dat is precies waarom de verantwoordelijkheid voor gepubliceerde tekst bij een mens blijft liggen.

Benchmarks: wat de cijfers hier wel en niet zeggen

Op de Artificial Analysis Intelligence Index scoort Fable 5.1 op max effort 66 punten, de hoogste score die dat instituut tot nu toe mat, boven Opus 5 (63), Fable 5 (62) en GPT-5.6 Sol (61). Anthropics eigen cijfers laten de grootste sprong zien op agentisch coderen: Terminal-Bench 4.0 van 42,0 naar 55,8 procent.

Twee kanttekeningen die je erbij moet houden. De sprong is het grootst op max effort — precies het niveau waar het tokenverbruik ook het hoogst is. En vendor-benchmarks meten de taken die de vendor koos.

Onafhankelijk bevestigd wordt dat niet overal. Snorkel AI zette 5.1 naast Opus 5 op een eigen Terminal-Bench-variant en concludeert dat Fable "geen strikte upgrade" is: Opus 5 won vijf taken, Fable 5.1 er twee, achttien losten beide op.

De auteurs noemen hun eigen opzet beschrijvend en niet generaliseerbaar — een eerlijkheid die je in vendormateriaal zelden ziet. Hoe je zulke scores leest zonder erin te verdwalen, staat in AI-benchmarks en wat scores betekenen.

Anthropic zelf classificeert Fable 5.1 bovendien als het traagste model in de eigen line-up, tegenover "moderate" voor Opus 5 en "fast" voor Sonnet 5. Slimmer betekent hier expliciet langzamer.

Hoe goed is Claude Fable 5.1 in het Nederlands?

Even goed als Fable 5, en dat is geen slordige samenvatting: Anthropic schrijft in de release-notities letterlijk dat de meertalige prestaties gelijk zijn gebleven. De verbeteringen concentreren zich in agentisch coderen, kenniswerk met documenten, research, vision, long-context redeneren en computer use.

Voor Nederlandstalig werk — klantmails beantwoorden, offerteteksten opstellen, documenten samenvatten — voegt de upgrade dus niets toe aan de taalkwaliteit zelf. De tokenizer is ook ongewijzigd, dus dezelfde Nederlandse tekst kost hetzelfde aantal tokens als bij Fable 5.

Wat wél verandert, is de vorm. Dichtere proza en minder opmaak betekenen dat prompts die op Fable 5 nette, gestructureerde Nederlandse output gaven, op 5.1 langere lopende alinea's kunnen opleveren. Dat is een promptaanpassing, geen modelprobleem — maar je merkt het pas als je erop test.

Kortom: als je Claude vooral in het Nederlands inzet voor tekstwerk, is dit geen release die je hoeft te halen. Wat Claude in een Nederlandse MKB-context wél oplevert, staat in ons artikel over Claude zakelijk inzetten.

Waar je Fable 5.1 mag draaien met AVG-eisen

De directe Claude API biedt geen EU-optie: de instelling voor inference-geo accepteert alleen "global" en "us". Wie EU-dataresidentie nodig heeft, moet dus via een cloudplatform.

Route EU-residentie Opmerking
Claude API (direct) Nee Alleen global en us
Google Cloud Vertex Ja Multi-region endpoint "eu", 10 procent toeslag
Amazon Bedrock In de praktijk niet Regionale endpoints voor 5.1 alleen in us-east-1
Microsoft Foundry Nee 5.1 draait er alleen als Global Standard

Bronnen: Anthropics platformdocumentatie voor Vertex, Bedrock en Microsoft Foundry, peildatum 6 september 2026.

Twee dingen om mee te nemen naar je DPIA. Fable 5.1 valt onder een verplichte dataretentie van 30 dagen en is niet beschikbaar onder zero data retention tenzij Anthropic dat expliciet toestaat — anders dan Opus 5 en Sonnet 5. En op Bedrock en Vertex is de cloudprovider de verwerker, wat betekent dat je bestaande verwerkersovereenkomst met AWS of Google de basis vormt.

Het volledige AVG-keuzevraagstuk per model behandelen we apart in welk AI-model AVG-proof is; dat is de pagina om te lezen voordat je een leverancier vastlegt.

Upgraden of niet: onze beslisregel

Anthropics eigen modeloverzicht adviseert te beginnen met Opus 5 en pas naar Fable te grijpen bij veeleisend redeneerwerk of langlopend agentisch werk. Dat advies staat haaks op hoe de release in de markt wordt gelezen, en het is het eerlijkste stuk van de documentatie.

Zet om naar 5.1 als je cache-read-post groter is dan je output-post, je agents lange sessies met herhaalde context draaien, of je op Fable 5 tegen de grenzen van lange, onbewaakte taken aanliep.

Blijf waar je bent als je vooral Nederlandstalig tekstwerk doet, je workload uit losse prompts zonder cachehergebruik bestaat, of je op een Claude-abonnement zit in plaats van de API — daar wordt per venster afgerekend, dus het hogere tokenverbruik komt bij jou terecht zonder dat de cachekorting iets compenseert.

Kijk eerst omlaag in plaats van omhoog als je huidige evals op Opus 5 of Sonnet 5 al slagen. Die modellen kosten de helft respectievelijk een vijfde, zijn sneller, en kennen de verplichte retentie van dertig dagen niet.

Claude-first is bij ons de huisstandaard, geen dogma: per project kijken we welk model de taak haalt tegen de laagste kosten per afgeronde taak, en dat is sinds deze release vaker Opus 5 dan de naamgeving doet vermoeden. Waarom die keuze niet aan één leverancier vast mag zitten, hebben we uitgewerkt naar aanleiding van de dag dat Fable 5 wereldwijd geblokkeerd werd. Het bredere beeld van het model waar 5.1 op voortbouwt staat in ons artikel over Claude Fable 5, en OpenAI's antwoord van drie dagen later behandelen we in GPT-6 Astra.

Wil je weten wat dit voor jouw eigen AI-workload betekent zonder zelf door facturen te spitten? Bij een AI-implementatietraject rekenen we je huidige verbruik door op modelkeuze en effort-niveau, of plan een gesprek waarin we die verhouding samen op je usage-overzicht opzoeken.

Veelgestelde vragen over Claude Fable 5.1

De vragen die we sinds de release het vaakst krijgen. Alle bedragen en specificaties hebben peildatum 6 september 2026.

Opgesteld met AI-ondersteuning, geredigeerd en inhoudelijk verantwoord door Bram Dokman.

Tags:#Claude#AI tools#AI Strategie#AI kosten#MKB
Delen:
Veelgestelde vragen

Antwoorden over dit artikel

Wat is Claude Fable 5.1?

Claude Fable 5.1 is het taalmodel dat Anthropic op 1 september 2026 uitbracht als opvolger van Claude Fable 5. Het heeft een contextvenster van 1 miljoen tokens, een maximale output van 128.000 tokens en een kennis-cutoff van juni 2026. De prijs is 10 dollar per miljoen inputtokens en 50 dollar per miljoen outputtokens. Naast Fable 5.1 verscheen Claude Mythos 5.1: hetzelfde basismodel met andere safeguard-instellingen, alleen beschikbaar via een besloten programma.

Wat is het verschil tussen Claude Fable 5 en Fable 5.1?

De input- en outputprijs zijn identiek; alleen de cache-read-prijs zakte van 1,00 naar 0,25 dollar per miljoen tokens. Inhoudelijk verbetert 5.1 vooral op agentisch coderen, documentwerk, research, vision en long-context redeneren — de meertalige prestaties zijn volgens Anthropic gelijk gebleven. Daar staan drie breaking changes tegenover: forced tool use vervalt, thinking blocks zijn modelgebonden, en het bewerken van gespreksgeschiedenis maakt die blocks ongeldig. Wat Fable 5 zelf is en kan, staat in ons artikel over Claude Fable 5.

Wat kost Claude Fable 5.1 via de API?

Tien dollar per miljoen inputtokens en vijftig dollar per miljoen outputtokens, met cache reads op 0,25 dollar en cache writes op 12,50 dollar (vijf minuten) of 20 dollar (een uur) per miljoen. Via de Batch API geldt vijftig procent korting: 5 en 25 dollar. Ter vergelijking kost Claude Opus 5 de helft en Claude Sonnet 5 een vijfde. Peildatum 6 september 2026; een indicatie van wat AI in totaal kost voor een MKB-bedrijf staat in ons kostenoverzicht.

Is Claude Fable 5.1 echt 25 procent goedkoper?

Alleen als een groot deel van je factuur uit cache reads bestaat. Die prijs daalde met 75 procent, maar input, output en cache writes bleven gelijk, terwijl Artificial Analysis mat dat 5.1 ongeveer 1,7 keer zoveel outputtokens verbruikt als Fable 5 — waardoor één taak uit hun index 3,76 in plaats van 3,14 dollar kostte. De praktische regel: 5.1 verlaagt je factuur zodra je cache-read-post groter is dan je output-post, en verhoogt hem eronder.

Zit Fable 5.1 in mijn Claude-abonnement?

Ja, maar de prijsverlaging niet. Abonnementen rekenen af in een aandeel van een gebruiksvenster in plaats van per token, dus daar landt de goedkopere cache read nergens. Omdat zo’n venster in tokens wordt opgemaakt en niet in geld, komt het hogere tokenverbruik van 5.1 er wel één-op-één in terecht: je venster is sneller op. Voor kostenvoordeel moet je op de API zitten.

Hoe goed is Claude Fable 5.1 in het Nederlands?

Even goed als Fable 5: Anthropic geeft in de release-notities aan dat de meertalige prestaties gelijk zijn gebleven, omdat de winst zit in coderen, documentwerk, research, vision en long-context redeneren. Ook de tokenizer is ongewijzigd, dus Nederlandse tekst kost hetzelfde aantal tokens. Wel verandert de vorm: 5.1 schrijft dichtere proza met minder koppen en lijsten, dus prompts die eerder nette gestructureerde output gaven, hebben mogelijk bijstelling nodig.

Moet ik van Claude Fable 5 upgraden naar 5.1?

Alleen wanneer je cache-read-post groter is dan je output-post, je agents lange sessies met veel herhaalde context draaien, of je op Fable 5 vastliep op langlopende autonome taken. Bij losse prompts zonder cachehergebruik en bij overwegend Nederlandstalig tekstwerk levert de upgrade niets op. Anthropics eigen modeloverzicht adviseert bovendien te beginnen met Claude Opus 5, dat de helft kost en in onafhankelijke coding-tests niet onderdoet. Test in elk geval eerst de drie breaking changes tegen je eigen integratie.

Fable 5.1 of GPT-6 Astra — wat kies ik?

Op tokenprijs zijn ze gelijk (10 en 50 dollar per miljoen), maar Astra rekent 1,00 dollar per miljoen cache reads tegen 0,25 bij Fable 5.1 en hanteert boven 272.000 inputtokens een toeslag, terwijl Fable 5.1 over het volle miljoen het standaardtarief houdt. Voor cache-zware agents met lange context is dat een reëel verschil in het voordeel van Anthropic. Wat Astra zelf toevoegt, behandelen we in ons artikel over GPT-6 Astra; de keuze tussen beide staat uitgewerkt in onze vergelijking Fable 5.1 versus GPT-6 Astra.

Kan ik Claude Fable 5.1 AVG-proof in de EU draaien?

Niet via de directe Claude API: die accepteert alleen global en us als inferentieregio. De best gedocumenteerde EU-route is Google Cloud Vertex met het eu-multi-region endpoint tegen tien procent toeslag; op Amazon Bedrock bestaan voor 5.1 alleen regionale endpoints in us-east-1. Houd er rekening mee dat voor Fable 5.1 een dataretentie van dertig dagen verplicht is en zero data retention niet beschikbaar is zonder expliciete toestemming van Anthropic. Zie welk AI-model AVG-proof is voor de afweging per model.

Volgende stap

Wat dit in jouw situatie betekent, weet je snel

Je legt je vraag voor, wij zeggen wat haalbaar is, wat het ongeveer kost en wat de slimste eerste stap is. Ook als dat betekent: nog even niet bouwen.

Liever eerst schriftelijk? Stel je vraag via het formulier.
Liever eerst zelf checken? Download de AI Readiness Checklist.
5,0op Google
  • Prettig samengewerkt met Clevertech. Ze hebben maatwerk software geleverd en voor ons een dashboard ontwikkeld waarmee we onze website eenvoudig kunnen beheren en aanpassen. Goede communicatie, korte lijnen en een resultaat waar we erg tevreden mee zijn. Aanrader!

    Niels H.

  • We spraken CleverTech over wat AI voor ons zou kunnen betekenen, ondanks dat er voor ons op dit moment geen AI verbeteringen te realiseren waren, kregen we spontaan een gratis check en advies over ons google business profile, vindbaarheid en prijs profilering. Ik probeer al een tijdje te profileren van Vintech Electrotechniek naar Vintech Installatietechniek en deze concrete verwijzingen van waar dit nog niet goed stond hielpen enorm.

    Jaco V.

Verder lezen

Meer in deze serie

Blijf op de hoogte

Ontvang praktische AI-inzichten in je inbox. Geen spam, alleen waardevolle content.

Geen spam · max 2x per maand · altijd opzegbaar

Je gegevens worden alleen gebruikt voor het verzenden van de nieuwsbrief. Uitschrijven kan op elk moment.

Van kennis naar resultaat

Wat betekent dit voor jouw bedrijf?

We denken vrijblijvend mee over wat dit concreet zou opleveren — vaste prijs, vaste deadline.