Kort antwoord
Claude Opus 5.5 (22 september 2026) kost $4 input en $20 output per miljoen tokens, 20% minder dan Opus 5, en cache reads zakken 60% naar $0,20. De 40% lagere kosten die Anthropic noemt, zijn gemeten op de standaardinstelling, en die standaard-effort ging van high naar medium. Op max effort staat Opus 5.5 op nummer 1 in de Intelligence Index van Artificial Analysis, maar kost een taak daar 4,5 keer zoveel als op medium. Opus 5 blijft actief tot minstens 24 juli 2027, dus overstappen kan na een eigen test.
Van lezen naar doen.
Claude Opus 5.5 draait standaard op effort medium, een stand lager dan Opus 5, en die effort-stand bepaalt meer van je factuur dan de 20% lagere tokenprijs. Zet je hem op max, dan kost een taak 4,5 keer zoveel als op medium: $5,98 tegen $1,34.
Anthropic bracht het model op 22 september 2026 uit, dezelfde dag als GPT-6 Sol van OpenAI. De Opus-klasse werd goedkoper per token, en Opus 5.5 staat op max effort op nummer 1 in de Intelligence Index van Artificial Analysis.
Wij rekenen de overstap van Opus 5 door in vier scenario's en zetten de vier breaking changes om in een checklist. Voor het bredere modellandschap is onze index over AI-modellen vergelijken de ingang.
Wat is Claude Opus 5.5?
Claude Opus 5.5 is het eerste model van de Claude 5.5-familie en de opvolger van Claude Opus 5 van 24 juli 2026. Anthropic noemt het in de aankondiging een model dat "at the level of Claude Fable 5.1 on most work" presteert.
In het modeloverzicht staat sinds de release een helder advies: begin bij twijfel met Opus 5.5, en kies Fable 5.1 voor veeleisend redeneerwerk en langlopend agentisch werk.
| Kenmerk | Claude Opus 5.5 |
|---|---|
| Uitgebracht | 22 september 2026 |
| Model-ID | claude-opus-5-5 (Bedrock: anthropic.claude-opus-5-5) |
| Input / output per miljoen tokens | $4 / $20 |
| Cache read per miljoen tokens | $0,20 |
| Batch API (input / output) | $2 / $10 |
| Contextvenster | 1.000.000 tokens |
| Maximale output | 128.000 tokens (300.000 via Batch met beta-header) |
| Kennis-cutoff | juni 2026 |
| Thinking | Adaptive thinking, altijd aan |
| Standaard-effort | medium |
| Uitfasering niet vóór | 22 september 2027 |
Bronnen: modelpagina Opus 5.5, prijspagina en uitfaseringspagina van Anthropic, peildatum 22 september 2026. Alle bedragen exclusief btw.
Het model neemt tekst en beeld als invoer en geeft tekst terug. Volgens Anthropic schrijft het zijn output ruim 30% sneller dan Opus 5; dat is een claim van de leverancier, geen onafhankelijke meting.
De lichtere modellen van dezelfde familie, Sonnet 5.5 en Haiku 5.5, heeft Anthropic aangekondigd zonder datum. Wie nu op Sonnet 5 draait, hoeft dus niet op Opus over te stappen om de nieuwe generatie te krijgen; wachten kan ook.
Wat is er nieuw ten opzichte van Opus 5?
Vijf dingen veranderen op de factuur of in je integratie. De rest is een model-ID-wissel.
| Opus 5 | Opus 5.5 | Verschil | |
|---|---|---|---|
| Input | $5 | $4 | -20% |
| Output | $25 | $20 | -20% |
| Cache write 5 min / 1 uur | $6,25 / $10 | $5 / $8 | -20% |
| Cache read | $0,50 | $0,20 | -60% |
| Batch input / output | $2,50 / $12,50 | $2 / $10 | -20% |
| Standaard-effort | high | medium | een stand lager |
| Thinking uitzetten | kan | kan niet | breaking change |
Bedragen per miljoen tokens; de verschillen hebben we zelf nagerekend op de prijspagina. De effort- en thinking-regels komen uit de migratienotities.
De cache read is de grootste verschuiving. Bij Opus 5 kost een cache-hit een tiende van de inputprijs, bij Opus 5.5 een twintigste.
Dat is niet de laagste factor in de line-up: Fable 5.1 zit op een veertigste.
Lange context kost niets extra. Een prompt van negenhonderdduizend tokens betaalt per token evenveel als een korte vraag; een toeslag boven een drempel, zoals GPT-6 Sol die boven 272.000 inputtokens rekent, bestaat bij Opus 5.5 niet.
Fast mode is er als research preview. Tot 2,5 keer zoveel outputtokens per seconde tegen het dubbele tarief, $8 / $40.
Toegang loopt via een wachtlijst of je accountmanager, en alleen op de eigen Claude API (fast mode-documentatie).
Wie Claude via een abonnement gebruikt, ziet de tokenprijs niet. Anthropic verhoogt wel de vijfuurslimieten op Pro, Max, Team en Enterprise met seats en geeft abonnees een limiet-reset die ze zelf inzetten.
Hoeveel ruimer de limieten worden, heeft Anthropic niet gepubliceerd.
Waar komt de "40% goedkoper" vandaan?
Anthropic schrijft dat Opus 5.5 "costs 40% less to run than Opus 5", terwijl de tokenprijs 20% daalt. Het gat tussen die twee getallen zit in één zinsdeel van de aankondiging: gemeten "at default settings … on typical workloads".
Die standaardinstelling is niet dezelfde gebleven: Opus 5 draaide standaard op effort high, Opus 5.5 op medium. De 40% vergelijkt dus twee modellen op twee verschillende standen.
Terugrekenen maakt het concreet: om bij 20% lagere tokenprijs op 40% lagere kosten uit te komen, moet het tokenverbruik per taak ongeveer een kwart lager liggen (0,8 × 0,75 = 0,6). Dat is onze eigen rekensom, geen meting.
Dat dat tokenvoordeel bij de medium-stand zit, is ook onze afleiding. Artificial Analysis ondersteunt wel de richting: op medium schreef Opus 5.5 38 miljoen outputtokens voor de hele index, "very concise" tegen een mediaan van 88 miljoen.
Op max waren het er 260 miljoen, "very verbose". Box meldt in een klantcitaat uit Anthropics lancering dat Opus 5.5 in zijn evaluaties ongeveer een derde van de tokens van Opus 5 gebruikte (The New Stack).
Dat is een door de leverancier aangeleverde anekdote, geen onafhankelijke meting.
Anthropic waarschuwt daar zelf voor in de migratienotities: op dezelfde effort-stand denkt het model per beurt meer dan Opus 5, "most of all at xhigh and max". De 40% is dus echt, maar alleen voor wie de nieuwe standaard ook laat staan.
Rekenvoorbeeld: je factuur van Opus 5 naar Opus 5.5
Dit is onze eigen tabel, gerekend met de lijstprijzen van de prijspagina van 22 september 2026. Alle bedragen in dollars per maand, exclusief btw; we rekenen bewust niet om naar euro.
| Scenario | Maandverbruik | Opus 5 | Opus 5.5 | Verschil |
|---|---|---|---|---|
| 1. Gelijke tokens, geen cache | 10M input, 2M output | $100 | $80 | -20% |
| 2. Cache-zware agent | 50M cache read, 5M input, 2M output, 2M cache write (5 min) | $112,50 | $80 | -28,9% |
| 3. Scenario 1 via een EU-endpoint | idem, +10% regionale toeslag | $110 | $88 | -20% |
| 4. Eén indextaak, medium tegen max | meting Artificial Analysis | n.v.t. | $1,34 tegen $5,98 | 4,5 keer |
Scenario 1 is de ondergrens: hetzelfde werk, dezelfde tokens, alleen een goedkoper tarief. Precies de 20% van de prijslijst.
Scenario 2 laat zien waarom agents meer winnen: de cache reads gaan van $25 naar $10, de rest daalt 20%. Hoe groter het cache-aandeel van je factuur, hoe dichter je op dat deel bij de 60% komt.
Scenario 3 is de prijs van EU-verwerking: Google Cloud en Bedrock rekenen voor regionale endpoints 10% bovenop het globale tarief (Google Cloud, Bedrock). De batchkorting kun je daar niet bij optellen; waarom, staat in de EU-sectie hieronder.
Scenario 4 is de knop die meer doet dan de modelwissel: een taak uit de index van Artificial Analysis kostte op medium $1,34 en op max $5,98. Wie na de upgrade op max gaat draaien, betaalt per taak 4,5 keer het medium-bedrag; dat weegt ruim op tegen de 20% tokenkorting.
Twee varianten houden we buiten de tabel: via de Batch API kost scenario 1 op Opus 5.5 $40, maar niet via een EU-route. Met fast mode kost hetzelfde verbruik $160, tegen $200 op Opus 5.
Een controle op onafhankelijke cijfers: Artificial Analysis rekent met een mengprijs van $2,94 per miljoen tokens voor Opus 5.5 (verhouding 7:2:1 cache hit, input, output). Met dezelfde formule komen wij voor Opus 5 op $3,85, dus -23,6%; dat getal is onze eigen berekening, niet van Artificial Analysis.
Wat de volledige Claude-tarieflijst per model is, inclusief cache writes en batch voor elk model, staat op wat de Claude API kost.
Medium of max: welke effort-stand kies je?
Opus 5.5 kent vijf standen: low, medium, high, xhigh en max. Artificial Analysis mat ze alle vijf op versie 4.3.2 van de Intelligence Index, over 212 modellen.
| Effort | Indexscore | Rang | Kosten per indextaak |
|---|---|---|---|
| low | 42 | 37 | $0,55 |
| medium (standaard) | 51 | 8 | $1,34 |
| high | 54 | 3 | $1,82 |
| xhigh | 56 | 2 | $3,46 |
| max | 58 | 1 | $5,98 |
Bron: de modelpagina's van Artificial Analysis per effort-stand (low, medium, high, xhigh, max), gemeten 22 september 2026 met Anthropics standaard-fallback aan.
De nummer-1-positie die in de berichtgeving rondgaat, is de duurste regel van deze tabel. Van medium naar max stijgt de score 7 punten en de prijs per taak 4,5 keer.
Onze vuistregel: begin op medium, en zet een taak pas hoger als je eigen evaluatieset aantoont dat medium hem mist, eerst naar high. Die stap kost per taak ruim een derde meer, de stap naar max ruim vier keer zoveel.
Low is het overwegen waard voor classificeren en korte extracties, al heb je daar vaak geen Opus nodig: Sonnet 5 kost per input- en outputtoken de helft van Opus 5.5. Hoe je die trap afloopt, staat in onze vergelijking van Haiku, Sonnet, Opus en Fable.
Wat de benchmarks wel en niet zeggen
Anthropic publiceert een tabel waarin Opus 5.5 op de meeste tests boven Fable 5.1 en Opus 5 uitkomt. Drie dingen maken die tabel minder hard dan hij lijkt.
De scores van Opus 5.5 zijn op max effort gemeten. Terminal-Bench 4.0 draaide op xhigh, de rest op max; over de standaardinstelling medium zegt de tabel niets. Alleen de grafieken in de aankondiging geven twee medium-cijfers: 52,5% op CursorBench en 54,6% op FrontierCode.
Een deel van het werk deed een ander model. Anthropic testte met de productie-safeguards aan, en waar die ingrepen, maakte Opus 4.8 de taak af bij cybersecurity en Opus 5 bij biologie en frontier-LLM-ontwikkeling (aankondiging, voetnoot).
Alleen AutomationBench liep zonder die fallback.
De vergelijking is met GPT-5.6 Sol, niet met GPT-6 Sol. Geen van beide leveranciers zet de twee nieuwe modellen van 22 september naast elkaar.
Een selectie uit Anthropics eigen cijfers, allemaal vendor; Opus 5.5 draaide op max, Terminal-Bench op xhigh:
| Benchmark | Opus 5.5 | Fable 5.1 | Opus 5 |
|---|---|---|---|
| Terminal-Bench 4.0 (Opus 5.5 op xhigh) | 66,4% | 55,8% | 52,3% |
| CursorBench 4.0 | 57,8% | 51,8% | 46,6% |
| AutomationBench (zonder fallback) | 40,0% | 31,4% | 26,9% |
| SWE-bench Pro (system card) | 89,9 | 81,2 | 79,2 |
Bronnen: aankondiging en system card van Anthropic; SWE-bench Pro gemiddeld over vijf runs, met Opus 5.5 op max effort; voor de andere modellen verwijst Anthropic naar eerdere system cards. GPT-6 Astra scoort in dezelfde Anthropic-tabel hoger op AutomationBench (41,4%) en Terminal-Bench-Science.
De codekwaliteit volgens Sonar
Sonar liet Opus 5.5 (high) en Opus 5 (thinking) 4.444 Java-taken oplossen en analyseerde de code. Het is geen gelijke effort-vergelijking, dus lees het als richting.
- Opus 5.5 schreef 27,5% minder code en 40% minder outputtokens.
- Het totaal aan bevindingen daalde 42% in absolute aantallen, maar per miljoen regels code maar ongeveer 20%.
- Het aantal bugs daalde absoluut 19%, maar steeg per miljoen regels met 12%.
- Concurrency-bugs, de grootste categorie, stegen per miljoen regels van 205 naar 295.
- Security-blockers daalden per miljoen regels van 19 naar 9.
De cijfers komen van Sonar. De les is eenvoudig: minder code is niet hetzelfde als betere code, en review blijft nodig.
Waarom een benchmarkscore van een leverancier iets anders meet dan jouw werk, en welke onafhankelijke indices je wél kunt naast elkaar leggen, leggen we uit op AI-benchmarks lezen.
Moet je upgraden?
Nee, niet meteen: Opus 5 heeft de status Active en verdwijnt niet vóór 24 juli 2027 (uitfaseringspagina). Die datum geldt voor de Claude API, Claude Platform on AWS en Microsoft Foundry; op Bedrock en Google Cloud bepaalt de cloudleverancier het moment.
Wel loont het om snel te testen. De besparing is structureel, en de migratie is een model-ID-wissel van claude-opus-5 naar claude-opus-5-5, mits je code geen van de vier breaking changes raakt.
Onze migratiechecklist
De vier breaking changes staan in Anthropics migratienotities; wij hebben er twee stille gedragswijzigingen aan toegevoegd. Dit is de volgorde waarin we een bestaande integratie nalopen, van harde fout naar stille regressie.
- Zoek naar geforceerd toolgebruik. Een
tool_choicevananyof een specifieke toolnaam geeft nu een 400invalid_request_error. Vervang het doorautomet een duidelijke instructie in de prompt. - Zoek naar code die thinking uitzet. Adaptive thinking staat altijd aan en is niet meer uit te schakelen. Stuur in plaats daarvan op effort.
- Controleer je model-router. Opus 5.5 leest thinking-blocks van Opus 5 en oudere Opus-, Sonnet- en Haiku-modellen, maar niet van Fable of Mythos. Gaat een gesprek halverwege van Fable 5.1 naar Opus 5.5, dan vallen de thinking-blocks van Fable weg; de omgekeerde route (Opus 5.5 naar Fable 5.1) behoudt ze op de Claude API.
- Controleer computer use. De oude tool
computer_20251124werkt niet meer op de Claude API en Google Cloud. - Pas je parser aan. Korte notities tussen toolcalls komen nu binnen als
thinking-blocks in plaats vantext-blocks. Code die alleentextleest, mist ze. - Zet de effort expliciet. Liet je hem op de standaard staan, dan draai je na de wissel op medium in plaats van high. Test beide op je eigen evaluatieset en kies bewust.
Punt 5 en 6 zijn geen breaking changes in Anthropics telling, maar daar zitten de stille regressies: niets faalt, de output is alleen anders.
Twee redenen om níet over te stappen
Je doet veel security-werk. De meeste cybersecuritytaken gaan in de apps en met server-side fallback automatisch naar Opus 4.8 (aankondiging); routinematig bugs vinden en fixen blijft op Opus 5.5 (uitleg Anthropic). Tester Every schrijft dat dit "complicates the case for making it your default coding model if you do security work regularly" (Every).
Je draait op Bedrock, Google Cloud of Foundry en leunt op fallback. De server-side fallback (fallbacks: "default", beta) werkt daar niet; wordt een verzoek geweigerd, dan krijg je een refusal terug en moet je zelf een ander model aanroepen.
Nog één punt voor wie documenten of mails van derden in een prompt plakt: volgens de system card volgt Opus 5.5 vaker kwaadaardige instructies die in zulke geplakte tekst staan. Houd je bestaande invoerfilters dus aan.
Opus 5.5 of Fable 5.1?
Voor de meeste bedrijven is dat sinds 22 september de echte afweging, niet Opus 5 tegen Opus 5.5.
| Opus 5.5 | Fable 5.1 | |
|---|---|---|
| Input / output | $4 / $20 | $10 / $50 |
| Cache read | $0,20 (0,05x input) | $0,25 (0,025x input) |
| SWE-bench Pro (vendor, Opus 5.5 op max) | 89,9 | 81,2 |
| Latency-klasse volgens Anthropic | moderate | slower |
| Advies Anthropic | startpunt voor de meeste workloads | veeleisend redeneerwerk, lang agentisch werk |
Bronnen: prijspagina, system card en modelpagina van Anthropic.
Per input- en outputtoken is Opus 5.5 60% goedkoper, maar op cache reads is het verschil maar 20%, omdat Fable 5.1 daar de lagere factor heeft. Voor een agent die vooral context terugleest, wordt het prijsverschil dus kleiner dan de prijslijst doet vermoeden.
Onze lijn: zet werk dat nu op Fable 5.1 draait eerst op Opus 5.5 op high, en vergelijk op je eigen taken; haalt Opus 5.5 het, dan betaal je minder per taak.
Wat Fable 5.1 zelf veranderde en voor welke factuur de cachekorting daar werkt, staat in ons artikel over Claude Fable 5.1.
Waar draait Opus 5.5 in de EU?
Niet via de eigen Claude API. De inferentie-instelling kent daar alleen global en us, en US-only kost 1,1 keer het tarief (dataresidentie).
| Route | EU-verwerking | Prijs t.o.v. globaal | Batch | Server-side fallback |
|---|---|---|---|---|
| Claude API (direct) | Nee | gelijk, US-only +10% | Ja | Ja |
| Claude Platform on AWS | Nee | geen EU-route | Ja | niet als uitzondering genoemd |
| Google Cloud | Ja, alleen multi-region eu | +10% | Nee | Nee |
| Amazon Bedrock | Via een EU-inference-profile | +10% | Nee | Nee |
| Microsoft Foundry | Nee, Global of US Data Zone | gelijk, US +10% | Nee | Nee |
Bronnen: Anthropics platformdocumentatie voor Google Cloud, Bedrock, Microsoft Foundry en Claude Platform on AWS, peildatum 22 september 2026.
Uit die tabel volgt een harde regel: batchkorting en EU-verwerking sluiten elkaar uit. De twee platforms met batch hebben geen EU-optie, en de platforms met een EU-route ondersteunen geen batch.
Eerste kanttekening bij de EU-routes: of Opus 5.5 op dag één al op het Bedrock-EU-profiel en het eu-endpoint van Google Cloud staat, is bij de release niet bevestigd.
Tweede kanttekening: op Bedrock staat Opus 5.5 niet in de lijst van modellen die voor alle klanten open zijn; controleer Model access in de AWS-console voordat je het vastlegt.
Opus 5.5 is net als eerdere Opus-modellen onder zero data retention af te nemen. Fable 5.1 hoort daarentegen bij de modellen die een bewaartermijn van 30 dagen vereisen.
De afweging per cloudroute, inclusief verwerkersovereenkomst en toeslagen, staat op AI-modellen in de EU hosten. Welke Claude-versies er naast Opus 5.5 nog draaien en tot wanneer, zie je op onze pagina met alle Claude-versies.
En GPT-6 Sol?
OpenAI koos dezelfde dag de andere kant: GPT-6 Sol kost $2 / $10 per miljoen tokens, per input- en outputtoken de helft van Opus 5.5, en Astra blijft het topmodel. Op de index van Artificial Analysis scoort Sol op max 48, Opus 5.5 op max 58.
Wat Sol en Luna met je OpenAI-factuur doen, staat in ons artikel over GPT-6 Sol; de keuze tussen beide staat in Claude vs ChatGPT zakelijk.
Wat wij ermee doen
Claude-first is bij ons de huisstandaard, en Opus 5 was tot 22 september het eerste model dat we testten bij ontwikkelwerk en agents. Opus 5.5 neemt die plek over, op medium, met high als eerste stap omhoog.
Draait jouw bedrijf al op Opus 5 of Fable 5.1, dan is de overstap beperkt testwerk als de checklist hierboven schoon is. Bij AI-software op maat bouwen we het model-ID en de effort als configuratie in, zodat zo'n wissel geen herbouw is.
Twijfel je welke stand en welke route bij jouw verbruik past? Stuur ons je usage-export van de afgelopen maand via contact of bel 085 016 0118, dan leggen we die naast de vier scenario’s hierboven.
Opgesteld met AI-ondersteuning, geredigeerd en inhoudelijk verantwoord door Bram Dokman.










