Kort antwoord
Sonnet 5.5, het Claude-model dat Anthropic op 28 september 2026 uitbracht, kost per token precies hetzelfde als Sonnet 5 en als GPT-6.1 Sol: $2 input en $10 output per miljoen tokens. Het verschil zit in het verbruik per taak: op medium is Sonnet 5.5 zuinig en snel, op max kost een taak volgens Artificial Analysis meer dan bij Opus 5.5. Op diezelfde index haalt GPT-6.1 Sol een vergelijkbare score voor ruwweg een kwart van de kosten per taak, terwijl Sonnet 5.5 bij Vals AI bovenaan de index en twee codeertests staat. Overstappen van Sonnet 5 loont na een eigen test, maar door vijf breaking changes is het geen pure ID-wissel.
Van lezen naar doen.
Anthropic schrijft dat Sonnet 5.5 "up to 30% less" per taak kost dan Sonnet 5. Artificial Analysis mat op max effort het omgekeerde: een taak uit hun index kost ongeveer 50% méér dan bij Sonnet 5.
Beide kloppen, en het verschil tussen die twee getallen is de kern van deze pagina.
De tokenprijs veranderde namelijk niet. Wat verandert, is hoeveel tokens het model per taak gebruikt, en dat hangt vooral af van de effort-stand die jij kiest.
Daarom leggen we Sonnet 5.5 stand voor stand naast GPT-6.1 Sol, dat OpenAI op 29 september voor exact dezelfde tokenprijs lanceerde. Andere middenmodellen, van Gemini tot Mistral, vind je terug in het overzicht AI-modellen vergelijken.
Wat is Claude Sonnet 5.5?
Claude Sonnet 5.5 is het tweede model van de Claude 5.5-familie, na Opus 5.5 van 22 september, en de opvolger van Sonnet 5. Anthropic noemt het in de aankondiging "a faster, lower-cost complement to Claude Opus 5.5", het sterkst in "well-scoped everyday tasks".
| Kenmerk | Claude Sonnet 5.5 |
|---|---|
| Uitgebracht | 28 september 2026 |
| Model-ID | claude-sonnet-5-5 (Bedrock: global.anthropic.claude-sonnet-5-5) |
| Input / output per miljoen tokens | $2 / $10 |
| Cache read per miljoen tokens | $0,20 |
| Batch API (input / output) | $1 / $5 |
| Contextvenster | 1.000.000 tokens |
| Maximale output | 128.000 tokens (300.000 via Batch met beta-header) |
| Kennis-cutoff | juni 2026 |
| Effort-standen | low, medium, high, xhigh, max |
| Standaard-effort op de API | high |
| Latency-klasse volgens Anthropic | fast |
| Uitfasering niet vóór | 28 september 2027 |
Bronnen: modelpagina Sonnet 5.5, prijspagina en uitfaseringspagina van Anthropic, peildatum 29 september 2026. Alle bedragen in dollars, exclusief btw.
Het model neemt tekst en beeld als invoer en geeft tekst terug. De tokenizer is dezelfde als die van Sonnet 5: dezelfde tekst levert hetzelfde aantal tokens op.
Let op één ding dat Anthropic zelf níet zegt: dat Sonnet 5.5 het nieuwe startmodel is. Het modeloverzicht adviseert bij twijfel nog steeds te beginnen met Opus 5.5.
Wat is er nieuw ten opzichte van Sonnet 5?
Op de prijslijst niets: Sonnet 5 kostte al $2 / $10, en de verhoging naar $3 / $15 die voor 1 september gepland stond, gaat volgens de prijspagina niet door. Cache, batch en de volledige 1M-context zonder toeslag zijn ook gelijk.
De verschillen zitten in gedrag en integratie:
| Sonnet 5 | Sonnet 5.5 | |
|---|---|---|
| Tokenprijs | $2 / $10 | $2 / $10 |
| Kleinste cachebare prompt | 1.024 tokens | 512 tokens |
| Thinking uitzetten | kan (disabled) |
geeft een 400; laagste stand is between_tools |
| Geforceerd toolgebruik | kan | geeft een 400 |
| Effort per bericht, systeemberichten halverwege | nee | ja (beta) |
| Effort-kalibratie | oud | opnieuw gekalibreerd: zelfde stand, ander denkwerk |
| AA Intelligence Index (max) | 38 | 56 |
Bronnen: migratienotities en effort-documentatie van Anthropic; indexscore van Artificial Analysis (+18 punten, 28 september 2026).
De lagere cachedrempel is een stille winst voor wie korte systeemprompts gebruikt. Prompts tussen 512 en 1.024 tokens konden bij Sonnet 5 niet in de cache; nu wel, voor $0,20 per miljoen gelezen tokens in plaats van $2.
De nieuwe stand between_tools zet het vooraf nadenken uit en laat het model alleen tussen toolcalls denken. Die stand werkt op low, medium en high, niet op xhigh en max.
Snelheid en kosten per taak noemt Anthropic "30%+ faster" en "up to 30% less for most work". Beide zijn claims van de leverancier; hoe ver die "tot" reikt, zie je in de tabel hieronder.
Anthropics eigen benchmarktabel uit de system card, op max effort en gemiddeld over vijf runs:
| Benchmark (vendor) | Sonnet 5.5 | Sonnet 5 | Opus 5.5 |
|---|---|---|---|
| SWE-Bench Pro | 81,3 | 63,2 | 89,9 |
| OSWorld 2.1 (computergebruik) | 80,1 | 57,0 | 81,8 |
| Humanity's Last Exam, met tools | 64,5 | 54,9 | 67,7 |
| AutomationBench | 44,7 | 10,7 | 42,5 |
De sprong ten opzichte van Sonnet 5 is groot, maar dit zijn metingen van de leverancier. Waarom je die anders leest dan een onafhankelijke index, leggen we uit op AI-benchmarks lezen.
Onze middenklasse-tabel: Sonnet 5.5, GPT-6.1 Sol en Gemini
Sonnet 5.5 en GPT-6.1 Sol kosten per input- en outputtoken hetzelfde. Gemini 3.1 Pro Preview zit er vlak naast; Gemini 3.8 Flash staat erbij als goedkoper referentiepunt.
| Per miljoen tokens | Sonnet 5.5 | GPT-6.1 Sol | Gemini 3.1 Pro Preview | Gemini 3.8 Flash |
|---|---|---|---|---|
| Input / output | $2 / $10 | $2 / $10 | $2 / $12 | $0,75 / $3,75 |
| Cached input | $0,20 | $0,10 | $0,20 | $0,075 |
| Toeslag lange context | geen | boven 272K: 2x input, 1,5x output | boven 200K: $4 / $18 | geen; tijdelijk tarief t/m 31-12-2026, daarna $1,50 / $7,50 |
| Contextvenster | 1.000.000 | 1.050.000 | niet vergeleken | niet vergeleken |
| Maximale output | 128.000 | 128.000 | niet vergeleken | niet vergeleken |
| Kennis-cutoff | juni 2026 | 30 april 2026 | niet vergeleken | niet vergeleken |
| Batch | 50% korting | 50% korting | niet vergeleken | niet vergeleken |
Bronnen: prijspagina's van Anthropic, OpenAI en Google, alle drie gelezen op 29 september 2026. Waar "niet vergeleken" staat, hebben we de waarde niet zelf gecontroleerd.
Per token is het verschil tussen Sonnet 5.5 en GPT-6.1 Sol dus alleen de cache: Sol rekent voor gecachte input de helft. En boven 272.000 inputtokens rekent Sol een toeslag, Sonnet niet.
Per effort-stand: score en kosten per taak
Dit is de tabel die de tokenprijs níet laat zien. Artificial Analysis mat beide modellen per stand op dezelfde Intelligence Index, op dezelfde dag.
| Effort | Sonnet 5.5: score | Sonnet 5.5: kosten per taak | GPT-6.1 Sol: score | GPT-6.1 Sol: kosten per taak |
|---|---|---|---|---|
| low | 36 | $0,41 | 42 | $0,13 |
| medium | 41 | $0,59 | 48 | $0,21 |
| high | 47 | $1,08 | 50 | $0,32 |
| xhigh | 52 | $2,74 | 51 | $0,39 |
| max | 56 | $7,60 | 52 | $0,72 |
Bron: leaderboard en modelpagina's van Artificial Analysis (Sonnet 5.5, Sonnet 5.5 medium, GPT-6.1 Sol), stand 29 september 2026. Een momentopname; de ranglijst verschuift met elk nieuw model.
Drie dingen vallen op, en de rekensommen zijn van ons:
- Bij een gelijke score is Sol veel goedkoper. Beide halen 52: Sonnet 5.5 op xhigh voor $2,74, Sol op max voor $0,72, ongeveer een kwart.
- Sonnet 5.5 haalt het hoogste plafond. Op max scoort het 56, vier punten boven Sol op max en twee onder Opus 5.5 op max.
- Max is voor Sonnet 5.5 een dure stand. Een taak kost daar $7,60, meer dan bij Opus 5.5 op max ($5,98), en Opus 5.5 op xhigh haalt dezelfde 56 voor $3,46.
Dat laatste komt door het tokengebruik. Op max schreef Sonnet 5.5 gemiddeld zo'n 193.000 outputtokens per indextaak, volgens Artificial Analysis ongeveer 60% meer dan Opus 5.5 op max.
Op medium is het omgekeerd: 29 miljoen outputtokens voor de hele index, "very concise" tegen een mediaan van 82 miljoen (Artificial Analysis, medium). Dat past bij Anthropics "tot 30% goedkoper", dat volgens Anthropic geldt voor "most work", zonder genoemde effort-stand.
Snelheid: wie antwoordt eerst?
Voor een chatvenster of een klantgesprek telt de wachttijd tot het eerste token meer dan de score. Ook die hangt aan de stand.
| Stand (meting 29-09) | Tokens per seconde | Eerste token na |
|---|---|---|
| Sonnet 5.5 medium | 89,3 | 1,34 s |
| GPT-6.1 Sol medium | 62 | 5,29 s |
| Sonnet 5.5 max | 137,6 | 374,77 s |
| GPT-6.1 Sol max | 66,8 | 267,64 s |
Bron: modelpagina's en leaderboard van Artificial Analysis, gemeten via de eigen API van Anthropic en OpenAI, momentopname 29 september 2026. De tijd tot het eerste token is inclusief denkwerk.
Op medium antwoordt Sonnet 5.5 dus snel: de mediaan van zijn klasse ligt volgens Artificial Analysis op 3,98 seconden. Op max wacht je minuten voordat er iets verschijnt.
Is Sonnet 5.5 beter dan GPT-6.1 Sol?
Dat hangt af van wat je meet, en de bronnen spreken elkaar hier deels tegen.
Op de algemene index van Artificial Analysis wint Sol op prijs per punt, zoals de tabel hierboven laat zien. Alleen boven 52 punten is Sonnet 5.5 de enige van de twee die er komt.
Op de Vals Index (versie 2.1, 29 september) staat Sonnet 5.5 op 1 met 67,04%, praktisch gelijk met Opus 5.5 (66,97%, binnen de foutmarge). GPT-6.1 Sol stond op die dag nog niet in de top 15; GPT-6 Sol op 9 met 57,54%.
Op codeertests van Vals AI staat Sonnet 5.5 bovenaan Vibe Code Bench (92,39%) en Code Migration (69,83%). Een vergelijkbare score voor GPT-6.1 Sol was er bij publicatie nog niet.
In een praktijktest van paddo.dev op één monorepo, 20 runs per model op medium, brak Sonnet 5.5 geen enkele bestaande test; GPT-6 Sol brak er vijf. Sonnet kostte daar $11,76, Sol $13,16.
Let op: dat was GPT-6 Sol, niet 6.1, en de auteur noemt zelf de beperkingen van één codebase.
Waarom Terminal-Bench 4.0 hier ontbreekt: Anthropic meet 70,6%, Artificial Analysis 64%, Vals AI 64,14%, met elk een eigen testopzet. Die getallen horen niet in één tabel.
Ons routeringsadvies voor de middenklasse
Dit is advies op basis van de bronnen hierboven, geen eigen benchmark. Test het op je eigen taken voordat je het vastlegt.
| Werk | Onze eerste keuze | Waarom |
|---|---|---|
| Codewijzigingen in een bestaande codebase met goede tests | Sonnet 5.5 op medium | Voorop bij Vals-codeertests, geen gebroken tests bij paddo.dev |
| Chat en klantgesprekken waar wachttijd telt | GPT-6.1 Sol op low of Sonnet 5.5 op medium | Sol low: 42 punten voor $0,13, eerste token na 1,84 s; Sonnet medium: 1,34 s |
| Tekstwerk in bulk: samenvatten, classificeren, extraheren | GPT-6.1 Sol op medium | Score 48 voor $0,21 per taak |
| Agents die veel context herlezen | GPT-6.1 Sol, mits onder 272K | Gecachte input kost de helft |
| Dossiers boven 272.000 tokens | Sonnet 5.5 | Geen lange-contexttoeslag |
| Onbewaakte agentruns, dunne tests | Opus 5.5 | Advies van paddo.dev; Anthropic noemt Sonnet "broadly less capable" |
Voor nog goedkoper volumewerk bestaan GPT-6 Luna ($0,10 / $0,50) en Gemini 3.8 Flash. De merkvraag, abonnementen en privacy staan in Claude vs ChatGPT zakelijk; de volledige OpenAI-ladder in welk OpenAI-model kiezen.
Vier factuurscenario's: Sonnet 5.5 naast GPT-6.1 Sol
Dit is onze eigen tabel, gerekend met de lijstprijzen van 29 september 2026. Bedragen in dollars per maand, exclusief btw; we rekenen bewust niet om naar euro.
| Scenario | Maandverbruik | Sonnet 5.5 | GPT-6.1 Sol |
|---|---|---|---|
| 1. Gelijke tokens, geen cache | 10M input, 2M output | $40 | $40 |
| 2. Cache-zware agent | 50M cache read, 5M input, 2M output, 2M cache write | $45 | $40 |
| 3. Honderd lange dossiers | 100 × 400K input, 100 × 4K output | $84 | $166 |
| 4. Eén indextaak, zelfde score (52) | meting Artificial Analysis | $2,74 (xhigh) | $0,72 (max) |
Scenario 1 is identiek, omdat de tokenprijs dat is. Ook tegenover Sonnet 5 verandert hier niets: $40 blijft $40.
Scenario 2 kantelt naar Sol door de cache: 50 miljoen gelezen tokens kosten bij Sonnet $10 en bij Sol $5. Voor Sonnet rekenen we de cache write op het 5-minutentarief van $2,50; Sol rekent ook $2,50.
Scenario 3 kantelt de andere kant op. Wij rekenen met de toeslag over het hele verzoek, zoals OpenAI die bij GPT-6 Sol documenteerde; of dat bij 6.1 precies zo werkt, controleer je in je eigen factuur.
Houd je dossiers onder 272K, dan vervalt het verschil.
Scenario 4 laat zien dat de effort-stand zwaarder weegt dan de prijslijst. Bij gelijke score is het verschil per taak bijna vier keer.
De volledige Claude-tarieflijst per model, inclusief cache writes en batch, staat op wat de Claude API kost. Rekenen met je eigen tokens doe je met onze uitleg over API-kosten berekenen.
Welke effort-stand kies je voor Sonnet 5.5?
Anthropic adviseert in de effort-documentatie te beginnen op high, de standaard op de API. Voor agentisch coderen en goed afgebakende taken noemt het medium, voor chat low of medium, en xhigh of max alleen als je eigen evaluaties winst tonen.
Onze vuistregel wijkt daar een stap vanaf: begin op medium, niet op high. Uit de tabel van Artificial Analysis volgt dat high per taak bijna twee keer zo duur is ($1,08 tegen $0,59), voor zes punten meer.
Twee waarschuwingen:
- Gebruik max niet als standaard. Simon Willison zag Sonnet 5.5 op max vastlopen op de outputlimiet van 128.000 tokens zonder resultaat, voor $1,28; op xhigh kreeg hij in 41 seconden een werkend resultaat voor $0,0574 (Willison).
- Draai je sweep opnieuw. Anthropic heeft de standen opnieuw gekalibreerd; medium op Sonnet 5.5 denkt niet evenveel als medium op Sonnet 5.
Sonnet 5.5 voor software bouwen
Sinds versie 2.1.284 van 28 september is claude-sonnet-5-5 het standaard-Sonnet-model in Claude Code op de Anthropic API (changelog). Wie Claude Code op Sonnet gebruikt, draait dus al op het nieuwe model.
In GitHub Copilot is Sonnet 5.5 algemeen beschikbaar voor Pro, Pro+, Max, Business en Enterprise, in onder meer VS Code, JetBrains en de Copilot CLI (GitHub). GitHub rekent het af tegen de lijstprijs van de leverancier, dus niet als gratis extra.
Volgens GitHubs eigen test haalde Sonnet 5.5 het niveau van Sonnet 5 met "significantly fewer steps, tokens, and tool calls". Dat is een meting van een partner, geen onafhankelijk onderzoek.
Wat Claude Code per ontwikkelaar kost, staat op Claude Code kosten. Claude Code tegen Cursor, Copilot en Codex vergelijken we op AI-codetools vergelijken.
Wat dit betekent voor software op maat
Voor een MKB-bedrijf is dit de praktische kant van zo'n release. Maatwerk software die eindelijk doet wat je bedrijf wil, zonder maanden vertraging, komt dichterbij als een goed codeermodel op medium snel en goedkoop antwoordt.
Eerlijk is wel: het model schrijft code, maar bepaalt niet wat je bouwt. Het ontwerp van je proces, de tests die regressies vangen en het oordeel van een ontwikkelaar blijven nodig.
Ook paddo.dev adviseert Sonnet 5.5 op medium juist daar waar tests en review sterk zijn, en Opus 5.5 waar ze dun zijn.
Hoe wij dat combineren, zie je bij maatwerk software. Wat zo'n traject kost, staat op wat maatwerk software kost.
Sonnet 5.5 of Opus 5.5?
Per input- en outputtoken kost Sonnet 5.5 de helft van Opus 5.5 ($2 / $10 tegen $4 / $20). Op cache reads is de prijs gelijk: $0,20 bij allebei.
| Sonnet 5.5 | Opus 5.5 | |
|---|---|---|
| Input / output | $2 / $10 | $4 / $20 |
| Standaard-effort | high | medium |
| Latency-klasse (Anthropic) | fast | moderate |
| AA-kosten per taak op max | $7,60 | $5,98 |
| Rol volgens Anthropic | afgebakend dagelijks werk | complex werk met zorgvuldig oordeel |
| EU-profiel op Bedrock | nee | ja |
Bronnen: prijspagina en modeloverzicht van Anthropic, Bedrock-modelkaart van AWS, Artificial Analysis; peildatum 29 september 2026.
Onze lijn: Sonnet 5.5 op medium voor afgebakende taken, Opus 5.5 zodra je Sonnet hoger dan high zou zetten. Op die hoogte is Opus per taak de goedkopere route: Opus 5.5 op high haalt bij Artificial Analysis 54 punten voor $1,82, Sonnet 5.5 op xhigh 52 voor $2,74.
De volledige trap van Haiku tot Fable staat op Claude Haiku, Sonnet, Opus of Fable, het Opus-model zelf op Claude Opus 5.5.
Zit Sonnet 5.5 in je abonnement?
Volgens Anthropics productpagina kan iedereen op Claude.ai met Sonnet 5.5 chatten, op web, iOS en Android. Welk model per abonnement standaard is, heeft Anthropic in de releasenotes niet vastgelegd; berichten daarover spreken elkaar tegen.
GPT-6.1 Sol zit in ChatGPT Plus, Pro, Business, Enterprise en Edu, maar alleen in Work en Codex, niet in de gewone chat en niet in Free of Go (OpenAI). Bij Enterprise en Edu staat het standaard uit tot de beheerder het aanzet.
Wat de Claude-abonnementen kosten en welke limieten erbij horen, staat op wat Claude kost.
Moet je overstappen van Sonnet 5?
Niet haastig: Sonnet 5 heeft de status Active en verdwijnt niet vóór 30 juni 2027 (uitfaseringspagina). Wel loont het om nu te testen, want bij dezelfde tokenprijs krijg je een model dat op medium sneller en zuiniger is.
De migratie begint met een wissel van claude-sonnet-5 naar claude-sonnet-5-5, maar stopt daar niet.
Checklist: van Sonnet 5 naar Sonnet 5.5
Anthropic noemt vijf breaking changes en één wijziging in de responsvorm (migratienotities). Dit is de volgorde waarin wij een bestaande integratie nalopen, van harde fout naar stille regressie.
- Zoek naar code die thinking uitzet.
thinking: {"type": "disabled"}en handmatigebudget_tokensgeven een 400. Gebruikbetween_tools, op high of lager. - Zoek naar geforceerd toolgebruik. Een
tool_choicevananyof een specifieke tool geeft een 400. Het alternatief isautometstrict: trueof structured outputs. - Controleer je sampling-parameters. Een niet-standaardwaarde voor
temperature,top_poftop_kgeeft volgens de modelpagina een 400. - Controleer je model-router. Thinking-blokken zijn gebonden aan model, gesprek en account. Sonnet 5.5 leest geen blokken van Opus 5 of 5.5, Fable of Mythos, en geen ander model leest die van Sonnet 5.5. Houd gesprekken append-only.
- Controleer computer use. Op de Claude API en Google Cloud werkt alleen nog
computer_toolset_20260801; de oudecomputer_20251124wordt geweigerd. - Controleer de advisor tool (beta). Die weigert Sonnet 5, Opus 4.8 en Opus 4.7 als adviseur.
- Test je streaming-interface. Tekst tussen toolcalls komt terug als
thinking-blok. Met de standaarddisplay: "omitted"is die leeg, en een scherm dat die tussentekst toont, valt stil zonder foutmelding. - Draai de effort-sweep opnieuw en zet de stand expliciet in je configuratie.
Punt 7 en 8 geven geen foutmelding. Daar zitten de regressies die je pas in productie merkt.
Draai je op Bedrock, let dan ook op: structured outputs en Count tokens ontbreken daar op bedrock-runtime, en Batch wordt niet ondersteund (Bedrock-modelkaart). Het alternatief uit punt 2 test je daar dus apart.
Waar draait Sonnet 5.5 in de EU?
Hier wijkt Sonnet 5.5 af van Opus 5.5, en niet in het voordeel van Sonnet.
| Route | EU-verwerking (29 september 2026) | Prijs t.o.v. globaal |
|---|---|---|
| Claude API (direct) | Nee: alleen global of us |
gelijk; US-only +10% |
| Amazon Bedrock | Nee: alleen een Global-profiel, geen EU-profiel | gelijk op Global |
| Google Cloud | Multi-region eu staat in Googles voorbeeldcode; de officiële docpagina bevestigde het niet |
+10% |
| GPT-6.1 Sol via OpenAI | EU-dataresidentie beschikbaar volgens de modelpagina | voorwaarden voor 6.1 niet bevestigd |
Bronnen: Anthropic over dataresidentie en Google Cloud, de Bedrock-modelkaart van AWS, Googles vertex-ai-samples en OpenAI's modelpagina.
Het Bedrock-profiel global.anthropic.claude-sonnet-5-5 kun je vanuit Frankfurt of Ierland aanroepen, maar het routeert wereldwijd zonder residentie-eisen. Dat is iets anders dan EU-verwerking.
Moet je data aantoonbaar in de EU blijven, dan is Opus 5.5 via het EU-profiel op Bedrock vandaag de zekerdere Claude-route. Of controleer in je Google Cloud-console of Sonnet 5.5 op eu voor jouw project openstaat.
De afweging per cloudroute, inclusief verwerkersovereenkomst en toeslagen, staat op AI-modellen in de EU hosten. Welke Claude-versies er naast Sonnet 5.5 nog draaien, zie je op alle Claude-versies.
Hoe wij Sonnet 5.5 inzetten
Claude-first is bij ons de huisstandaard. Sonnet 5.5 op medium wordt ons eerste model voor afgebakende taken in integraties en in Claude Code, met Opus 5.5 voor review en voor werk dat zonder toezicht draait.
GPT-6.1 Sol testen we mee waar het om tekstwerk in bulk gaat, omdat de kosten per taak daar zo ver uiteenlopen. Bij AI-software op maat leggen we model-ID en effort vast als configuratie, zodat een wissel tussen die twee geen herbouw is.
Draai je nu op Sonnet 5 of op GPT-6 Sol en wil je weten wat de wissel per maand doet? Neem contact op of bel 085 016 0118; met je tokenverbruik per model rekenen we beide middenmodellen voor je door.
Opgesteld met AI-ondersteuning, geredigeerd en inhoudelijk verantwoord door Bram Dokman.










