Kort antwoord
Zet classificatie en extractie op GPT-5.6 Luna ($0,20 / $1,20 per miljoen tokens), dagelijks tekst- en codewerk op GPT-5.6 Terra ($2 / $12) en redeneerwerk, lange dossiers en agents op GPT-5.6 Sol ($4 / $20, promotieprijs tot minstens 21 november 2026). GPT-6 Astra ($10 / $50) kies je pas als Sol in je eigen evaluatie aantoonbaar tekortschiet, meestal bij meerstaps agents en werk over hele codebases. Draai eerst aan de reasoning-effort-knop voordat je een trede hoger gaat; dat scheelt vaker dan een modelwissel.
Van lezen naar doen.
Van de zeven tekstmodellen die OpenAI op 18 september 2026 op zijn prijzenpagina zet, kost het duurste vijftig keer zoveel per inputtoken als het goedkoopste: GPT-6 Astra $10, GPT-5.6 Luna $0,20 per miljoen (OpenAI, prijzen). Op de snelheidsas geeft OpenAI alle zeven hetzelfde label: "Fast".
Wie dus op snelheid of prijs alleen kiest, kiest verkeerd. De vraag "welk GPT-model" beantwoord je per soort werk: hoeveel redeneren de taak vraagt, hoeveel context erin moet en waar het model moet draaien.
Deze pagina zet die keuze in één tabel en één ladder, met een rekenvoorbeeld per 1.000 taken. De versiegeschiedenis met releasedatums en uitfaseringen staat op de aparte versiepagina van de OpenAI-modellen; de volledige tarieventabel inclusief tools en beeld op de kostenpagina van de OpenAI API.
Zeven modellen in één tabel: taak, prijs, snelheid, context en waar het draait
Elke cel hieronder komt van de prijzenpagina en de modelpagina's van OpenAI, het Help Center-stuk over de 5.6-lijn en GPT-6 Pro en de Foundry-modellenpagina van Microsoft, alle opgehaald op 18 september 2026. De kolom "snelheid" en "redeneren" zijn letterlijk de labels die OpenAI op de modelpagina zet; wij meten geen milliseconden.
| Model (API-id) | Waar wij het voor inzetten | Prijs in / uit per 1M tokens | Cached input | Snelheid en redeneren (label OpenAI) | Context en max. output | Waar het draait |
|---|---|---|---|---|---|---|
| GPT-6 Astra (gpt-6-astra) | Meerstaps agents, werk over hele codebases, onderzoek met rapport | $10 / $50 | $1,00 | Fast; Highest | 1.050.000 / 128.000 | API; in ChatGPT als GPT-6 Pro op de plannen Pro, Business en Enterprise; Plus alleen in Work en Codex; Azure Foundry |
| GPT-5.6 Sol (gpt-5.6-sol, ook via de alias gpt-5.6) | Redeneerwerk, lange dossiers, agents met toolgebruik | $4 / $20 (promotie tot minstens 21 november 2026) | $0,40 | Fast; Highest | 1.050.000 / 128.000 | API; ChatGPT Instant t/m Extra High op betaalde plannen; Work; Codex; Azure Foundry |
| GPT-5.6 Terra (gpt-5.6-terra) | Dagelijks tekst- en codewerk, chat op eigen kennisbank | $2 / $12 | $0,20 | Fast; Higher | 1.050.000 / 128.000 | API; Work en Codex (niet in de gewone chat); Azure Foundry |
| GPT-5.6 Luna (gpt-5.6-luna) | Classificatie, extractie, routering, hoog volume | $0,20 / $1,20 | $0,02 | Fast; High | 1.050.000 / 128.000 | API; standaardmodel op Free en Go; Work en Codex; Azure Foundry |
| GPT-5.5 (gpt-5.5) | Vorige vlaggenschip; alleen als je er al op draait | $5 / $30 | $0,50 | Fast; Highest | 1.050.000 / 128.000 | API; Azure Foundry |
| GPT-5.4 mini (gpt-5.4-mini) | Subagents en computer use met kleiner venster | $0,75 / $4,50 | $0,075 | Fast; Higher | 400.000 / 128.000 | API; Azure Foundry |
| GPT-5.4 nano (gpt-5.4-nano) | Classificatie en extractie in batch, ranking | $0,20 / $1,25 | $0,02 | Fast; High | 400.000 / 128.000 | API; Azure Foundry |
Bronnen per rij: de modelpagina's van GPT-6 Astra, GPT-5.6 Sol, Terra, Luna, GPT-5.5, GPT-5.4 mini en GPT-5.4 nano; de ChatGPT-kolom uit het Help Center; de Azure-kolom uit de Foundry-modellenpagina. De kolom "waar wij het voor inzetten" is onze eigen indeling.
Twee dingen vallen op. Alle drie de GPT-5.6-modellen en Astra delen hetzelfde contextvenster van 1.050.000 tokens, dus context is geen reden meer om een trede omhoog te gaan; en de 5.4-modellen mini en nano zijn de enige met een kleiner venster van 400.000.
Wat de namen betekenen: Astra, Sol, Terra, Luna en de erfenis van mini en nano
Tot en met GPT-5.5 kende OpenAI drie maten per generatie: het kale model, mini en nano. Sinds GPT-5.6 heten die maten Sol, Terra en Luna, en OpenAI schrijft dat zelf op de modelpagina's: Sol "corresponds to the unsuffixed model tier", Terra "to the mini model tier", Luna "to the nano model tier" (OpenAI, modelpagina Sol).
Zoek je dus "GPT-6 mini" of "GPT-6 nano", dan zoek je iets dat op 18 september 2026 niet bestaat. GPT-6 Astra is één model bovenop de GPT-5.6-lijn, dat OpenAI "our most capable model" noemt en positioneert voor "the hardest end-to-end work" (OpenAI, modelpagina Astra).
GPT-5.4 mini en GPT-5.4 nano staan nog gewoon in de catalogus, met een kleiner venster en een oudere kennisdatum (31 augustus 2025 tegenover 16 februari 2026 voor de 5.6-lijn). Voor nieuw werk is er geen reden om ze boven Luna of Terra te kiezen; voor bestaand werk is er evenmin een reden om te migreren zolang ze niet worden uitgefaseerd.
Wie dezelfde vraag voor Google stelt, vindt het antwoord op welke Gemini-versies er in 2026 zijn; de vergelijking over leveranciers heen staat op welk AI-model het beste bij je bedrijf past.
De beslisladder: vier treden, van Luna tot Astra
Onze ladder heeft vier treden en één regel: begin op de laagste trede die het werk aankan, en ga pas omhoog als je eigen evaluatie dat vraagt. Niet omdat een hoger model "beter" is, maar omdat elke trede de prijs per taak ruwweg verdubbelt tot vervijfvoudigt.
| Trede | Model | Werk dat hier hoort | Ga een trede hoger als |
|---|---|---|---|
| 1 | GPT-5.6 Luna (in batch ook GPT-5.4 nano) | Mails classificeren, velden uit facturen halen, berichten routeren, deduplicatie, sentiment | het antwoord een oordeel vraagt (klacht of vraag?) of Luna in je evaluatie onder de foutmarge zakt |
| 2 | GPT-5.6 Terra | Offerte- en mailteksten uit een briefing, chat op eigen kennisbank, samenvatting van korte stukken, gewone code | de tekst juridisch of technisch zwaar wordt, of de taak meer dan twee toolaanroepen achter elkaar vraagt |
| 3 | GPT-5.6 Sol | Contracten en dossiers, code review, agents die zelfstandig een taak met tools afronden, analyses met redenering | Sol bij effort "xhigh" of "max" nog steeds fouten maakt die je handmatig moet herstellen |
| 4 | GPT-6 Astra | Meerstaps agents over uren, refactoring over een codebase, onderzoek dat tot een compleet rapport moet leiden | n.v.t.; dit is de bovenste trede |
De ladder is onze eigen indeling, gebaseerd op de inzetgebieden die OpenAI per model noemt: Luna "cost-sensitive, high-volume workloads", Terra "balances intelligence and cost", Sol "complex professional work", Astra "complex reasoning, coding, computer use, research, and document creation" (OpenAI, modelpagina's).
Voor GPT-5.4 nano noemt OpenAI letterlijk "classification, data extraction, ranking, and sub-agents" (OpenAI, modelpagina nano). Dat is precies trede 1, en Luna doet hetzelfde werk met een groter venster voor bijna dezelfde prijs.
Het praktische verschil met de Claude-familie: bij Anthropic zit tussen "goedkoop" en "top" één middenmodel, bij OpenAI zitten er twee (Terra en Sol). Wie de Claude-modeltrap van Haiku tot Fable kent, herkent de logica; alleen de middentrede is hier gesplitst.
Reasoning effort: de knop die je omzet vóór de modelwissel
Elk GPT-5.6-model en Astra heeft een parameter reasoning.effort, en die verandert meer aan kwaliteit en prijs dan veel mensen denken. Sol, Terra en Luna kennen none, low, medium (standaard), high, xhigh en max; Astra kent low tot en met max, zonder none (OpenAI, modelpagina Astra).
Een hogere effort laat het model meer redeneertokens schrijven, en die tokens betaal je als output. Terra op "high" is daardoor vaak dichter bij Sol op "medium" dan de prijslijst suggereert, en Sol op "max" kan duurder uitvallen dan Astra op "low".
Onze werkwijze: evalueer eerst op de laagste trede met effort "medium", dan met "high", en pas als dat tekortschiet één trede omhoog op "medium". Zo weet je of het probleem in het model zat of in de denktijd.
In ChatGPT heet diezelfde knop de Thinking-schuif: Instant, Medium, High en Extra High draaien alle vier op Sol, en Pro is een aparte laag met Sol Pro en GPT-6 Pro (OpenAI Help Center, 2026). Op Plus en Pro schakelt Instant niet vanzelf omhoog bij een moeilijke vraag; dat moet je zelf doen.
Rekenvoorbeeld: wat elke trede per 1.000 taken kost
Rekenvoorbeeld, geen meting: de standaardtarieven van 18 september 2026, zonder batch, met caching alleen waar het erbij staat. De tokenaantallen per taak zijn afgeronde aannames, de euro's zijn omgerekend met de ECB-dagkoers van 18 september 2026 ($1,1460 per euro, ECB) en exclusief btw.
| Taak (per 1.000 stuks) | Tokens per taak (in / uit) | Luna | Terra | Sol | Astra |
|---|---|---|---|---|---|
| Mail classificeren en routeren | 800 / 40 | $0,21 (circa €0,18) | $2,08 (circa €1,81) | $4,00 (circa €3,49) | $10,00 (circa €8,73) |
| Offertetekst uit een briefing | 3.000 / 1.200 | $2,04 (circa €1,78) | $20,40 (circa €17,80) | $36,00 (circa €31,41) | $90,00 (circa €78,53) |
| Contract samenvatten | 40.000 / 1.500 | – | $98,00 (circa €85,51) | $190,00 (circa €165,79) | $475,00 (circa €414,49) |
| Agent-run met tools, 5 beurten | 10.000 vers + 20.000 cached / 4.000 | – | $72,00 (circa €62,83) | $128,00 (circa €111,69) | $320,00 (circa €279,23) |
| Code review op een pull request | 25.000 / 2.000 | – | $74,00 (circa €64,57) | $140,00 (circa €122,16) | $350,00 (circa €305,41) |
Rekenwijze op de contractregel voor Sol: 40.000 × $4 plus 1.500 × $20, gedeeld door een miljoen, is $0,19 per contract; keer 1.000 is $190. Op de agentregel tellen de 20.000 cached tokens tegen het cached-tarief ($0,40 op Sol), de 10.000 verse tokens tegen het volle tarief.
Zet je de ladder toe (mail op Luna, offerte op Terra, contract en code review op Sol, agent op Astra), dan kost dit pakket van 5.000 taken $670,61, circa €585 exclusief btw en circa €708 inclusief. Alles op Astra kost $1.245 (circa €1.086); alles op Terra $266,48 (circa €233).
De les zit in het verschil tussen de laatste twee getallen. Alles-op-Terra is bijna vijf keer goedkoper dan alles-op-Astra, maar als Terra op de agentregel één op de tien runs laat mislukken, kost dat handmatig herstel meer dan het prijsverschil van circa €217 op die regel.
Wil je zelf rekenen met je eigen volumes, dan staat de methode per document en per gesprek op AI-API-kosten berekenen per token. Voor de vraag welk model achter een klantenservice-chatbot hoort, met acht criteria over leveranciers heen, is er een eigen pagina over het chatbotmodel.
Drie prijsschakelaars: lange context, batch en fast mode
Boven 272.000 inputtokens rekent OpenAI over het complete verzoek 2x het inputtarief en 1,5x het outputtarief; Astra kost dan $20 / $75 en Sol $8 / $30 (OpenAI, prijzen). Wie een dossier van 300.000 tokens in één keer instuurt, betaalt dus niet 10% extra maar het dubbele over alles.
Batch en Flex halveren de prijs op alle drie de 5.6-modellen en op Astra: Astra $5 / $25, Sol $2 / $10, Terra $1 / $6, Luna $0,10 / $0,60. Dat maakt trede 3 in batch goedkoper dan trede 2 realtime, wat de ladder omdraait voor alles wat een nacht kan wachten.
Fast mode, tot 30 juli 2026 "priority processing" geheten, verdubbelt de prijs: Astra $20 / $100, Sol $8 / $40. Voor Astra met EU-dataresidentie is fast mode niet beschikbaar; dan blijft alleen standaard verwerking over.
Regionale verwerking (dataresidentie) kost 10% extra voor elk model met een releasedatum vanaf 5 maart 2026, dus voor de hele 5.6-lijn en Astra. Welke documenten je überhaupt in een venster van een miljoen tokens moet stoppen en welke je beter opknipt, staat op welk AI-model lange documenten het best leest.
Waar het model draait: ChatGPT-plan, API of Azure
De modelnaam alleen zegt niet of je erbij kunt. Dezelfde zeven modellen zijn verdeeld over drie routes, en per route verschilt welke je krijgt.
| Route | Luna | Terra | Sol | Astra |
|---|---|---|---|---|
| ChatGPT Free en Go | standaardmodel, ook achter Think | Codex | niet | niet |
| ChatGPT Plus | Work en Codex | Work en Codex | Instant, Medium en High in chat; Work; Codex | alleen in Work en Codex |
| ChatGPT Pro, Business, Enterprise | Work en Codex | Work en Codex | alle standen t/m Extra High plus Sol Pro | als GPT-6 Pro; Pro-plan ook in chat, Work en Codex |
| OpenAI API | ja | ja | ja | ja |
| Azure Foundry | ja (versie 2026-07-09) | ja (versie 2026-07-09) | ja (versie 2026-07-09) | ja (versie 2026-09-03) |
De ChatGPT-rijen komen uit het Help Center-artikel over GPT-5.6 Sol en GPT-6 Pro; in Business- en Enterprise-werkruimtes kan een beheerder modellen uitzetten, en nieuwe Pro $200-aanmeldingen zijn op 18 september 2026 tijdelijk gepauzeerd. Wat je binnen zo'n plan per uur of per week mag versturen, staat op heeft ChatGPT een limiet per abonnement.
De Azure-rij komt van de Foundry-modellenpagina: gpt-6-astra vraagt op sommige quota-niveaus een quota-aanvraag, Tier 5 en 6 hebben standaard quota. In de regiotabel is Astra op 18 september 2026 in alle elf Europese regio's beschikbaar als Global Standard-deployment; een EU Data Zone-deployment bestaat voor Astra niet; daar staan de 5.6-lijn, GPT-5.5 en GPT-5.4 wel.
Voor wie data binnen de EU wil houden zijn er dus twee OpenAI-routes: de regionale endpoints van OpenAI zelf (+10%) of een Azure-deployment met EU Data Zone (wel voor de 5.6-lijn, GPT-5.5 en GPT-5.4, niet voor Astra), waarbij Microsoft "prompts and responses anywhere within the specified data zone" verwerkt. Welke van de twee bij een bestaand Microsoft-contract past, hangt af van je licenties; als Microsoft-reseller helpen we daar ook bij, maar ons standaardadvies voor nieuwe software begint bij Claude.
Waar Claude de betere keuze is, en waar een OpenAI-model
Wij bouwen standaard Claude-first, met een uitwisselbare modellaag. Dat is een keuze, geen bewijs dat OpenAI slechter is; op 18 september 2026 wijst het onafhankelijke bewijs eerder op gelijkspel aan de top.
Artificial Analysis zet GPT-6 Astra op 53 in zijn Intelligence Index, gelijk aan Claude Fable 5.1, tegen circa 40% van de kosten per taak ($3,26 tegenover $7,63) (Artificial Analysis, 9 september 2026). In de Coding Agent Index staan beide op 62, Astra tegen circa 60% van de kosten.
In de Intelligence Index gebruikt Astra op max effort 27.000 outputtokens per taak, ongeveer een derde van Fable 5.1.
Dezelfde meting noemt ook waar Astra terugvalt: circa 45 Elo-punten lager dan GPT-5.6 Sol op GDPval-AA v2, en een lagere presentatiekwaliteit in AA-Briefcase, waar Sol nog steeds alle modellen voor blijft. Wie rapporten en presentaties laat schrijven, heeft dus reden om op Sol te blijven in plaats van naar Astra te gaan.
Waar wij een OpenAI-model als eerste keuze zien:
- Trede 1-werk in Azure-omgevingen die al op Microsoft-contracten en EU Data Zone draaien: Luna is dan goedkoper in beheer dan een tweede leverancier erbij.
- Agents met heel veel toolaanroepen waarbij tokenzuinigheid de rekening bepaalt: Astra schrijft per taak minder outputtokens dan Fable 5.1.
- Teams die al in Codex werken en hun agentworkflow niet willen verhuizen.
Waar wij Claude als eerste keuze zien:
- Trede 1 en 2 in nieuwe maatwerksoftware: Claude Haiku 4.5 ($1 / $5) en Sonnet 5 ($2 / $10) zitten prijstechnisch tussen Luna en Terra respectievelijk op Terra-niveau, met een cache-read op Sonnet 5 van $0,20 (Anthropic, prijzen).
- Lange documenten in het Nederlands, waar onze eigen ervaring met Claude het grootst is en de evaluaties al liggen.
- Situaties waarin een klant expliciet niet van één cloudleverancier afhankelijk wil zijn: Claude draait via de eigen API, Bedrock en Vertex.
Welke Claude-trede bij welk werk hoort, met dezelfde ladderlogica als hierboven, staat op Claude Haiku, Sonnet, Opus of Fable. De twee ladders naast elkaar leggen is meestal het eerste wat we in een adviestraject doen.
Hoe wij de modelkeuze in software vastleggen
In de software die wij bouwen is het model geen hardgecodeerde naam maar een instelling per functie: de mailclassificatie wijst naar de goedkope trede, de dossieranalyse naar de zware, en beide zijn zonder deploy te wisselen. Zo kun je bij een nieuwe release, zoals Astra op 3 september 2026, één functie tegelijk omzetten en meten.
Daar hoort een evaluatieset bij: twintig tot vijftig echte voorbeelden per functie met het gewenste antwoord, waarop we elke trede en elke effort-stand draaien voordat we kiezen. Zonder die set is elke modelkeuze een mening.
Dat werk begint bij ons AI-advies met een AI readiness assessment voor €3.500: nulmeting, gap-analyse en kansenlijst, waarin de modelkeuze per proces een vaste paragraaf is. Losse onderdelen zijn er vanaf €950, complete adviestrajecten lopen van €3.500 tot €22.500; de bouw van de software zelf valt onder AI-software op maat.
Twijfel je of je met een ChatGPT-abonnement toe kunt of de API nodig hebt, bel 085 016 0118, of zet je vraag in het contactformulier; we beantwoorden hem in een half uur zonder offerte. Het overzicht van alle vragen rond modelkeuze, kosten en AVG staat in de kennisbank AI-modellen vergelijken.
Zo blijft deze keuze actueel
Drie datums bepalen wanneer je deze pagina opnieuw moet lezen. De promotieprijs van Sol geldt "at least through November 21, 2026" en kan daarna omhoog; de uitfaseringsdatums van oudere modellen staan op de versiepagina; en elke nieuwe generatie hernoemt de treden, zoals 5.6 dat met Sol, Terra en Luna deed.
Wij werken de tabel bij zodra OpenAI een prijs, venster of plan wijzigt, met de datum in de tekst. Wijkt de prijzenpagina van vandaag af van deze tabel, dan wint de prijzenpagina.
Opgesteld met AI-ondersteuning, geredigeerd en inhoudelijk verantwoord door Bram Dokman.










