Kort antwoord
Azure OpenAI rekent per miljoen tokens hetzelfde als OpenAI zelf voor de actuele modellen: GPT-5.6 Sol kost op Global Standard $4 input en $20 output per miljoen tokens bij korte context, net als Terra ($2/$12), Luna ($0,20/$1,20) en GPT-6 Astra ($10/$50). Het verschil zit elders: een EU Data Zone kost 10 procent extra en bij Astra zelfs 20 procent, en voor de 5.6-familie en GPT-6 kent de Azure-prijslijst geen batchtarief terwijl OpenAI daar de halve prijs rekent. Vaste capaciteit (Provisioned Throughput) begint bij 15 PTU, kost vanaf circa €3.349 per maand en verdient zich op de tokenprijs nooit terug.
Van lezen naar doen.
Twee prijslijsten, hetzelfde model, dezelfde dag — en hetzelfde bedrag. Microsofts eigen prijslijst zet GPT-5.6 Sol op $4 per miljoen inputtokens en $20 per miljoen outputtokens, precies wat OpenAI er zelf voor vraagt.
Dat geldt voor de hele actuele catalogus: Terra, Luna en GPT-6 Astra staan op Global Standard tot op de cent gelijk. De keuze tussen Azure en de OpenAI API gaat dus niet over de tokenprijs.
Die gaat over wat je op elke route kunt kopen. Batchkorting, fast mode, Europese verwerking en vaste capaciteit staan op de twee lijsten verschillend geprijsd — of op één van de twee helemaal niet.
Voor de kale tarieven van OpenAI zelf, met rekenvoorbeelden per gesprek en per document, is de pagina over de kosten van de OpenAI API het vertrekpunt. Hier gaat het om wat de route via Microsoft daaraan toevoegt, en waar hij iets mist.
De tokentabel: OpenAI direct naast Azure OpenAI
Alle bedragen in dollar per miljoen tokens, korte context, standaardverwerking, exclusief btw. De Azure-kolommen komen uit de Azure Retail Prices API (regio West Europe, opgevraagd 19 september 2026), de OpenAI-kolom uit de OpenAI-prijslijst.
| Model | OpenAI direct (in / out) | Azure Global Standard | Azure Data Zone EU | Verschil |
|---|---|---|---|---|
| GPT-6 Astra | $10 / $50 | $10 / $50 | $12 / $60 | Data Zone +20% |
| GPT-5.6 Sol | $4 / $20 | $4 / $20 | $4,40 / $22 | Data Zone +10% |
| GPT-5.6 Terra | $2 / $12 | $2 / $12 | $2,20 / $13,20 | Data Zone +10% |
| GPT-5.6 Luna | $0,20 / $1,20 | $0,20 / $1,20 | $0,22 / $1,32 | Data Zone +10% |
| GPT-5.5 | niet meer op de prijslijst | $5 / $30 | $5,50 / $33 | +10%, alleen via Azure |
Cached input kost op beide lijsten een tiende van het inputtarief en een cache write 1,25 keer; bij Sol dus $0,40 en $5,00 op Global Standard.
Waar beide partijen hetzelfde model verkopen, staat er hetzelfde bedrag. Het verschil zit in de kolom ernaast en in wat er níet op de lijst staat.
Korte en lange context: twee tarieven per model
Elk model heeft twee tarieven, afhankelijk van hoe vol het contextvenster zit. Boven de grens schakelt de meter om, en de inputkant stijgt harder dan de outputkant.
| Model | Korte context (in / out) | Lange context (in / out) |
|---|---|---|
| GPT-6 Astra | $10 / $50 | $20 / $75 |
| GPT-5.6 Sol | $4 / $20 | $8 / $30 |
| GPT-5.6 Terra | $2 / $12 | $4 / $18 |
| GPT-5.6 Luna | $0,20 / $1,20 | $0,40 / $1,80 |
Bij alle vier verdubbelt het inputtarief en gaat het outputtarief met de helft omhoog. OpenAI hanteert precies dezelfde twee tarieven, dus ook hier ontstaat geen verschil tussen de routes.
Dit is wél de post die een Azure-factuur laat afwijken van je schatting: één lange bijlage in de prompt verdubbelt het inputtarief van dat hele verzoek. Alle bedragen hieronder staan op korte context, tenzij er iets anders bij staat.
Let op: Microsofts twee prijsbronnen spreken elkaar tegen op Sol
De Azure-prijspagina toont voor GPT-5.6 Sol nog $5 / $30 op korte context en $10 / $45 op lange, ook voor West Europe. De Retail Prices API — dezelfde tarieven, maar met meter-id, sku en ingangsdatum erbij — geeft $4 / $20 en $8 / $30, effectief 1 september 2026.
Twee dingen wijzen aan welke van de twee klopt. De bedragen op de prijspagina zijn tot op de cent die van GPT-5.5, een model waarvoor beide bronnen het onderling wél eens zijn, en de API-bedragen zijn tot op de cent de lijstprijs van OpenAI zelf — op alle acht standaardwaarden én op de fast-mode-kolom.
Wij rekenen daarom met de API. Zie je op de prijspagina een hoger bedrag, controleer dan je eigen verbruik in Azure Cost Management voordat je ermee begroot.
Gelijk geprijsd, maar niet met dezelfde garantie
Azures meters voor de 5.6-familie gaan in op 1 september 2026 en noemen geen einddatum. OpenAI zet onder zijn eigen tabel dat het Sol-tarief "is available at least through November 21, 2026" — een promotieprijs, geen lijstprijs.
Microsoft volgt dat tarief nu dus, maar zegt nergens wat er na 21 november gebeurt. Wie een meerjarenbegroting op deze bedragen bouwt, bouwt op een prijs met een houdbaarheidsdatum aan één kant en geen toezegging aan de andere.
De praktische regel: vergelijk de tarieven van de week waarin je tekent, en leg in het contract vast welk tarief geldt als de promotie afloopt.
Dezelfde tabel in euro, en waarom daar twee koersen in zitten
Azure factureert Nederlandse klanten in euro en publiceert een eigen eurolijst. OpenAI factureert in dollar, dus daar reken je zelf om.
Die twee koersen lopen niet gelijk. Azure rekent met een per maand vastgezette koers; de ECB-referentiekoers stond op 18 september 2026 op 1 euro = 1,1460 dollar.
| Model en route | Dollarprijs | Euro (Azure-lijst of ECB) | Omrekenbasis |
|---|---|---|---|
| Sol, OpenAI direct | $4 / $20 | circa €3,49 / €17,45 | ECB 18-09-2026 |
| Sol, OpenAI EU-endpoint (+10%) | $4,40 / $22 | circa €3,84 / €19,20 | ECB 18-09-2026 |
| Sol, Azure Global Standard | $4 / $20 | €3,43 / €17,17 | Azure-eurolijst |
| Sol, Azure Data Zone EU | $4,40 / $22 | €3,78 / €18,89 | Azure-eurolijst |
| Astra, Azure Global Standard | $10 / $50 | €8,59 / €42,93 | Azure-eurolijst |
| Astra, Azure Data Zone EU | $12 / $60 | €10,30 / €51,52 | Azure-eurolijst |
Alle bedragen per miljoen tokens, exclusief 21 procent btw. Reken met deze kolom als je de btw terugvraagt, en tel er 21 procent bij op als dat niet kan.
Kijk naar de Azure-regel voor Sol: €3,43 waar de ECB-koers €3,49 zou geven. Azures vaste maandkoers ligt op dit moment circa 1,6 procent gunstiger dan de dagkoers, en dat draait even makkelijk de andere kant op.
Dat is meteen het enige echte voordeel van de euro-facturatie: geen koersrisico binnen de maand. Het is geen korting.
De negen deployment types: waar je data staat en hoe je betaalt
Bij OpenAI kies je een endpoint. Op Azure kies je bij het uitrollen een deployment type, en dat type bepaalt twee dingen tegelijk: waar de inferentie gebeurt en op welke meter je betaalt.
| Deployment type | Verwerking | Facturatie | Minimum |
|---|---|---|---|
| Global Standard | elke Azure-regio | per token | geen |
| Data Zone Standard | binnen de zone (EU, VS of APAC) | per token | geen |
| Standard | binnen de Azure-geografie | per token | geen |
| Global Provisioned | elke Azure-regio | PTU per uur of reservering | 15 PTU |
| Data Zone Provisioned | binnen de zone | PTU per uur of reservering | 15 PTU |
| Regional Provisioned | binnen de geografie | PTU per uur of reservering | 50 PTU |
| Global Batch | elke Azure-regio | 50% korting, binnen 24 uur | geen |
| Data Zone Batch | binnen de zone | 50% korting, binnen 24 uur | geen |
| Developer | elke Azure-regio | per token, 24 uur, geen SLA | geen |
Bron: Microsoft Learn, deployment types for Foundry Models, geraadpleegd 18 september 2026. Opslag in rust blijft bij elk type in de Azure-geografie van je resource.
Het type zegt niets over welke modellen erop draaien. Voor de 5.6-familie en GPT-6 staat er in de hele prijslijst geen enkele batchmeter — die twee regels in de tabel bestaan voor die modellen alleen op papier.
De EU-zone valt samen met de Azure EU Data Boundary, die volgens Microsoft naast EU-lidstaten ook EFTA-landen als Noorwegen en Zwitserland kan omvatten. Welke aanbieder via welke route welke garantie geeft, staat per model uitgesplitst op onze pagina over AI-modellen in de EU laten draaien.
Twee waarschuwingen staan in dezelfde documentatie. Nieuwe modellen komen altijd eerst als Global, dan als Data Zone en pas daarna geografie-gebonden, en het Developer-type kent expliciet geen dataresidentie-garantie en geen SLA.
GPT-6 Astra: de Europese zone kost twintig procent, niet tien
Bij Sol, Terra en Luna kost een Data Zone-deployment overal tien procent extra — in de Amerikaanse regio's net zo goed als in de Europese. Bij Astra niet.
De prijslijst zet de Astra-Data-Zone-meter in de VS-regio's op $11 / $55 en in tien Europese regio's, van westeurope tot swedencentral, op $12 / $60. Dezelfde zone-belofte, de dubbele toeslag.
| GPT-6 Astra op Azure | Input | Cached input | Cache write | Output |
|---|---|---|---|---|
| Global Standard, korte context | $10,00 | $1,00 | $12,50 | $50,00 |
| Global Standard, lange context | $20,00 | $2,00 | $25,00 | $75,00 |
| Data Zone EU, korte context | $12,00 | $1,20 | $15,00 | $60,00 |
| Data Zone EU, lange context | $24,00 | $2,40 | $30,00 | $90,00 |
| Data Zone VS, korte context | $11,00 | $1,10 | $13,75 | $55,00 |
Microsofts aankondiging bij de algemene beschikbaarheid noemde alleen Global en de Amerikaanse zone. De prijslijst loopt daarop vooruit, dus controleer de capaciteit in je eigen regio voordat je erop rekent.
Op de OpenAI-API kost een residency-endpoint vlak tien procent, ook voor Astra. Daar staat tegenover dat je goedkeuring nodig hebt voor aangepaste misbruikmonitoring plus een Modified Retention-amendement.
Provisioned Throughput: wat vaste capaciteit werkelijk kost
Naast betalen per token verkoopt Azure gereserveerde rekencapaciteit, gemeten in Provisioned Throughput Units. Je betaalt dan per PTU per uur, ongeacht of er verzoeken binnenkomen.
| Route | Minimum | Per PTU per uur | Maandreservering | Jaarreservering |
|---|---|---|---|---|
| Global Provisioned | 15 PTU | €0,8587 | €223,25 | €2.277,18 |
| Data Zone Provisioned | 15 PTU | €1,0304 | €267,90 | €2.730,55 |
| Regional Provisioned | 50 PTU | €2,3356 | €334,02 | €3.410,61 |
Bedragen per PTU, regio West Europe, valuta EUR, uit dezelfde prijslijst. In dollar zijn dezelfde regels $1, $1,20 en $2,72 per uur, $260, $312 en $389 per maand en $2.652, $3.180 en $3.972 per jaar.
Vertaald naar een maandbedrag voor de kleinst mogelijke Global-deployment van 15 PTU, met de maand van 720 uur die Microsoft zelf hanteert:
- Uurtarief zonder reservering: circa €9.274 per maand.
- Maandreservering: circa €3.349 per maand.
- Jaarreservering: circa €34.158 per jaar, ofwel €2.846 per maand.
Voor een EU Data Zone-deployment worden die bedragen €11.128, €4.019 en €3.413 per maand. En wie de verwerking in de West-Europese geografie wil vastpinnen in plaats van in de zone, zit vast aan 50 PTU tegen een hoger unittarief: circa €16.701 per maand bij een maandreservering.
Dat laatste getal is de reden dat Regional Provisioned bij MKB-bedrijven zelden op tafel komt. Het is vijf keer de instap van een Global-deployment, voordat er één token verwerkt is.
Waarom vaste capaciteit zich op de tokenprijs nooit terugverdient
Microsoft publiceert zelf de sleutel tot deze som: één PTU levert bij GPT-5.6 Sol 1.200 inputtokens per minuut, volgens de PTU-sizinggids.
| Stap | Uitkomst |
|---|---|
| Capaciteit per PTU per maand (720 uur) | 51,84 miljoen inputtokens |
| Diezelfde tokens op Global Standard (€3,4347/M) | €178,05 |
| Maandreservering per PTU | €223,25 |
| Jaarreservering per PTU, per maand | €189,76 |
Zelfs de jaarreservering kost meer dan de inputtokens die hij in een volledig benutte maand kan verwerken. Er is dus geen bezettingsgraad waarbij vaste capaciteit op inputtokens goedkoper uitvalt.
Op $5 per miljoen — wat GPT-5.5 kost — zou dat omslagpunt rond 85 procent bezetting liggen. Op $4 ligt het er niet meer, en dat is precies waarom deze som elk kwartaal opnieuw gemaakt moet worden.
Microsoft schrijft zelf dat PTU en Global Standard bij volledige bezetting "approximately equivalent on a normalized-token basis" zijn. Genormaliseerd telt een outputtoken zwaarder, dus een outputzware werklast komt dichter bij break-even — erboven komt hij niet.
En het uurtarief zonder reservering staat op €0,8587 per PTU tegenover €0,2473 aan verbruik op dezelfde capaciteit: ruim drie keer zoveel. Handig om een week mee te benchmarken, ruïneus om te laten staan.
De instapdrempel vertaald naar documenten
Vijftien PTU op Sol is 777 miljoen inputtokens per maand bij volle bezetting. Met de vuistregel van circa 600 tokens per volle A4 die we gebruiken op de pagina over de OpenAI-API-tarieven, is dat ruim 1,2 miljoen A4 per maand.
Geen enkel MKB-bedrijf leest zoveel papier, en wie dat wel doet betaalt per token nog steeds minder. Provisioned Throughput is daarmee geen kostenbesparing maar een latentiegarantie: je koopt een toegezegde responstijd, en betaalt daarvoor.
Microsoft zegt dat ook met zoveel woorden in de vergelijkingstabel van de PTU-documentatie: Standard heeft geen latentie-SLA, Provisioned wel, met voor Sol een doel van 99 procent boven 50 tokens per seconde.
Koop je het om die reden, dan is het een verdedigbare uitgave. Koop je het om geld te besparen bij MKB-volumes, dan is het rekenkundig een vergissing.
Drie posten waar de twee lijsten wél uit elkaar lopen
Batch. Op de OpenAI-API kost een batchverzoek de helft: Sol $2 / $10, Astra $5 / $25, met een doorlooptijd tot 24 uur. In de Azure-prijslijst bestaat die meter voor de 5.6-familie en GPT-6 niet — batchtarieven lopen daar tot en met GPT-5.5 ($2,50 / $15). Wie nachtwerk op een actueel model draait, betaalt op Azure het volle tarief.
Fast mode. Snellere verwerking is bij beide een aparte kolom en kost bij Sol precies het dubbele: $8 / $40 op korte context, $16 / $60 op lange. Azure prijst die kolom voor Sol, Terra en Luna, maar niet voor Astra; OpenAI wel ($20 / $100), behalve in combinatie met EU-dataresidentie.
Fine-tuning. De Azure-prijslijst kent fine-tuning alleen voor oudere en open-weight modellen: gpt-4.1 ($25 per miljoen trainingstokens), o4-mini met reinforcement fine-tuning ($100 per uur training) en GPT OSS 20B ($3,60 per miljoen trainingstokens plus $0,30 per uur hosting, $0,33 in de Data Zone). Voor GPT-5.6 en GPT-6 staat er geen enkele fine-tuning-meter in.
Die laatste regel sneuvelt vaak pas laat in een project. Wie fine-tuning in het ontwerp heeft staan, kiest daarmee impliciet een oudere modelgeneratie — en een hostingtarief dat doorloopt als het model stilstaat.
Wat de route via Microsoft dan wél oplevert
Nu de tokenprijs gelijk is, moet de rest van het verhaal het dragen. In de documentatie over data en privacy legt Microsoft vast dat OpenAI geen toegang heeft tot je prompts en antwoorden, en dat de dienst niet praat met systemen van OpenAI zelf.
Daar komt bij wat je al hebt als je Azure gebruikt: identiteitsbeheer via Entra, netwerkisolatie via private endpoints, kostenbeheer via Azure Cost Management, facturatie in euro en één verwerkersovereenkomst met Microsoft in plaats van een tweede leverancierscontract.
En versiecontinuïteit. Azure prijst GPT-5.5, 5.4, 5.2, 5.1 en 4.1 gewoon door, terwijl OpenAI's prijslijst alleen de vier actuele modellen toont — wie een modelversie jaren wil vastzetten, heeft op Azure meer houvast.
Wat je er niet voor terugkrijgt: batchkorting op de nieuwste modellen, fast mode voor Astra, en een EU-zone die voor Astra twintig procent kost in plaats van tien.
Welke van de drie cloudroutes — Azure, Amazon Bedrock of Google Cloud — je data het strakst binnen de EU houdt, staat in Azure OpenAI, Bedrock of Vertex. Dat is een andere vraag dan deze: hier gaat het om het bedrag, daar om het contract en de regio.
Wanneer Azure de betere route is, en wanneer niet
- Je vergelijkt op tokenprijs: dan valt er niets te kiezen — op Global Standard zijn de bedragen identiek.
- Je draait nachtwerk in batch: OpenAI halveert daar het tarief op de actuele modellen, Azure kent die meter voor 5.6 en GPT-6 niet.
- Je wilt EU-verwerking: Azure Data Zone kost 10 procent extra, bij Astra 20; het EU-endpoint van OpenAI kost vlak 10 procent.
- Je hebt al een Azure-tenant met Entra en private endpoints: reken de bespaarde inrichtingstijd en de euro-facturatie mee voordat je op iets anders beslist.
- Je verwacht met PTU te besparen: op tokenprijs lukt dat niet; koop het voor de latentiegarantie of koop het niet.
- Je hebt fine-tuning nodig: de prijslijst kent die alleen voor oudere en open-weight modellen, op geen enkele route voor GPT-5.6 of GPT-6.
Wat de route kost naast de tokens
Wij hebben in deze vergelijking een eigen belang, en dat hoor je te weten voordat je de tabellen hierboven gebruikt: Azure- en Microsoft 365-licenties lopen bij ons via de indirecte reseller-overeenkomst met Pax8, met marge. Op de route die deze pagina beschrijft verdienen we dus mee.
Even eerlijk in de andere richting: voor AI die we zelf bouwen is Claude onze standaardkeuze, en een OpenAI-model komt erin als het voor die taak aantoonbaar beter of goedkoper is. Wie de derde prijslijst ernaast wil leggen, vindt de tarieven van Anthropic bij de Claude API en wat die per miljoen tokens kost.
Op de meeste begrotingen is de tokenfactuur de kleinste regel. Ons eigen tarief ter vergelijking: bouwen we er één AI-feature omheen, dan begint dat bij €8.500 en zoeken op je eigen documenten bij €12.500, vast geprijsd na scoping en daarna vanaf €750 per maand onderhoud bovenop het verbruik.
Wil je de modelkosten per functie gemeten hebben in plaats van geschat, dan hoort dat bij AI-software op maat; doorlopend beheer van een draaiende AI-omgeving valt onder Managed AI, van €500 tot €2.500 per maand afhankelijk van reactietijd en scope. De bredere kostenposten van AI, van abonnement tot maatwerk, staan op onze pagina over wat AI kost voor bedrijven.
Zit de vraag vooral in licenties en niet in eigen software, dan is de pagina over Microsoft 365 Copilot-licenties de snellere ingang, en de index over AI-modellen vergelijken zet alle modellen en routes naast elkaar.
Liever één bedrag voor jouw eigen verbruik dan een tabel? Bel 085 016 0118, of zet je vraag op de contactpagina, dan rekenen we je documentvolume op beide routes door.
Zo houd je de Azure-factuur onder controle
- Vergelijk per model én per deployment type, niet per leverancier: de tokenprijs is gelijk, de rest niet.
- Controleer of het Sol-promotietarief nog loopt voordat je een meerjarenbegroting sluit.
- Kies Global Standard tenzij je een aantoonbare residentie- of latentie-eis hebt; bij Astra kost de EU-zone twintig procent.
- Reken PTU nooit door op verwacht verbruik, maar op verwachte bezetting per uur — en weet dat het op tokenprijs niet uitkomt.
- Laat Regional Provisioned links liggen onder 50 PTU aan echte capaciteitsbehoefte.
- Zet nachtwerk dat kan wachten op batch, en controleer eerst of jouw model die meter heeft.
- Controleer of fast mode ergens aanstaat; dat verdubbelt het tarief zonder dat de output verandert.
Opgesteld met AI-ondersteuning, geredigeerd en inhoudelijk verantwoord door Bram Dokman.










