Ga naar hoofdinhoud
Terug naar AI Modellen Vergelijken
14 min lezen19 september 2026Gecontroleerd op 19 september 2026

Wat kost Azure OpenAI in 2026, en waar wijkt het af van de OpenAI API?

Azure rekent voor de actuele modellen exact de OpenAI-lijstprijs. De volledige prijslijst van september 2026, inclusief PTU, EU-toeslag en het batch-gat.

Bram DokmanOprichter & AI-specialist

Oprichter van CleverTech AI, met 12+ jaar ervaring in software development, online marketing en cloud-infrastructuur. BSc Science & Innovation Management (Universiteit Utrecht).

Deze pagina is gecontroleerd op

Een lange vergadertafel in een licht kantoor met vrijwel alle stoelen leeg, waarbij iemand een blauw gereserveerd-kaartje op drie stoelen legt
AI Modellen Vergelijken

Kort antwoord

Azure OpenAI rekent per miljoen tokens hetzelfde als OpenAI zelf voor de actuele modellen: GPT-5.6 Sol kost op Global Standard $4 input en $20 output per miljoen tokens bij korte context, net als Terra ($2/$12), Luna ($0,20/$1,20) en GPT-6 Astra ($10/$50). Het verschil zit elders: een EU Data Zone kost 10 procent extra en bij Astra zelfs 20 procent, en voor de 5.6-familie en GPT-6 kent de Azure-prijslijst geen batchtarief terwijl OpenAI daar de halve prijs rekent. Vaste capaciteit (Provisioned Throughput) begint bij 15 PTU, kost vanaf circa €3.349 per maand en verdient zich op de tokenprijs nooit terug.

Twee prijslijsten, hetzelfde model, dezelfde dag — en hetzelfde bedrag. Microsofts eigen prijslijst zet GPT-5.6 Sol op $4 per miljoen inputtokens en $20 per miljoen outputtokens, precies wat OpenAI er zelf voor vraagt.

Dat geldt voor de hele actuele catalogus: Terra, Luna en GPT-6 Astra staan op Global Standard tot op de cent gelijk. De keuze tussen Azure en de OpenAI API gaat dus niet over de tokenprijs.

Die gaat over wat je op elke route kunt kopen. Batchkorting, fast mode, Europese verwerking en vaste capaciteit staan op de twee lijsten verschillend geprijsd — of op één van de twee helemaal niet.

Voor de kale tarieven van OpenAI zelf, met rekenvoorbeelden per gesprek en per document, is de pagina over de kosten van de OpenAI API het vertrekpunt. Hier gaat het om wat de route via Microsoft daaraan toevoegt, en waar hij iets mist.

De tokentabel: OpenAI direct naast Azure OpenAI

Alle bedragen in dollar per miljoen tokens, korte context, standaardverwerking, exclusief btw. De Azure-kolommen komen uit de Azure Retail Prices API (regio West Europe, opgevraagd 19 september 2026), de OpenAI-kolom uit de OpenAI-prijslijst.

Model OpenAI direct (in / out) Azure Global Standard Azure Data Zone EU Verschil
GPT-6 Astra $10 / $50 $10 / $50 $12 / $60 Data Zone +20%
GPT-5.6 Sol $4 / $20 $4 / $20 $4,40 / $22 Data Zone +10%
GPT-5.6 Terra $2 / $12 $2 / $12 $2,20 / $13,20 Data Zone +10%
GPT-5.6 Luna $0,20 / $1,20 $0,20 / $1,20 $0,22 / $1,32 Data Zone +10%
GPT-5.5 niet meer op de prijslijst $5 / $30 $5,50 / $33 +10%, alleen via Azure

Cached input kost op beide lijsten een tiende van het inputtarief en een cache write 1,25 keer; bij Sol dus $0,40 en $5,00 op Global Standard.

Waar beide partijen hetzelfde model verkopen, staat er hetzelfde bedrag. Het verschil zit in de kolom ernaast en in wat er níet op de lijst staat.

Korte en lange context: twee tarieven per model

Elk model heeft twee tarieven, afhankelijk van hoe vol het contextvenster zit. Boven de grens schakelt de meter om, en de inputkant stijgt harder dan de outputkant.

Model Korte context (in / out) Lange context (in / out)
GPT-6 Astra $10 / $50 $20 / $75
GPT-5.6 Sol $4 / $20 $8 / $30
GPT-5.6 Terra $2 / $12 $4 / $18
GPT-5.6 Luna $0,20 / $1,20 $0,40 / $1,80

Bij alle vier verdubbelt het inputtarief en gaat het outputtarief met de helft omhoog. OpenAI hanteert precies dezelfde twee tarieven, dus ook hier ontstaat geen verschil tussen de routes.

Dit is wél de post die een Azure-factuur laat afwijken van je schatting: één lange bijlage in de prompt verdubbelt het inputtarief van dat hele verzoek. Alle bedragen hieronder staan op korte context, tenzij er iets anders bij staat.

Let op: Microsofts twee prijsbronnen spreken elkaar tegen op Sol

De Azure-prijspagina toont voor GPT-5.6 Sol nog $5 / $30 op korte context en $10 / $45 op lange, ook voor West Europe. De Retail Prices API — dezelfde tarieven, maar met meter-id, sku en ingangsdatum erbij — geeft $4 / $20 en $8 / $30, effectief 1 september 2026.

Twee dingen wijzen aan welke van de twee klopt. De bedragen op de prijspagina zijn tot op de cent die van GPT-5.5, een model waarvoor beide bronnen het onderling wél eens zijn, en de API-bedragen zijn tot op de cent de lijstprijs van OpenAI zelf — op alle acht standaardwaarden én op de fast-mode-kolom.

Wij rekenen daarom met de API. Zie je op de prijspagina een hoger bedrag, controleer dan je eigen verbruik in Azure Cost Management voordat je ermee begroot.

Gelijk geprijsd, maar niet met dezelfde garantie

Azures meters voor de 5.6-familie gaan in op 1 september 2026 en noemen geen einddatum. OpenAI zet onder zijn eigen tabel dat het Sol-tarief "is available at least through November 21, 2026" — een promotieprijs, geen lijstprijs.

Microsoft volgt dat tarief nu dus, maar zegt nergens wat er na 21 november gebeurt. Wie een meerjarenbegroting op deze bedragen bouwt, bouwt op een prijs met een houdbaarheidsdatum aan één kant en geen toezegging aan de andere.

De praktische regel: vergelijk de tarieven van de week waarin je tekent, en leg in het contract vast welk tarief geldt als de promotie afloopt.

Dezelfde tabel in euro, en waarom daar twee koersen in zitten

Azure factureert Nederlandse klanten in euro en publiceert een eigen eurolijst. OpenAI factureert in dollar, dus daar reken je zelf om.

Die twee koersen lopen niet gelijk. Azure rekent met een per maand vastgezette koers; de ECB-referentiekoers stond op 18 september 2026 op 1 euro = 1,1460 dollar.

Model en route Dollarprijs Euro (Azure-lijst of ECB) Omrekenbasis
Sol, OpenAI direct $4 / $20 circa €3,49 / €17,45 ECB 18-09-2026
Sol, OpenAI EU-endpoint (+10%) $4,40 / $22 circa €3,84 / €19,20 ECB 18-09-2026
Sol, Azure Global Standard $4 / $20 €3,43 / €17,17 Azure-eurolijst
Sol, Azure Data Zone EU $4,40 / $22 €3,78 / €18,89 Azure-eurolijst
Astra, Azure Global Standard $10 / $50 €8,59 / €42,93 Azure-eurolijst
Astra, Azure Data Zone EU $12 / $60 €10,30 / €51,52 Azure-eurolijst

Alle bedragen per miljoen tokens, exclusief 21 procent btw. Reken met deze kolom als je de btw terugvraagt, en tel er 21 procent bij op als dat niet kan.

Kijk naar de Azure-regel voor Sol: €3,43 waar de ECB-koers €3,49 zou geven. Azures vaste maandkoers ligt op dit moment circa 1,6 procent gunstiger dan de dagkoers, en dat draait even makkelijk de andere kant op.

Dat is meteen het enige echte voordeel van de euro-facturatie: geen koersrisico binnen de maand. Het is geen korting.

De negen deployment types: waar je data staat en hoe je betaalt

Bij OpenAI kies je een endpoint. Op Azure kies je bij het uitrollen een deployment type, en dat type bepaalt twee dingen tegelijk: waar de inferentie gebeurt en op welke meter je betaalt.

Deployment type Verwerking Facturatie Minimum
Global Standard elke Azure-regio per token geen
Data Zone Standard binnen de zone (EU, VS of APAC) per token geen
Standard binnen de Azure-geografie per token geen
Global Provisioned elke Azure-regio PTU per uur of reservering 15 PTU
Data Zone Provisioned binnen de zone PTU per uur of reservering 15 PTU
Regional Provisioned binnen de geografie PTU per uur of reservering 50 PTU
Global Batch elke Azure-regio 50% korting, binnen 24 uur geen
Data Zone Batch binnen de zone 50% korting, binnen 24 uur geen
Developer elke Azure-regio per token, 24 uur, geen SLA geen

Bron: Microsoft Learn, deployment types for Foundry Models, geraadpleegd 18 september 2026. Opslag in rust blijft bij elk type in de Azure-geografie van je resource.

Het type zegt niets over welke modellen erop draaien. Voor de 5.6-familie en GPT-6 staat er in de hele prijslijst geen enkele batchmeter — die twee regels in de tabel bestaan voor die modellen alleen op papier.

De EU-zone valt samen met de Azure EU Data Boundary, die volgens Microsoft naast EU-lidstaten ook EFTA-landen als Noorwegen en Zwitserland kan omvatten. Welke aanbieder via welke route welke garantie geeft, staat per model uitgesplitst op onze pagina over AI-modellen in de EU laten draaien.

Twee waarschuwingen staan in dezelfde documentatie. Nieuwe modellen komen altijd eerst als Global, dan als Data Zone en pas daarna geografie-gebonden, en het Developer-type kent expliciet geen dataresidentie-garantie en geen SLA.

GPT-6 Astra: de Europese zone kost twintig procent, niet tien

Bij Sol, Terra en Luna kost een Data Zone-deployment overal tien procent extra — in de Amerikaanse regio's net zo goed als in de Europese. Bij Astra niet.

De prijslijst zet de Astra-Data-Zone-meter in de VS-regio's op $11 / $55 en in tien Europese regio's, van westeurope tot swedencentral, op $12 / $60. Dezelfde zone-belofte, de dubbele toeslag.

GPT-6 Astra op Azure Input Cached input Cache write Output
Global Standard, korte context $10,00 $1,00 $12,50 $50,00
Global Standard, lange context $20,00 $2,00 $25,00 $75,00
Data Zone EU, korte context $12,00 $1,20 $15,00 $60,00
Data Zone EU, lange context $24,00 $2,40 $30,00 $90,00
Data Zone VS, korte context $11,00 $1,10 $13,75 $55,00

Microsofts aankondiging bij de algemene beschikbaarheid noemde alleen Global en de Amerikaanse zone. De prijslijst loopt daarop vooruit, dus controleer de capaciteit in je eigen regio voordat je erop rekent.

Op de OpenAI-API kost een residency-endpoint vlak tien procent, ook voor Astra. Daar staat tegenover dat je goedkeuring nodig hebt voor aangepaste misbruikmonitoring plus een Modified Retention-amendement.

Provisioned Throughput: wat vaste capaciteit werkelijk kost

Naast betalen per token verkoopt Azure gereserveerde rekencapaciteit, gemeten in Provisioned Throughput Units. Je betaalt dan per PTU per uur, ongeacht of er verzoeken binnenkomen.

Route Minimum Per PTU per uur Maandreservering Jaarreservering
Global Provisioned 15 PTU €0,8587 €223,25 €2.277,18
Data Zone Provisioned 15 PTU €1,0304 €267,90 €2.730,55
Regional Provisioned 50 PTU €2,3356 €334,02 €3.410,61

Bedragen per PTU, regio West Europe, valuta EUR, uit dezelfde prijslijst. In dollar zijn dezelfde regels $1, $1,20 en $2,72 per uur, $260, $312 en $389 per maand en $2.652, $3.180 en $3.972 per jaar.

Vertaald naar een maandbedrag voor de kleinst mogelijke Global-deployment van 15 PTU, met de maand van 720 uur die Microsoft zelf hanteert:

  • Uurtarief zonder reservering: circa €9.274 per maand.
  • Maandreservering: circa €3.349 per maand.
  • Jaarreservering: circa €34.158 per jaar, ofwel €2.846 per maand.

Voor een EU Data Zone-deployment worden die bedragen €11.128, €4.019 en €3.413 per maand. En wie de verwerking in de West-Europese geografie wil vastpinnen in plaats van in de zone, zit vast aan 50 PTU tegen een hoger unittarief: circa €16.701 per maand bij een maandreservering.

Dat laatste getal is de reden dat Regional Provisioned bij MKB-bedrijven zelden op tafel komt. Het is vijf keer de instap van een Global-deployment, voordat er één token verwerkt is.

Waarom vaste capaciteit zich op de tokenprijs nooit terugverdient

Microsoft publiceert zelf de sleutel tot deze som: één PTU levert bij GPT-5.6 Sol 1.200 inputtokens per minuut, volgens de PTU-sizinggids.

Stap Uitkomst
Capaciteit per PTU per maand (720 uur) 51,84 miljoen inputtokens
Diezelfde tokens op Global Standard (€3,4347/M) €178,05
Maandreservering per PTU €223,25
Jaarreservering per PTU, per maand €189,76

Zelfs de jaarreservering kost meer dan de inputtokens die hij in een volledig benutte maand kan verwerken. Er is dus geen bezettingsgraad waarbij vaste capaciteit op inputtokens goedkoper uitvalt.

Op $5 per miljoen — wat GPT-5.5 kost — zou dat omslagpunt rond 85 procent bezetting liggen. Op $4 ligt het er niet meer, en dat is precies waarom deze som elk kwartaal opnieuw gemaakt moet worden.

Microsoft schrijft zelf dat PTU en Global Standard bij volledige bezetting "approximately equivalent on a normalized-token basis" zijn. Genormaliseerd telt een outputtoken zwaarder, dus een outputzware werklast komt dichter bij break-even — erboven komt hij niet.

En het uurtarief zonder reservering staat op €0,8587 per PTU tegenover €0,2473 aan verbruik op dezelfde capaciteit: ruim drie keer zoveel. Handig om een week mee te benchmarken, ruïneus om te laten staan.

De instapdrempel vertaald naar documenten

Vijftien PTU op Sol is 777 miljoen inputtokens per maand bij volle bezetting. Met de vuistregel van circa 600 tokens per volle A4 die we gebruiken op de pagina over de OpenAI-API-tarieven, is dat ruim 1,2 miljoen A4 per maand.

Geen enkel MKB-bedrijf leest zoveel papier, en wie dat wel doet betaalt per token nog steeds minder. Provisioned Throughput is daarmee geen kostenbesparing maar een latentiegarantie: je koopt een toegezegde responstijd, en betaalt daarvoor.

Microsoft zegt dat ook met zoveel woorden in de vergelijkingstabel van de PTU-documentatie: Standard heeft geen latentie-SLA, Provisioned wel, met voor Sol een doel van 99 procent boven 50 tokens per seconde.

Koop je het om die reden, dan is het een verdedigbare uitgave. Koop je het om geld te besparen bij MKB-volumes, dan is het rekenkundig een vergissing.

Drie posten waar de twee lijsten wél uit elkaar lopen

Batch. Op de OpenAI-API kost een batchverzoek de helft: Sol $2 / $10, Astra $5 / $25, met een doorlooptijd tot 24 uur. In de Azure-prijslijst bestaat die meter voor de 5.6-familie en GPT-6 niet — batchtarieven lopen daar tot en met GPT-5.5 ($2,50 / $15). Wie nachtwerk op een actueel model draait, betaalt op Azure het volle tarief.

Fast mode. Snellere verwerking is bij beide een aparte kolom en kost bij Sol precies het dubbele: $8 / $40 op korte context, $16 / $60 op lange. Azure prijst die kolom voor Sol, Terra en Luna, maar niet voor Astra; OpenAI wel ($20 / $100), behalve in combinatie met EU-dataresidentie.

Fine-tuning. De Azure-prijslijst kent fine-tuning alleen voor oudere en open-weight modellen: gpt-4.1 ($25 per miljoen trainingstokens), o4-mini met reinforcement fine-tuning ($100 per uur training) en GPT OSS 20B ($3,60 per miljoen trainingstokens plus $0,30 per uur hosting, $0,33 in de Data Zone). Voor GPT-5.6 en GPT-6 staat er geen enkele fine-tuning-meter in.

Die laatste regel sneuvelt vaak pas laat in een project. Wie fine-tuning in het ontwerp heeft staan, kiest daarmee impliciet een oudere modelgeneratie — en een hostingtarief dat doorloopt als het model stilstaat.

Wat de route via Microsoft dan wél oplevert

Nu de tokenprijs gelijk is, moet de rest van het verhaal het dragen. In de documentatie over data en privacy legt Microsoft vast dat OpenAI geen toegang heeft tot je prompts en antwoorden, en dat de dienst niet praat met systemen van OpenAI zelf.

Daar komt bij wat je al hebt als je Azure gebruikt: identiteitsbeheer via Entra, netwerkisolatie via private endpoints, kostenbeheer via Azure Cost Management, facturatie in euro en één verwerkersovereenkomst met Microsoft in plaats van een tweede leverancierscontract.

En versiecontinuïteit. Azure prijst GPT-5.5, 5.4, 5.2, 5.1 en 4.1 gewoon door, terwijl OpenAI's prijslijst alleen de vier actuele modellen toont — wie een modelversie jaren wil vastzetten, heeft op Azure meer houvast.

Wat je er niet voor terugkrijgt: batchkorting op de nieuwste modellen, fast mode voor Astra, en een EU-zone die voor Astra twintig procent kost in plaats van tien.

Welke van de drie cloudroutes — Azure, Amazon Bedrock of Google Cloud — je data het strakst binnen de EU houdt, staat in Azure OpenAI, Bedrock of Vertex. Dat is een andere vraag dan deze: hier gaat het om het bedrag, daar om het contract en de regio.

Wanneer Azure de betere route is, en wanneer niet

  • Je vergelijkt op tokenprijs: dan valt er niets te kiezen — op Global Standard zijn de bedragen identiek.
  • Je draait nachtwerk in batch: OpenAI halveert daar het tarief op de actuele modellen, Azure kent die meter voor 5.6 en GPT-6 niet.
  • Je wilt EU-verwerking: Azure Data Zone kost 10 procent extra, bij Astra 20; het EU-endpoint van OpenAI kost vlak 10 procent.
  • Je hebt al een Azure-tenant met Entra en private endpoints: reken de bespaarde inrichtingstijd en de euro-facturatie mee voordat je op iets anders beslist.
  • Je verwacht met PTU te besparen: op tokenprijs lukt dat niet; koop het voor de latentiegarantie of koop het niet.
  • Je hebt fine-tuning nodig: de prijslijst kent die alleen voor oudere en open-weight modellen, op geen enkele route voor GPT-5.6 of GPT-6.

Wat de route kost naast de tokens

Wij hebben in deze vergelijking een eigen belang, en dat hoor je te weten voordat je de tabellen hierboven gebruikt: Azure- en Microsoft 365-licenties lopen bij ons via de indirecte reseller-overeenkomst met Pax8, met marge. Op de route die deze pagina beschrijft verdienen we dus mee.

Even eerlijk in de andere richting: voor AI die we zelf bouwen is Claude onze standaardkeuze, en een OpenAI-model komt erin als het voor die taak aantoonbaar beter of goedkoper is. Wie de derde prijslijst ernaast wil leggen, vindt de tarieven van Anthropic bij de Claude API en wat die per miljoen tokens kost.

Op de meeste begrotingen is de tokenfactuur de kleinste regel. Ons eigen tarief ter vergelijking: bouwen we er één AI-feature omheen, dan begint dat bij €8.500 en zoeken op je eigen documenten bij €12.500, vast geprijsd na scoping en daarna vanaf €750 per maand onderhoud bovenop het verbruik.

Wil je de modelkosten per functie gemeten hebben in plaats van geschat, dan hoort dat bij AI-software op maat; doorlopend beheer van een draaiende AI-omgeving valt onder Managed AI, van €500 tot €2.500 per maand afhankelijk van reactietijd en scope. De bredere kostenposten van AI, van abonnement tot maatwerk, staan op onze pagina over wat AI kost voor bedrijven.

Zit de vraag vooral in licenties en niet in eigen software, dan is de pagina over Microsoft 365 Copilot-licenties de snellere ingang, en de index over AI-modellen vergelijken zet alle modellen en routes naast elkaar.

Liever één bedrag voor jouw eigen verbruik dan een tabel? Bel 085 016 0118, of zet je vraag op de contactpagina, dan rekenen we je documentvolume op beide routes door.

Zo houd je de Azure-factuur onder controle

  • Vergelijk per model én per deployment type, niet per leverancier: de tokenprijs is gelijk, de rest niet.
  • Controleer of het Sol-promotietarief nog loopt voordat je een meerjarenbegroting sluit.
  • Kies Global Standard tenzij je een aantoonbare residentie- of latentie-eis hebt; bij Astra kost de EU-zone twintig procent.
  • Reken PTU nooit door op verwacht verbruik, maar op verwachte bezetting per uur — en weet dat het op tokenprijs niet uitkomt.
  • Laat Regional Provisioned links liggen onder 50 PTU aan echte capaciteitsbehoefte.
  • Zet nachtwerk dat kan wachten op batch, en controleer eerst of jouw model die meter heeft.
  • Controleer of fast mode ergens aanstaat; dat verdubbelt het tarief zonder dat de output verandert.

Opgesteld met AI-ondersteuning, geredigeerd en inhoudelijk verantwoord door Bram Dokman.

Tags:#Copilot#AI kosten#AI infrastructuur#ChatGPT#MKB
Delen:
Veelgestelde vragen

Antwoorden over dit artikel

Wat kost Azure OpenAI per miljoen tokens in 2026?

Op Global Standard in West Europe staat GPT-5.6 Sol bij korte context op $4 per miljoen inputtokens en $20 per miljoen outputtokens, met Terra op $2/$12, Luna op $0,20/$1,20 en GPT-6 Astra op $10/$50. Boven de contextgrens verdubbelt het inputtarief en stijgt het outputtarief met de helft, bij Sol naar $8/$30. Een Data Zone-deployment kost daar 10 procent bovenop, bij Astra 20 procent. Bron: de Azure Retail Prices API, meters voor regio westeurope, effectief 1 september 2026.

Is Azure OpenAI duurder dan de OpenAI API?

Niet op de tokenprijs. Voor Sol, Terra, Luna en GPT-6 Astra rekent Azure op Global Standard exact de OpenAI-lijstprijs, tot en met de cached-input- en cache-writetarieven. Het verschil zit in wat je op elke route kunt kopen: OpenAI heeft een batchtarief van de halve prijs voor de actuele modellen en Azure niet, en de Azure EU Data Zone kost bij Astra 20 procent extra tegen 10 procent bij het EU-endpoint van OpenAI.

Tot wanneer geldt het promotietarief van GPT-5.6 Sol?

OpenAI meldt bij de eigen prijslijst dat het Sol-tarief "at least through November 21, 2026" geldt. Azure rekent nu hetzelfde bedrag, met meters die ingaan op 1 september 2026 en geen einddatum noemen. Wat er na 21 november op beide lijsten gebeurt, staat nergens toegezegd, dus een meerjarenbegroting op deze prijs is riskant.

Kan ik GPT-6 Astra in een EU Data Zone draaien op Azure?

De prijslijst kent sinds 1 september 2026 een Astra-Data-Zone-meter in tien Europese regio's, waaronder West Europe, tegen $12 input en $60 output per miljoen tokens. Dat is 20 procent boven Global Standard, terwijl de Amerikaanse zone op $11/$55 staat. Microsofts aankondiging bij de algemene beschikbaarheid noemde alleen Global en de VS-zone, dus controleer de capaciteit in je eigen regio voordat je erop rekent.

Wat is het verschil tussen Global Standard en Data Zone Standard?

Bij Global Standard mag Azure prompts en antwoorden verwerken in elke regio waar het model draait. Bij Data Zone Standard verwerkt Azure uitsluitend binnen de opgegeven zone, voor Europa binnen de Azure EU Data Boundary, die ook EFTA-landen als Noorwegen en Zwitserland kan omvatten. Dat kost bij Sol $4,40 in plaats van $4 per miljoen inputtokens; opslag in rust blijft bij beide in de Azure-geografie van je resource.

Wat is een PTU en wat kost er een?

Een Provisioned Throughput Unit is een vaste hoeveelheid gereserveerde rekencapaciteit, die je betaalt of je hem gebruikt of niet. In West Europe kost een Global-PTU €0,8587 per uur, €223,25 per maand met een maandreservering of €2.277,18 per jaar met een jaarreservering. De kleinste Global-deployment is 15 PTU.

Vanaf welk verbruik is Provisioned Throughput goedkoper dan per token betalen?

Op de tokenprijs van GPT-5.6 Sol nooit. Eén PTU verwerkt bij volle bezetting 51,84 miljoen inputtokens per maand, goed voor €178,05 op Global Standard, terwijl de goedkoopste reservering €189,76 per maand kost. Microsoft noemt PTU en Global Standard bij volledige bezetting "approximately equivalent on a normalized-token basis": vaste capaciteit koop je voor de latentiegarantie, niet voor de besparing.

Hoeveel tokens moet ik minimaal verwerken voor een PTU-deployment?

Vijftien PTU op GPT-5.6 Sol levert 777 miljoen inputtokens per maand bij volledige bezetting, ruim een miljoen A4 aan tekst. Dat volume haalt vrijwel geen MKB-bedrijf, en wie het wel haalt betaalt per token nog steeds minder. Per token betalen is daarom bij dit tarief altijd de goedkopere route.

Waarom vraagt Regional Provisioned 50 PTU in plaats van 15?

Global en Data Zone Provisioned hebben een minimum van 15 PTU, geografie-gebonden Regional Provisioned van 50 PTU voor de meeste modellen. Het unittarief ligt bovendien hoger: €334,02 per PTU per maand met een maandreservering, dus circa €16.701 per maand als instap. Dat is de reden dat een harde eis "verwerking uitsluitend in West Europe" veel duurder uitpakt dan verwacht.

Geeft Azure OpenAI korting via de Batch API?

Voor de 5.6-familie en GPT-6 staat er geen batchmeter in de Azure-prijslijst; batchtarieven lopen daar tot en met GPT-5.5, dat op $2,50/$15 staat tegen $5/$30 regulier. OpenAI rekent op de eigen API wel de halve prijs op de actuele modellen: Sol $2/$10 en Astra $5/$25. Voor documentverwerking die kan wachten, is dat het grootste prijsverschil tussen de twee routes.

Kan ik een GPT-5.6- of GPT-6-model fine-tunen op Azure?

Nee. De prijslijst kent op 19 september 2026 alleen fine-tuning-meters voor oudere en open-weight modellen: gpt-4.1 en zijn mini- en nano-varianten, o4-mini met reinforcement fine-tuning en GPT OSS 20B. Voor GPT-5.6 en GPT-6 bestaat geen enkele meter, dus wie fine-tuning in het ontwerp heeft staan kiest impliciet een oudere modelgeneratie plus een hostingtarief dat doorloopt als het model stilstaat.

Blijven mijn prompts bij Azure OpenAI weg bij OpenAI zelf?

Dat is wat Microsoft toezegt: prompts en completions zijn volgens de documentatie over data en privacy niet beschikbaar voor OpenAI, en de dienst communiceert niet met diensten van OpenAI. De verwerkersovereenkomst loopt dan ook via Microsoft, niet via OpenAI. Misbruikmonitoring blijft bestaan, met opslag in de geografie van je resource.

Betaal ik Azure OpenAI in euro of in dollar?

Azure factureert Nederlandse klanten in euro, met een koers die per maand wordt vastgezet. Op 19 september 2026 stond Sol op de eurolijst op €3,4347 per miljoen inputtokens, circa 1,6 procent onder de ECB-dagkoers van 1,1460 dollar per euro. OpenAI factureert in dollar, dus daar loop je wel koersrisico binnen de maand.

Waarom staat er op de Azure-prijspagina een ander bedrag voor GPT-5.6 Sol?

Microsofts twee prijsbronnen lopen op dit model uiteen: de prijspagina toont $5/$30 op korte context, de Retail Prices API $4/$20 met meters die ingaan op 1 september 2026. De bedragen op de prijspagina zijn exact die van GPT-5.5, terwijl de API-bedragen exact de lijstprijs van OpenAI zelf zijn; voor GPT-5.5 zijn beide bronnen het onderling wel eens. Wij rekenen met de API en adviseren je eigen verbruik in Azure Cost Management te controleren voordat je op een van beide begroot.

Verkoopt CleverTech AI zelf Azure-licenties?

Ja. Onze Microsoft- en Azure-licenties lopen via de indirecte reseller-overeenkomst met Pax8, met marge; dat belang benoemen we bij elk advies over deze keuze. Onze eerste keuze voor AI die we zelf bouwen is Claude, en we zetten OpenAI-modellen in waar die aantoonbaar beter of goedkoper zijn voor de taak.

Volgende stap

Wat dit in jouw situatie betekent, weet je snel

Je legt je vraag voor, wij zeggen wat haalbaar is, wat het ongeveer kost en wat de slimste eerste stap is. Ook als dat betekent: nog even niet bouwen.

Liever eerst schriftelijk? Stel je vraag via het formulier.
Liever eerst zelf checken? Download de AI Readiness Checklist.
5,0op Google
  • Zeer fijne samenwerking! Professioneel, deskundig en vooral erg oplossingsgericht. Ze denken goed mee, communiceren duidelijk en leveren kwaliteit. Een betrouwbare en innovatieve techpartner die ik zeker kan aanbevelen!

    Spark O.

  • Heel goed geholpen duidelijke uitleg en werken heel hard voor je en denken heel goed mee wat belangrijk is. Duidelijk heel veel kennis van zaken. Echt een aanrader.

    Maarten B.

Blijf op de hoogte

Ontvang praktische AI-inzichten in je inbox. Geen spam, alleen waardevolle content.

Geen spam · max 2x per maand · altijd opzegbaar

Je gegevens worden alleen gebruikt voor het verzenden van de nieuwsbrief. Uitschrijven kan op elk moment.

Van kennis naar resultaat

Wat betekent dit voor jouw bedrijf?

We denken vrijblijvend mee over wat dit concreet zou opleveren — vaste prijs, vaste deadline.