OpenAI vermeldt voor GPT-5.6 Sol een tarief van $4 per 1 miljoen inputtokens en $20 per 1 miljoen outputtokens voor standaardaanvragen met korte context. Dat zijn API-tarieven voor ontwikkelaars, geen maandprijzen voor ChatGPT-abonnementen. De vermelde promotieprijs geldt minstens tot 21 november 2026.
De GPT-5.6 Sol-API-prijs in één oogopslag
Een token is een klein tekstdeel dat de API verwerkt. Bij een aanvraag betaal je apart voor wat je aanlevert — de input — en wat het model terugstuurt — de output. Daardoor is $4 per miljoen inputtokens niet hetzelfde als $4 per miljoen tokens in totaal.
| Type aanvraag | Input | Gecachte input | Cache-schrijvingen | Output |
| Standaard, korte context | $4 per 1 miljoen tokens | $0,40 per 1 miljoen tokens | $5 per 1 miljoen tokens | $20 per 1 miljoen tokens |
| Lange context | $8 per 1 miljoen tokens | $0,80 per 1 miljoen tokens | $10 per 1 miljoen tokens | $30 per 1 miljoen tokens |
Bij gecachte input betaalt een toepassing voor eerder opgeslagen invoer die opnieuw wordt gebruikt. Een cache-schrijving is de aparte kost voor het opslaan daarvan. Die twee posten zijn dus niet hetzelfde — een klein detail op papier, maar een flinke valkuil bij het ramen van API-uitgaven.
Korte en lange context hebben verschillende tarieven
Nee, de $4/$20-prijs geldt niet automatisch voor lange context. OpenAI vermeldt voor GPT-5.6 Sol bij lange context $8 per 1 miljoen inputtokens en $30 per 1 miljoen outputtokens. Ook de cachetarieven verdubbelen daar niet simpelweg mee: gecachte input staat op $0,80 en cache-schrijvingen op $10 per 1 miljoen tokens.
Wie een applicatie begroot, moet daarom eerst vaststellen welk type aanvraag die applicatie werkelijk verstuurt. Een workflow met korte context kan met de standaardtarieven worden doorgerekend; een workflow die lange context gebruikt, hoort in een eigen berekening thuis.
Voor bepaalde modellen die op of na 5 maart 2026 zijn uitgebracht, vermeldt OpenAI bovendien een toeslag van 10 procent voor regionale verwerking. Of die toeslag op jouw specifieke verwerking van toepassing is, hangt af van de gekozen verwerkingsoptie.
De daling verschilt voor input en output
De eerdere standaardtarieven bedroegen volgens de gerapporteerde prijswijziging $5 per 1 miljoen inputtokens en $30 per 1 miljoen outputtokens. Vergeleken met die bedragen daalt input met 20 procent en output met ongeveer 33,3 procent.
Dat betekent niet dat iedere toepassing automatisch 33,3 procent goedkoper wordt. De uiteindelijke besparing hangt af van de verhouding tussen input- en outputtokens. Een chatbot die vooral lange antwoorden genereert, profiteert anders dan een tool die grote documenten inleest en slechts korte resultaten terugstuurt.
De praktische rekensom is eenvoudig: splits je verwachte verbruik op in input en output, pas op beide stromen hun eigen tarief toe en tel eventuele cache- en contextkosten afzonderlijk op. Zo voorkom je dat de slogan “meer dan 20 procent goedkoper” een te rooskleurige totaalschatting wordt.
API-betaling is iets anders dan een ChatGPT-abonnement
De bedragen van $4 en $20 horen bij gebruik van de GPT-5.6 Sol API. Ze zijn dus geen nieuwe maandprijzen voor ChatGPT Pro, ChatGPT Plus of ChatGPT Business. API-verbruik wordt per token afgerekend; een abonnement werkt met een eigen product- en gebruiksmodel.
Daaruit volgt ook niet automatisch dat een lagere API-prijs de gebruikslimieten van ChatGPT verhoogt. Wie alleen ChatGPT gebruikt, krijgt niet ineens een rekening op basis van $4 per miljoen inputtokens. Wie een eigen applicatie bouwt, moet juist het afzonderlijke API-verbruik begroten.
Dat onderscheid is vooral belangrijk voor ontwikkelaars die dezelfde modelnaam in verschillende OpenAI-producten tegenkomen. GPT-5.6 Sol, ChatGPT en Codex zijn geen synoniemen voor één gedeelde tariefregel.
Tot wanneer geldt de promotieprijs?
De tariefkaart vermeldt de promotie voor GPT-5.6 Sol minstens tot 21 november 2026. Dat is een eindpunt voor de vermelde promotieperiode, geen garantie dat de $4/$20-prijs daarna blijft gelden.
Voor een tijdelijk project kun je de genoemde bedragen dus gebruiken als prijsbasis binnen die periode. Voor een langer contract of een applicatie met hoge volumes hoort de begroting rekening te houden met het feit dat promotietarieven kunnen veranderen.
De kern: voor standaardkorte context is GPT-5.6 Sol goedkoper geworden, maar de rekening wordt bepaald door vier dingen — input, output, cachegebruik en contextlengte. Wie die categorieën uit elkaar houdt, weet pas echt wat de lagere API-prijs voor zijn applicatie betekent.