Voor ontwikkelaars en bedrijven die veel AI-verkeer via de API verwerken, is vooral de prijsdaling van GPT-5.6 Luna opvallend: het model werd 80 procent goedkoper.
Luna wordt door OpenAI omschreven als het snelste en meest betaalbare model binnen de GPT-5.6-reeks. De nieuwe standaardtarieven gelden per 1 miljoen tokens .
| Onderdeel | Oude prijs per 1 miljoen tokens | Nieuwe prijs per 1 miljoen tokens |
|---|---|---|
| Invoer | $1,00 | $0,20 |
| Gecachte invoer | $0,25 | $0,10 |
| Uitvoer | $6,00 | $1,20 |
De gecombineerde prijs voor invoer en uitvoer komt daarmee uit op 1,40 dollar per miljoen tokens . De daadwerkelijke rekening hangt uiteraard af van de verhouding tussen de tekst die een toepassing naar het model stuurt en de tekst die het model genereert.
Ter vergelijking: GPT-5.6 Terra, de middenklasse binnen de reeks, daalt met 20 procent naar 2 dollar per miljoen invoertokens en 12 dollar per miljoen uitvoertokens. Voorheen waren die tarieven respectievelijk 2,50 en 15 dollar .
GPT-5.6 Sol blijft staan op 5 dollar voor invoer en 30 dollar voor uitvoer per miljoen tokens . De nieuwe prijzen gingen direct in op 30 juli 2026 en gelden voor de standaard API-laag .
OpenAI noemt vooral technische efficiëntie als reden voor de prijsverlagingen. Tegelijkertijd komt de stap op een moment waarop bedrijven kritischer kijken naar hun AI-uitgaven en goedkopere modellen de concurrentie opvoeren .
Volgens OpenAI zijn verbeteringen doorgevoerd in iedere laag van het systeem. Efficiëntere code en optimalisaties van de infrastructuur moeten ervoor zorgen dat klanten “aanzienlijk meer intelligentie per dollar” krijgen . Het bedrijf noemt dat het opschuiven van de grens tussen prijs en prestaties .
Een deel van de efficiëntiewinst kwam volgens berichtgeving voort uit GPT-5.6 Sol zelf. Het model herschreef tijdens de interne ontwikkeling zelfstandig productiekernels, waardoor de kosten om het model te bedienen met 20 procent daalden . Aanvullend kernelwerk verlaagde de totale kosten van modelbediening nog verder met 20 procent, terwijl experimenten de efficiëntie van tokenproductie met meer dan 15 procent verhoogden .
Naast die technische verbeteringen speelt de markt een belangrijke rol. Bedrijven zijn terughoudender geworden met dure AI-modellen wanneer het rendement van zulke toepassingen nog niet duidelijk is. CNBC schreef dat OpenAI daardoor rekening moet houden met een prijsgevoeliger klantenbestand .
Ook goedkopere open-source- en open-weightmodellen uit China vergroten de druk op OpenAI en Anthropic om aan te tonen waarom hun duurdere modellen de meerprijs waard zijn . Reuters beschreef de prijsverlagingen eveneens als een combinatie van efficiëntiewinst en een zakelijk klimaat waarin bedrijven hun AI-bestedingen nauwlettender volgen .
OpenAI-topman Sam Altman vatte de inzet op X als volgt samen: “We want to offer the best price/intelligence tradeoff at every level” . Vrij vertaald: het bedrijf wil op elk niveau de beste balans tussen prijs en intelligentie bieden.
De nieuwe tarieven maken Luna vooral interessant voor toepassingen met grote volumes en een sterke nadruk op snelheid. Denk aan geautomatiseerde verwerking, ondersteunende functies in software en andere toepassingen waarbij honderdduizenden of miljoenen modelinteracties snel kunnen oplopen.
De verlaging kan ook de drempel verlagen voor bedrijven die tot nu toe voorzichtig waren met grootschalige implementaties. Tegelijkertijd blijft de keuze tussen Luna, Terra en Sol afhangen van de gewenste kwaliteit, complexiteit en snelheid van een toepassing. De goedkoopste optie is niet automatisch de beste voor elke taak.
De lagere tarieven werken bovendien door in de manier waarop gebruik wordt meegeteld binnen betaalde abonnementen voor ChatGPT Work en Codex. Enterpriseklanten zouden daardoor meer AI-werk kunnen uitvoeren zonder een hogere abonnementsprijs .
De boodschap van OpenAI is duidelijk: betere technische efficiëntie moet AI goedkoper maken. Maar de timing laat ook zien hoe snel de concurrentie op de AI-markt verschuift van alleen maximale prestaties naar de vraag hoeveel bruikbaar werk een model per dollar kan leveren.