Prisendringene trådte i kraft umiddelbart 30. juli 2026, rundt tre uker etter at GPT-5.6-familien ble lansert offentlig 9. juli .
GPT-5.6 Luna er modellen OpenAI beskriver som den raskeste og rimeligste i serien. Den er særlig rettet mot arbeidslaster med høyt volum, der mange forespørsler skal behandles raskt .
| Måleenhet | Tidligere pris per 1 million tokens | Ny pris per 1 million tokens |
|---|---|---|
| Input | 1,00 dollar | 0,20 dollar |
| Bufret input | – | 0,10 dollar |
| Output | 6,00 dollar | 1,20 dollar |
Input-tokens er teksten eller dataene modellen mottar, mens output-tokens er svaret den genererer. Med de nye satsene blir den samlede input- og output-prisen for Luna 1,40 dollar per million tokens .
Til sammenligning koster GPT-5.6 Terra nå 2 dollar per million input-tokens og 12 dollar per million output-tokens, ned fra henholdsvis 2,50 og 15 dollar. GPT-5.6 Sol ligger fortsatt på 5 dollar for input og 30 dollar for output per million tokens .
OpenAI trekker fram bedre effektivitet i hele teknologistakken som hovedforklaring. Selskapet sier at forbedringer i modellarkitekturen, programvaren og systemene som kjører modellene, gjør det mulig å levere «vesentlig mer intelligens per dollar» .
OpenAI omtaler strategien som å flytte grensen for forholdet mellom pris og ytelse. Ifølge selskapet har arbeid på såkalte kjerner – de lavnivådelene av programvaren som effektiviserer modellkjøringen – redusert kostnaden ved å levere modellen med 20 prosent. Andre eksperimenter skal ha økt effektiviteten i token-genereringen med mer enn 15 prosent .
En del av effektiviseringsarbeidet ble ifølge rapportene også drevet av GPT-5.6 Sol, som selv skrev om produksjonskode for å redusere kostnadene ved modellkjøring med 20 prosent .
Prisreduksjonene kommer samtidig som virksomheter vurderer AI-regningene sine mer nøye. Mange bedrifter har vært tilbakeholdne med å ta i bruk dyre modeller uten et tydelig bilde av avkastningen på investeringen .
OpenAI møter også konkurranse fra rimeligere alternativer, blant annet kinesiske modeller med åpne vekter. Det øker presset på både OpenAI og andre AI-selskaper for å dokumentere at dyrere modeller gir tilsvarende merverdi . Reuters beskriver derfor kuttene som et resultat av både tekniske effektiviseringsgevinster og at bedriftene gransker AI-forbruket tettere .
OpenAI-sjef Sam Altman kunngjorde endringene på X. «Vi ønsker å tilby det beste forholdet mellom pris og intelligens på hvert nivå», skrev han .
For utviklere som bygger apper og tjenester med OpenAI API, kan Luna-kuttet få størst betydning ved stor bruk. Lavere kostnad per million tokens gjør det rimeligere å bruke modellen til for eksempel automatisering, kundeservice og andre oppgaver med mange forespørsler – uten at API-prisen øker tilsvarende.
De lavere prisene gjenspeiles også i hvordan bruken teller mot betalte abonnementer i ChatGPT Work og Codex. Bedriftskunder skal dermed kunne utføre mer AI-arbeid uten å betale mer .
Prisendringen viser samtidig hvor raskt markedet er i ferd med å bevege seg: OpenAI lanserte GPT-5.6-familien for bare noen uker siden, men har allerede justert prisene kraftig for de to rimeligere modellene. Selskapet fremstiller dette som et resultat av teknisk fremgang, mens konkurransen om kostnadsbevisste bedriftskunder gjør priskutt stadig viktigere.