OpenAI tilbyr også Fast-modus for Sol. Den skal kunne gi opptil 2,5 ganger høyere hastighet enn standardbehandling, mot det dobbelte av standardprisen. Modusen endrer ikke modellens intelligensnivå.
OpenRouter viser for øyeblikket GPT-5.6 Sol til 2 dollar per million input-tokens og 10 dollar per million output-tokens – halvparten av OpenAIs nye direktepris. Det kan gjøre en aggregator som OpenRouter interessant for innkjøpere, men prisene bør kontrolleres nøye. De kan være knyttet til en bestemt leverandørrute eller en tidsbegrenset kampanje, og er ikke nødvendigvis en universell eller varig listepris.
Amazon Bedrock har på sin side ulike priser avhengig av hvordan forespørselen rutes. For Sol koster kort kontekst på opptil 272 000 tokens 5 dollar for input og 30 dollar for output gjennom global cross-region inference. In-region og geografisk cross-region inference er oppgitt til 5,50 dollar for input og 33 dollar for output.
AWS har utvidet støtten for GPT-5.6 Sol, Terra og Luna på bedrock-runtime. Modellene kan brukes gjennom Responses API, Converse API og Chat Completions API, og de støtter både geografisk og global cross-region inference.
global. kan sende forespørselen til enhver støttet kommersiell AWS-region der modellen er tilgjengelig. Rutevalget baseres på kapasitet i sanntid og gir den største tilgjengelige kapasitetsbasen. For Sol oppgir AWS en kvote på 10 millioner tokens per minutt for cross-region inference i hver støttede region. Kvoten inkluderer summen av input- og output-tokens på tvers av forespørsler.
Bedrock støtter tekst- og bildeinput, tekstoutput, prompt-caching og kontekstvinduer på opptil 1 million tokens for modellfamilien. AWS dokumenterer samtidig et kortere prisnivå på 272 000 tokens.
Den praktiske fordelen med cross-region inference er at AWS kan flytte trafikken til tilgjengelig kapasitet uten at kunden selv må håndtere en flaskehals i én enkelt region. Det kan gi høyere gjennomstrømming og en mulig reserve ved regional overbelastning eller driftsproblemer.
Global ruting passer likevel ikke for alle. Dersom data må behandles innenfor en bestemt region eller geografi, kan in-region eller geografisk ruting være nødvendig. Valget handler derfor ikke bare om laveste tokenpris, men også om datalokasjon, kontraktsvilkår og krav til etterlevelse.
Utviklingen peker mot en stadig tydeligere priskonkurranse mellom leverandører av avanserte AI-modeller. OpenAI startet med kraftige kutt i Luna og Terra, før selskapet senere reduserte prisen på flaggskipet Sol. Samtidig tilbød alternative kanaler allerede betydelige rabatter. Dermed blir total kostnad, kapasitet, svartid og innkjøpsfleksibilitet nesten like viktige som selve modellkvaliteten.
OpenAI har knyttet de tidligere Luna- og Terra-kuttene og den raskere Sol-behandlingen til forbedret pris–ytelse. Det tyder på at bedre effektivitet i kjøring og inferens i større grad blir gitt videre til kundene gjennom lavere priser og ulike hastighetsnivåer, i stedet for bare å bli beholdt som høyere marginer.
For større virksomheter kan Bedrock og andre rutelag derfor tilby mer enn en alternativ tokenpris: AWS-fakturering, IAM-kontroller, valg mellom streng regional behandling og bred global kapasitet, samt en enklere vei rundt regionale kapasitetsproblemer. Før en leverandør velges, bør kjøpere likevel kontrollere databehandling, modellversjon, rate limits, caching, kontraktsvilkår og om automatisk regional ruting tilfredsstiller virksomhetens krav.