Il prezzo diretto di GPT 5.6 Sol passa da 5 a 4 dollari per milione di token in ingresso e da 30 a 20 dollari per i token in uscita: rispettivamente 20% e circa 33%. La riduzione è inferiore a quella già applicata ai modelli più economici: Luna è sceso dell’80%, mentre Terra del 20%.
Research answer

Create a landscape editorial hero image for this Studio Global article: What changes did OpenAI make to GPT 5.6 Sol’s API and credit pricing, how does the reduction compare with the earlier GPT 5.6 Luna and Terra. Article summary: OpenAI has cut direct GPT‑5.6 Sol API pricing to $4/M short context input tokens and $20/M output tokens, from the earlier $5/M and $30/M—20% lower on input and about 33% lower on output.. Topic tags: general web, openai, ai, productivity, code. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thum
OpenAI ha ridotto il prezzo dell’API di GPT-5.6 Sol, il modello di punta della famiglia, portando la tariffa per il contesto breve a 4 dollari per milione di token in ingresso e 20 dollari per milione di token in uscita. In precedenza i prezzi erano rispettivamente di 5 e 30 dollari: il taglio è quindi del 20% sull’input e di circa un terzo sull’output.
Per il contesto lungo, la nuova tariffa indicata da OpenAI è di 8 dollari per milione di token in ingresso e 30 dollari per milione di token in uscita. La riduzione riguarda anche i crediti acquistati per alcuni prodotti destinati a sviluppatori e agenti; gli abbonamenti ChatGPT Pro, Plus e Business non risultano invece modificati.
Il confronto con il precedente intervento di OpenAI mostra una strategia a più livelli:
A luglio OpenAI aveva inoltre introdotto Fast mode per Sol: fino a 2,5 volte più veloce dell’elaborazione Standard, ma al doppio del prezzo. L’opzione è pensata per chi privilegia la latenza senza cambiare modello o livello di intelligenza.
Sol resta il modello ammiraglia perché occupa il vertice della gamma e mantiene il prezzo più alto. Terra è presentato come il compromesso tra capacità, prestazioni e costi per i carichi di produzione; Luna è invece orientato a volumi elevati e applicazioni sensibili alla latenza, come classificazione, riepilogo e instradamento.
La pagina di GPT-5.6 Sol su OpenRouter mostra attualmente 2 dollari per milione di token in ingresso e 10 dollari in uscita: circa la metà delle nuove tariffe dirette di OpenAI per il contesto breve.
Il confronto, però, non equivale automaticamente a un nuovo listino universale. OpenRouter è un aggregatore che instrada le richieste verso i provider e può applicare prezzi specifici per una determinata rotta, promozioni o condizioni temporanee. Prima di spostare un carico di lavoro, conviene verificare la durata dell’offerta, la parità della versione del modello, i limiti di utilizzo, la gestione della cache e le condizioni contrattuali.
Anche Amazon Bedrock presenta prezzi diversi a seconda del routing. Per Sol, AWS documenta nel contesto breve 5 dollari per milione di token in ingresso e 30 dollari in uscita con il profilo globale cross-region; le opzioni in-region e geographic cross-region salgono a 5,50 e 33 dollari.
AWS ha ampliato la disponibilità di GPT-5.6 Sol, Terra e Luna sull’endpoint bedrock-runtime. I tre modelli possono essere utilizzati tramite le API Responses, Converse e Chat Completions, con supporto alle modalità di inferenza geografica e globale cross-region.
global. può inviare la richiesta a qualsiasi Regione commerciale AWS supportata, scegliendo in base alla capacità disponibile in tempo reale. Offre il bacino di capacità più ampio, ma può essere inadatto ai carichi soggetti a requisiti rigidi di residenza dei dati. Il vantaggio pratico è ridurre la dipendenza da una singola Regione e gestire meglio congestioni o indisponibilità locali. Per GPT-5.6 Sol, AWS indica una quota di inferenza cross-region di 10 milioni di token al minuto per ogni Regione supportata; il conteggio include token di input e output.
La documentazione AWS indica per la famiglia Sol, Terra e Luna il supporto a input testuali e immagini, output testuale, prompt caching e una finestra di contesto fino a 1 milione di token. AWS distingue inoltre una fascia di prezzo per il contesto breve da 272.000 token.
Per gli sviluppatori, il cambiamento non consiste quindi soltanto nell’avere un endpoint aggiuntivo: i profili di inferenza diventano anche strumenti di gestione della capacità, della latenza e dei vincoli geografici. La scelta del profilo, tuttavia, deve essere coerente con i requisiti di conformità dell’applicazione.
La sequenza dei tagli suggerisce che la competizione tra modelli frontier si stia spostando dalla sola qualità alla combinazione di costo totale, velocità, capacità e flessibilità di acquisto. OpenAI ha prima ridotto drasticamente il prezzo del modello più economico e poi quello del modello intermedio; il taglio successivo di Sol arriva mentre canali alternativi mostrano tariffe molto aggressive.
OpenAI ha collegato i prezzi più bassi di Luna e Terra e le migliori prestazioni di Sol a progressi nel rapporto prezzo-prestazioni. In altre parole, una parte dei guadagni di efficienza nell’inferenza viene trasferita agli utenti sotto forma di prezzi ridotti e modalità di elaborazione più rapide.
Per le aziende, però, il prezzo per token è solo una voce del conto. L’uso di Bedrock può offrire fatturazione AWS, controlli IAM e routing regionale integrato; un aggregatore può semplificare il confronto tra provider; l’API diretta di OpenAI può invece ridurre la complessità del percorso tra applicazione e modello. Ogni opzione comporta compromessi su governance, disponibilità, dati e prestazioni.
La scelta più solida non è dunque semplicemente quella dell’endpoint più economico. Prima di migrare un workload è opportuno confrontare termini contrattuali, trattamento dei dati, versione effettiva del modello, limiti di velocità, comportamento della cache, latenza e regole di instradamento cross-region. Per i dati soggetti a vincoli geografici, in particolare, il routing globale deve essere valutato con cautela.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Il prezzo diretto di GPT 5.6 Sol passa da 5 a 4 dollari per milione di token in ingresso e da 30 a 20 dollari per i token in uscita: rispettivamente 20% e circa 33%.
Il prezzo diretto di GPT 5.6 Sol passa da 5 a 4 dollari per milione di token in ingresso e da 30 a 20 dollari per i token in uscita: rispettivamente 20% e circa 33%. La riduzione è inferiore a quella già applicata ai modelli più economici: Luna è sceso dell’80%, mentre Terra del 20%.
OpenRouter mostra una tariffa di 2 dollari in ingresso e 10 dollari in uscita per milione di token, ma il prezzo dipende dal canale e dalle condizioni della piattaforma.