Le tarif direct de GPT 5.6 Sol passe de 5 à 4 dollars par million de tokens en entrée et de 30 à 20 dollars en sortie pour le contexte court, soit respectivement 20 % et environ 33 %. La baisse reste moins spectaculaire que celles de GPT 5.6 Luna ( 80 %) et Terra ( 20 %) annoncées en juillet ; OpenAI propose aussi u...
Réponse de recherche

Create a landscape editorial hero image for this Studio Global article: What changes did OpenAI make to GPT 5.6 Sol’s API and credit pricing, how does the reduction compare with the earlier GPT 5.6 Luna and Terra. Article summary: OpenAI has cut direct GPT‑5.6 Sol API pricing to $4/M short context input tokens and $20/M output tokens, from the earlier $5/M and $30/M—20% lower on input and about 33% lower on output.. Topic tags: general web, openai, ai, productivity, code. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thum
La baisse de prix de GPT-5.6 Sol marque un nouveau tournant dans la compétition entre modèles d’IA avancés. Après avoir fortement réduit le prix de ses versions Luna et Terra, OpenAI s’attaque désormais à son modèle le plus puissant — et le plus cher — sur l’API et certains crédits d’utilisation.
Pour le contexte court, jusqu’à 272 000 tokens, OpenAI affiche désormais les tarifs suivants, en dollars par million de tokens :
| Usage | Ancien tarif | Nouveau tarif | Évolution |
|---|---|---|---|
| Entrée | 5 $ | 4 $ | -20 % |
| Sortie | 30 $ | 20 $ | environ -33 % |
| Entrée mise en cache | 0,50 $ | 0,40 $ | -20 % |
Pour le contexte long, le tarif indiqué est de 8 $ par million de tokens en entrée et 30 $ en sortie. La page tarifaire d’OpenAI précise que le nouveau prix promotionnel de Sol est disponible au moins jusqu’au 21 novembre 2026.
La réduction concerne l’API ainsi que les crédits éligibles associés à certains produits professionnels et de développement. Les abonnements ChatGPT Pro, Plus et Business ne sont pas annoncés comme modifiés par cette mesure.
OpenAI avait réduit en juillet le prix de ses deux modèles moins coûteux :
La baisse de Sol est donc plus modérée que celle de Luna, mais elle touche le modèle qui pèse le plus lourd dans la facture des applications produisant beaucoup de tokens de sortie. OpenAI avait initialement conservé les tarifs de Sol tout en lançant un mode Fast, capable d’atteindre jusqu’à 2,5 fois la vitesse du traitement standard, au prix du double du tarif normal.
Sol conserve le positionnement de modèle phare de la famille GPT-5.6. Son prix reste supérieur à celui de Terra et Luna, ce qui reflète son rôle dans les tâches nécessitant le niveau de raisonnement et de performance le plus élevé.
Dans cette gamme, la logique est relativement claire :
Le fait que Sol soit désormais moins cher ne signifie donc pas qu’OpenAI change sa hiérarchie de modèles. Le modèle reste le plus onéreux de la gamme, mais l’écart de prix devient plus difficile à justifier pour les acheteurs qui peuvent se contenter d’un autre niveau de performance.
OpenRouter affiche actuellement GPT-5.6 Sol à 2 $ par million de tokens en entrée et 10 $ en sortie, soit la moitié du nouveau tarif direct d’OpenAI.
Pour un développeur ou une entreprise, cette différence peut rendre un agrégateur intéressant. Elle doit toutefois être examinée avec prudence : le prix dépend de la route utilisée, du fournisseur sous-jacent, des éventuelles promotions et des conditions applicables au trafic non-BYOK (« bring your own key », ou clé fournisseur propre).
Autrement dit, le tarif OpenRouter constitue une option d’approvisionnement potentiellement avantageuse, mais pas nécessairement un prix catalogue universel et durable. Avant de déplacer une charge de production, il faut notamment vérifier la parité de version du modèle, les limites de débit, la gestion du cache, les engagements contractuels et les règles de traitement des données.
Amazon Web Services a étendu la disponibilité de GPT-5.6 Sol, Terra et Luna sur le point de terminaison bedrock-runtime. Les trois modèles peuvent être utilisés avec les API Responses, Converse et Chat Completions, ainsi qu’avec les profils d’inférence interrégionale géographique et mondiale.
global. peut diriger la requête vers n’importe quelle région commerciale AWS prise en charge, en fonction de la capacité disponible en temps réel. Cette approche maximise la capacité accessible, mais elle ne convient pas aux données qui doivent rester dans un territoire déterminé. Au lancement, Sol était disponible dans les régions américaines US East (Virginie du Nord) et US East (Ohio). Terra et Luna étaient également proposés dans US West (Oregon).
L’intérêt principal du routage interrégional est opérationnel : l’application n’est plus obligée de gérer seule un engorgement ou une indisponibilité dans une région unique. AWS documente pour GPT-5.6 Sol un quota de 10 millions de tokens par minute dans chaque région prise en charge, en additionnant les tokens d’entrée et de sortie des requêtes concernées.
Il ne s’agit pas d’une garantie de disponibilité illimitée, mais d’un plafond de quota pour l’inférence interrégionale. Les équipes doivent donc toujours tester les limites, les temps de réponse et les mécanismes de reprise propres à leur architecture.
Sur Bedrock, la famille GPT-5.6 prend en charge les entrées texte et image, la sortie texte, la mise en cache des prompts et une fenêtre de contexte pouvant atteindre 1 million de tokens. AWS distingue également une tranche de tarification pour le contexte court de 272 000 tokens.
Pour Sol, le prix court-contextuel mondial publié par AWS est de 5 $ en entrée et 30 $ en sortie par million de tokens. Les tarifs In-Region et Geo sont de 5,50 $ et 33 $. En contexte long, les prix mondiaux indiqués atteignent 10 $ en entrée et 45 $ en sortie, contre 11 $ et 49,50 $ pour les options In-Region et Geo.
La séquence Sol-Luna-Terra illustre un marché où la puissance brute du modèle ne suffit plus. Les fournisseurs cherchent à transformer leurs progrès d’efficacité d’inférence en baisses de prix, en gains de vitesse ou en offres adaptées à chaque type de charge. OpenAI affirme ainsi que ses améliorations de rapport qualité-prix permettent de réduire le prix de Luna et Terra tout en accélérant Sol.
Pour les entreprises, le choix ne se résume donc plus au prix affiché par million de tokens. Il faut comparer le coût total :
Bedrock apporte ici une couche de gestion utile aux organisations déjà équipées d’AWS : facturation centralisée, permissions IAM, routage contrôlé et accès à un bassin de capacité plus large. OpenRouter et d’autres agrégateurs offrent, de leur côté, une voie d’achat différente et peuvent parfois afficher des tarifs plus bas.
La stratégie la plus solide consiste donc à tester les trois canaux — OpenAI en direct, Bedrock et un agrégateur — avec des charges représentatives. Le prix le plus bas n’est réellement avantageux que si la version du modèle, la qualité de service, la gestion des données et le routage automatique répondent aux exigences de production.
Studio Global AI
Cette page comprend une réponse basée sur la source que vous pouvez continuer dans Studio Global.
Le tarif direct de GPT 5.6 Sol passe de 5 à 4 dollars par million de tokens en entrée et de 30 à 20 dollars en sortie pour le contexte court, soit respectivement 20 % et environ 33 %.
Le tarif direct de GPT 5.6 Sol passe de 5 à 4 dollars par million de tokens en entrée et de 30 à 20 dollars en sortie pour le contexte court, soit respectivement 20 % et environ 33 %. La baisse reste moins spectaculaire que celles de GPT 5.6 Luna ( 80 %) et Terra ( 20 %) annoncées en juillet ; OpenAI propose aussi un mode Fast jusqu’à 2,5 fois plus rapide, au double du prix standard.
Sur OpenRouter, une tarification affichée à 2 dollars en entrée et 10 dollars en sortie peut être nettement inférieure au tarif direct, mais elle dépend de la route et des conditions commerciales du service.