Для клієнтів, яким важливіша швидкість, OpenAI також пропонує Fast mode для Sol: він може працювати до 2,5 раза швидше за Standard, але коштує вдвічі дорожче. При цьому інтелектуальні можливості моделі не змінюються.
На сторінці GPT-5.6 Sol в OpenRouter відображається ціна $2 за 1 млн вхідних і $10 за 1 млн вихідних токенів — приблизно вдвічі менше за нові короткоконтекстні ставки прямого API OpenAI.
Однак ці цифри описують конкретний маршрут через агрегатор, а не обов’язково загальну офіційну ціну OpenAI. На вартість можуть впливати провайдер, акційні умови, кешування, тип запиту та правила використання без власного ключа провайдера. Тому OpenRouter може бути вигідним каналом закупівлі, але перед міграцією потрібно перевірити стабільність ціни, ліміти, доступність і відповідність версії моделі.
AWS розширила доступ до GPT-5.6 Sol, Terra та Luna через endpoint bedrock-runtime. Тепер моделі підтримують Responses API, Converse API та Chat Completions API, а також географічну й глобальну cross-Region inference.
global. може вибрати будь-який підтримуваний комерційний регіон AWS у реальному часі, орієнтуючись на доступну потужність. Це найширший пул ресурсів, але він може не підходити для даних, які мають залишатися в конкретній країні або географії. Для GPT-5.6 Sol AWS вказує ліміт cross-Region inference на рівні 10 млн токенів на хвилину в кожному підтримуваному регіоні. У розрахунок входить сума вхідних і вихідних токенів для відповідних API-запитів.
У Bedrock усі три моделі підтримують текстовий та графічний вхід, текстовий вихід, кешування підказок і контекстне вікно до 1 млн токенів. AWS також розділяє короткий контекст на тарифний рівень до 272 тисяч токенів.
Ціна Sol у Bedrock залежить від маршруту. Для короткого контексту глобальний профіль коштує $5 за 1 млн вхідних і $30 за 1 млн вихідних токенів. Для обробки в одному регіоні або через географічний cross-Region профіль AWS вказує $5,50 і $33 відповідно.
Послідовність подій схожа на новий етап цінової конкуренції у frontier-AI. Спочатку OpenAI різко здешевила нижні рівні — особливо Luna, — а потім знизила ціну флагманської Sol, коли альтернативні канали вже пропонували значні знижки. Для покупців це означає, що порівнювати потрібно не лише якість моделі, а й повну вартість володіння: ціну токенів, кешування, пропускну здатність, затримку, ліміти та умови доступу.
OpenAI пояснювала липневі зміни покращенням співвідношення ціни та продуктивності. Це сигналізує, що ефективніші системи виконання та інференсу дедалі частіше перетворюються на нижчі тарифи або додаткові швидкісні режими, а не лише на вищу маржу постачальника.
Для корпоративних клієнтів Amazon Bedrock додає переваги, яких не видно в простій ціні за токен: єдині рахунки AWS, інтеграцію з IAM, контроль над регіоном обробки та можливість автоматично обходити локальні проблеми з потужністю. Водночас глобальна маршрутизація може суперечити вимогам до локалізації даних.
Тому найкраща стратегія закупівлі — не просто обрати найдешевший endpoint. Перед запуском варто порівняти прямий API OpenAI, Bedrock і агрегатори за контрактними умовами, обробкою даних, ідентичністю версії моделі, rate limits, поведінкою кешу та відповідністю cross-Region маршрутизації вимогам безпеки й комплаєнсу.