Тож твердження про «нове математичне відкриття» наразі не має підтвердження у наведених даних.
Terminal-Bench 2.1 перевіряє планування, роботу з інструментами та здатність автономно виконувати завдання в командному рядку. Це своєрідний стрес-тест для моделей, які мають не просто генерувати текст, а самостійно діяти в терміналі Y.
Результат Sol Ultra приблизно на 4 відсоткові пункти вищий за показник Claude Mythos 5 і більш ніж на 8 пунктів перевищує результат GPT-5.5 BI.
OpenAI оцінила всі три моделі як такі, що мають «високий» рівень ризику у сферах кібербезпеки та біології. Водночас жодна з них не досягла рівня «критичного» ризику A.
GPT-5.6 — це не одна модель, а три рівні продуктивності:
| Модель | Вхідні дані | Вихідні дані | Основне призначення |
|---|---|---|---|
| GPT-5.6 Sol | $5,00 | $30,00 | Складне міркування, програмування, кібербезпека, автономні завдання |
| GPT-5.6 Terra | $2,50 | $15,00 | Збалансована робота на рівні GPT-5.5 за нижчою ціною |
| GPT-5.6 Luna | $1,00 | $6,00 | Масові завдання: класифікація, вилучення даних, маршрутизація |
Для GPT-5.6 також передбачено кешування промптів. Запис у кеш тарифікується за ставкою, що у 1,25 раза перевищує звичайну ціну вхідних токенів. Читання з кешу отримує знижку 90%. Моделі підтримують явні точки кешування, а мінімальний термін життя кешу становить 30 хвилин H.
Головна причина — пряме втручання уряду США. Адміністрація Трампа попросила OpenAI обмежити доступ до моделей перед запуском, посилаючись на міркування національної безпеки TAK. За повідомленнями джерел, кожну з приблизно 20 організацій-партнерів погоджували окремо AI.
Американська адміністрація вважала, що можливості GPT-5.6 можуть бути співставними з моделями рівня Mythos — назва відсилає до Claude Mythos від Anthropic. Обмеження для GPT-5.6 пов'язують із тією самою політичною та експортною рамкою, у межах якої раніше були застосовані заходи щодо моделей Anthropic A.
OpenAI публічно заявила, що подібний державний контроль «позбавляє найкращих інструментів користувачів, розробників, компанії, фахівців із кіберзахисту та міжнародних партнерів, які їх потребують» A.
OpenAI заявила, що планує розширити доступ «якнайшвидше», але конкретної дати повного запуску поки не назвала H. Сем Альтман очікує ширшої доступності «протягом кількох тижнів» A. У картці безпеки моделі компанія також зазначила, що планує зробити Sol, Terra та Luna загальнодоступними найближчими тижнями D.
Поки що GPT-5.6 залишається не продуктом для всіх користувачів, а обмеженим попереднім переглядом для партнерів, допущених у межах узгодженого зі США запуску.