OpenAI анонсировала Ultrafast — режим для GPT 5.6 Sol, ускоряющий инференс до 14× по сравнению со стандартной обработкой; пиковая скорость — 750 токенов в секунду за счёт wafer scale чипов Cerebras CS 3. Режим нацелен на корпоративные задачи, где критична минимальная задержка: реагирование на инциденты, поддержка кл...
Ответ на исследование

Create a landscape editorial hero image for this Studio Global article: What is OpenAI's new "Ultrafast" mode for GPT-5.6 Sol, how fast is it compared to standard processing, what token throughput does it achieve. Article summary: Here is the full breakdown of OpenAI's Ultrafast mode for GPT-5.6 Sol:. Topic tags: general, documentation, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence.
13 августа 2026 года OpenAI представила Ultrafast — новый тариф API, который запускает флагманскую модель GPT-5.6 Sol на рекордной скорости . Режим работает на wafer-scale чипах Cerebras (системы Cerebras CS-3) и призван устранить традиционный компромисс между качеством модели и скоростью ответа для корпоративных приложений
.
OpenAI заявляет, что Ultrafast работает до 14 раз быстрее стандартного тарифа . Пиковая скорость генерации достигает 750 токенов в секунду, что примерно в 14 раз превышает пропускную способность стандартного GPT-5.6 Sol
. Для задач, чувствительных к задержкам, это сокращает время ответа с нескольких секунд до почти реального времени
. По данным Cerebras, ускорение достигается без малейших потерь в качестве: Sol Ultrafast сохраняет передовые показатели модели при гораздо более высокой скорости
.
Ultrafast работает на wafer-scale чипах Cerebras (системы Cerebras CS-3) . Cerebras и OpenAI совместно анонсировали партнёрство: Cerebras предоставляет аппаратное обеспечение для низколатентного инференса
. Важно понимать: это не новая модель. Ultrafast запускает существующий GPT-5.6 Sol (анонсированный в июне 2026 года и доступный широкой публике с июля) на специализированной инфраструктуре Cerebras
.
Openai нацеливает Ultrafast на бизнес-процессы, где решающую роль играет каждая миллисекунда . В рамках предварительного просмотра клиенты тестируют Ultrafast в пяти ключевых областях
:
Кроме того, Openai применяет Ultrafast в исследовательских рабочих процессах: поиск знаний, запросы к данным, работа с подключёнными инструментами и синтез информации .
Ultrafast находится в ограниченном предварительном доступе (по заявкам) для избранных клиентов API по состоянию на 13–14 августа 2026 года . Openai обещает расширять доступ по мере увеличения мощностей Cerebras
. Цены не раскрыты — известно лишь, что это будет премиум-тариф API
. Для справки: стандартные цены GPT-5.6 API остаются на уровне Sol $5/$30, Terra $2/$12 и Luna $0.20/$1.20 за миллион входных/выходных токенов соответственно
.
Ограниченный предварительный доступ объясняется осторожным подходом OpenAI к масштабированию новой партнёрской инфраструктуры. Когда мощности Cerebras возрастут, доступ будет расширен, но точные сроки пока не названы .
Studio Global AI
На этой странице есть ответ, подтвержденный источником, который вы можете продолжить внутри Studio Global.
OpenAI анонсировала Ultrafast — режим для GPT 5.6 Sol, ускоряющий инференс до 14× по сравнению со стандартной обработкой; пиковая скорость — 750 токенов в секунду за счёт wafer scale чипов Cerebras CS 3.
OpenAI анонсировала Ultrafast — режим для GPT 5.6 Sol, ускоряющий инференс до 14× по сравнению со стандартной обработкой; пиковая скорость — 750 токенов в секунду за счёт wafer scale чипов Cerebras CS 3. Режим нацелен на корпоративные задачи, где критична минимальная задержка: реагирование на инциденты, поддержка клиентов, финансовый анализ, написание кода, e commerce.
Ultrafast — это не новая модель, а премиум тариф API; доступ к нему пока ограничен списком ожидания для избранных клиентов, цены не раскрыты.