13 sierpnia 2026 roku Cerebras i OpenAI ogłosiły tryb Ultrafast – nowy poziom usług API dla GPT 5.6 Sol, działający z prędkością do 750 tokenów wyjściowych na sekundę – nawet 14× szybciej niż standardowe przetwarzanie. Sercem rozwiązania jest autorski układ Cerebras WSE 3 z 44 GB pamięci SRAM na chipie, który elimin...
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Cerebras and OpenAI jointly announce on Thursday regarding a new "Ultrafast" service tier for GPT-5.6 Sol, what speeds and benchmar. Article summary: On **Thursday, August 13, 2026**, Cerebras and OpenAI jointly announced **Ultrafast mode**, a new API service tier for **GPT-5.6 Sol** — OpenAI's most capable model — powered entirely by Cerebras's wafer-scale hardware [. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
W czwartek, 13 sierpnia 2026 roku, Cerebras i OpenAI wspólnie ogłosiły tryb Ultrafast – nowy poziom usług API dla GPT-5.6 Sol, najbardziej zaawansowanego modelu OpenAI, zasilanego w całości przez autorskie chipy Cerebras . Tryb ten osiąga do 750 tokenów wyjściowych na sekundę i zapewnia wnioskowanie nawet 14× szybsze niż standardowe przetwarzanie OpenAI
.
To pierwszy przypadek, gdy OpenAI publicznie uruchomiło produkcyjny model graniczny na układach innych niż Nvidia na taką skalę . Dostęp jest początkowo ograniczony do wybranej grupy klientów, z planami stopniowego rozszerzania w miarę wzrostu mocy obliczeniowych
.
Osiągi trybu Ultrafast stawiają go w zupełnie innej lidze w porównaniu z konwencjonalnymi wdrożeniami na GPU:
Cerebras opublikowało również wyniki testu Humanity's Last Exam – zestawu 2500 pytań na poziomie studiów magisterskich. GPT-5.6 Sol Ultrafast rozwiązał cały zestaw w 11 godzin i 11 minut; Claude Fable 5 potrzebował 78 godzin i 27 minut, by osiągnąć porównywalne wnioski .
Kluczowym elementem jest Cerebras WSE-3 (Wafer-Scale Engine 3). W przeciwieństwie do konwencjonalnych klastrów GPU, które łączą ze sobą dziesiątki lub setki małych układów, WSE-3 to pojedynczy, ogromny krzemowy wafler wielkości dużego talerza. Eliminuje to wąskie gardła komunikacji między chipami, które są zmorą rozproszonych systemów GPU .
Architektura zawiera 44 GB pamięci SRAM na chipie, co pozwala na przechowywanie całego modelu GPT-5.6 Sol w lokalnej pamięci procesora . Podczas wnioskowania wagi modelu nigdy nie muszą być przesyłane do wolnej pamięci DRAM, co usuwa typowe ograniczenie przepustowości pamięci, spowalniające dekodowanie dużych modeli językowych
.
Dla porównania: wykonanie zadania agenta o długości 3000 tokenów, które na standardowym klastrze H100 trwa około 43 sekund, na sprzęcie Cerebras zajmuje zaledwie około 4 sekund .
Mimo przełomowego ogłoszenia technologicznego, akcje Cerebras (NASDAQ: CBRS) gwałtownie spadły. Kurs zamknął się na poziomie 231,01 USD, co oznacza spadek o 11,85% w regularnej sesji, a w handlu po godzinach zniżkował nawet o 17% .
Spadek ten był jednak w dużej mierze spowodowany wynikami finansowymi Cerebras za II kwartał 2026 roku, opublikowanymi poprzedniego wieczoru (12 sierpnia). Firma osiągnęła rekordowe przychody w wysokości 209,9 mln USD (ponad dwukrotnie więcej niż rok wcześniej), ale odnotowała znacznie wyższą od oczekiwań stratę w przeliczeniu na akcję: -2,98 USD wobec szacunków analityków na poziomie -0,18 USD .
Opinie analityków były mieszane. Morgan Stanley podniósł cenę docelową dla CBRS z 273 do 279 USD, podczas gdy Citi utrzymało rekomendację „Kupuj”, ale obniżyło cenę docelową do 320 USD .
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
13 sierpnia 2026 roku Cerebras i OpenAI ogłosiły tryb Ultrafast – nowy poziom usług API dla GPT 5.6 Sol, działający z prędkością do 750 tokenów wyjściowych na sekundę – nawet 14× szybciej niż standardowe przetwarzanie.
13 sierpnia 2026 roku Cerebras i OpenAI ogłosiły tryb Ultrafast – nowy poziom usług API dla GPT 5.6 Sol, działający z prędkością do 750 tokenów wyjściowych na sekundę – nawet 14× szybciej niż standardowe przetwarzanie. Sercem rozwiązania jest autorski układ Cerebras WSE 3 z 44 GB pamięci SRAM na chipie, który eliminuje wąskie gardła pamięciowe typowe dla klastrów GPU.
Mimo technologicznego przełomu akcje Cerebras (NASDAQ: CBRS) spadły o 11,85% w ciągu sesji i nawet 17% po godzinach, głównie z powodu rozczarowujących wyników finansowych za II kwartał 2026 roku.