Torsdag 13. august 2026 annoncerede Cerebras og OpenAI Ultrafast, en ny API tjeneste til GPT 5.6 Sol, der kører med op til 750 output tokens i sekundet – op til 14 gange hurtigere end standardbehandling.
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Cerebras and OpenAI jointly announce on Thursday regarding a new "Ultrafast" service tier for GPT-5.6 Sol, what speeds and benchmar. Article summary: On **Thursday, August 13, 2026**, Cerebras and OpenAI jointly announced **Ultrafast mode**, a new API service tier for **GPT-5.6 Sol** — OpenAI's most capable model — powered entirely by Cerebras's wafer-scale hardware [. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
Torsdag 13. august 2026 annoncerede Cerebras og OpenAI i fællesskab Ultrafast, en ny API-tjeneste til GPT-5.6 Sol — OpenAI's mest avancerede model — der udelukkende kører på Cerebras' wafer-scale-hardware . Tjenesten leverer op til 750 output-tokens i sekundet og er op til 14 gange hurtigere end OpenAI's standardbehandling
.
Det er første gang, OpenAI lader en frontlinjemodel i produktion køre på andet end Nvidia-silicium i denne skala . Adgangen er i første omgang begrænset til en udvalgt gruppe kunder, men udvides efterhånden som kapaciteten vokser
.
Ydelsestallene placerer Ultrafast i en klasse for sig sammenlignet med traditionelle GPU-baserede installationer:
Cerebras offentliggjorde også en kørsel af Humanity's Last Exam, en benchmark med 2.500 spørgsmål på kandidatniveau. GPT-5.6 Sol Ultrafast gennemførte hele sættet på 11 timer og 11 minutter; Claude Fable 5 brugte 78 timer og 27 minutter på at nå sammenlignelige resultater .
Cerebras' WSE-3 (Wafer-Scale Engine 3) er nøglen. I modsætning til konventionelle multi-GPU-klynger, der samler dusinvis eller hundredvis af små chips, er WSE-3 en enkelt, massiv silicium-wafer på størrelse med en middagstallerken. Det eliminerer flaskehalse i kommunikationen mellem chips, som plager distribuerede GPU-systemer .
Arkitekturen inkluderer 44 GB indbygget SRAM, hvilket gør det muligt at have hele GPT-5.6 Sol-modellen placeret i processorens lokale hukommelse . Under inferens behøver modelvægtene aldrig at blive sendt til langsom ekstern DRAM, hvilket fjerner den hukommelsesbåndbredde-væg, der typisk begrænser store sprogmodellers hastighed
.
Helt konkret betyder det, at et agent-svar på 3.000 tokens, der tager omkring 43 sekunder på en standard H100-klynge, gennemføres på cirka 4 sekunder på Cerebras-hardware .
På trods af den banebrydende tekniske annoncering faldt Cerebras-aktien (NASDAQ: CBRS) kraftigt. Kursen faldt 11,85 % i almindelig handel til lukkekurs $231,01 og faldt op til 17 % i eftermarkedet .
Nedturen skyldtes dog primært Cerebras' Q2 2026-regnskab offentliggjort aftenen før (onsdag 12. august) — en rekordomsætning på $209,9 millioner (mere end en fordobling år-over-år), men et langt større end forventet justeret tab på -$2,98 per aktie, sammenlignet med analytikernes forventning på -$0,18 .
Analytikernes reaktion var blandet. Morgan Stanley hævede sit kursmål for CBRS fra $273 til $279, mens Citi fastholdt en Køb-anbefaling, men sænkede målet til $320 .
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Torsdag 13. august 2026 annoncerede Cerebras og OpenAI Ultrafast, en ny API tjeneste til GPT 5.6 Sol, der kører med op til 750 output tokens i sekundet – op til 14 gange hurtigere end standardbehandling.
Torsdag 13. august 2026 annoncerede Cerebras og OpenAI Ultrafast, en ny API tjeneste til GPT 5.6 Sol, der kører med op til 750 output tokens i sekundet – op til 14 gange hurtigere end standardbehandling. Arkitekturen bygger på Cerebras' WSE 3 (Wafer Scale Engine 3), en enkelt, kæmpestor silicium wafer med 44 GB indbygget SRAM, der eliminerer flaskehalse mellem chips.
På trods af den tekniske milepæl faldt Cerebras aktien (NASDAQ: CBRS) 11,85 % i almindelig handel og op til 17 % i eftermarkedet, primært på grund af et skuffende Q2 regnskab.