OpenAI und Cerebras kündigten am 13. August 2026 den neuen API Tier 'Ultrafast' für GPT 5.6 Sol an, der auf Cerebras Wafer Scale Hardware läuft.
Forschungsantwort

Create a landscape editorial hero image for this Studio Global article: What did Cerebras and OpenAI jointly announce on Thursday regarding a new "Ultrafast" service tier for GPT-5.6 Sol, what speeds and benchmar. Article summary: On **Thursday, August 13, 2026**, Cerebras and OpenAI jointly announced **Ultrafast mode**, a new API service tier for **GPT-5.6 Sol** — OpenAI's most capable model — powered entirely by Cerebras's wafer-scale hardware [. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
OpenAI und der Chip-Spezialist Cerebras haben am Donnerstag, den 13. August 2026, gemeinsam den neuen Service-Tier Ultrafast für das leistungsfähigste OpenAI-Modell GPT-5.6 Sol vorgestellt . Angetrieben wird der Dienst ausschließlich von Cerebras' Wafer-Scale-Hardware. Der Tier erreicht eine Spitzengeschwindigkeit von 750 Ausgabe-Tokens pro Sekunde und ist damit bis zu 14-mal schneller als die Standardverarbeitung von OpenAI
.
Es ist das erste Mal, dass OpenAI ein Spitzenmodell im Produktivbetrieb öffentlich auf Nicht-Nvidia-Silizium in dieser Größenordnung laufen lässt . Der Zugang ist zunächst auf eine ausgewählte Kundengruppe beschränkt; ein breiterer Rollout ist geplant, sobald die Kapazitäten wachsen
.
Die Leistungsdaten heben Ultrafast deutlich von herkömmlichen GPU-basierten Bereitstellungen ab:
Cerebras veröffentlichte zudem einen Durchlauf von „Humanity’s Last Exam“, einem Benchmark mit 2.500 Fragen auf Graduiertenniveau. GPT-5.6 Sol Ultrafast beantwortete den gesamten Fragenkatalog in 11 Stunden und 11 Minuten; Claude Fable 5 benötigte dafür 78 Stunden und 27 Minuten .
Cerebras' WSE-3 (Wafer-Scale Engine 3) ist der entscheidende Enabler. Im Gegensatz zu herkömmlichen Multi-GPU-Clustern, die dutzende oder hunderte kleiner Chips zusammenschalten, ist der WSE-3 ein einziger, massiver Silizium-Wafer in der Größe eines Esstellers. Dadurch entfallen die Kommunikationsengpässe zwischen den Chips, die verteilte GPU-Systeme plagen .
Die Architektur verfügt über 44 GB On-Chip-SRAM, sodass das gesamte GPT-5.6 Sol-Modell in den lokalen Speicher des Prozessors passt . Während der Inferenz müssen die Modellgewichte nie zu langsamem externen DRAM übertragen werden, was die Speicherbandbreiten-Barriere beseitigt, die normalerweise die Decodierung großer Sprachmodelle ausbremst
.
Konkret bedeutet das: Ein Agenten-Durchlauf mit 3.000 Tokens, der auf einem Standard-H100-Cluster etwa 43 Sekunden dauert, ist auf der Cerebras-Hardware in rund 4 Sekunden erledigt .
Trotz der bahnbrechenden technischen Ankündigung fiel die Cerebras-Aktie (NASDAQ: CBRS) deutlich. Der Aktienkurs gab im regulären Handel um 11,85 % nach und schloss bei 231,01 US-Dollar; im nachbörslichen Handel fiel er zeitweise um bis zu 17 % .
Der Rückgang war jedoch größtenteils auf den am Vorabend (Mittwoch, 12. August) veröffentlichten Quartalsbericht für Q2 2026 zurückzuführen. Cerebras meldete zwar einen Rekordumsatz von 209,9 Millionen US-Dollar (mehr als eine Verdopplung zum Vorjahr), aber einen deutlich höheren Verlust als erwartet: Der bereinigte Verlust pro Aktie betrug -2,98 US-Dollar, während Analysten mit -0,18 US-Dollar gerechnet hatten .
Die Analystenreaktionen fielen gemischt aus. Morgan Stanley erhöhte das Kursziel für CBRS von 273 auf 279 US-Dollar, während Citi zwar ein „Kaufen“-Rating beibehielt, das Kursziel aber auf 320 US-Dollar senkte .
Studio Global AI
Diese Seite enthält eine quellengestützte Antwort, die Sie in Studio Global fortsetzen können.
OpenAI und Cerebras kündigten am 13. August 2026 den neuen API Tier 'Ultrafast' für GPT 5.6 Sol an, der auf Cerebras Wafer Scale Hardware läuft.
OpenAI und Cerebras kündigten am 13. August 2026 den neuen API Tier 'Ultrafast' für GPT 5.6 Sol an, der auf Cerebras Wafer Scale Hardware läuft. Die Inferenz erreicht bis zu 750 Ausgabe Tokens pro Sekunde – bis zu 14 mal schneller als die Standardverarbeitung von OpenAI.
Cerebras’ WSE 3 Chip mit 44 GB On Chip SRAM vermeidet die Speicherengpässe herkömmlicher GPU Cluster und ermöglicht die hohe Geschwindigkeit.