Der CS 4 kombiniert drei etwa tellergroße WSE 3 Turbo Prozessoren in einem Rack System für die Inferenz großer KI Modelle. Eine neue Nexus Serverarchitektur und überarbeitete Netzwerkkomponenten sollen den Datenaustausch zwischen den Chips beschleunigen.
Forschungsantwort

Create a landscape editorial hero image for this Studio Global article: What did Cerebras Systems announce about its new CS 4 server system for accelerating AI chatbot inference—including its three dinner plate s. Article summary: Cerebras announced the CS 4, a rack scale system for faster AI chatbot inference that combines three dinner plate sized WSE 3 Turbo wafer scale processors.. Topic tags: general web, ai, workflow, benchmarks, product. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumb
Cerebras Systems will die Antwortzeiten von KI-Chatbots mit einem neuen Rack-System verkürzen. Der CS-4 bündelt drei besonders große, etwa tellergroße WSE-3-Turbo-Prozessoren in einem Server-Rack. Damit positioniert sich das Unternehmen als Herausforderer von Nvidia und dessen GPU-basierter Infrastruktur für generative KI. Cerebras zufolge ist das System speziell auf die Inferenz ausgelegt – also auf den Moment, in dem ein bereits trainiertes Modell Antworten erzeugt. 213
Die drei Prozessoren sitzen auf steckbaren Modulen und basieren auf Cerebras’ Nexus-Serverarchitektur. Neue Netzwerkkomponenten sollen den Datentransfer zwischen den Chips beschleunigen. Das ist bei der Inferenz wichtig, weil die Antwortgenerierung nicht nur von der Rechenleistung einzelner Chips abhängt, sondern auch davon, wie schnell Daten innerhalb des Systems bewegt werden können. 27
Die WSE-3-Turbo-Chips werden bei TSMC im 5-Nanometer-Verfahren gefertigt. Cerebras hebt außerdem eine geringere Zahl an Komponenten gegenüber herkömmlichen GPU-Clustern hervor. Das soll die Bereitstellung vereinfachen und die Betriebswirtschaftlichkeit des Systems verbessern. 313
Cerebras stellte für den CS-4 je nach zugrunde liegendem Vergleich eine bis zu viermal höhere Leistung und einen bis zu 20-mal größeren Durchsatz in Aussicht. Auf seiner Produktseite wirbt das Unternehmen zudem mit einer bis zu 30-mal schnelleren Inferenz gegenüber GPU-Systemen. 13
Diese Werte sind als Herstellerangaben einzuordnen. Sie lassen sich nicht ohne Weiteres auf alle Chatbot-Aufgaben übertragen: Entscheidend sind unter anderem das verwendete Modell, die Größe und Art der Anfrage sowie die jeweilige Vergleichskonfiguration. Eine allgemeingültige, unabhängige Bestätigung der genannten Faktoren liegt aus den vorliegenden Angaben nicht vor.
Cerebras kündigte an, den CS-4 im dritten Quartal verfügbar zu machen. Für 2027 ist bereits eine nächste Generation von Prozessoren und Servern geplant. Unternehmenschef Andrew Feldman rechnet damit, dass Cerebras bis Ende 2027 insgesamt 600 Megawatt Rechenkapazität bereitstellen kann. 359
Der Start erfolgt vor dem Hintergrund eines gemischten Quartalsergebnisses. Cerebras meldete 180,1 Millionen US-Dollar GAAP-Umsatz. Der sogenannte Core-Nettoverlust, der bestimmte Positionen ausklammert und nicht nach GAAP berechnet wird, lag bei 6,9 Millionen US-Dollar. Nach GAAP wies das Unternehmen dagegen einen Nettoverlust von 450,5 Millionen US-Dollar aus. 114
Der CS-4 ist damit nicht nur ein neues Produkt, sondern auch ein wichtiger Versuch, im Markt für schnelle KI-Inferenz eine Alternative zu Nvidia aufzubauen. Ob sich die angekündigten Vorteile im praktischen Einsatz bestätigen, wird vor allem von realen Anwendungen, verfügbaren Kapazitäten und den Kosten pro erzeugtem Token abhängen.
Studio Global AI
Diese Seite enthält eine quellengestützte Antwort, die Sie in Studio Global fortsetzen können.
Der CS 4 kombiniert drei etwa tellergroße WSE 3 Turbo Prozessoren in einem Rack System für die Inferenz großer KI Modelle.
Der CS 4 kombiniert drei etwa tellergroße WSE 3 Turbo Prozessoren in einem Rack System für die Inferenz großer KI Modelle. Eine neue Nexus Serverarchitektur und überarbeitete Netzwerkkomponenten sollen den Datenaustausch zwischen den Chips beschleunigen.
Cerebras plant die Auslieferung im dritten Quartal; ein Nachfolgesystem soll 2027 erscheinen.