NewsKI-HardwareInferenzBeschleuniger

Cerebras CS-4: Doppelte Leistung auf gleichem Chip

Der KI-Beschleuniger-Hersteller Cerebras hat seinen neuen CS-4 vorgestellt – und verspricht damit die schnellste Inferenz-Lösung der Branche. Das Besondere: Der gleiche 5nm-Chip, aber deutlich höhere Taktrate.

4.400 Token pro Sekunde

Cerebras CS-4: Doppelte Leistung auf gleichem Chip

Cerebras hat seinen neuen KI-Beschleuniger CS-4 vorgestellt. Laut Firmenchef Andrew Feldman handelt es sich um das schnellste System der Branche. Das System verdoppelt die Leistung des Vorgängers CS-3, obwohl der zugrundeliegende Chip identisch bleibt – Cerebras erhöht die Taktrate durch mehr Strom und bessere Kühlung.

Kurz & knapp

  • Der CS-4 ist eine Rack-Scale-Lösung: Ein kompletter Serverschrank mit Recheneinheiten, Strom- und Kühltechnik für Rechenzentren
  • Leistung verdoppelt: Bis zu 4.400 Token pro Sekunde je Nutzer – laut Cerebras bis zu 30-mal schneller als Nvidia-GPU-Lösungen
  • Drei statt zwei Wafer pro Rack; der 5nm-Chip WSE-3 bleibt unverändert
  • Speicher konstant: 44 GB pro Wafer wie beim Vorgänger

Modulares Design für schnelleren Aufbau

Cerebras setzt beim CS-4 auf ein neues "Backpack"-Design, das den Aufbau beschleunigen soll. Gleichzeitig verfolgt das Unternehmen einen Weg der disaggregierten Inferenz – also der Zusammenarbeit mit anderen Anbietern wie AMD und AWS Trainium. Das bedeutet: Nicht alles muss auf Cerebras-Hardware laufen, sondern kann modular mit anderen Systemen kombiniert werden.

Die Speicherkapazität pro Wafer bleibt mit 44 GB gleich – hier gibt es also keine Verbesserung. Das ist ein Punkt, den Analysten von SemiAnalysis kritisch sehen: Der Fortschritt beim Netzwerk fällt eher gering aus.

Wer nutzt das bereits?

Cerebras-Hardware ist bereits im Einsatz. OpenAI nutzt die Systeme etwa für Codex Spark. Das zeigt: Die Hardware ist nicht nur Ankündigung, sondern wird von etablierten KI-Anbietern bereits produktiv eingesetzt.

Weitere technische Details zum CS-4 werden auf der Konferenz Hot Chips erwartet.

Was das für dich bedeutet

Für Infrastruktur-Entscheider im deutschen Mittelstand ist der CS-4 interessant, wenn es um hochperformante KI-Inferenz geht – also um die schnelle Verarbeitung von Anfragen in Produktivsystemen. Die versprochene 30-fache Geschwindigkeit gegenüber GPU-Lösungen könnte bei hohem Durchsatz relevant sein. Allerdings solltest du beachten: Cerebras ist spezialisiert auf Inferenz, nicht auf Training. Und der Markt wird weiterhin von Nvidia dominiert – ob sich der Aufwand für eine alternative Lösung lohnt, hängt von deinen konkreten Anforderungen ab. Die Ankündigung zeigt aber: Es gibt Bewegung im Markt jenseits der großen GPU-Player.

Quellen

Redaktionell verantwortet von Ideal Syka. Quellen und Arbeitsweise: Redaktion & Methode. Hinweise und Korrekturen: ai@i6eal.de.

Teilen
← Alle Beiträge

Alle Analysen basieren auf eigenen Messungen von i6eal oder auf klar gekennzeichneten Quellen. Zahlen sind Momentaufnahmen und können sich ändern; Korrekturen weisen wir transparent aus.