Huawei Atlas 960E: KI-Supercomputer skaliert auf bis zu 4.096 NPUs

Der neue SuperPoD soll bis zu 4.096 NPUs verbinden; Huaweis Clusterkonzept reicht laut Unternehmen bis zu einer Million.

Huawei hat auf der HUAWEI CONNECT 2026 in Shanghai mit dem Atlas 960E SuperPoD eine neue Recheninfrastruktur für KI-Training und -Inferenz vorgestellt.

Die Plattform kombiniert die Interconnect-Technologie UnifiedBus mit der optischen Verbindungslösung Hi-ONE und soll laut einem Bericht von technotime.net vom 23. September 2026 auf bis zu 4.096 NPUs skalieren. Dabei erreicht ein SuperPoD 8 EFLOPS bei FP8-Genauigkeit beziehungsweise 16 EFLOPS bei FP4.

Wie itpro.com am 24. September 2026 berichtete, soll der Atlas 960E gemeinsam mit dem ebenfalls vorgestellten Speichersystem OceanStor M900 Training und Inferenz von Foundation-Modellen mit bis zu 10 Billionen Parametern beschleunigen.

Optische Vernetzung soll Stromverbrauch senken

Ein zentrales Element der Architektur ist Hi-ONE, das laut technotime.net eine Übertragungskapazität von 7,2 Tbit/s bietet. Nach Angaben Huaweis sollen 5.500 Hi-ONE-Einheiten insgesamt 48.000 herkömmliche 800G-Optikmodule ersetzen. Dadurch soll der Stromverbrauch um mehr als 550 kW sinken, während eine Systemverfügbarkeit von 99,8 Prozent erreicht werden soll.

UnifiedBus wiederum bündelt laut itpro.com zehn verschiedene Protokolle. Huawei zufolge sinkt die RTT-Latenz durch diese Bündelung von 7 ms auf 2 ms, während die Interconnect-Bandbreite von 100 Gbit/s auf 1 Tbit/s steigt. Das Unternehmen gibt zudem an, dass sich die Leistung der Vektorsuche bei großen, komplexen Datenlasten dadurch verdoppelt. Ein zusätzlicher Speicherbaustein namens DDRM soll den NPUs als erweiterter Arbeitsspeicher dienen.

Anzeige

Wer sich mit der Implementierung solch leistungsstarker KI-Infrastrukturen befasst, muss auch die rechtlichen Rahmenbedingungen der EU kennen. Dieser kostenlose Leitfaden bietet Unternehmen einen kompakten Überblick über alle Anforderungen, Pflichten und Fristen des EU AI Acts. EU AI Act in 5 Schritten verstehen: Fristen, Pflichten und Risikoklassen kompakt erklärt

Skalierung bis zu einer Million NPUs

Über den einzelnen SuperPoD hinaus zielt Huawei auf deutlich größere Cluster-Dimensionen ab. Laut technotime.net kann ein SuperCluster bis zu 512.000 NPUs verbinden, mit einer Multi-Rail-Topologie sogar bis zu einer Million.

Der Server TaiShan 950 unterstützt dabei bis zu 4.096 Knoten und einen gemeinsamen Speicherpool von 256 TB. Das ergänzend vorgestellte Speichersystem OceanStor M900 bietet nach Unternehmensangaben einen Key-Value-Cache im Petabyte-Bereich, der für die Verarbeitung großer Kontextfenster in Foundation-Modellen relevant ist.

Anzeige

Die rasante Entwicklung bei KI-Systemen und Rechenzentren führt nicht nur zu technologischen, sondern auch zu neuen regulatorischen Herausforderungen. Erfahren Sie in diesem kostenlosen Report, welche KI-Systeme als Hochrisiko eingestuft werden und was Unternehmen bei der Dokumentation jetzt konkret tun müssen. Kostenlosen Umsetzungsleitfaden zur KI-Verordnung herunterladen

Einordnung in Huaweis KI-Strategie

Die Vorstellung des Atlas 960E SuperPoD reiht sich in eine Reihe weiterer Ankündigungen ein, die Huawei auf der HUAWEI CONNECT 2026 in Shanghai machte. Parallel präsentierte Huawei Cloud dort seine sogenannte „open agentic cloud“-Strategie, für die das Unternehmen angibt, dass bereits über 3.500 Unternehmenskunden Varianten der zugehörigen Agentic Infra nutzen.

Mit der Kombination aus UnifiedBus, Hi-ONE and den skalierbaren SuperPoD- beziehungsweise SuperCluster-Architekturen positioniert sich Huawei als Anbieter von Infrastruktur für das Training extrem großer Sprachmodelle.

Die technischen Kennzahlen – von der EFLOPS-Leistung über die Reduktion des Stromverbrauchs bis zur Skalierbarkeit auf Hunderttausende von Recheneinheiten – stammen dabei durchgängig aus Unternehmensangaben Huaweis, die im Rahmen der Konferenzpräsentation kommuniziert wurden.