Schlagwort KI-Infrastruktur

Lenovo AI Express: Vorvalidierte KI-Server sollen ab 15 Werktagen lieferbar sein
Am 30. September 2026 hat Lenovo den Start von AI Express angekündigt. Das neue Angebot umfasst vorvalidierte Hardware-Konfigurationen in Kombination mit Technologie von NVIDIA, um den Aufbau betrieblicher KI-Infrastruktur zu beschleunigen. Statt monatelanger Wartezeiten auf kundenspezifische GPU-Server stellt das Unternehmen…

M3 Ultra und oMLX: KI-Prefill schrumpft von 49 auf 1,7 Sekunden
Zwei Open-Source-Projekte zeigen, wie weit sich das Software-Ökosystem rund um Apple-Silicon-Macs seit der Einführung der M-Chip-Generationen entwickelt hat: der LLM-Inferenzserver oMLX und der Windows-Kompatibilitätslayer Whisky. Beide Werkzeuge verfolgen unterschiedliche Ziele, treffen sich aber in einem gemeinsamen Anspruch – Apples eigene…

AMD EPYC 9006: Venice startet mit bis zu 256 Kernen und 14.904 Dollar
AMD hat die vollständigen Preise für seine kommende EPYC-9006-Serie mit Codenamen „Venice“ bekanntgegeben. Die Zen-6-basierte Prozessorfamilie umfasst mehr als 30 Modelle in den beiden Sockel-Plattformen SP7 und SP8 für Ein- und Zweisockel-Systeme. Die Preisspanne reicht von 700 US-Dollar bis 14.904…

ASUS HGX Rubin NVL8: Acht KI-GPUs passen jetzt in nur eine Höheneinheit
ASUS hat mit dem NVIDIA HGX Rubin NVL8 ein Serverdesign vorgestellt, das den Platzbedarf für KI-Beschleuniger deutlich reduziert. Das System mit acht Rubin-GPUs wurde auf der AI Tech 2026 in Seoul präsentiert und zeigt, wie Flüssigkeitskühlung zusammen mit einer veränderten…

Google TPU v7 Ironwood: Inferact misst 57 Prozent mehr KI-Durchsatz
Ein neuer Benchmark des Startups Inferact stellt die Leistungsfähigkeit von Googles TPU v7 Ironwood im Vergleich zu Nvidias GB200-Plattform bei der KI-Inferenz heraus. Wie qbitai.com und ifeng.com berichteten, erreichten 16 TPU-v7-Ironwood-Chips bei dem Modell Kimi K3 unter Einsatz von vLLM…

Huawei Atlas 960E: Neuer SuperPoD bündelt 4.096 NPUs für KI-Modelle
Huawei hat auf der HUAWEI CONNECT 2026 in Shanghai mit dem Atlas 960E SuperPoD nach eigenen Angaben den weltweit ersten NPO-basierten (Network-on-Package) SuperPoD vorgestellt. Das System wurde von David Wang, Deputy Chairman und Rotating Chairman des Unternehmens, präsentiert und soll…

Microsoft im Golf: Mehr als 10 Milliarden Dollar für Cloud und KI
Der Technologiekonzern Microsoft plant eine massive Ausweitung seiner Präsenz im Nahen Osten. Wie aus aktuellen Berichten hervorgeht, beabsichtigt das Unternehmen, bis zum Jahr 2030 mehr als 10 Milliarden US-Dollar in den Golfstaaten zu investieren. Die Mittel sollen in den Ausbau…

H100-GPU-Preise: Vessl AI erhöht um 24,7 Prozent ab September
Der südkoreanische Cloud-Spezialist Vessl AI hat zum 1. September 2026 den Stundensatz für die Nutzung von Nvidia H100-Grafikprozessoren (GPUs) markant angehoben. Der Preis stieg von 2,39 US-Dollar auf 2,98 US-Dollar pro Stunde, was einer Erhöhung um 24,7 Prozent entspricht. Das…

Microsoft eröffnet Cloud-Region Hyderabad: Vierte Basis in Indien
Microsoft hat auf dem AI Infrastructure Summit in New Delhi den Start der neuen Cloud-Region India South Central in Hyderabad bekanntgegeben. Parallel kündigte der Konzern auf der DevDays Asia 2026 an, seine Rechenzentren in Taiwan von zwei auf vier Standorte…

KI-Inferenz: China Mobile verdoppelt Leistung mit neuromorphen Chips
Auf der China Computing Power Conference in Langfang hat China Mobile Cloud Mitte September ein neuartiges Inferenzsystem vorgestellt. Die Lösung kombiniert klassische Grafikprozessoren (GPUs) mit neuromorphen Chips, um die Effizienz bei der Verarbeitung von Künstlicher Intelligenz deutlich zu steigern. Das…
