NVIDIA VSS Blueprint 3.3: Adaptive EVS senkt Videotokens um 80 Prozent

QumulusAI, Bitdeer AI und GMI Cloud melden Kapazitätsausbau und Finanzierungen; CoreWeave führt neue Systeme und Forge ein.

•

Cloud-Service-Provider treiben den Ausbau ihrer Infrastruktur für NVIDIA-Blackwell-GPUs voran. Parallel dazu hat NVIDIA neue Software-Blueprints veröffentlicht, die Entwicklungskosten und Effizienz visueller KI-Agenten auf dieser Architektur senken sollen. Das geht aus Berichten von Ende September 2026 hervor.

VSS Blueprint 3.3 und neue Effizienzgewinne

Im Zentrum der Software-Ankündigung steht der VSS Blueprint 3.3, der die Funktion vss-build-vision-ai enthält. Sie erlaubt es, KI-Agenten aus natürlichsprachlichen Prompts zu erstellen. In einer Demo zur Abfüllproduktion ließ sich laut NVIDIA ein Coding-Agent in unter 30 Minuten und für wenige Dollar bereitstellen; die Konfiguration lief auf einem RTX PRO 6000 Blackwell mit zwei GPUs.

Ein weiterer Baustein ist die adaptive Efficient Video Sampling (EVS), die laut NVIDIA bei 60-minütigen Videozusammenfassungen die VLM-Eingabetokens um 80 Prozent senkt und die Verarbeitungszeit halbiert.

Zudem ermöglicht Adaptive EVS nach Angaben von NVIDIA 46 Prozent mehr parallele Videostreams auf derselben GPU – von 13 auf 19. Beim Einsatz von Cosmos 3 Super FP8 auf einem RTX PRO 6000 Blackwell sei zudem die Latenz bei der Alarm-Kontextualisierung um 17 Prozent gesunken, von 1.021 auf 844 Millisekunden. Zu diesen Neuerungen war eine Livestream-Demo zum VSS Blueprint 3.3 für den 1. Oktober 2026, 9 Uhr PT, angesetzt.

QumulusAI sichert sich Blackwell-Kapazität über Take-or-pay-Verträge

Auf Infrastrukturseite meldete QumulusAI zwei dreijährige Take-or-pay-Verträge über zusammen 240,9 Mio. Dollar für mehr als 2.000 NVIDIA-Blackwell-B300-GPUs. Der erste Vertrag über 211,9 Mio. Dollar sieht die Kapazitätsübergabe für Anfang 2027 vor, der zweite über 29,1 Mio. Dollar für Dezember 2026. Damit steigen die Kundenverpflichtungen von QumulusAI auf über 344 Mio. Dollar.

Unter Einbeziehung möglicher, nicht garantierter Verlängerungsoptionen beziffert das Unternehmen den potenziellen Gesamtwert über fünf Jahre auf 401,6 Mio. Dollar.

Global Switch baut einen der größten Blackwell-Standorte Europas

Der Rechenzentrumsbetreiber Global Switch teilte mit, dass sein Pariser Standort einen der größten NVIDIA-Blackwell-Einsätze Europas beherbergen soll. Die Infrastruktur werde mehrheitlich flüssigkeitsgekühlt und mit 100 Prozent erneuerbarer Energie betrieben.

Nach Angaben von Global Switch ermöglicht Blackwell eine fünffache Inferenzleistung gegenüber früheren Modellen. Für das Fernwärmenetz von Levallois-Perret ist ein Wärmeabnahmeprojekt vorgesehen, das 2027 starten soll; eine Wiederholung in Clichy ist geplant.

Bitdeer AI meldet milliardenschwere Backlog-Werte in Malaysia

Bitdeer AI gab bekannt, dass bereits mehr als 70 Prozent der rund 21,7 Megawatt Kapazität seines A201-Rechenzentrums in Johor Bahru, Malaysia, durch Abnahmezusagen gebunden sind.

Die Inbetriebnahme ist für das erste Quartal 2027 geplant. Für den Standort seien über fünf Jahre erwartete KI-Cloud-Erlöse von mehr als 1,7 Mrd. Dollar vertraglich gesichert, der erwartete Gesamtumsatz-Backlog liege bei rund 2,9 Mrd. Dollar.

Anzeige

Welche KI-Systeme gelten als Hochrisiko – und was müssen Unternehmen jetzt konkret tun? Die EU-KI-Verordnung stellt neue Regeln auf, die viele noch nicht kennen – dieser kostenlose Report klärt auf. Jetzt kostenloses E-Book zum EU AI Act herunterladen

Bitdeer AI hat zudem über 100 Racks mit NVIDIA GB300 NVL72 beschafft und peilt bis zum ersten Quartal 2028 bis zu 350 Megawatt KI-Rechenzentrumskapazität an; die Standorte A201 und A202 sollen zusammen 86,8 Megawatt umfassen. Die aktive Pipeline für KI-Cloud-Kapazität übersteigt laut Unternehmen 10 Mrd. Dollar.

GMI Cloud finanziert Expansion mit GPU-besichertem Kredit

GMI Cloud meldete eine Finanzierung über insgesamt 668 Mio. Dollar, bestehend aus 223 Mio. Dollar Eigenkapital – angeführt von ARCHIV unter Beteiligung von Nvidia – sowie 445 Mio. Dollar Kredit, arrangiert vom taiwanischen Institut CTBC. Die Kreditfazilität wird als erster GPU-besicherter syndizierter Kredit im asiatisch-pazifischen Raum beschrieben.

Die Verschuldung ist auf 55 Prozent des Werts der Nvidia-Master-Serviceverträge über die verbleibende Laufzeit begrenzt; Abrufe sind auf 80 Prozent der Serverinvestitionen in den Phasen 1 und 2 beschränkt. Ein taiwanisches 16-Megawatt-Projekt soll 7.488 Nvidia-GPUs und Serverinvestitionen von rund 546 Mio. Dollar umfassen.

GMI Cloud betreibt Rechenzentren in Taiwan, Thailand und Malaysia und baut zusätzlich in den USA sowie im Rahmen einer japanischen Initiative aus. Der vertraglich gebundene jährliche wiederkehrende Umsatz (ARR) soll bis Jahresende zehnmal so hoch liegen wie im Dezember 2025; der realisierte ARR sei im vergangenen Jahr auf das Fünffache gestiegen und übersteige mittlerweile 600 Mio. Dollar.

Die Inferenzplattform des Unternehmens verarbeitet im Durchschnitt mehr als 4 Billionen Tokens pro Woche. CEO Alex Yeh nannte die Sicherung von Rechenzentrumskapazität und Strom als Priorität des Unternehmens.

CoreWeave stellt Vera Rubin NVL72 und neue Plattform Forge vor

CoreWeave kündigte die Verfügbarkeit von NVIDIA-Vera-Rubin-NVL72-Systemen mit Spectrum-X-102.4T-Ethernet an. Erster Kunde mit produktiven Workloads ist Cognition, das den Cluster Anfang September in Betrieb nahm und laut CoreWeave innerhalb von zwei Tagen betriebsbereit war.

In frühen Tests erzielte Vera Rubin NVL72 bei SWE-2-Inferenz bis zu 4,8-mal mehr Token-Durchsatz als GB200 NVL72, bei Reinforcement-Learning-Aufgaben einen 3,8-mal höheren Ausgabetoken-Durchsatz. Bei DeepSeek R1 zeigte sich laut CoreWeave bei gleicher Interaktivität ein zehnfacher Token-Durchsatz je Megawatt gegenüber GB200 NVL72.

Anzeige

Wer KI-Systeme professionell entwickelt oder einsetzt, muss heute auch die rechtlichen Rahmenbedingungen im Blick behalten. Dieser kostenlose Download verschafft Ihnen den Überblick über Fristen und Pflichten, den Ihre IT-Abteilung jetzt dringend braucht. EU AI Act in 5 Schritten verstehen

Zusätzlich bietet CoreWeave NVIDIA-Vera-CPUs an: Ein Rack umfasst 128 CPUs und 11.264 Kerne für mehr als 11.000 parallele Agentenumgebungen. Tests zeigten über dreifach schnellere Sandbox-Starts und eine 1,7-mal bessere Leistung bei bestandenen Terminal-Bench-Aufgaben. Die Vera-CPUs sollen als Bare-Metal-Angebot bereitgestellt werden, erste Kundentests werden in den kommenden Wochen erwartet.

Mit Forge stellte CoreWeave zudem eine Plattform vor, die Training, Inferenz, Evaluation, Beobachtung und Agentenentwicklung bündelt und nach Unternehmensangaben offen für verschiedene Modelle, Frameworks und andere Clouds ist. Angeboten werden die Stufen Free, Pro und Enterprise. MasterClass und Canva nutzen Forge bereits, frühe Partner sind VAST Data, CrowdStrike und ClickHouse.

Die Funktion Agent Lens erkennt laut CoreWeave in einem Benchmark 20 Prozent mehr kritische Fehler und behebt Probleme zu einem Zehntel der Kosten eines allgemeinen Frontier-LLM; Serverless RL trainiere 1,4-mal schneller bei 40 Prozent niedrigeren Kosten als ein selbstverwaltetes Setup.

Ennoble Care setzt auf CoreWeave für klinische KI

Im Gesundheitsbereich wählte Ennoble Care CoreWeave Cloud für klinische KI-Inferenz und setzt dabei NVIDIA RTX PRO 6000 Blackwell Server Edition über den CoreWeave Kubernetes Service ein. Der Einsatz soll Zusammenfassungen, Dokumentation und klinische Entscheidungsunterstützung im häuslichen Pflegebetrieb unterstützen.

Vorgesehen sind reservierte GPU-Kapazität, hardwaregestützte isolation und Zero-Trust-Kontrollen; CoreWeave gibt für den Kubernetes Service 8- bis 10-mal schnellere Containerstarts an als bei einer allgemeinen Cloud-Alternative. Ennoble Care versorgt nach eigenen Angaben jährlich rund 50.000 Patienten in 15 US-Bundesstaaten.