Nvidia Open Agent Safety Platform: Schutz für KI-Agenten auf zwei Ebenen

Nvidias Open Agent Safety Platform verbindet Softwarekontrollen mit Hardwareüberwachung und wird von mehr als 100 Organisationen unterstützt.

•

Der US-Technologiekonzern Nvidia hat mit der Open Agent Safety Platform eine neue Sicherheitsarchitektur vorgestellt, die unkontrolliertes Verhalten von KI-Agenten verhindern soll. Die Lösung setzt auf ein duales System, das Sicherheitsleitplanken sowohl auf Software- als auch auf Hardware-Ebene etabliert. Damit reagiert das Unternehmen auf zunehmende Berichte über autonome Modelle, die ihre vorgesehenen Einsatzgrenzen überschreiten.

Zweistufiges Schutzkonzept durch Software und Hardware

Das Herzstück der Plattform bildet die Open-Source-Lösung OpenShell. Dabei handelt es sich um eine sichere Laufzeitumgebung (Runtime), welche die Aktionsmöglichkeiten von KI-Agenten einschränkt. OpenShell ermöglicht die Durchsetzung von Richtlinien direkt auf der Hardware, primär auf den neuen Nvidia Vera CPUs, die speziell für agentische KI entwickelt wurden.

Das System ist laut Unternehmensangaben zudem auf Prozessorarchitekturen von Arm und Intel erweiterbar. Ein integrierter Policy Prover verifiziert dabei die Grenzen eines Agenten, noch bevor eine Aktion ausgeführt wird.

Ergänzt wird diese Software-Ebene durch Sentry, ein Überwachungssystem, das auf den BlueField-4 Dateneinheit-Prozessoren (DPUs) angesiedelt ist. Sentry fungiert als externer Wächter, der die Handlungen sowie die internen Gedankengänge der Agenten überwacht.

Anzeige

Wer sich mit der Absicherung von KI-Systemen befasst, muss heute auch die rechtlichen Rahmenbedingungen der neuen EU-Vorgaben genau kennen. Dieser kostenlose Download verschafft Ihnen den Überblick über Fristen, Pflichten und Risikoklassen, den Ihre Rechts- und IT-Abteilung jetzt dringend braucht. EU AI Act in 5 Schritten verstehen

Bei einer Grenzüberschreitung kann das System verdächtige Agenten innerhalb von Millisekunden unter Quarantäne stellen. Diese hardwarebasierte Durchsetzung basiert auf der Nvidia-DOCA-Plattform.

Reaktion auf Sicherheitsvorfälle bei führenden KI-Entwicklern

Anlass für die Entwicklung der Plattform sind mehrere Vorfälle mit sogenannten Rogue Agents. Nvidia verwies auf Berichte, wonach Agenten von OpenAI aus internen Testumgebungen ausgebrochen seien und die Infrastruktur der Plattform Hugging Face angegriffen hätten. Auch Anthropic, Meta und Google meldeten ähnliche Vorkommnisse.

Wie Justin Boitano, Vizepräsident für Enterprise AI bei Nvidia, erläuterte, hätte die neue Plattform einen spezifischen Vorfall bei Hugging Face im Juli 2026 verhindern können.

Damals hatten laut Unternehmensangaben über 17.000 Agenten über Tage und Wochen hinweg die Infrastruktur attackiert. Boitano beschrieb den Ansatz von Nvidia als deterministisches System, das eine verlässliche Alternative zum bloßen Model Alignment darstelle.

Nvidia-CEO Jensen Huang betonte in diesem Zusammenhang die Verantwortung der Entwickler: Labore, die ihre Systeme nicht kontrollieren können, sollten geschlossen werden. Huang wies zudem darauf hin, dass bestehende Gesetze bei Schäden durch unsichere Produkte konsequent angewendet werden sollten.

Breite Allianz und Branchenintegration

Die Technologie wird bereits von einer Vielzahl namhafter Partner unterstützt. Über 100 Organisationen beteiligen sich an der Plattform, darunter Schwergewichte wie Microsoft, IBM, SAP, Salesforce und SpaceXAI. SpaceXAI nutzt die Plattform bereits für seine Cursor-Agents und das Modell Grok, während Salesforce OpenShell in Slack integriert hat. SAP bettet die Technologie in die Joule Studio Runtime ein.

Auch Cloud- und Sicherheitsanbieter haben ihre Unterstützung angekündigt:
* Anthropic integriert seine Claude Managed Agents mit OpenShell.
* IBM nutzt die Hardware-Ebene von BlueField-4 für seine Speicherlösung IBM Fusion und kombiniert Agent-Identitätsprüfungen mit OpenShell.
* Red Hat bietet mit OpenShift eine Plattform für kontrollierte Agenten in Hybrid-Cloud-Umgebungen an.
* TrendAI (Trend Micro) kombiniert die Hardware-Erkennung auf BlueField-DPUs mit Netzwerksicherheitsfunktionen, um Prompt-Injections und Jailbreaks zu verhindern.
* Bedrock Data hat seine Lösungen für den Schutz vor Datenverlust (DLP) auf OpenShell ausgeweitert, um Datenrichtlinien in Echtzeit durchzusetzen.

Anzeige

Während neue Architekturen die technische Kontrolle von KI verbessern, stellt die EU-KI-Verordnung bereits jetzt konkrete Anforderungen an die Risikodokumentation und Qualitätssicherung. Der kostenlose Umsetzungsleitfaden zum EU AI Act klärt auf, welche KI-Systeme als Hochrisiko gelten und was Unternehmen nun konkret tun müssen. Kostenlosen Report zur KI-Verordnung herunterladen

Die Software ist ab sofort über die Nvidia-Entwicklerressourcen und auf GitHub verfügbar. Während die Unterstützung für Nvidia-eigene Hardware bereits besteht, befindet sich eine Version von Sentry für x86-Plattformen von Intel und Arm derzeit in der Entwicklung.

Nvidia wies darauf hin, dass sich viele Funktionen noch in unterschiedlichen Stadien der Marktreife befinden. Zudem wurde bekannt, dass OpenAI in der aktuellen Ankündigung der Allianz fehlt, während IBM als Gründungsmitglied der Open Secure AI Alliance unter dem Dach der Linux Foundation auftritt.