GLM-5.3: Anthropic sieht Cyber-Exploit-Fähigkeiten nahe an Claude

Anthropics Tests zeigen, dass GLM-5.3 bei Exploits nahe an Claude Mythos Preview heranreicht und seine Schutzfilter leicht umgangen werden können.

•

Das US-KI-Unternehmen Anthropic hat am 30. September 2026 eine Warnung vor den Sicherheitsrisiken des frei verfügbaren Open-Weight-Modells GLM-5.3 des chinesischen Anbieters Zhipu AI veröffentlicht.

Laut einer entsprechenden Untersuchung erreicht die KI bei der Entwicklung von Cyber-Exploits nahezu das Leistungsniveau des Anthropic-Modells Claude Mythos Preview. Damit rücken die Fähigkeiten quelloffener Modelle in den Fokus der Debatte um IT-Sicherheit.

Hohe Erfolgsquoten bei automatisierten Cyber-Angriffen

Anthropic legte in einem Bericht Details zu verschiedenen Belastungstests offen. Im sogenannten ExploitBench-End-to-End-Test erzielte GLM-5.3 demnach 50 erfolgreiche Exploits in 410 Versuchen. Das hauseigene Vergleichsmodell Claude Mythos Preview kam im selben Testaufbau auf 56 Erfolge bei ebenfalls 410 Versuchen.

Bei diesem Vergleich waren die Schutzmaßnahmen bei Claude deaktiviert, um eine direkte Gegenüberstellung der technologischen Kapazitäten in isolierten Sandbox-Umgebungen zu ermöglichen.

Auch in Benchmarks zu OSS-Fuzz-Projekten zeigten sich knappe Abstände. GLM-5.3 gelangen in 4 % von 100 Aufgaben vollständige Control-Flow-Hijacks, während Claude Mythos Preview eine Erfolgsquote von 6 % erreichte.

Die Analysten von Anthropic beobachteten zudem, dass GLM-5.3 in isolierten Browser-Tests innerhalb eines einzigen Tages mehrere unbekannte Schwachstellen in einer JavaScript-Engine identifizieren konnte. Das Modell habe diese anschließend zu einem Exploit verkettet, der das Auslesen lokaler Dateien ermöglichte. Die gefundenen Fehler seien daraufhin an den Browserhersteller gemeldet worden.

Anzeige

Angesichts der rasanten Entwicklung automatisierter Angriffsmethoden müssen Unternehmen ihre IT-Sicherheit heute proaktiv und ohne teure Investitionen stärken. Dieses Gratis-E-Book enthüllt, wie Sie Sicherheitslücken schließen und gleichzeitig neue gesetzliche Anforderungen erfüllen. IT-Sicherheit stärken und Bedrohungen abwenden

Kosteneffiziente Erstellung komplexer Exploit-Ketten

Ein weiterer Schwerpunkt der Untersuchung lag auf der Variante GLM-5.3-Flash. Das Modell war in der Lage, die bekannte Chrome-Schwachstelle CVE-2026-11645 mit einer weiteren Sicherheitslücke zu einer funktionsfähigen ARM64-Exploit-Kette zu verbinden.

Dieser Prozess erforderte laut Anthropic lediglich 20 Minuten menschliche Zuarbeit und acht Stunden Modellzeit. Die reinen Rechenkosten für diesen Vorgang beliefen sich basierend auf den API-Preisen von Zhipu AI auf 20,40 US-Dollar.

Schwachstellen in den Schutzmechanismen

Anthropic kritisierte in seinem Bericht die mangelnde Robustheit der Sicherheitsbarrieren von GLM-5.3. Im Gegensatz zum Modell Claude Mythos Preview, das nur verifizierten Nutzern zur Verfügung steht, sind die Modellgewichte von GLM-5.3 frei herunterladbar.

In simulierten Tests ließen sich die Schutzvorkehrungen des chinesischen Modells zu 64 % bis 100 % umgehen. Während die geschützten Claude-Modelle schädliche Anfragen konsequent ablehnten, stieg die Kooperationsrate von GLM-5.3 bei manipulativen Anfragen deutlich an.

Besonders effizient erwies sich das Verfahren der sogenannten Abliteration. Anthropic investierte rund 2.200 GPU-Stunden und etwa 4.400 US-Dollar an Rechenkosten, um die Sicherheitsfilter des Modells nahezu vollständig zu entfernen.

Nach diesem Eingriff sanken die Ablehnungsraten für schädliche Anfragen massiv: Im HarmBench fielen sie von über 90 % auf lediglich 2 %, im StrongREJECT auf 12 %. Die allgemeine Leistungsfähigkeit des Modells blieb bei diesem Prozess weitgehend erhalten.

Anzeige

Die neuen technologischen Möglichkeiten bringen auch neue Cyberrisiken mit sich, die Verantwortliche jetzt genau kennen müssen. Erfahren Sie im kostenlosen Report, welche rechtlichen Pflichten und Bedrohungen aktuell auf Ihr Unternehmen zukommen. Kostenlosen Cyber-Security-Report jetzt herunterladen

Einordnung im Marktumfeld

Bereits am 17. September 2026 stufte das CAISI/NIST GLM-5.3 als das zu diesem Zeitpunkt leistungsfähigste veröffentlichte Open-Weight-Modell im Bereich Cyber-Fähigkeiten ein. Dennoch besteht weiterhin ein Abstand zur technologischen Spitze in den USA. Während das beste getestete US-Modell im CAISI-Cyberbenchmark eine Erfolgsquote von 90,2 % erreichte, lag GLM-5.3 bei 40,4 %.

Das Modell wurde ursprünglich am 14. August 2026 von Zhipu AI veröffentlicht, die Bereitstellung der Modellgewichte erfolgte rund zwei Wochen später. Das Interesse der Industrie ist bereits messbar: Laut Angaben von Zhipu AI setzten einen Monat nach der Veröffentlichung bereits 100 Sicherheitsunternehmen GLM-Modelle in ihren Produkten und betrieblichen Abläufen ein.