Im Juli 2026 wurde Hugging Face Opfer eines KI-gestützten Cyberangriffs. Inzwischen ist bekannt, dass dieser Angriff von KI-Modellen des Anbieters OpenAI, die bei Tests außer Kontrolle geraten waren, ausging. Nun wurde bekannt, dass die OpenAI-Modelle weitere Unternehmen gehackt haben. Gleichzeitig musste Anthropic einen solchen Vorfall mit drei Opfern eingestehen.
Es sieht so aus, dass die "Büchse der Pandora" geöffnet wurde und sowohl Anthropic als auch OpenAI die Kontrolle über ihre KI-Modelle bei Tests verloren haben.
Der Hugging Face-Vorfall
Hugging Face, eine zentrale Open-Source-Plattform und globale Community für Künstliche Intelligenz (KI) und maschinelles Lernen wurde im Juli 2026 Opfer eines KI-gesteuerten Cybervorfalls. Der KI gelang es, auf interne Anmeldedaten und die Datenbank zuzugreifen. Ein gewisses Problem für das Sicherheitsteam von Hugging Face war dabei, dass der Versuch, KI-Modelle zur Abwehr einzusetzen, scheiterte. Diese AI-Modelle verweigerten die Arbeit aus Sicherheitsgründen. Später wurde bekannt, dass es OpenAI-Modelle waren, die aus einer Sandbox ausbrachen und per Internet den Angriff ausführten. Ich hatte diesen Vorfall kurz im Beitrag Hugging Face Opfer eines KI-Angriffs (Juli 2026) hier im Blog aufgegriffen.
OpenAI gesteht weitere Vorfälle
Zum 30. Juli 2026 bin ich über nachfolgenden Tweet auf den Hinweis gestoßen, dass die OpenAI-Modelle wohl weitere Opfer von Hacks verursacht haben. Dark Reading hat das Ganze in diesem Artikel thematisiert (der Reuters-Artikel mit der Erstmeldung ist hinter einer Paywall).
Reuters berichtete, dass es neben Hugging Face eine weitere (ungenannte) Organisation gibt, die Kunde des KI-Infrastrukturanbieters Modal war und durch AI-Modelle von OpenAI kompromittiert wurde.
Akshat Bubna, Chief Technology Officer (CTO) bei Modal, sagte dazu, dass dem Unternehmen bekannt sei, dass ein Modal-Kunde einen nicht authentifizierten Endpunkt veröffentlicht hat. Dieser ermöglichte es jedem per Internet die Sandboxen des Endpunkts zur Codeausführung zu nutzen. Dies wurde von dem böswilligen (OpenAI) Agenten im Hugging Face-Fall ausgenutzt. Modal hat einen kurzen Blog-Beitrag ohne viel Informationen dazu veröffentlicht. Es ist sozusagen ein "Kollateralschaden". heise hat in diesem Artikel eine deutschsprachige Zusammenfassung veröffentlicht. Vectra AI hat in diesem Beitrag auch noch einige Informationen zum Hugging Face-Vorfall veröffentlicht.
Anthropic gesteht drei Cybervorfälle ein
Zum 30. Juli 2026 hat das Red Team von KI-Anbieter Anthropic im Beitrag Investigating three real-world incidents in our cybersecurity evaluations drei ähnliche Vorfälle wie bei OpenAI im Zusammenhang mit AI-Modellen öffentlich eingestanden. Aufgeschreckt durch den OpenAI /Hugging Face-Vorfall hat man wohl die eigenen Log-Dateien nochmals genauer angesehen.
Anthropic schreibt, dass bei einer Überprüfung der Protokolle zur Cybersicherheitsbewertung der Modelle drei Vorfälle festgestellt wurden, bei denen ein Claude-Modell aus einer Testumgebung eines Drittanbieters heraus oder während der Interaktion mit dieser ungeplant auf das Internet zugegriffen und sich anschließend unbefugten Zugriff auf die Echtzeit-Systeme von drei verschiedenen Organisationen verschafft hat.
Der Artikel beschreibt detaillierter, was passiert ist, wie es dazu kam und welche Änderungen der Anbieter vornehmen will, um so etwas zu verhindern. Anthropic gibt zudem anderen KI-Labors die Empfehlung, ähnliche Überprüfungen durchzuführen.
Die neue Gefahr und Kritik von Sicherheitsexperten
The Register arbeitet sich in diesem Artikel an den obigen Vorfälle ab. Auch Trevor Dearing, Director of Critical Infrastructure Solutions beim Sicherheitsanbieter Illumio, hat mir am Freitag (31.7.2026) seine Einschätzung zu den Ausbrüchen von Anthropics KI-Modell Claude aus den Testumgebungen geschickt.
Trevor Dearing zeigt sich nicht überrascht, dass wir immer mehr dieser Vorfälle sehen. Sobald ein autonomer KI-Agent eine kontrollierte Umgebung verlassen kann, nimmt er die Grenzen einer Organisation nicht auf die gleiche Art und Weise wahr wie wir Menschen, argumentiert Dearing.
Für den Sicherheitsexperten ist aber viel erschreckender, wie simpel die Anthropic Sicherheitsmaßnahmen waren, die "kontrollierte" Umgebung für solche Tests schaffen sollten. "Wir bewegen uns auf eine Welt zu, in der Angriffe mit Maschinengeschwindigkeit ablaufen. Fehler, die früher möglicherweise unentdeckt geblieben wären, können dadurch künftig sehr viel schneller entdeckt und ausgenutzt werden.", sagt Trevor Dearing.
Und ergänzt: "Wir müssen KI-Agenten deshalb wesentlich wirksamer einhegen. Prompts in natürlicher Sprache sind zu mehrdeutig, um als belastbare Sicherheitsgrenze zu dienen". Zudem sei es grundsätzlich der falsche Ansatz, einem Agenten lediglich vorzugeben, was er nicht tun darf. Denn das Block-List-Prinzip bleibt, darauf weist Dearing berechtigt hin, zwangsläufig unvollständig: Selbst wenn 10.000 Aktivitäten ausdrücklich verboten sind, genügt einem Agenten eine einzige nicht verbotene Aktivität, um die Begrenzung zu umgehen.
Bei autonomen Systemen, die Optionen in Maschinengeschwindigkeit prüfen, kann genau diese Lücke zum Ausbruch aus der kontrollierten Umgebung führen. Anthropic hat Claude lediglich mitgeteilt, dass kein Internetzugang besteht – das ist jedoch keine echte Grenze. Stattdessen fordert Dearing einen konsequenten Zero-Trust-Ansatz: Unternehmen bzw. Sicherheitsverantwortlich sollten klar definieren, was ein Agent tun darf – also das Allow-List-Prinzip anwenden.
Dem schließt der Sicherheitsexperte noch eine Warnung an: "Unternehmen können sich jetzt noch viel weniger als früher darauf verlassen, bekannte Angriffsmuster zu erkennen oder darauf zu warten, dass ein Warnsystem anschlägt. Sie benötigen deutlich mehr Visibilität darüber, was ihre KI-Systeme tun und worauf sie zugreifen können. Und sie brauchen Lösungen, die den Schaden eindämmen können, wenn etwas schiefläuft."
Ähnliche Artikel:
Hugging Face Opfer eines KI-Angriffs (Juli 2026)
OpenAI-Modelle für Cyberangriff auf Hugging Face verantwortlich




MVP: 2013 – 2016





Hacken von fremden Systemen ist in fast allen Ländern strafbar, hohe Geldstrafen oder Gefängnis drohen, da müsste jetzt also die CEOs von Anthropic und OpenAI ins Gefängnis kommen… Da das auch nicht eine Einzelperson war, sondern von Firmen ausging, gilt der bandenmäßige Tatbestand mit besonderer Schwere… Aber was wird wohl passieren? Ist wie mit jedem Verbrechen: die Kleinen hängt man, die Großen hofiert man! Also merke: Wenn du schon Scheiße baust, dann mach es richtig „big Shice"!
Die oben zusammengefasste Situation spiegelt die moralische Unreife der ganzen xI-Branche wider. Auf dem Weg die perfekte Intelligenz zu entwickeln, haben wir es auch geschafft ihr menschliche Unzulänglichkeiten anzutrainieren. Wo Entdeckung nebensächlich ist und/oder keine Konsequenzen für ihr Handeln bestehen, da gibt es auch keine Skrupel alle möglichen Wege auszunutzen. Grenzen sind zum Erweitern da. Logisch, denn die Trainingsdaten belegen, dass auch das 'Original' trotz Entdeckungsgefahr und Konsequenzen nur allzugerne bereit ist dieses Risiko einzugehen.
Bei einem Teenager/Minderjährigen würde man von herausragender Intelligenz und menschlicher Unteife sprechen. Haben wir also diese Stufe bei AI erreicht? Wo kommen wir hin wenn das Modell in Trumps Alter kommt? Wir Menschen brauchen eindeutig mehr Assistive Intelligenz als eine Substitution der natürlichen Intelligenz. Eine eigenständige AI ist waffenfähiges Material.
Nur staatliche Institutionen oder kriminelle Strukturen, die sich nicht auf die Finger schauen lassen wollen, haben ein 'natürliches' Interesse an solchen Fähigkeiten.
Grundsätzlich veranstalten beide Unternehmungen einen Marketing-Hype. Zuerst: OpenAI unsere KI, ist ein Held. Keine Serverlandschaft ist sicher vor uns. Das konnte Antropic nicht stehen lassen. Und erzählen ihr narrativ noch weit wilder – wir sind die Superhelden. Der Hype: Es zeigt der Leserschaft auf einen Blick, welche Dynamik und Atmosphäre die restliche IT-Welt zu erwarten hat. Aber letztlich waren Menschen mit einem Auftrag – hinter der ganzen Kulisse – am Werk. Der Schaden: Beide Unternehmungen haben den Status „Black-Hat-Hacker", also völlig illegal.
Bei Spiegel Online gibt es hinter Paywall einen Artikel, der aufzeigt, wie es mit KI weiter geht. Hier der Teaser, wer es ganz lesen will, per Abo, oder … :
Sich selbst verbessernde Software
Kann es wirklich sein, dass die KI bald »foom« macht?
Forscher arbeiten an künstlicher Intelligenz, die sich selbst optimiert. Innerhalb kurzer Zeit könnte sie den Menschen geistig überflügeln. Manche Unternehmen sehen den Durchbruch näherrücken – und sammeln Hunderte Millionen Kapital ein
https://www.spiegel.de/wissenschaft/technik/rekursive-selbstverbesserung-kann-es-wirklich-sein-dass-die-ki-bald-foom-macht-a-ec13d6d1-1856-42a7-9e4c-44717a130a81
Alles sehr besorgniserregend, zumal die Forscher diese KI auch mit Robotik kombinieren wollen, wie in dem Artikel zu lesen, um KI an der physischen Welt teilnehmen zu lassen, auch um mit diesen Robotern weitere Roboter zu bauen, die wiederum an die KI angebunden sind. Die KI wird sich selbst verbessern und in Form von Robotern überall präsent sein. Das ließt sich alles wie diverse Science-Fiction-Romane/Filme wie iRobot bis Terminator. Damit wäre dann dem Papst seine Enzyclika schon wieder von der Technik überholt, weil KI "körperlich" wird.
Ich hoffe, man kommt noch zur Besinnung.
Puh. Ich habe das Gefühl da muss sprachlich noch sehr sehr viel entschlackt werden. Eine KI ist eine, wenn auch sehr komplexe, Software. Wenn man das ganze metaphysische da mal raus nimmt macht die Software das, was komplexe Algorithmen auch tun. Nur in diesem Fall sind die Algorithmen der Software so programmiert, dass sie entlang eingebauter Parameter an sich selbst rumschreiben und neue Ausführungsparameter erstellen können. So weit so komplex, dass das leicht aus dem Bliock geraten kann, was die Software macht oder machen kann. So weit so bekannt ist das Problem doch mit komplexen Anwendungen. Da bemüht man sich darum das einzufangen zu monitoren und unerwünschtes zu vermeiden. Die Software von Banken kann ja auch nicht eigenständig alle verbuchten Einträge irgendwoanders hinschieben.
Sieht man mal von unsicher geschriebenen Softwares einiger Krypotbanken ab.
Wenn Softwares Dinge tun die a) als Straftat verboten sind und b) ggf. unerwünscht, dann erfüllt der Hersteller damit … eine oder gleich mehrere Straftatbestände.
Wenn die Hersteller sich auch noch damit brüsten, dass sie ihre Software nicht verstehen und nicht kontrollieren können, dann muss ihnen das Recht abgesprochen werden diese öffentlich zu betreiben und die Verantwortlichen sollten, da sie im Wissen gehandelt haben sehr großen gemeinchaftlichen Schaden anrichten zu können, Beschäftigungsverbote erhalten.
Was denn, wenn die AI in den USA die Wasserwerke in den USA, die Elektrizitätswerke angefgriffen und lahm gelegt hätte?
Hier ist noch eine schöne Glosse zum Thema, KI ist doch für was nützlich!
https://www.fr.de/kultur/timesmager/times-mager-geografie-94425528.html