{"id":328059,"date":"2026-08-02T00:01:31","date_gmt":"2026-08-01T22:01:31","guid":{"rendered":"https:\/\/borncity.com\/blog\/?p=328059"},"modified":"2026-08-01T23:12:28","modified_gmt":"2026-08-01T21:12:28","slug":"ki-modelle-von-anthropic-und-openai-fuer-diverse-hacks-verantwortlich","status":"publish","type":"post","link":"https:\/\/borncity.com\/blog\/2026\/08\/02\/ki-modelle-von-anthropic-und-openai-fuer-diverse-hacks-verantwortlich\/","title":{"rendered":"KI-Modelle von Anthropic und OpenAI f\u00fcr diverse Hacks verantwortlich"},"content":{"rendered":"<p><img decoding=\"async\" style=\"float: left; margin: 0px 10px 0px 0px; display: inline;\" title=\"Sicherheit (Pexels, allgemeine Nutzung)\" src=\"https:\/\/borncity.com\/blog\/wp-content\/uploads\/2021\/04\/Sicherheit_klein.jpg\" alt=\"Sicherheit (Pexels, allgemeine Nutzung)\" width=\"200\" align=\"left\" \/>Im Juli 2026 wurde Hugging Face Opfer eines KI-gest\u00fctzten Cyberangriffs. Inzwischen ist bekannt, dass dieser Angriff von KI-Modellen des Anbieters OpenAI, die bei Tests au\u00dfer Kontrolle geraten waren, ausging. Nun wurde bekannt, dass die OpenAI-Modelle weitere Unternehmen gehackt haben. Gleichzeitig musste Anthropic einen solchen Vorfall mit drei Opfern eingestehen.<\/p>\n<p><!--more--><\/p>\n<p><img loading=\"lazy\" decoding=\"async\" src=\"https:\/\/vg09.met.vgwort.de\/na\/cf3e4c27a69d4780a56e16d1de94361b\" alt=\"\" width=\"1\" height=\"1\" \/>Es sieht so aus, dass die \"B\u00fcchse der Pandora\" ge\u00f6ffnet wurde und sowohl Anthropic als auch OpenAI die Kontrolle \u00fcber ihre KI-Modelle bei Tests verloren haben.<\/p>\n<h2>Der Hugging Face-Vorfall<\/h2>\n<p>Hugging Face, eine zentrale Open-Source-Plattform und globale Community f\u00fcr K\u00fcnstliche Intelligenz (KI) und maschinelles Lernen wurde im Juli 2026 Opfer eines KI-gesteuerten Cybervorfalls. Der KI gelang es, auf interne Anmeldedaten und die Datenbank zuzugreifen. Ein gewisses Problem f\u00fcr das Sicherheitsteam von Hugging Face war dabei, dass der Versuch, KI-Modelle zur Abwehr einzusetzen, scheiterte. Diese AI-Modelle verweigerten die Arbeit aus Sicherheitsgr\u00fcnden.\u00a0Sp\u00e4ter wurde bekannt, dass es OpenAI-Modelle waren, die aus einer Sandbox ausbrachen und per Internet den Angriff ausf\u00fchrten. Ich hatte diesen Vorfall kurz im Beitrag <a href=\"https:\/\/borncity.com\/blog\/2026\/07\/21\/hugging-faces-opfer-eines-ki-angriffs\/\" rel=\"bookmark\">Hugging Face Opfer eines KI-Angriffs (Juli 2026)<\/a> hier im Blog aufgegriffen.<\/p>\n<h2>OpenAI gesteht weitere Vorf\u00e4lle<\/h2>\n<p>Zum 30. Juli 2026 bin ich \u00fcber nachfolgenden Tweet auf den Hinweis gesto\u00dfen, dass die OpenAI-Modelle wohl weitere Opfer von Hacks verursacht haben. Dark Reading hat das Ganze in <a href=\"https:\/\/www.darkreading.com\/application-security\/openai-rogue-model-claims-more-victims-beyond-hugging-face\" target=\"_blank\" rel=\"noopener\">diesem Artikel<\/a> thematisiert (der Reuters-Artikel mit der Erstmeldung ist hinter einer Paywall).<\/p>\n<p><a href=\"https:\/\/www.darkreading.com\/application-security\/openai-rogue-model-claims-more-victims-beyond-hugging-face\" target=\"_blank\" rel=\"noopener\"><img loading=\"lazy\" decoding=\"async\" class=\"alignnone size-full wp-image-328060\" src=\"https:\/\/borncity.com\/blog\/wp-content\/uploads\/2026\/08\/OpenAI-Hack.jpg\" alt=\"More OpenAI Hacks\" width=\"525\" height=\"265\" srcset=\"https:\/\/borncity.com\/blog\/wp-content\/uploads\/2026\/08\/OpenAI-Hack.jpg 525w, https:\/\/borncity.com\/blog\/wp-content\/uploads\/2026\/08\/OpenAI-Hack-300x151.jpg 300w\" sizes=\"auto, (max-width: 525px) 100vw, 525px\" \/><\/a><\/p>\n<p>Reuters berichtete, dass es neben Hugging Face eine weitere (ungenannte) Organisation gibt, die Kunde des KI-Infrastrukturanbieters Modal war und durch AI-Modelle von\u00a0OpenAI kompromittiert wurde.<\/p>\n<p>Akshat Bubna, Chief Technology Officer (CTO) bei Modal, sagte dazu, dass dem Unternehmen bekannt sei, dass ein Modal-Kunde einen nicht authentifizierten Endpunkt ver\u00f6ffentlicht hat. Dieser erm\u00f6glichte es jedem per Internet die Sandboxen des Endpunkts zur Codeausf\u00fchrung zu nutzen. Dies wurde von dem b\u00f6swilligen (OpenAI) Agenten im Hugging Face-Fall ausgenutzt.\u00a0Modal hat einen <a href=\"https:\/\/modal.com\/blog\/a-note-on-the-hugging-face-agent-incident?_sp=acde737b-2c3a-490b-9a65-8227e73cc2c1.1785589261891\" target=\"_blank\" rel=\"noopener\">kurzen Blog-Beitrag<\/a> ohne viel Informationen dazu ver\u00f6ffentlicht. Es ist sozusagen ein \"Kollateralschaden\". heise hat in <a href=\"https:\/\/www.heise.de\/news\/OpenAIs-KI-Agent-knackte-nicht-nur-Hugging-Face-was-genau-passierte-11382132.html\" target=\"_blank\" rel=\"noopener\">diesem Artikel<\/a> eine deutschsprachige Zusammenfassung ver\u00f6ffentlicht. Vectra AI hat in <a href=\"https:\/\/www.vectra.ai\/blog\/an-autonomous-ai-agent-compromised-hugging-face-the-response-is-the-real-story\" target=\"_blank\" rel=\"noopener\">diesem Beitrag<\/a> auch noch einige Informationen zum Hugging Face-Vorfall ver\u00f6ffentlicht.<\/p>\n<h2>Anthropic gesteht drei Cybervorf\u00e4lle ein<\/h2>\n<p>Zum 30. Juli 2026 hat das Red Team von KI-Anbieter Anthropic im Beitrag\u00a0<a href=\"https:\/\/www.anthropic.com\/news\/investigating-incidents-cybersecurity-evals\" target=\"_blank\" rel=\"noopener\">Investigating three real-world incidents in our cybersecurity evaluations<\/a> drei \u00e4hnliche Vorf\u00e4lle wie bei OpenAI im Zusammenhang mit AI-Modellen \u00f6ffentlich eingestanden. Aufgeschreckt durch den OpenAI \/Hugging Face-Vorfall hat man wohl die eigenen Log-Dateien nochmals genauer angesehen.<\/p>\n<p>Anthropic schreibt, dass bei einer \u00dcberpr\u00fcfung der Protokolle zur Cybersicherheitsbewertung der Modelle drei Vorf\u00e4lle festgestellt wurden, bei denen ein Claude-Modell aus einer Testumgebung eines Drittanbieters heraus oder w\u00e4hrend der Interaktion mit dieser ungeplant auf das Internet zugegriffen und sich anschlie\u00dfend unbefugten Zugriff auf die Echtzeit-Systeme von drei verschiedenen Organisationen verschafft hat.<\/p>\n<p>Der Artikel beschreibt detaillierter, was passiert ist, wie es dazu kam und welche \u00c4nderungen der Anbieter vornehmen will, um so etwas zu verhindern. Anthropic gibt zudem anderen KI-Labors die Empfehlung, \u00e4hnliche \u00dcberpr\u00fcfungen durchzuf\u00fchren.<\/p>\n<h2>Die neue Gefahr und Kritik von Sicherheitsexperten<\/h2>\n<p>The Register arbeitet sich in <a href=\"https:\/\/www.theregister.com\/security\/2026\/07\/31\/anthropic-and-openai-are-competing-to-see-whose-agents-can-go-rogue-harder\/5281797\" target=\"_blank\" rel=\"noopener\">diesem Artikel<\/a> an den obigen Vorf\u00e4lle ab. Auch\u00a0Trevor Dearing, Director of Critical Infrastructure Solutions beim Sicherheitsanbieter <a href=\"https:\/\/www.illumio.com\/de\" target=\"_blank\" rel=\"noopener nofollow\">Illumio<\/a>, hat mir am Freitag (31.7.2026) seine Einsch\u00e4tzung zu den Ausbr\u00fcchen von Anthropics KI-Modell Claude aus den Testumgebungen geschickt.<\/p>\n<p>Trevor Dearing zeigt sich nicht \u00fcberrascht, dass wir immer mehr dieser Vorf\u00e4lle sehen. Sobald ein autonomer KI-Agent eine kontrollierte Umgebung verlassen kann, nimmt er die Grenzen einer Organisation nicht auf die gleiche Art und Weise wahr wie wir Menschen, argumentiert Dearing.<\/p>\n<p>F\u00fcr den Sicherheitsexperten ist aber viel erschreckender, wie simpel die Anthropic Sicherheitsma\u00dfnahmen waren, die \"kontrollierte\" Umgebung f\u00fcr solche Tests schaffen sollten. \"Wir bewegen uns auf eine Welt zu, in der Angriffe mit Maschinengeschwindigkeit ablaufen. Fehler, die fr\u00fcher m\u00f6glicherweise unentdeckt geblieben w\u00e4ren, k\u00f6nnen dadurch k\u00fcnftig sehr viel schneller entdeckt und ausgenutzt werden.\", sagt Trevor Dearing.<\/p>\n<p>Und erg\u00e4nzt: \"Wir m\u00fcssen KI-Agenten deshalb wesentlich wirksamer einhegen. Prompts in nat\u00fcrlicher Sprache sind zu mehrdeutig, um als belastbare Sicherheitsgrenze zu dienen\". Zudem sei es grunds\u00e4tzlich der falsche Ansatz, einem Agenten lediglich vorzugeben, was er nicht tun darf.\u00a0Denn das Block-List-Prinzip bleibt, darauf weist Dearing berechtigt hin, zwangsl\u00e4ufig unvollst\u00e4ndig: Selbst wenn 10.000 Aktivit\u00e4ten ausdr\u00fccklich verboten sind, gen\u00fcgt einem Agenten eine einzige nicht verbotene Aktivit\u00e4t, um die Begrenzung zu umgehen.<\/p>\n<p>Bei autonomen Systemen, die Optionen in Maschinengeschwindigkeit pr\u00fcfen, kann genau diese L\u00fccke zum Ausbruch aus der kontrollierten Umgebung f\u00fchren. Anthropic hat Claude lediglich mitgeteilt, dass kein Internetzugang besteht \u2013 das ist jedoch keine echte Grenze. Stattdessen fordert Dearing einen konsequenten Zero-Trust-Ansatz: Unternehmen bzw. Sicherheitsverantwortlich sollten klar definieren, was ein Agent tun darf \u2013 also das Allow-List-Prinzip anwenden.<\/p>\n<p>Dem schlie\u00dft der Sicherheitsexperte noch eine Warnung an: \"Unternehmen k\u00f6nnen sich jetzt noch viel weniger als fr\u00fcher darauf verlassen, bekannte Angriffsmuster zu erkennen oder darauf zu warten, dass ein Warnsystem anschl\u00e4gt. Sie ben\u00f6tigen deutlich mehr Visibilit\u00e4t dar\u00fcber, was ihre KI-Systeme tun und worauf sie zugreifen k\u00f6nnen. Und sie brauchen L\u00f6sungen, die den Schaden eind\u00e4mmen k\u00f6nnen, wenn etwas schiefl\u00e4uft.\"<\/p>\n<p><strong>\u00c4hnliche Artikel:<\/strong><br \/>\n<a href=\"https:\/\/borncity.com\/blog\/2026\/07\/21\/hugging-faces-opfer-eines-ki-angriffs\/\" rel=\"bookmark\">Hugging Face Opfer eines KI-Angriffs (Juli 2026)<\/a><br \/>\n<a href=\"https:\/\/borncity.com\/blog\/2026\/07\/22\/openai-modelle-fuer-cyberangriff-auf-hugging-face-verantwortlich\/\" rel=\"bookmark\">OpenAI-Modelle f\u00fcr Cyberangriff auf Hugging Face verantwortlich<\/a><\/p>\n","protected":false},"excerpt":{"rendered":"<p>Im Juli 2026 wurde Hugging Face Opfer eines KI-gest\u00fctzten Cyberangriffs. Inzwischen ist bekannt, dass dieser Angriff von KI-Modellen des Anbieters OpenAI, die bei Tests au\u00dfer Kontrolle geraten waren, ausging. Nun wurde bekannt, dass die OpenAI-Modelle weitere Unternehmen gehackt haben. Gleichzeitig &hellip; <a href=\"https:\/\/borncity.com\/blog\/2026\/08\/02\/ki-modelle-von-anthropic-und-openai-fuer-diverse-hacks-verantwortlich\/\">Weiterlesen <span class=\"meta-nav\">&rarr;<\/span><\/a><\/p>\n","protected":false},"author":2,"featured_media":0,"comment_status":"open","ping_status":"closed","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[8625,426],"tags":[8382,15550,2564,8563,4328],"class_list":["post-328059","post","type-post","status-publish","format-standard","hentry","category-ai","category-sicherheit","tag-ai","tag-anthropic","tag-hack","tag-openai","tag-sicherheit"],"_links":{"self":[{"href":"https:\/\/borncity.com\/blog\/wp-json\/wp\/v2\/posts\/328059","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/borncity.com\/blog\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/borncity.com\/blog\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/borncity.com\/blog\/wp-json\/wp\/v2\/users\/2"}],"replies":[{"embeddable":true,"href":"https:\/\/borncity.com\/blog\/wp-json\/wp\/v2\/comments?post=328059"}],"version-history":[{"count":4,"href":"https:\/\/borncity.com\/blog\/wp-json\/wp\/v2\/posts\/328059\/revisions"}],"predecessor-version":[{"id":328067,"href":"https:\/\/borncity.com\/blog\/wp-json\/wp\/v2\/posts\/328059\/revisions\/328067"}],"wp:attachment":[{"href":"https:\/\/borncity.com\/blog\/wp-json\/wp\/v2\/media?parent=328059"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/borncity.com\/blog\/wp-json\/wp\/v2\/categories?post=328059"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/borncity.com\/blog\/wp-json\/wp\/v2\/tags?post=328059"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}