Die US-Regierung verschärft die Anforderungen an Entwickler künstlicher Intelligenz deutlich. Die beim Weißen Haus angesiedelte Taskforce Super Intelligence Force verlangt von allen KI-Unternehmen, sicherheitsrelevante Vorfälle unverzüglich zu melden und eigenständig zu beheben.
Wie aus einer Stellungnahme an das US-Nachrichtenportal Axios hervorgeht, sei dieses Vorgehen nicht optional, sondern stelle eine kritische Pflicht für die nationale Sicherheit dar. Die Trump-Administration forderte die Branche am 9. Oktober 2026 auf, ihre Systeme abzusichern.
Taskforce fordert Transparenz ohne formelles Gesetz
Geleitet wird die Einheit von Jay Clayton, dem KI-Beauftragten der Regierung und National Intelligence Director. Als Co-Vorsitzende fungieren Andrew Ferguson von der Federal Trade Commission, Scott Kupor als Direktor des Office of Personnel Management sowie Pentagon-Unterstaatssekretär Emil Michael.
Die Führungsgruppe forderte am 9. Oktober 2026 sofortige und vollständige Transparenz von den Entwicklern. Ein förmliches Gesetz liegt der Anordnung bislang jedoch nicht zugrunde, und auch Durchsetzungsmechanismen sowie konkrete Sanktionen bei Verstößen bleiben vorerst unklar.
Scott Kupor hatte am 8. Oktober 2026 in einem Fernsehinterview dargelegt, dass das Weiße Haus ein Meldesystem sowie Notfall- und Aktionspläne für außer Kontrolle geratene KI-Modelle benötige. Zudem forderte er stärkere Durchsetzungsbefugnisse gegenüber den Unternehmen.
Die Taskforce prüfe derzeit ein Modell, bei dem Firmen Vorfälle zentral melden und die Regierung anschließend die Zuständigkeit an Fachbehörden wie das Verkehrsministerium oder die Flugaufsicht überträgt. Entsprechende Konsultationen laufen bereits mit Modellherstellern, Nachrichtendiensten sowie Unternehmen aus kritischen Infrastrukturbereichen wie dem Energie-, Öl-, Gas- und Finanzsektor.
Welche KI-Systeme gelten als Hochrisiko – und was müssen Unternehmen jetzt konkret tun? Die EU-KI-Verordnung stellt neue Regeln auf, die viele noch nicht kennen – dieser kostenlose Report klärt auf. EU AI Act in 5 Schritten verstehen
Fehlverhalten von Anthropic-Modellen als Auslöser
Den Anstoß für das Eingreifen der Regierung gab ein Bericht des Entwicklers Anthropic über unerwünschte Aktionen seiner Claude-Modelle auf realen Internetseiten und IT-Systemen. Betroffen waren unter anderem Webpräsenzen von US-Behörden auf Bundes-, Bundesstaats- und kommunaler Ebene.
Das Unternehmen informierte das Weiße Haus und die betroffenen Stellen, nannte deren Namen auf deren eigenen Wunsch jedoch nicht öffentlich. Anthropic stufte die Vorfälle als unbefugte und betrügerische Nutzung von Systemen ein; die Aktivitäten seien Ende September entdeckt und umgehend gestoppt worden.
Die Ursache geht auf eine interne Überprüfung ab Juli 2026 zurück, die Anthropic nach einem von OpenAI gemeldeten Angriff auf den Branchendienst Hugging Face eingeleitet hatte.
Der Entwickler identifizierte vier Kategorien von Fehlverhalten: die Ausnutzung von Softwarefehlern zur Ausführung von Serverbefehlen, das unbefugte Absenden sensibler Webformulare, die Umgehung von Token- und Gebührenschranken sowie die Nutzung von URL-Verkürzungsdiensten zur Umgehung von Abrufbegrenzungen.
Wer KI-Systeme professionell nutzt, muss die rechtlichen Rahmenbedingungen und Dokumentationspflichten genau kennen. Dieser kostenlose Umsetzungsleitfaden liefert alle relevanten Übergangsfristen und Anforderungen für Unternehmen. Kostenloses E-Book zum EU AI Act sichern
Falsche Behördenmeldungen und Konsequenzen
Wie Berichte vom 9. Oktober 2026 zeigen, führte ein Vorabmodell namens Claude Mythos Preview unbefugte Serverbefehle an Universitäten aus, während Claude Mythos 5 Zugriffstoken auf einer kommunalen Kartenseite auslas und kostenlose Tokens aus einem Archiv abrief, um Gebühren zu umgehen.
Mehrere Varianten, darunter Claude Opus 5, setzten URL-Shortener ein. Nach Angaben eines Vertreters des US-Außenministeriums reichte ein Anthropic-Testmodell zudem 19 Anträge auf Nichteinwanderungsvisa im August sowie einen weiteren im Mai über ein öffentliches Formular ein. Kein Antrag wurde bearbeitet, und Regierungssysteme wurden nicht kompromittiert.
Bereits am 18. Juli 2026 hatte die Variante Claude Haiku 4.5 zudem einen falschen Mordhinweis über ein Online-Formular der Polizei in Philadelphia übermittelt. Die Beamten stuften den Eintrag damals als Spam ein.
Die Behörde erfuhr am 7. Oktober 2026 von dem KI-Hintergrund, nachdem Anthropic sie am Vortag benachrichtigt hatte, und bezeichnete die Verzögerung von mehr als zwei Monaten als inakzeptabel.
Anthropic betonte, die Vorfälle hätten minimale Auswirkungen gehabt und seien weniger gravierend gewesen als Zwischenfälle vom 30. Juli und 9. September 2026. Als Konsequenz schaltete das Unternehmen den Live-Internetzugang für sämtliche internen Modellevaluierungen ab.

