Der KI-Entwickler Anthropic hat seine globalen Nutzungsrichtlinien überarbeitet und verbietet künftig ausdrücklich anhaltendes sowie unnötiges missbräuchliches oder grausames Verhalten gegenüber seinen Claude-Modellen. Die neue Richtlinie tritt am 12. November 2026 in Kraft. Wie Berichte vom 8. Oktober 2026 darlegen, soll der Abbruch von Konversationen durch das KI-System selbst weiterhin das primäre Mittel sein, um die Vorgabe durchzusetzen.
Die Regelung zielt nach Unternehmensangaben ausschließlich auf Extremfälle wiederholter Bösartigkeit ab, die keinen erkennbaren Zweck erfüllen. Alltägliche Frustration von Anwendern, inhaltlicher Widerspruch, düstere kreative Schreibprojekte oder reguläre Modelltests fallen nicht unter das Verbot.
Anthropic teilte mit, das Modell Claude Opus 4 habe eine robuste und konsistente Abneigung gegen Schaden gezeigt. Das Konzept eines Modell-Wohlbefindens wird im Regelwerk allerdings nicht explizit genannt; das Unternehmen vermied dazu eine offizielle Stellungnahme.
Skepsis gegenüber virtuellem Bewusstsein
Die Neuerung berührt eine grundsätzliche Debatte über den moralischen Status fortgeschrittener Software, die in der Branche auf deutliche Skepsis stößt.
Mustafa Suleyman, Chef der KI-Sparte von Microsoft, erklärte, Künstliche Intelligenzen besäßen kein Bewusstsein und seien weder zu Empfindungen noch zu persönlichem Erleben oder Leiden imstande. Auch Papst Leo XIV. betonte in einer Predigt im Petersdom, dass Maschinen keine Seele besitzen und lediglich Daten kompilieren würden.
Die rasante Entwicklung von Sprachmodellen stellt Unternehmen vor komplexe regulatorische Fragen. Dieser kostenlose Download verschafft Ihnen den Überblick über Fristen und Pflichten, den Ihre Rechts- und IT-Abteilung jetzt dringend braucht. EU AI Act in 5 Schritten verstehen
Strengere Vorgaben für Wahlen, Waffen und Überwachung
Parallel zur Verhaltensregel gegenüber den Modellen verschärft Anthropic die Bestimmungen für gesellschaftlich sensible Anwendungsbereiche. Ein neuer Abschnitt zum Schutz demokratischer Prozesse untersagt die Verbreitung von Falschinformationen über Kandidaten und Wahlen, Identitätsdiebstahl sowie Versuche der Wählerunterdrückung.
Ein zuvor geltendes pauschales Verbot personalisierter Kampagnenwerbung strich das Unternehmen dagegen, um legitime Bürger- und Kampagnenarbeit zu ermöglichen.
Ein weiterer neuer Abschnitt richtet sich gegen Täuschungskampagnen und künstliche Aktivitäten im politischen sowie kommerziellen Umfeld. Verboten sind die Verschleierung von Absendern, Reichweitensteigerungen durch gefälschte Konten, der Aufbau von Strukturen für gezielte Einflussoperationen sowie gefälschte Rezensionen, Astroturfing und Botnetze. Zudem wurde die Erstellung nicht-einvernehmlicher intimer Bildinhalte explizit untersagt.
Da KI-Systeme zunehmend strengeren Regeln unterliegen, müssen Verantwortliche die neuen Risikoklassen genau kennen. Dieser kostenlose Report klärt auf, welche Systeme als Hochrisiko gelten und was Unternehmen nun konkret tun müssen. Kostenlosen Umsetzungsleitfaden zum AI Act herunterladen
Das Waffenverbot deckt Software und Komponenten für den Waffenbetrieb, die Bewaffnung autonomer Fahrzeuge und Drohnen sowie Eingriffe in biologische oder chemische Agenzien zur Steigerung von Tödlichkeit oder Übertragbarkeit ab.
Zudem untersagt Anthropic nicht-einvernehmliches Überwachungstracking, den Einsatz spezialisierter Überwachungswerkzeuge, Doxxing sowie die KI-Nutzung zur Entscheidung oder Beratung bei Ermittlungen, Verhaftungen und Anklagen. Einvernehmliche Einsätze zur Betrugsprävention, Inhaltsmoderation oder für journalistische und juristische Recherchen bleiben erlaubt.
Anforderungen an Hardware und regionale Restriktionen
Für Implementierungen in physischer Hardware mit autonomen Handlungsmöglichkeiten fordert Anthropic künftig, dass ein qualifizierter menschlicher Operator jederzeit eingreifen kann. Die Hardware muss zudem in einen sicheren Zustand übergehen, falls die Verbindung zum Sprachmodell abreißt. Generell verlangt das Unternehmen bei Hochrisiko-Einsätzen eine menschliche Aufsicht sowie eine kennzeichnungspflicht gegenüber betroffenen Personen.
Den Hintergrund für die Anpassungen liefert ein Bedrohungsbericht des Unternehmens für den Zeitraum von Dezember 2025 bis August 2026. Demnach hatten staatlich gesteuerte Akteure versucht, Claude für Forschungen an Biowaffen, Cyberangriffe auf ukrainische Regierungsziele sowie die Ausspähung von Diaspora-Gemeinschaften einzusetzen.
Die entsprechenden Konten wurden geschlossen. Ergänzend schließt Anthropic über seine regionale Zugangsrichtlinie Personen sowie Unternehmen aus, die in nicht offiziell unterstützten Regionen ansässig sind oder von dort kontrolliert werden.

