Geheime Mails: Microsoft-Chef nennt KI-Training „beispiellosen Diebstahl“

Gerichtsdokumente offenbaren kritische Einschätzungen zur Datennutzung, starke Klickverluste für Verlage und neue politische Spannungen im Verfahren.

Im laufenden Urheberrechtsstreit zwischen der New York Times und den Technologieunternehmen Microsoft und OpenAI bringen neu unredigierte Gerichtsdokumente die Verteidigungsstrategie der KI-Entwickler unter Druck. Interne Mails und Memos zeigen, dass Führungskräfte beider Häuser den Umgang mit urheberrechtlich geschützten Inhalten intern kritisch bewerteten.

Ein Fachanwalt für Datenschutz wies darauf hin, dass die Umgehung von Bezahlschranken die Argumentation einer zulässigen Nutzung („Fair Use“) grundlegend untergrabe und einen Verstoß gegen den Digital Millennium Copyright Act (DMCA) darstellen könne.

Schwere Vorwürfe in internen Microsoft-Memos

Aus den Unterlagen geht hervor, dass Dr. Brent Hecht, Microsofts Director of Applied Science, bereits im Jahr 2023 in einem internen Memo deutliche Warnungen aussprach. Er bezeichnete das Training von KI-Systemen als erstaunlichen Diebstahl von beispiellosem Ausmaß und sprach vom möglicherweise größten Diebstahl von Arbeitsleistung in der Geschichte der Menschheit.

Hecht warnte zudem davor, dass Millionen von Menschen die Erfassung ihrer Arbeit durch KI-Systeme als bloßes Aufsaugen ihrer Leistungen ohne Kompensation wahrnehmen könnten. Ein gerichtliches Urteil zugunsten von Microsoft würde nach seiner Einschätzung die Idee des „Fair Use“ ins Lächerliche ziehen.

Weitere interne Dokumente von Microsoft warnen vor einer KI-Content-Strategie, die einen Teufelskreis („Doom Loop“) in Gang gesetzt habe. Demnach würden die KI-Produkte die ökonomischen Grundlagen ihrer eigenen Zulieferer bedrohen. Ein Dokument beschreibt Large Language Models (LLMs) explizit als ein Produkt, das seine eigene Lieferkette zerstöre.

Massive Auswirkungen auf den Verlagsverkehr

Die wirtschaftlichen Folgen für Medienhäuser werden durch unternehmenseigene Daten von Microsoft verdeutlicht. Diese zeigen, dass die Click-Through-Raten für Domains der New York Times und von Daily News bei der Nutzung der Antwort-Engine von Copilot im Vergleich zur herkömmlichen Bing-Suche um 83 bis 93 Prozent eingebrochen sind. Bei Ziff Davis wurden Rückgänge zwischen 51 und 94 Prozent gemessen.

Anzeige

Die rechtlichen Rahmenbedingungen für künstliche Intelligenz verschärfen sich zusehends und fordern von Unternehmen volle Transparenz. Dieser kostenlose Ratgeber klärt auf, welche rechtlichen Pflichten und Bedrohungen Unternehmer jetzt im Zuge neuer Regulierungen kennen müssen. Kostenlosen Report zu neuen KI-Gesetzen und Risiken herunterladen

Microsoft-CEO Satya Nadella räumte in einer eidlichen Aussage ein, dass Chatbot-Konversationen Informationen direkt auf der KI-Plattform bereitstellten, anstatt die Nutzer zur ursprünglichen Quelle zu führen.

Nadella erklärte zudem, dass Inhalte hinter einer Paywall lizenziert werden sollten. Hätte er gewusst, dass OpenAI Material hinter Bezahlschranken für das Training verwendet habe, hätte er von seinem Recht Gebrauch gemacht, ein erneutes Training der Modelle zu fordern.

OpenAI-Führung sah existenzielle Bedrohung für Verlage

Auch bei OpenAI herrschte intern offenbar Bewusstsein über die disruptive Wirkung der Technologie. Nick Turley, ChatGPT-Chef, sprach bereits im Juni 2023 von einer existenziellen Bedrohung für Verlage und bezeichnete die KI-Produkte im Februar 2024 als weitgehend ersetzend.

Präsident Greg Brockman betonte die besondere Stärke der Modelle bei der Vorhersage und Verarbeitung von Nachrichtenartikeln. Ein Mitarbeiter wies Brockman zudem auf eine Methode zur Umgehung der Paywall der New York Times hin, was dieser positiv kommentierte.

Der Umfang der genutzten Daten ist beträchtlich. Das sogenannte Mango-Dataset enthält mindestens 160.903 einzigartige Werke der Kläger, während das Common-Crawl-Dataset mehr als zwei Millionen Dokumente umfasst. Für das Training wurde zudem der New York Times Annotated Corpus mit über 1,8 Millionen Artikeln erworben – laut Dokumenten unter dem Vorwand der nicht-kommerziellen Forschung.

Anzeige

Da die EU mit dem AI Act bereits klare Regeln für den Einsatz von KI-Systemen geschaffen hat, müssen Verantwortliche jetzt schnell handeln, um die Compliance sicherzustellen. Ein kostenloser Download verschafft Ihnen den notwendigen Überblick über Fristen, Pflichten und Risikoklassen, den Ihre Rechtsabteilung jetzt dringend braucht. EU AI Act Umsetzungsleitfaden kostenlos sichern

Juristisches Tauziehen und politische Dimension

Das Verfahren, das im Dezember 2023 in Manhattan eingeleitet wurde, hat sich mittlerweile auf elf weitere Verlage ausgeweitet. Die New York Times argumentiert, dass das massenhafte Kopieren zum Zweck des kommerziellen Gewinns nicht als „Fair Use“ gelten könne. OpenAI weist die Klage hingegen als unberechtigte Forderung zurück.

Anfang September 2026 reichten alle Parteien Anträge auf ein summarisches Urteil ein. Unterstützung erhielten Microsoft und OpenAI dabei durch ein Statement des US-Justizministeriums.

Das Ministerium warnte vor nationalen Sicherheits- und Wettbewerbsrisiken, sollte das Training von LLMs auf urheberrechtlich geschützten Texten als Rechtsverstoß gewertet werden. Die Trump-Administration argumentierte ergänzend, dass eine Lizenzierungspflicht die US-KI-Entwicklung im Wettbewerb mit China behindern würde.

Während das Justizministerium die „Fair Use“-Doktrin für den Trainingsprozess stützt, äußerten sich das US-Patent- und Markenamt sowie das Copyright Office überrascht über diese Position. Letzteres ist nach der Entlassung von Shira Perlmutter derzeit ohne Führung.