Gerichtsdokumente: Microsoft-Manager warnen vor KI-Datenscraping als Diebstahl

Microsoft erzielt 24,1 Milliarden USD mit OpenAI-Verträgen, während interne Dokumente Risiken für Verlage und sinkende Klickraten offenlegen.

Im Geschäftsjahr 2026, das die zwölf Monate bis zum 30. Juni umfasst, hat sich OpenAI als größter Kunde von Microsoft im Bereich der künstlichen Intelligenz etabliert. Während die finanzielle Verflechtung beider Konzerne neue Höchststände erreicht, geraten die Partner durch Mitte September entsiegelte Gerichtsdokumente unter Druck.

Die internen Unterlagen verdeutlichen, dass führende Mitarbeiter beider Unternehmen das massenhafte Auslesen redaktioneller Inhalte für das Training von KI-Modellen intern bereits frühzeitig scharf kritisierten.

Die wirtschaftliche Verflechtung prägte Microsofts Geschäftsjahr 2026 maßgeblich. Der Gesamtumsatz des Konzerns stieg um 18% auf 331,8 Mrd. USD, wovon 24,1 Mrd. USD beziehungsweise rund 7% direkt aus Verträgen mit OpenAI stammten.

Gleichzeitig schuldete OpenAI dem Technologiekonzern zum 30. Juni insgesamt 6,0 Mrd. USD. Die Erlöse der Cloud-Sparte Azure überschritten im selben Zeitraum erstmals die Schwelle von 100 Mrd. USD bei einem Zuwachs von 41%, wobei OpenAI-Aufträge etwa ein Viertel dieses Volumens ausmachten.

Auch die vertraglich gebundenen künftigen Einnahmen im Geschäftskundenbereich kletterten um 84% auf 678 Mrd. USD. Ohne die Vereinbarungen mit OpenAI hätte dieser Anstieg laut Finanzchefin Amy Hood bei 25% gelegen. Parallel dazu weitete Microsoft die Investitionen in Sachanlagen im Geschäftsjahr 2026 von zuvor 64,6 Mrd. USD um rund 80% auf 115,9 Mrd. USD aus.

Interne Memos warnen vor Auszehrung journalistischer Quellen

Hinter den Bilanzen schwelen erhebliche rechtliche Risiken. Am 17. September ordnete Richter Sidney H. Stein im konsolidierten Urheberrechtsverfahren vor einem Gericht in Manhattan die Entsiegelung hunderter Seiten interner Dokumente an. Ein von Jason Kint von der Branchenorganisation Digital Content Next veröffentlichter, 92 Seiten umfassender Schriftsatz der Klägerseite bringt brisante Äußerungen ans Licht.

So stufte Brent Hecht, Director of Applied Science bei Microsoft, das Datenscraping in einem Papier aus dem Januar 2023 als beispiellosen Diebstahl von Arbeitskraft ein. Er warnte vor realen Gefahren für die Beschäftigung und bezeichnete Sprachmodelle als Produkte, die ihre eigene Lieferkette zerstören.

Weitere interne Unterlagen Microsofts sprachen von einer verhängnisvollen Abwärtsspirale, da ein Endprodukt die ökonomischen Grundlagen seiner wichtigsten Zulieferer untergrabe.

Anzeige

Die rasante Entwicklung von KI-Modellen bringt komplexe rechtliche Anforderungen mit sich, die weit über das Urheberrecht hinausgehen. Welche neuen Regeln für die Entwicklung und Nutzung von KI-Systemen nun verbindlich gelten, erfahren Sie in diesem kompakten E-Book. EU AI Act in 5 Schritten verstehen: Fristen, Pflichten und Risikoklassen kompakt erklärt

Microsoft-Chef Satya Nadella bestätigte unter Eid, die Nutzung von Chatbots habe den Besuch von Originalquellen ersetzt. Inhalte hinter Bezahlschranken müssten lizenziert werden; bei Kenntnis über solche Trainingsdaten hätte er OpenAI zu einem erneuten Training verpflichtet.

Auch Nick Turley, Chef von ChatGPT bei OpenAI, hielt im Juni 2023 fest, generative KI stelle eine existenzielle Bedrohung für Verlage dar und wirke zunehmend als Ersatz für deren Inhalte. OpenAI-Präsident Greg Brockman wusste zudem von Techniken zur Umgehung der Bezahlschranke der New York Times und reagierte zustimmend darauf.

Klagen von Verlagen und massiver Rückgang von Klickraten

Die vorgelegten Unterlagen belegen drastische Folgen für Medienhäuser. Microsoft-eigene Erhebungen zeigen, dass der Einsatz des Assistenten Copilot im Vergleich zur herkömmlichen Bing-Suche zu einem Einbruch der Klickraten auf große Nachrichtenseiten um bis zu 94% führte.

Anzeige

Wer sich mit dem Einsatz moderner KI-Technologien befasst, muss neben wirtschaftlichen Risiken auch die neuen gesetzlichen Rahmenbedingungen im Blick behalten. Dieser kostenlose Report liefert den notwendigen Überblick über Risikoklassen und Dokumentationspflichten für Unternehmen. Kostenlosen Umsetzwas-Leitfaden zum EU AI Act jetzt herunterladen

Für Seiten der New York Times belief sich das Minus auf 87% bis 93%, bei der Daily News-Gruppe auf 83% bis 91% und bei Ziff-Davis-Angeboten wie CNET oder ZDNET auf 51% bis 94%.

In den Trainingskorpora von OpenAI befanden sich unter anderem mehr als 91.692 Kopien von Artikeln der New York Times sowie mindestens 160.903 Werke anderer Verlage aus dem Projekt Mango. Zudem umfasste der Datensatz Common Crawl über 2 Mio. Seiten von nytimes.com.

Microsoft-Sprecher Alex Haurek erklärte, die Memos von Hecht spiegelten lediglich die persönliche Sichtweise eines einzelnen Angestellten wider und stellten keine juristische Analyse dar. Das Unternehmen betrachte das Training weiterhin als transformative, rechtlich zulässige Nutzung und weise den Vorwurf zurück, Copilot verdränge Journalismus.

Die Trump-Regierung stützte diese Haltung am 1. September mit einer Stellungnahme, wonach das Training auf geschützten Texten außerordentlich transformativ sei.

Die bereits 2023 eingereichte Klage von Medien wie The Intercept, dem Center for Investigative Reporting, Ziff Davis und der New York Times wird vor Richter Stein und Magistratsrichterin Ona T. Wang verhandelt; eine Entscheidung wird nicht vor 2027 erwartet.

Die finanzielle Dimension verdeutlicht ein Präzedenzfall: Der Konkurrent Anthropic zahlte 1,5 Mrd. USD an Autoren, um Vorwürfe über die unerlaubte Nutzung von Büchern für das Training seines Modells Claude beizulegen.