Urheberrecht · Gerichtsakten
„Der größte Diebstahl von Arbeit in der Menschheitsgeschichte“ — entsiegelte Akten zeigen, was Microsoft und OpenAI intern über ihre Trainingsdaten schrieben
Im großen US-Urheberrechtsverfahren gegen OpenAI und Microsoft wurde am Donnerstag ein bislang geschwärzter Schriftsatz entsiegelt. Sein Inhalt ist für jeden interessant, der KI-Systeme einkauft oder Inhalte produziert — weniger wegen der juristischen Bewertung, die noch aussteht, als wegen dessen, was die beteiligten Unternehmen intern über ihr eigenes Geschäft geschrieben haben.
Eine Einschränkung gehört an den Anfang, nicht ans Ende. TechCrunch, das die Akten zuerst ausgewertet hat, weist selbst darauf hin: Der größte Teil der neuen Informationen stammt aus dem Schriftsatz der New York Times, nicht aus den zugrundeliegenden Beweisstücken — die bleiben versiegelt. Die Zitate liegen also ohne ihren ursprünglichen Zusammenhang vor, ausgewählt von der Klägerseite. Das entwertet sie nicht, aber es ändert, wie man sie liest.
Der Satz, der der Meldung ihren Namen gibt, stammt von einem Microsoft-Mitarbeiter. Brent Hecht, bei Microsoft Director of Applied Science, schrieb in einem internen Memo vom Januar 2023, das massenhafte Abgreifen von Webinhalten sei „an astonishing theft of unprecedented proportions“ und „the largest theft of labor in human history“. Ein Jahr später, in einer internen Präsentation vom Januar 2024, beschrieb er die betriebswirtschaftliche Mechanik dahinter: „It is highly unusual that an end-product threatens the economic foundations of its essential suppliers, but that is the situation we have created for our LLM business with respect to its ‚content supply chain‘.“ Er nannte das Ergebnis einen „doom loop“, der „hurt the performance of our models and the entire web at the same time“ würde.
Anlass dieser Präsentation war keine Meinung, sondern eine Messung. Microsofts eigene Daten zeigen laut dem Schriftsatz, dass die Antwortmaschine Copilot die Klickrate auf die Domain der New York Times um bis zu 93 Prozent einbrechen ließ, verglichen mit der klassischen Bing-Suche. Das ist die wichtigste Zahl des Vorgangs: Sie trifft genau den Punkt, an dem sich die amerikanische Schrankenregelung entscheidet — ob eine Nutzung den Markt für das Original ersetzt.
Microsoft hat noch am Donnerstag reagiert und Hechts Einschätzung als Einzelmeinung eingeordnet. Ein Sprecher gegenüber TheWrap: „These comments reflect one employee's individual perspective, are not a legal analysis, and do not represent the company's views.“ Das ist formal zutreffend — ein Director of Applied Science spricht nicht für die Rechtsabteilung. Es erklärt allerdings nicht den zweiten Fund in denselben Akten.
Denn dort steht auch eine Aussage von Satya Nadella, protokolliert in einer Vernehmung Anfang dieses Jahres. Der Microsoft-Chef sagte, „anything that is paywalled should be licensed by anyone who wants to use it…for grounding or training“. Hätte man ihn informiert, dass OpenAI Inhalte hinter Bezahlschranken abgegriffen habe, hätte er nach eigener Aussage Microsofts Recht geltend gemacht, OpenAI zum Neutraining zu verpflichten. Microsoft erklärte dazu, Nadella habe über „broad principles“ gesprochen; das dürfe nicht mit rechtlichen Schlussfolgerungen verwechselt werden.
Auf OpenAI-Seite fällt die Wortwahl ähnlich deutlich aus. Nick Turley, bei OpenAI für ChatGPT verantwortlich, beschreibt die eigenen Produkte intern als „largely substitutive“ und auf dem Weg, es zunehmend zu werden; Verlage stünden vor einer „existential threat“. Präsident Greg Brockman nennt die Modelle „excellent at news“. In einem weiteren protokollierten Austausch bezeichnet der OpenAI-Forscher Nick Ryder ein Vorgehen als „hack to get around nytimes paywall“; Brockmans Antwort besteht aus zwei Wörtern: „ah nice.“ Zum Umfang nennt der Schriftsatz erstmals Zahlen: allein in den Mid-Training-Datensätzen mehr als 91.692 Kopien von Werken der Times, der Daily News und des Center for Investigative Reporting, in einem aus Common Crawl abgeleiteten Datensatz über zwei Millionen Dokumente von nytimes.com.
Zum Verfahren. Die Times klagt seit drei Jahren vor einem Bundesgericht in New York, zuständig ist Richter Sidney Stein. Die Kläger haben ein Urteil im schriftlichen Verfahren beantragt; gibt Stein dem statt, kommt es zu keinem Prozess. Vor 2027 wird nichts entschieden. Anfang September stellte sich das US-Justizministerium mit einem Schriftsatz hinter OpenAI und Microsoft. Steven Lieberman, Anwalt der ebenfalls klagenden New York Daily News, fasst die Bedeutung der Dokumente aus Klägersicht zusammen: „The evidence revealed here for the first time shows that OpenAI and Microsoft knew that what they were doing was wrong.“
Was davon in die eigene Planung gehört. Interne Bewertungen sind keine Rechtslage, ein Memo entscheidet keinen Prozess, und die bisherige Rechtsprechung ist uneinheitlich — von Thomson Reuters v. Ross (gegen Fair Use, aber für ein Rechercheprodukt) über Kadrey v. Meta (für Meta, wegen Mängeln des klägerischen Vortrags) bis zu Anthropics Vergleich über 1,5 Milliarden Dollar, bei dem es um die Beschaffung raubkopierter Bücher ging und nicht um das Training. Für die Vertragsgestaltung ist trotzdem etwas gewonnen: Wer heute mit einem Modellanbieter über Freistellungsklauseln für Urheberrechtsansprüche verhandelt, kann auf eine Aktenlage verweisen, in der die Anbieter selbst von Substituierbarkeit sprechen — und in der einer von ihnen den Marktschaden mit einer eigenen Prozentzahl beziffert hat. Die Frage an den Anbieter lautet dann nicht mehr, ob ein Restrisiko besteht, sondern wer es trägt.
- TechCrunch — Microsoft exec called AI scraping ‚the largest theft of labor in human history,‘ new unredacted filings reveal (17.9.2026, Volltext selbst gelesen)
- TheWrap — OpenAI's Head of ChatGPT Warned Publishers Faced an ‚Existential Threat‘ in Unsealed Court Docs (Quelle der beiden Microsoft-Stellungnahmen im Wortlaut)
- CP24 / AFP — New York Times: OpenAI knew it was stealing news content (Umfangszahlen, Richter Sidney Stein, Verfahrensstand, DOJ-Schriftsatz)
- Futurism — Microsoft Director Privately Admitted AI Was the ‚Largest Theft of Labor in Human History‘
- CNBC — Judge gives preliminary OK to Anthropic's 1,5-Mrd.-Dollar-Vergleich (25.9.2025, Einordnung der Rechtsprechung)