Gerichtsakte: OpenAI und Microsoft waren sich bewusst, dass sie stehlen

Eine neue Gerichtsakte im Urheberrechtsverfahren der "New York Times" gegen OpenAI und Microsoft enthält beunruhigende neue Beweise. Kurz gesagt: Führungskräfte beider Unternehmen wussten, dass sie stahlen und gegen das Gesetz verstießen, setzten ihre Vorgehensweise jedoch dennoch fort – in dem wahnwitzigen Bestreben, ihre KI-Modelle mit hochwertigen Inhalten zu trainieren.

In diesem Fall geht es, wie es der Director of Applied Science von Microsoft formulierte, um 'einen erstaunlichen Diebstahl von beispiellosem Ausmaß' [und] vielleicht um den 'größten Diebstahl von Arbeitsleistung in der Geschichte der Menschheit'. [OpenAI und Microsoft] haben wiederholt Millionen von urheberrechtlich geschützten Artikeln [der New York Times] ohne Genehmigung vollständig kopiert, um kommerzielle KI-Produkte als Ersatz herzustellen.

OpenAI und Microsoft sind nicht wirklich auf die Rechtswidrigkeit der Umgehung der Bezahlschranken eingegangen, die die "New York Times" und andere Verlage für ihre Inhalte eingerichtet haben. Die Unternehmen haben jedoch öffentlich behauptet, dass ihr Diebstahl von Inhalten der "New York Times" und anderer Inhaltsanbieter unter das Recht auf faire Nutzung falle, da ihre KI-Modelle die Originalinhalte in eine neue Art von Inhalten umwandeln, die nicht direkt mit der Originalquelle konkurrieren. Doch das ist das fadenscheinigste Argument, das man sich vorstellen kann, und nun wissen wir, dass nicht einmal OpenAI und Microsoft selbst daran glauben.

Zu den Details in der Klage, die alle im Rahmen der Beweisaufnahme zutage traten, gehört eine interne Mitteilung des ChatGPT-Leiters von OpenAI, in der er schreibt, dass die KI-Modelle des Unternehmens eine "existenzielle Bedrohung" für Nachrichtenverlage darstellten, da sie "weitgehend substitutiv sind", und nicht nur transformativ. Schlimmer noch: Sie werden "immer ersetzender werden, je besser sie werden". Diese ernüchternde Sichtweise auf den Diebstahl von Inhalten "entkräftet" die Fair-Use-Verteidigung, schreibt die Times in den Unterlagen, "denn Substitution ist die 'Bête noire' des Urheberrechts". Das heißt: "Das Ziel des Urheberrechts ist es, einen wirtschaftlichen Anreiz zur Schaffung origineller Werke zu bieten."

Die Anwälte der Verlagshauses fanden zudem heraus, dass Greg Brockman, Mitbegründer und Präsident von OpenAI, intern bei verschiedenen Gelegenheiten schrieb, dass die KI-Modelle des Unternehmens "hervorragend bei Nachrichten" und "sehr gut bei jeder Aufgabe im Nachrichtenbereich" seien. Und Microsoft-CEO Satya Nadella versetzte der "Fair-Use"-Verteidigung einen schweren Schlag, als er anmerkte, dass die KI-Chatbots des Unternehmens die Originalquellen "ersetzten", indem sie "die Informationen direkt auf … der KI-Plattform bereitstellen, anstatt dass man zur zugrunde liegenden Quelle gehen muss".

Unsere KI-Inhaltsstrategie hat einen 'Teufelskreis' in Gang gesetzt, der die Leistung unserer Modelle und gleichzeitig das gesamte Web beeinträchtigen wird. Es ist höchst ungewöhnlich, dass ein Endprodukt die wirtschaftlichen Grundlagen seiner wesentlichen Lieferanten bedroht, aber genau diese Situation haben wir für unser LLM-Geschäft in Bezug auf dessen 'Inhaltslieferkette' geschaffen.

In der Klage wird weiter dokumentiert, dass es bei der "New York Times", bei ZDNet und anderen Content-Anbietern zu massiven Zugriffseinbrüchen gekommen ist, da die KI den Nutzern einfach die gewünschten Informationen liefert, ohne dass diese zu den Originalquellen weiterklicken müssen.

Die "New York Times" beantragt ein summarisches Urteil zur Haftung für den Diebstahl ihrer Inhalte, von denen der Großteil hinter Bezahlschranken liegt, für das daraus resultierende Training des KI-Modells, das darauf ausgelegt ist, "den ausdrucksstarken journalistischen Inhalt der kopierten Artikel vorherzusagen", für die Verwendung von Echtzeit-Antworten eines KI-Chatbots, die auf den gestohlenen Inhalten basieren, sowie für den "Pferdehandel", bei dem OpenAI und Microsoft die jeweils gestohlenen Inhalte untereinander austauschten.

Es ist unbestritten, dass [OpenAI und Microsoft] an jeder Art des Kopierens beteiligt waren und sie können die Beweislast für ihre Einrede der fairen Nutzung in keinem dieser Fälle tragen.