Zum Inhalt springen
KI Agenten

«Eine Schlange, die den eigenen Schwanz frisst»: So beschreibt die Klageschrift das KI-Training mit Zeitungsartikeln

Die Klage ging am 4. September 2026 beim Bundesbezirksgericht in Manhattan ein. Neben Schadensersatz verlangen die Verlage, Trainingsdatensätze und Modelle mit ihren Artikeln zu löschen.

Lukas GörögLukas Görög
Teilen
KI-Training: Zeitungen fordern Vernichtung von KI-Modellen
KI-Training: Zeitungen fordern Vernichtung von KI-Modellen

Die Seattle Times und Newsday haben am Freitag, dem 4. September 2026, beim Bundesbezirksgericht in Manhattan (U.S. District Court for the Southern District of New York) Klage gegen OpenAI und Microsoft eingereicht. Sie werfen den Unternehmen vor, ihre Artikel ohne Erlaubnis fürs Training von ChatGPT, Microsoft Copilot und den KI-Funktionen von Bing genutzt zu haben: Beim KI-Training sei das Urheberrecht systematisch verletzt worden. Die beiden Verlage verlangen Schadensersatz, dazu die Vernichtung aller Kopien ihrer Werke sowie der Trainingsdatensätze und KI-Modelle, die dieses Material enthalten. So hält es die Meldung von Reuters vom 5. September 2026 fest.

Laut Klageschrift wurden die Webseiten der Zeitungen ausgelesen („gescraped“), auch die Artikel hinter Bezahlschranken. Die Inhalte flossen anschließend in Trainingsdatensätze ein. Neu ist dieser Vorwurf nicht. TechCrunch zählt die beiden Blätter zu den jüngsten in einer langen Reihe, und The Legal Feed berichtete Ende Juni 2026 von knapp 400 Lokalzeitungen, die mit ähnlicher Begründung gegen Microsoft und OpenAI vorgehen. Die New York Times klagt seit Ende 2023.

Einen Tag vor der neuen Klage, am 4. September 2026, beantragten Nachrichtenorganisationen in einem anderen Verfahren beim selben Gericht, der Richter solle feststellen, dass sich weder Microsoft noch OpenAI auf „fair use“ berufen können – weder beim Einsammeln von Artikeln hinter Bezahlschranken noch beim Training großer Sprachmodelle mit kopierten Werken. Das berichtet der OC Register.

Eine Schlange, die den eigenen Schwanz frisst

Der Ton der Klageschrift ist ungewöhnlich direkt. Generative KI heißt darin „a snake eating its own tail“, eine Schlange, die den eigenen Schwanz frisst und dabei jene Organisationen zerstöre, die die Inhalte produzieren, mit denen sie trainiert wird. Solche Systeme könnten den Journalismus „broken beyond repair“ zurücklassen, also unwiederbringlich beschädigen. Eine weitere Passage aus der Klage: KI-Produkte wie ChatGPT und Copilot würden als Erzeuger von Inhalten angepriesen, seien tatsächlich aber „rapacious consumers“, die von Menschen geschriebene Texte verschlingen und Kopien sowie abgeleitete Imitationen zurückliefern.

Technisch stützt sich die Argumentation auf drei Schritte, die die Verlage den Anbietern vorwerfen:

  • das Auslesen der Webseiten, auch der Artikel hinter Bezahlschranken,
  • die Aufnahme dieser Texte in Trainingsdatensätze für kommerzielle Produkte,
  • die Wiedergabe in den Ausgaben der Modelle, laut der Darstellung bei Unite.ai teils wortwörtlich.

Geprüft ist davon bislang nichts. Zur neuen Klage liegt keine Gerichtsentscheidung vor, und ob OpenAI oder Microsoft öffentlich Stellung genommen haben, ist in den vorliegenden Berichten nicht dokumentiert.

Beim KI-Training bleibt das Urheberrecht offen

Für Unternehmen ist der Antrag zur Fair-Use-Frage der interessantere Vorgang. Fair Use ist die Ausnahme im US-Urheberrecht: Sie erlaubt eine Nutzung ohne Erlaubnis, wenn diese etwa transformativ ist. Solange kein Gericht sagt, ob Training auf lizenzfreien Kopien darunterfällt, hängt an dieser Frage die Kostenbasis der gesamten Branche. Wie hoch der Einsatz ist, zeigt die Forderung nach Löschung von Datensätzen und Modellen: Im Extremfall müssten betroffene Modelle neu bewertet oder ihre Datengrundlage nachträglich bereinigt werden.

Deshalb kaufen Anbieter Rechtssicherheit ein, wo sie zu haben ist. Dass Google den großen Hollywood-Studios Geld für Trainingsdaten bietet, hat neben dem Zugang zum Material einen zweiten Zweck: Vor Gericht wiegt ein Vertrag mehr als eine Rechtsauffassung.

Das Risiko wandert zu den Anwendern

Für Unternehmen, die Texte mit ChatGPT oder Copilot erstellen lassen, folgt daraus kein akutes Verfahren. Die Klagen richten sich gegen die Anbieter, nicht gegen deren Kundschaft, und keiner der vorliegenden Berichte beschreibt ein eigenes Haftungsrisiko für Anwender. Können Modelle Verlagstexte aber tatsächlich in Teilen wörtlich wiedergeben, bleibt ein Restrisiko in der eigenen Publikation: Wer generierte Passagen ungeprüft veröffentlicht, weiß nicht, wessen Formulierungen er verbreitet. Prüfen lässt sich das derzeit nur am Ergebnis, denn die Herkunft der Trainingsdaten muss in Europa erst durch die seit August geltenden Transparenzpflichten des AI Act überhaupt dokumentiert werden.

Für mich ist die Schlangen-Metapher der Klage der ehrlichste Teil dieses Streits, auch wenn sie von einer Partei stammt, die Geld will. Schließen Lokalredaktionen, versiegt genau das Material, aus dem die Modelle ihre Auskünfte über Stadtratsbeschlüsse, Gerichtsprozesse und Baustellen ziehen. Ein Gericht in Manhattan entscheidet damit nicht allein über Schadensersatz, sondern über den Preis, zu dem Wissen künftig entsteht.

Häufige Fragen

Was würde die geforderte Vernichtung der KI-Modelle konkret bedeuten?

Die Verlage verlangen mehr als Schadensersatz. OpenAI und Microsoft sollen laut Klageschrift Kopien ihrer Artikel, Trainingsdatensätze und Modelle vernichten, die diese Inhalte enthalten. Ob ein Gericht eine solche Anordnung erlässt, ist offen. Dafür müsste es zunächst prüfen, ob die behauptete Nutzung tatsächlich gegen das Urheberrecht verstößt.

Warum reicht ein Bezahlschranken-Abo nicht automatisch für das KI-Training?

Ein Abo erlaubt meist das Lesen persönlicher Inhalte, überträgt aber nicht automatisch Rechte für das Training eines KI-Modells. Genau diese Unterscheidung ist Teil des Streits. Die Verlage behaupten, auch Artikel hinter Bezahlschranken seien ohne Erlaubnis ausgelesen worden. Ob das zulässig war, soll das Gericht anhand des konkreten Falls klären.

Was bedeutet „Fair Use“ in diesem Verfahren?

„Fair Use“ erlaubt in den USA bestimmte Nutzungen urheberrechtlich geschützter Werke ohne vorherige Erlaubnis. OpenAI und Microsoft könnten sich darauf berufen, während die klagenden Nachrichtenorganisationen diese Verteidigung zurückweisen. Ein Gericht müsste unter anderem Zweck und Art der Nutzung sowie mögliche Auswirkungen auf den Markt der Originalartikel bewerten.

Könnten die Zeitungen erreichen, dass ChatGPT und Copilot ihre Texte sofort vergessen?

Ein Verfahren führt nicht automatisch dazu, dass ein Modell Inhalte sofort entfernt. Selbst wenn ein Gericht Verstöße feststellt, müsste es festlegen, welche Daten oder Modelle betroffen sind und wie eine Löschung technisch kontrolliert wird. Die Klage enthält diese Forderung, doch über sie ist nach den vorliegenden Angaben noch nicht entschieden.

Welche Folgen hätte ein Urteil für andere Verlage und KI-Anbieter?

Ein Urteil könnte klären, ob das Auslesen von Nachrichtenartikeln und ihr Einsatz im Training unter „Fair Use“ fallen. Das Ergebnis wäre für ähnliche Verfahren relevant, ersetzt aber keine Einzelfallprüfung. Bereits jetzt klagen zahlreiche Nachrichtenanbieter gegen Microsoft und OpenAI. Andere Verlage könnten daraus Argumente für Lizenzen oder weitere Klagen ableiten.

Was passiert als Nächstes im Verfahren?

Zunächst müssen OpenAI und Microsoft auf die Klage reagieren. Danach kann das Gericht über Anträge, Beweise und die Auslegung des Urheberrechts entscheiden. Parallel läuft ein weiterer Antrag von Nachrichtenorganisationen, der eine Berufung auf „Fair Use“ ausschließen soll. Ein konkreter Zeitplan oder ein Urteil ist laut den vorliegenden Informationen nicht bekannt.

Fügen Sie KI-Amigo in Google als bevorzugte Quelle hinzu, um unsere Artikel häufiger zu sehen.