← Zurück zum Blog
Newsca. 7 Min. Lesezeit

ByteDance konnte eine Klage darüber nicht abschütteln, wie es an die Videos gelangte

Veröffentlicht 6. Okt. 2026
ByteDance konnte eine Klage darüber nicht abschütteln, wie es an die Videos gelangte

Eine Gruppe von YouTubern verklagte ByteDance mit der Behauptung, das Unternehmen habe Millionen von Videos gescrapt, um sein Text-zu-Video-Modell zu trainieren. ByteDance bat ein Bundesgericht in Kalifornien, den Fall abzuweisen. Am 2. Oktober lehnte Richterin Jacqueline Scott Corley dies ab.

Die Entscheidung dreht sich um einen Abschnitt des Urheberrechts, der bisher am Rande der Debatte über KI-Training stand. Alle haben über Fair Use gestritten, also Paragraf 107. Die YouTuber argumentieren mit Paragraf 1201, der die Umgehung technischer Maßnahmen verbietet, die den Zugang zu einem urheberrechtlich geschützten Werk kontrollieren.

Das ist ein anderer Fall, und ByteDances Verteidigung hängt von diesem Unterschied ab.

Das Argument von ByteDance

Die Position des Unternehmens war, dass YouTubes Schutzmaßnahmen das Herunterladen regulieren, nicht den Zugang. Die fraglichen Videos sind öffentlich. Jeder kann sie ansehen. Wenn der Inhalt bereits für alle verfügbar ist, argumentierte ByteDance, dann sei eine Maßnahme, die das Massenherunterladen verlangsamt, keine Zugangskontrolle im Sinne des Gesetzes, und Paragraf 1201 finde keine Anwendung.

Richterin Corley lehnte dies ab. Sie entschied, dass die YouTube-Schutzmaßnahmen, die ByteDance angeblich umgangen hat, die Art von Zugangskontrolle darstellen, deren Umgehung der DMCA verbietet. Was die Plattform nach ihrer Auslegung einschränkte, war die Art und das Volumen des Zugriffs, und das zählt.

Die Unterscheidung, die sie traf, ist diejenige, die künftig zählt. Eine Paywall ist eine Zugangskontrolle. Ein Login ebenfalls. Offenbar auch ein Rate-Limiter oder eine Anti-Bot-Maßnahme, die Inhalte schützt, die ansonsten frei anzusehen sind. Das Gesetz verlangt nicht, dass das Werk geheim ist.

Warum dies ein Problem für die Trainingspipeline ist

Die praktische Folge ist, dass eine Datenerhebungsmethode rechtswidrig sein kann, selbst wenn die Daten selbst öffentlich gepostet wurden.

Wenn ein Gericht dieser Auslegung folgt, verschiebt sich die Compliance-Frage für einen Modelltrainer. Sie lautet nicht mehr nur: "Hatte ich das Recht, aus diesem Werk zu lernen?" Sie lautet auch: "Habe ich das Werk auf eine Weise erlangt, die die Plattform erlaubt hat?" Das sind getrennte Fragen mit getrennten Antworten, und ein Unternehmen kann bei der ersten richtig und bei der zweiten falsch liegen.

Die zweite Frage ist für einen Kläger auch leichter zu prozessieren. Fair Use erfordert eine Vier-Faktoren-Analyse zu Zweck, Art, Umfang und Marktwirkung, und die Antworten sind bestreitbar. Ob ein Scraper eine technische Maßnahme überwunden hat, ist eher eine Tatsachenfeststellung. Entweder das Tool hat die Kontrolle umgangen oder nicht.

Eine leere Edelstahl-Barrieresäule in einem leeren Betonkorridor unter kaltem blauem Licht

Paragraf 1201 kreist seit einer Weile um KI-Fälle

Dies ist nicht das erste Mal, dass dieser Paragraf in einem Trainingsstreit auftaucht, und die früheren Fälle gingen anders aus.

In Doe v. GitHub argumentierten Entwickler, dass Copilot ihren Code ohne Lizenz reproduzierte, und die Behandlung des Anspruchs nach Paragraf 1202 durch das Gericht, der die Entfernung von Urheberrechtsverwaltungsinformationen abdeckt, war enger als die Kläger erhofft hatten. Im Roblox-Fall verklagte ein Künstler namens Austin Beaulier die Entfernung von NoAI-Tags aus 3D-Modellen, die in einem Trainingsdatensatz verwendet wurden. Richterin Beth Labson Freeman wies die Klage ebenfalls am 2. Oktober ab, mit der Begründung, dass das NoAI-Tag zwar als Content-Management-Information gilt, der Kläger aber nicht nachgewiesen habe, dass Roblox es absichtlich entfernt hat.

Beide Fälle betreffen Paragraf 1202, der Informationen betrifft, die an ein Werk angehängt sind. ByteDances Fall betrifft Paragraf 1201, der das Tor davor betrifft. Die Abweisung im Roblox-Fall und das Überleben von ByteDance am selben Tag machen die Spaltung sichtbar: Ein Anspruch wegen verloren gegangener Metadaten ist schwer zu beweisen, und ein Anspruch wegen eines umgangenen Tors ist leichter.

Auch beim Fair Use ist die Lage nicht geklärt

Dieselbe Woche brachte die ungeschwärzte Entscheidung in Thomson Reuters v. ROSS Intelligence, in der das Third Circuit entschied, dass das Training eines juristischen Recherchetools mit Westlaw-Headnotes kein Fair Use war. Dieser Fall betrifft Paragraf 107 und enthält überhaupt keine technischen Maßnahmen. ROSS kopierte redaktionelle Zusammenfassungen und nutzte sie, um ein konkurrierendes Produkt aufzubauen.

Die drei Entscheidungen zusammen beschreiben eine Lage, in der die rechtliche Exposition einer KI-Trainingspipeline eher von der Mechanik als vom Prinzip abhängt. Wie die Daten beschafft wurden, ob die Metadaten die Pipeline überlebt haben und ob die Ausgabe mit der Quelle konkurrierte, unterliegen jeweils ihrer eigenen Regel.

Für ein Unternehmen, das Trainingsdaten in großem Umfang sammelt, besteht die operative Konsequenz darin, dass die Sammlungsebene nun selbst eine Compliance-Oberfläche ist. Zu protokollieren, wie sich ein Crawler verhalten hat, Rate Limits und Robots-Direktiven zu beachten und es zu unterlassen, um Plattformabwehrmaßnahmen herumzubauen, sind keine Höflichkeiten mehr. Sie entscheiden jetzt darüber, ob ein Fall im Stadium der Klageerwiderung abgewiesen werden kann.

Warum das Interesse der Plattform genauso zählt wie das des Urhebers

Ein Anspruch nach Paragraf 1201 steht sowohl der Person zu, die das Tor errichtet hat, als auch der Person, deren Werk dahinter liegt.

YouTubes Schutzmaßnahmen existieren, weil die Plattform ein eigenes Interesse daran hat, zu kontrollieren, wie auf ihren Katalog zugegriffen wird. Massenherunterladen ist teuer für einen Dienst, der Videos in großem Umfang ausliefert, und Scraping hat Konsequenzen für die Bandbreite, für die Werbemessung und für die Lizenzvereinbarungen, die die Plattform mit Rechteinhabern aushandelt. Eine Entscheidung, die diese Maßnahmen als Zugangskontrollen behandelt, verschafft Plattformen ein rechtliches Instrument gegen automatisierte Sammlung jeglicher Art, und ein solches hatten sie vorher nicht.

Das reicht über KI-Training hinaus. Es umfasst Preisüberwachung, akademische Forschungsdatensätze, Wettbewerbsanalyse und alles andere, was eine Website in großem Umfang ausliest. Die Anti-Umgehungsvorschrift ist Jahrzehnte älter als all das, und nun wird von ihr verlangt, eine Kategorie von Aktivitäten zu regeln, die ihre Verfasser sich nicht vorstellen konnten.

Für Rechteinhaber ist die Konsequenz ein zweiter Weg vor Gericht. Ein Urheber, der mit einem Fair-Use-Argument gegen einen Modelltrainer nicht gewinnen kann, hat möglicherweise immer noch einen Anspruch darauf, wie das Werk erlangt wurde, und dieser Anspruch erfordert nicht auf dieselbe Weise den Nachweis eines wirtschaftlichen Schadens. Er erfordert den Nachweis, dass eine technische Maßnahme überwunden wurde.

Wohin die Discovery wahrscheinlich führen wird

Wenn der Fall die Discovery überlebt, wird das interessante Material operativer Natur sein, nicht rechtlicher. Welche Crawling-Tools verwendet wurden, ob sie so konfiguriert waren, dass sie Plattformdirektiven respektieren, wie viele Anfragen über welchen Zeitraum gestellt wurden und was die eigenen Ingenieure des Unternehmens damals über die Risiken schrieben.

Interne Dokumente haben den Ausgang mehrerer jüngerer KI-Fälle bestimmt, und eine Trainingspipeline in der Größenordnung von ByteDance hinterlässt eine beträchtliche Spur. Die Frage, ob jemand vor Beginn des Scrapings auf das rechtliche Risiko hingewiesen hat, ist diejenige, die tendenziell den Vergleichswert bestimmt.

Wie es weitergeht

Die Entscheidung entscheidet nicht, ob ByteDance Urheberrechte verletzt hat. Sie hält den Fall im Stadium der Klageerwiderung am Leben, was bedeutet, dass die YouTuber Discovery erhalten. Dort werden die Einzelheiten öffentlich: welche Videos, welche Tools, welche Maßnahmen überwunden wurden und wie oft.

Der wahrscheinlichste Weg ist ein Vergleich vor dem Prozess. Klagen dieser Art enden normalerweise so, und ByteDance hat kein Interesse an einer öffentlichen Aufzeichnung darüber, wie eine Trainingspipeline funktionierte. Aber die Rechtsfrage ist jetzt im System, und die Antwort wird prägen, wie jeder künftige Scraper den Abwehrmaßnahmen einer Plattform begegnet.

Es gibt einen weiteren Punkt. Das Datenproblem der KI-Branche wurde als Lizenzierungsproblem behandelt: Zahle dem Rechteinhaber, und alles ist in Ordnung. Diese Rechtsprechungslinie legt nahe, dass Zahlen nicht ausreicht, weil die Plattform, die das Werk hostet, eigene Interessen hat, die in technischen Maßnahmen kodifiziert und durch ein Gesetz gestützt werden, dem es egal ist, ob das Werk frei lesbar war. Inhalte legal zu beschaffen und sie sauber zu beschaffen, sind jetzt zwei getrennte Verpflichtungen.

Verwandte Artikel