← Retour au blog
NewsEnviron 9 min de lecture

ByteDance n'a pas pu échapper à une plainte sur la façon dont elle a obtenu les vidéos

Publié le 6 oct. 2026
ByteDance n'a pas pu échapper à une plainte sur la façon dont elle a obtenu les vidéos

Un groupe de YouTubers a poursuivi ByteDance, alléguant que l'entreprise avait aspiré des millions de vidéos pour entraîner son modèle texte-vidéo. ByteDance a demandé à un tribunal fédéral de Californie de rejeter l'affaire. Le 2 octobre, la juge Jacqueline Scott Corley a refusé.

La décision repose sur un article du droit d'auteur qui était resté à l'écart du débat sur l'entraînement des IA. Tout le monde s'affronte sur le fair use, soit l'article 107. Les YouTubers, eux, invoquent l'article 1201, qui interdit de contourner les mesures techniques contrôlant l'accès à une œuvre protégée.

C'est une affaire différente, et la défense de ByteDance repose sur cette différence.

L'argument avancé par ByteDance

La position de l'entreprise était que les mesures de protection de YouTube régissent le téléchargement, et non l'accès. Les vidéos en question sont publiques. N'importe qui peut les regarder. Si le contenu est déjà accessible à tous, soutenait ByteDance, une mesure qui ralentit le téléchargement en masse n'est pas un contrôle d'accès au sens de la loi, et l'article 1201 ne s'applique pas.

La juge Corley a rejeté cet argument. Elle a estimé que les protections de YouTube que ByteDance aurait contournées relèvent bien du type de contrôle d'accès dont le DMCA interdit le contournement. Ce que la plateforme restreignait, selon son analyse, c'était la manière et le volume de l'accès, et cela compte.

La distinction qu'elle a posée est celle qui comptera à l'avenir. Un mur payant est un contrôle d'accès. Une page de connexion aussi. Apparemment, un limiteur de débit ou une mesure anti-bots protégeant un contenu par ailleurs consultable gratuitement en est un également. La loi n'exige pas que l'œuvre soit secrète.

Pourquoi cela pose problème pour la chaîne d'entraînement

L'effet pratique est qu'une méthode de collecte de données peut être illicite même lorsque les données elles-mêmes ont été publiées publiquement.

Si un tribunal retient cette lecture, la question de conformité se déplace pour celui qui entraîne un modèle. Il ne s'agit plus seulement de savoir « avais-je le droit d'apprendre à partir de cette œuvre ». Il s'agit aussi de savoir « ai-je obtenu cette œuvre d'une manière que la plateforme autorisait ». Ce sont deux questions distinctes, avec des réponses distinctes, et une entreprise peut avoir raison sur la première et tort sur la seconde.

La seconde question est aussi plus facile à plaider pour un demandeur. Le fair use exige une analyse en quatre facteurs portant sur la finalité, la nature, l'ampleur et l'effet sur le marché, et les réponses sont contestables. Savoir si un scraper a neutralisé une mesure technique relève davantage d'une constatation de fait. Soit l'outil a contourné le contrôle, soit il ne l'a pas fait.

Une borne de barrière en acier inoxydable vide dans un couloir en béton désert sous une lumière bleue froide

L'article 1201 tourne autour des affaires d'IA depuis un moment

Ce n'est pas la première fois que cet article apparaît dans un litige sur l'entraînement, et les affaires précédentes ont tourné dans l'autre sens.

Dans l'affaire Doe c. GitHub, des développeurs soutenaient que Copilot reproduisait leur code sans licence, et le traitement par le tribunal de la demande fondée sur l'article 1202, qui couvre la suppression des informations de gestion des droits d'auteur, a été plus restrictif que ne l'espéraient les demandeurs. Dans l'affaire Roblox, un artiste nommé Austin Beaulier a poursuivi pour la suppression de balises NoAI sur des modèles 3D utilisés dans un jeu de données d'entraînement. La juge Beth Labson Freeman a également rejeté l'affaire le 2 octobre, estimant que la balise NoAI compte bien comme information de gestion de contenu, mais que le demandeur n'avait pas démontré que Roblox l'avait supprimée intentionnellement.

Ces deux affaires portent sur l'article 1202, qui concerne les informations attachées à une œuvre. Celle de ByteDance porte sur l'article 1201, qui concerne la barrière placée devant elle. Le rejet de l'affaire Roblox et la survie de celle de ByteDance le même jour rendent la césure visible : une demande portant sur des métadonnées supprimées est difficile à prouver, tandis qu'une demande portant sur une barrière contournée l'est moins.

Le tableau du fair use n'est pas davantage fixé

La même semaine a apporté la version non expurgée de l'arrêt Thomson Reuters c. ROSS Intelligence, dans lequel le troisième circuit a jugé que l'entraînement d'un outil de recherche juridique sur les notes de jurisprudence de Westlaw ne relevait pas du fair use. Cette affaire porte sur l'article 107 et ne comporte aucune mesure technique. ROSS a copié des résumés éditoriaux et les a utilisés pour bâtir un produit concurrent.

Prises ensemble, ces trois décisions décrivent un contexte où l'exposition juridique d'une chaîne d'entraînement d'IA dépend de la mécanique plutôt que d'un principe. La manière dont les données ont été obtenues, la survie ou non des métadonnées tout au long de la chaîne, et la concurrence ou non du résultat avec la source obéissent chacune à leur propre règle.

Pour une entreprise qui collecte des données d'entraînement à grande échelle, la conséquence opérationnelle est que la couche de collecte est désormais une surface de conformité à part entière. Journaliser le comportement d'un crawler, respecter les limites de débit et les directives robots, et refuser de contourner les défenses des plateformes ne relèvent plus de la simple courtoisie. Ces éléments décident aujourd'hui si une affaire peut être rejetée au stade des conclusions.

Pourquoi l'intérêt de la plateforme compte autant que celui du créateur

Une action fondée sur l'article 1201 appartient autant à celui qui a construit la barrière qu'à celui dont l'œuvre se trouve derrière elle.

Les mesures de protection de YouTube existent parce que la plateforme a son propre intérêt à contrôler la manière dont son catalogue est consulté. Le téléchargement en masse coûte cher à un service qui diffuse de la vidéo à grande échelle, et le scraping a des conséquences sur la bande passante, sur la mesure publicitaire et sur les accords de licence que la plateforme négocie avec les titulaires de droits. Une décision qui traite ces mesures comme des contrôles d'accès donne aux plateformes un outil juridique contre la collecte automatisée de toute nature, dont elles ne disposaient pas auparavant.

Cela dépasse le cadre de l'entraînement des IA. Cela couvre la surveillance des prix, les jeux de données de la recherche académique, l'analyse concurrentielle et tout ce qui lit un site en volume. La disposition anti-contournement est antérieure à tout cela de plusieurs décennies, et on lui demande aujourd'hui d'encadrer une catégorie d'activité que ses rédacteurs n'imaginaient pas.

Pour les titulaires de droits, la conséquence est une seconde voie d'accès aux tribunaux. Un créateur qui ne peut pas gagner un argument de fair use contre un entraîneur de modèle peut malgré tout avoir une action sur la manière dont l'œuvre a été obtenue, et cette action n'exige pas de prouver un préjudice économique de la même façon. Elle exige de prouver qu'une mesure technique a été neutralisée.

Vers quoi la discovery va probablement se diriger

Si l'affaire survit jusqu'à la discovery, les éléments intéressants seront opérationnels plutôt que juridiques. Quels outils de crawling ont été utilisés, s'ils étaient configurés pour respecter les directives des plateformes, combien de requêtes ont été envoyées et sur quelle période, et ce que les propres ingénieurs de l'entreprise écrivaient alors sur les risques.

Des documents internes ont déterminé l'issue de plusieurs affaires récentes liées à l'IA, et une chaîne d'entraînement de l'ampleur de celle de ByteDance laisse une trace substantielle. La question de savoir si quelqu'un a signalé l'exposition juridique avant le début du scraping est celle qui tend à décider de la valeur d'un accord amiable.

Ce qui vient ensuite

La décision ne tranche pas la question de savoir si ByteDance a porté atteinte aux droits. Elle maintient l'affaire en vie au stade des conclusions, ce qui signifie que les YouTubers obtiennent la discovery. C'est là que les détails deviennent publics : quelles vidéos, quels outils, quelles mesures ont été neutralisées, et combien de fois.

La voie la plus probable est un accord amiable avant le procès. Les poursuites de cette forme se terminent généralement ainsi, et ByteDance n'a aucun intérêt à voir consigné publiquement le fonctionnement d'une chaîne d'entraînement. Mais la question juridique est désormais dans le circuit, et la réponse façonnera la manière dont chaque futur scraper se heurtera aux défenses d'une plateforme.

Il y a un point plus large. Le problème des données de l'industrie de l'IA a été traité comme un problème de licence : payez le titulaire de droits et tout va bien. Cette lignée de décisions suggère que payer ne suffit pas, car la plateforme qui héberge l'œuvre a ses propres intérêts, codifiés dans des mesures techniques et soutenus par une loi qui ne se soucie pas de savoir si l'œuvre était librement consultable. Obtenir le contenu légalement et l'obtenir proprement sont désormais deux obligations distinctes.

Articles associés