← 블로그로
News약 14 분 읽기

바이트댄스, 영상 수집 방식 관련 소송에서 벗어나지 못해

게시일 2026년 10월 6일
바이트댄스, 영상 수집 방식 관련 소송에서 벗어나지 못해

한 무리의 유튜버들이 바이트댄스를 상대로 소송을 제기하며, 이 회사가 자사의 텍스트-투-비디오 모델을 학습시키기 위해 수백만 개의 영상을 스크래핑했다고 주장했다. 바이트댄스는 캘리포니아 연방법원에 사건을 기각해 달라고 요청했지만, 10월 2일 재클린 스콧 콜리 판사는 이를 받아들이지 않았다.

이번 판결은 그동안 AI 학습 논쟁의 변두리에 놓여 있던 저작권법의 한 조항에 달려 있다. 모두가 공정이용, 즉 제107조를 두고 다투어 왔다. 유튜버들은 저작물에 대한 접근을 통제하는 기술적 조치를 우회하는 것을 금지하는 제1201조를 문제 삼고 있다.

이것은 전혀 다른 사안이며, 바이트댄스의 항변은 바로 그 차이에 달려 있다.

바이트댄스가 내세운 주장

회사의 입장은 유튜브의 보호 조치가 접근이 아니라 다운로드를 규율하는 것이라는 점이었다. 문제가 된 영상들은 공개되어 있다. 누구나 시청할 수 있다. 콘텐츠가 이미 모든 사람에게 제공되고 있다면, 대량 다운로드를 늦추는 조치는 법조문이 의미하는 접근 통제가 아니므로 제1201조가 적용되지 않는다고 바이트댄스는 주장했다.

콜리 판사는 이를 받아들이지 않았다. 그녀는 바이트댄스가 우회했다고 주장되는 유튜브의 보호 장치가 DMCA가 우회를 금지하는 종류의 접근 통제에 해당한다고 판시했다. 그녀의 해석에 따르면 플랫폼이 제한하고 있던 것은 접근의 방식과 규모였고, 그것으로 충분하다는 것이다.

그녀가 그은 이 구분이 앞으로 중요해질 지점이다. 유료 장벽은 접근 통제다. 로그인도 마찬가지다. 다른 조건에서는 무료로 볼 수 있는 콘텐츠를 지키는 속도 제한 장치나 봇 방지 조치도 마찬가지인 것으로 보인다. 법조문은 저작물이 비밀이어야 한다고 말하지 않는다.

이것이 학습 파이프라인에 문제가 되는 이유

실질적인 결과는 데이터 자체가 공개적으로 게시되었더라도 데이터 수집 방식이 위법할 수 있다는 것이다.

법원이 이러한 해석에 동의한다면, 모델 학습자의 컴플라이언스 질문은 달라진다. 더 이상 “나는 이 저작물로부터 학습할 권리가 있었는가”만의 문제가 아니다. “나는 플랫폼이 허용한 방식으로 그 저작물을 확보했는가”도 문제가 된다. 이들은 각기 다른 답을 가진 별개의 질문이며, 기업은 첫 번째 질문에는 맞고 두 번째 질문에는 틀릴 수 있다.

두 번째 질문은 원고가 소송을 이끌어가기에도 더 쉽다. 공정이용은 목적, 성질, 양, 시장 효과라는 네 가지 요소 분석을 요구하며 그 답은 다툼의 여지가 있다. 스크래퍼가 기술적 조치를 무력화했는지 여부는 사실 판단에 더 가깝다. 그 도구가 통제를 우회했거나, 하지 않았거나 둘 중 하나다.

차가운 푸른 빛이 비추는 텅 빈 콘크리트 복도에 놓인 무지한 스테인리스 스틸 차단 기둥

제1201조는 이미 한동안 AI 사건들 주변을 맴돌아 왔다

이 조항이 학습 분쟁에 등장한 것이 처음은 아니며, 앞선 사건들에서는 결론이 반대였다.

Doe v. GitHub 사건에서 개발자들은 코파일럿이 라이선스 없이 자신들의 코드를 재현했다고 주장했지만, 저작권 관리 정보의 제거를 다루는 제1202조 청구에 대한 법원의 취급은 원고들이 기대한 것보다 좁았다. 로블록스 사건에서는 오스틴 뷸리어라는 아티스트가 학습 데이터셋에 사용된 3D 모델에서 NoAI 태그가 제거된 것을 문제 삼아 소송을 제기했다. 베스 랩슨 프리먼 판사 역시 10월 2일 이를 기각하면서, NoAI 태그가 콘텐츠 관리 정보에 해당하기는 하지만 원고가 로블록스가 이를 의도적으로 삭제했다는 점을 입증하지 못했다고 판시했다.

이 두 사건은 모두 저작물에 부착된 정보를 다루는 제1202조에 관한 것이다. 바이트댄스 사건은 그 앞에 있는 관문을 다루는 제1201조에 관한 것이다. 같은 날 로블록스 소송이 기각되고 바이트댄스 소송이 살아남은 것은 이 간극을 뚜렷하게 보여준다. 삭제된 메타데이터에 관한 청구는 입증하기 어렵고, 우회된 관문에 관한 청구는 더 쉽다.

공정이용의 그림도 확정되지 않았다

같은 주에 Thomson Reuters v. ROSS Intelligence 사건의 비삭제 판결문이 공개되었는데, 제3순회법원은 웨스트로 헤드노트로 법률 리서치 도구를 학습시키는 것이 공정이용이 아니라고 판시했다. 이 사건은 제107조에 관한 것으로 기술적 조치는 전혀 등장하지 않는다. ROSS는 편집 요약을 복제해 경쟁 제품을 만드는 데 사용했다.

이 세 판결을 종합하면, AI 학습 파이프라인의 법적 위험이 원칙이 아니라 작동 방식에 달려 있는 상황을 보여준다. 데이터를 어떻게 확보했는지, 메타데이터가 파이프라인을 거치며 살아남았는지, 그리고 출력물이 원본과 경쟁했는지가 각각 나름의 규칙을 갖는다.

대규모로 학습 데이터를 수집하는 기업에게 운영상의 결과는 수집 계층 자체가 이제 그 자체로 컴플라이언스 영역이 되었다는 점이다. 크롤러가 어떻게 작동했는지 기록하고, 속도 제한과 로봇 지시를 준수하며, 플랫폼의 방어 조치를 우회하는 설계를 하지 않는 것은 더 이상 예의가 아니다. 이제 이들이 사건이 청구 단계에서 기각될 수 있는지를 좌우한다.

플랫폼의 이익이 창작자의 이익만큼 중요한 이유

제1201조에 따른 청구권은 그 관문을 세운 사람에게도, 그리고 그 뒤에 저작물이 놓여 있는 사람에게도 있다.

유튜브의 보호 조치는 플랫폼이 자사 카탈로그에 대한 접근 방식을 통제하는 데 자체적인 이익을 가지고 있기 때문에 존재한다. 대량 다운로드는 대규모로 영상을 제공하는 서비스에 비용이 많이 들며, 스크래핑은 대역폭, 광고 측정, 그리고 플랫폼이 권리자들과 협상하는 라이선스 계약에 영향을 미친다. 그러한 조치를 접근 통제로 취급하는 판결은 플랫폼에 모든 종류의 자동화된 수집에 맞설 법적 도구를 쥐여주는 것이며, 이전에는 그런 도구가 없었다.

이는 AI 학습을 넘어선다. 가격 모니터링, 학술 연구 데이터셋, 경쟁 분석, 그리고 대량으로 사이트를 읽는 그 밖의 모든 것을 포괄한다. 이 우회 금지 조항은 그 모든 것보다 수십 년 앞서 만들어졌으며, 이제는 입안자들이 상상하지 못했던 활동 범주를 규율하라는 요구를 받고 있다.

권리자에게 이것은 법정으로 들어가는 두 번째 길이 생겼다는 뜻이다. 모델 학습자를 상대로 공정이용 논쟁에서 이길 수 없는 창작자라도 저작물이 어떻게 확보되었는지에 관한 청구는 여전히 제기할 수 있으며, 그 청구는 같은 방식으로 경제적 손해를 입증할 것을 요구하지 않는다. 대신 기술적 조치가 무력화되었음을 입증하면 된다.

증거개시가 향할 곳

사건이 증거개시 단계까지 살아남는다면, 흥미로운 자료는 법률적이라기보다 운영적인 것이 될 것이다. 어떤 크롤링 도구가 사용되었는지, 그것이 플랫폼 지시를 존중하도록 설정되었는지, 얼마나 많은 요청이 어느 기간에 걸쳐 이루어졌는지, 그리고 당시 회사 자체 엔지니어들이 위험에 대해 무엇이라고 적었는지다.

내부 문서는 최근 여러 AI 사건의 결과를 좌우해 왔으며, 바이트댄스 규모의 학습 파이프라인은 상당한 흔적을 남긴다. 스크래핑이 시작되기 전에 누군가 법적 위험을 제기했는지 여부가 합의금 액수를 결정하는 문제인 경우가 많다.

앞으로 벌어질 일

이번 판결은 바이트댄스가 침해했는지를 결정하지 않는다. 단지 청구 단계에서 사건을 살려두는 것으로, 이는 유튜버들이 증거개시를 할 수 있게 된다는 뜻이다. 구체적인 내용이 공개되는 곳이 바로 그 단계다. 어떤 영상이었는지, 어떤 도구가 쓰였는지, 어떤 조치가 몇 번이나 무력화되었는지.

가장 유력한 경로는 재판 전 합의다. 이런 형태의 소송은 대개 그렇게 끝나며, 바이트댄스는 학습 파이프라인이 어떻게 운영되었는지에 대한 공개 기록이 남는 것을 원치 않는다. 그러나 법적 쟁점은 이제 제도 안에 들어왔고, 그 답은 앞으로 모든 스크래퍼가 플랫폼의 방어 조치에 어떻게 맞설지를 결정하게 될 것이다.

더 넓은 요점이 있다. AI 업계의 데이터 문제는 라이선스 문제로 취급되어 왔다. 권리자에게 돈을 지불하면 모든 것이 해결된다는 식이다. 이 일련의 사건들은 지불만으로는 충분하지 않다는 것을 시사한다. 저작물을 호스팅하는 플랫폼에는 자체적인 이익이 있고, 그것이 기술적 조치로 성문화되어 있으며, 그 저작물을 무료로 읽을 수 있었는지 여부를 따지지 않는 법률의 뒷받침을 받기 때문이다. 이제 콘텐츠를 합법적으로 확보하는 것과 깨끗하게 확보하는 것은 별개의 두 의무다.

관련 글