아무도 홍보하지 않는 비디오 모델 리더보드: 요청은 실제로 어디로 가는가

매주 새로운 비디오 생성 순위가 등장하며, 그 거의 전부가 같은 방식으로 만들어진다. 연구자들은 경쟁 모델들의 출력물을 모아 투표자들 앞에 제시하고 Elo 표를 발표한다. 그 표는 품질을 비교하는 데는 유용하다. 하지만 구매자들이 실제로 무엇을 하는지에 대해서는 거의 말해주지 않는다.
이제 다른 종류의 순위가 공개되었다. OpenRouter는 자사의 라우팅 서비스 전반에서 실제 사용량을 집계한 비디오 모델 요청량을 공개한다. 10월 1일로 끝나는 주의 수치는 품질 리더보드가 들려주지 않는 이야기를 들려준다.
요청량 표
구글의 Veo 3.1 Lite가 약 41,000건의 요청으로 1위를 차지했으며 약 15퍼센트 증가했다. 바이트댄스의 Seedance 2.5가 약 30,000건으로 2위, 약 28퍼센트 증가했다. Seedance 2.0 Fast가 22,000건으로 3위였다. Veo 3.1 Fast는 17,000건으로 4위였으며 전주 대비 거의 95퍼센트 증가했다. HeyGen Video는 약 17,000건의 요청으로 신규 진입하며 목록에 올랐다.
5위 아래에서는 알리바바의 Wan 2.7이 300퍼센트 이상 증가해 약 12,000건의 요청을 기록하며 표에서 가장 큰 변동을 보였다. Wan 3.0은 거의 같은 수준에 머물렀다. Kling의 Video v3.0 Pro는 약 10,000건의 요청으로 10위권에 진입했다.

이제 이것을 품질 표와 비교해 보자. Arena의 텍스트-투-비디오 보드에서는 Gemini Omni 1.1 Flash가 선두다. 이미지-투-비디오에서는 MiniMax H3가 선두다. Kling 3.0은 가성비를 따지는 여러 상용 순위에서 1위를 차지한다. 이 모델들 중 어느 것도 요청량 목록의 상위에는 나타나지 않는다.
Lite 등급이 이기는 이유는 작업의 성격이 바뀌었기 때문이다
이 표의 대부분을 설명하는 패턴은 가격과 속도다. Veo 3.1 Lite는 구글의 더 저렴하고 빠른 등급이며, 이 서비스에서 가장 많이 요청된 모델이다. Veo 3.1 Fast는 일주일 만에 요청량이 거의 두 배로 늘었다. 효율 등급인 Seedance 2.0 Fast와 Mini는 합쳐서 정식 Seedance 2.0보다 더 많은 요청을 차지한다.
이것이 평가 단계에서 양산 단계로 이동하는 시장의 모습이다. 사람들이 모델을 테스트할 때는 최고의 모델을 고른다. 무언가를 출시할 때는 단위 경제성이 맞는 모델을 고른다. 결과물이 데모 릴이 아니라 파이프라인으로 들어가기 시작하면, 훨씬 낮은 비용으로 약간 덜 인상적인 클립을 만들어내는 모델이 승리한다.
HeyGen Video의 진입은 다른 각도에서 본 같은 신호다. HeyGen은 범용 비디오 모델을 출시하면서 프로모션 기간 동안 초당 가격을 약 1센트, 즉 표준 요금의 절반 정도로 책정했고, 즉시 개발자 라우터를 통해 사용할 수 있게 했다. 며칠 만에 요청량 기준 5위 안에 들었다. 그 결과를 만든 것은 벤치마크 순위가 아니라 가격과 유통이다.
Wan의 도약은 개방성 때문이다
전주 대비 가장 큰 변화는 알리바바의 Wan 2.7로, 300퍼센트 이상 성장했다. Wan 제품군에는 오픈 웨이트 모델이 포함되어 있으며, 오픈 웨이트는 모델이 확산되는 방식을 바꾼다. 누구나 이를 호스팅하고 자체 가격을 책정해 하나의 선택지로 제공할 수 있다. 가중치가 공개되어 있으면 모델은 사용자에게 도달하기 위해 원 개발사의 허락이 필요하지 않다.
이것이 오픈 웨이트 비디오 전략의 작동 원리다. 폐쇄형 모델의 요청량은 벤더의 용량과 가격 결정에 의해 제한된다. 오픈 모델의 요청량은 얼마나 많은 제공자가 이를 서비스하기로 선택하느냐에 의해 제한된다. 두 번째 상한선이 보통 더 높다.
Wan의 성장은 비디오 생성이 어디에 쓰이는지에 대해서도 시사하는 바가 있다. 저비용의 자체 호스팅 가능한 모델은 대량 사용 애플리케이션, 즉 소셜 콘텐츠, 이커머스 변형, 게임 에셋 등에 주로 등장한다. 이런 용도는 영화급 품질을 필요로 하지 않는다. 저렴하게 충분한 양의 결과물을 필요로 하며, 여러 제공자가 서비스하는 오픈 모델이 여기에 맞는다.
사용량과 품질은 서로 다른 것을 측정한다
이것이 품질 선두 모델들이 실패하고 있다는 뜻은 아니다. 이들은 다른 세그먼트를 놓고 경쟁하고 있다는 뜻이다. 광고를 제작하는 스튜디오는 최고의 결과물이 필요하고 그에 기꺼이 비용을 지불한다. 하루에 수천 개의 클립을 생성하는 플랫폼은 클립당 비용, 지연 시간, 가용성을 필요로 한다.
두 세그먼트는 모두 규모가 크고 서로 반대 방향으로 당긴다. 그래서 비디오 모델을 단일 순위로 평가하는 것은 오해를 부른다. 어떤 모델이 한 표에서는 선두이면서 다른 표에서는 거의 보이지 않을 수 있고, 두 결과 모두 옳을 수 있다.
요청량 데이터가 잘 포착하는 세 번째 고려 사항이 있다: 신뢰성이다. 요청 수는 완료된 작업을 반영하며, 첫 시도에 쓸 만한 클립을 만들어내는 모델은 세 번을 다시 생성해야 하는 모델보다 더 가치가 있다. 수백만 건의 요청에 걸쳐 그 차이는 요청량으로 나타난다.
수치가 알려주지 못하는 것
요청량에는 사각지대가 있으며, 결론을 내리기 전에 이를 짚고 넘어갈 가치가 있다.
이 데이터는 전체 시장이 아니라 하나의 라우팅 서비스를 통해 제공되는 모델만을 포괄한다. 가장 큰 업체 몇 곳처럼 자사 앱에 자사 모델을 직접 제공하는 연구소는 아예 나타나지 않는다. 단일 대형 고객사 내부에서 인기 있는 모델은 과소 집계된다. 또한 요청 수는 한 사용자가 천 개의 클립을 생성하는 경우와 천 명의 사용자가 각각 하나씩 생성하는 경우를 구분하지 않는데, 이는 어디에 투자할지 결정하는 벤더에게 의미 있는 차이다.
수치는 출시 시점보다 뒤처지기도 한다. 지난주에 출시된 모델과 작년에 출시된 모델이 서로 반대 방향으로 움직이면서 같은 요청량을 보일 수 있으며, 퍼센트 변화는 이를 읽어야만 파악할 수 있다. 구글의 Veo 3.1 Fast가 일주일 만에 거의 두 배로 늘었다는 사실은 절대 순위보다 더 많은 것을 말해준다.
따라서 이 표는 시장 점유율 측정치가 아니라 실제 양산 트래픽이 어디로 향하는지에 대한 방향성 신호로 읽는 것이 가장 좋다. 이는 사람들이 실제로 어떤 모델을 호출하고 있는지에 대한 답이며, 품질 순위는 결코 던지지 않았던 질문이다.
2026년 말 시장의 모습
어떤 벤더의 주장이 아니라 수치에서 이끌어낸 네 가지 관찰이다.
이제 Fast 등급이 이 카테고리를 이끈다. 가장 많이 요청되는 비디오 모델은 경제적인 모델들이며, 이는 가장 많은 물량을 가진 구매자들이 사용 가능한 1초당 비용을 최적화하고 있다는 뜻이다.
오픈 웨이트는 유통상의 이점이 있다. Wan의 성장률은 가중치를 공개하는 것이 폐쇄형 모델이 자체 용량을 확장하는 것보다 더 빠르게 잠재 시장을 넓힌다는 가장 명확한 증거다.
신규 진입자도 며칠 만에 규모에 도달할 수 있다. HeyGen은 낮은 가격, 개발자 친화적 통합, 기존 고객 기반을 결합해 출시 후 일주일 만에 5위권에 올랐다. 유통 채널이 요청량 확보를 위한 가장 빠른 경로가 되었다.
품질 순위는 여전히 하이엔드에서 중요하다. Arena 표 상위의 모델들은 더 저렴한 클립보다 더 좋은 클립이 더 가치 있는 고객을 상대한다.
비디오 모델을 선택하는 사람은 두 표를 모두 읽어야 한다. 품질 표는 모델이 무엇을 달성할 수 있는지 말해주고, 요청량은 그것을 규모 있게 달성하는 데 드는 비용을 말해준다. 어느 단일 순위도 둘 다를 담아내지 못하며, 이것이 벤더들이 품질 표를 계속 발표하는 이유 중 하나다.
관련 글
Ai2가 오픈소스로 공개한 것은 또 다른 가중치가 아니라 학습 스택이다
가중치는 나누기 쉽지만 배우기는 어렵다.
알리바바의 Qwen3.8-Max, 2주 동안 스스로 코딩할 수 있다고 주장
파라미터 수는 이미 오래전부터 뉴스거리가 아니게 되었다. 주목할 만한 숫자는 12일이다.
PixelUMM, 모든 비주얼 AI 모델이 의존하는 두 가지 구성 요소를 버리다
픽셀 수준 확산은 이전에도 제안되었지만 반복적으로 연산 한계에 부딪혔습니다.
AI 데이터센터는 이제 칩 배송이 아니라 전력선을 기다린다
2027년에 제때 문을 여는 프로젝트는 연결과 메모리 할당을 먼저 해결한 곳이 될 것이다.