O ranking de modelos de vídeo que ninguém divulga: para onde as requisições realmente vão

Toda semana surge um novo ranking de geração de vídeo, e quase todos são construídos da mesma forma. Pesquisadores reúnem os resultados de modelos concorrentes, colocam-nos diante de avaliadores e publicam uma tabela de Elo. Essas tabelas são úteis para comparar qualidade. Mas não dizem quase nada sobre o que os compradores fazem.
Um tipo diferente de ranking agora é público. O OpenRouter publica os volumes de requisições de modelos de vídeo em seu serviço de roteamento, agregados a partir do uso real. Os números da semana encerrada em 1º de outubro contam uma história que os rankings de qualidade não contam.
A tabela de volume
O Veo 3.1 Lite, do Google, manteve o primeiro lugar com cerca de 41.000 requisições, alta de aproximadamente 15%. O Seedance 2.5, da ByteDance, ficou em segundo com cerca de 30.000 requisições, alta de cerca de 28%. O Seedance 2.0 Fast ficou em terceiro com 22.000. O Veo 3.1 Fast ficou em quarto com 17.000, alta de quase 95% em relação à semana anterior. O HeyGen Video entrou na lista como novo participante, com cerca de 17.000 requisições.
Abaixo do top cinco, o Wan 2.7, da Alibaba, registrou a maior variação da tabela, com alta de mais de 300%, chegando a cerca de 12.000 requisições. O Wan 3.0 ficou com volume aproximadamente igual. O Video v3.0 Pro, da Kling, entrou no top dez com cerca de 10.000 requisições.

Agora compare isso com as tabelas de qualidade. No quadro de texto para vídeo da Arena, o Gemini Omni 1.1 Flash lidera. O MiniMax H3 lidera em imagem para vídeo. O Kling 3.0 encabeça vários rankings comerciais de custo-benefício. Nenhum desses modelos aparece no topo da lista de volume de requisições.
As versões Lite estão vencendo porque o trabalho mudou
O padrão que explica a maior parte da tabela é preço e velocidade. O Veo 3.1 Lite é a versão mais barata e mais rápida do Google, e é o modelo mais requisitado do serviço. O Veo 3.1 Fast quase dobrou seu volume em uma semana. O Seedance 2.0 Fast e o Mini, ambos versões de eficiência, somam juntos mais requisições do que o Seedance 2.0 completo.
É assim que se parece um mercado em transição da avaliação para a produção. Quando as pessoas estão testando um modelo, escolhem o melhor. Quando estão colocando algo no ar, escolhem aquele que faz a economia unitária funcionar. Um modelo que produz um clipe um pouco menos impressionante por uma fração do custo vence quando o resultado vai para um pipeline em vez de uma demo.
A entrada do HeyGen Video é o mesmo sinal visto de outro ângulo. A HeyGen lançou seu modelo universal de vídeo com um preço por segundo em torno de um centavo no período promocional, cerca de metade da tarifa padrão, e o disponibilizou imediatamente por meio de roteadores para desenvolvedores. Em poucos dias, estava entre os cinco mais usados em volume. Preço e distribuição, e não a posição em benchmarks, produziram esse resultado.
O salto do Wan tem a ver com abertura
A maior variação semanal pertence ao Wan 2.7, da Alibaba, que cresceu mais de 300%. A família Wan inclui modelos de pesos abertos, e pesos abertos mudam a forma como um modelo se espalha. Qualquer um pode hospedá-lo, definir seu próprio preço e oferecê-lo como opção. Quando os pesos estão disponíveis, o modelo não precisa da permissão do fornecedor original para chegar aos usuários.
Esse é o mecanismo por trás da estratégia de vídeo com pesos abertos. O volume de um modelo fechado é limitado pela capacidade e pelas decisões de preço do fornecedor. O volume de um modelo aberto é limitado por quantos provedores decidem servi-lo. O segundo teto costuma ser mais alto.
O crescimento do Wan também sugere algo sobre onde a geração de vídeo está sendo usada. Modelos de baixo custo e auto-hospedáveis tendem a aparecer em aplicações de alto volume: conteúdo para redes sociais, variações para e-commerce, ativos de jogos. Essas aplicações não precisam de qualidade cinematográfica. Precisam de bastante resultado a baixo custo, e um modelo aberto servido por muitos provedores se encaixa nisso.
Uso e qualidade medem coisas diferentes
Nada disso significa que os líderes de qualidade estão fracassando. Significa que eles competem por um segmento diferente. Um estúdio produzindo um comercial precisa do melhor resultado e pagará por isso. Uma plataforma que gera milhares de clipes por dia precisa de custo por clipe, latência e disponibilidade.
Os dois segmentos são grandes e puxam em direções opostas. É por isso que um único ranking de modelos de vídeo é enganoso. Um modelo pode liderar uma tabela e ser quase invisível na outra, e os dois resultados podem estar corretos.
Há uma terceira consideração que os dados de volume capturam bem: confiabilidade. As contagens de requisições refletem trabalho concluído, e um modelo que produz um clipe utilizável na primeira tentativa vale mais do que um que exige três regenerações. Ao longo de milhões de requisições, essa diferença aparece como volume.
O que os números não podem dizer
O volume de requisições tem pontos cegos, e vale a pena nomeá-los antes de tirar conclusões.
Os dados cobrem modelos servidos por um único serviço de roteamento, não o mercado inteiro. Um laboratório que serve seu próprio modelo em seu próprio aplicativo, como fazem vários dos maiores, não aparece de forma alguma. Um modelo popular dentro de um único grande cliente é subcontado. E as contagens de requisições não distinguem entre um usuário gerando mil clipes e mil usuários gerando um cada, o que é uma diferença significativa para um fornecedor decidindo onde investir.
Os números também ficam atrás dos lançamentos. Um modelo lançado na semana passada e um modelo lançado no ano passado podem mostrar o mesmo volume enquanto se movem em direções opostas, e as variações percentuais capturam isso apenas se você as ler. O Veo 3.1 Fast, do Google, quase dobrando em uma semana, diz mais do que sua posição absoluta.
Portanto, a tabela deve ser lida como um sinal de direção sobre para onde o tráfego de produção está indo, e não como uma medição de participação de mercado. Ela responde à pergunta sobre quais modelos as pessoas estão de fato chamando, uma pergunta que os rankings de qualidade nunca fizeram.
Como o mercado se parece no fim de 2026
Quatro observações, tiradas dos números e não das alegações de qualquer fornecedor.
As versões Fast agora movem a categoria. Os modelos de vídeo mais requisitados são os econômicos, o que significa que os compradores com maior volume estão otimizando o custo por segundo utilizável.
Pesos abertos têm uma vantagem de distribuição. A taxa de crescimento do Wan é a evidência mais clara de que liberar os pesos expande o mercado endereçável mais rápido do que um modelo fechado consegue expandir sua própria capacidade.
Novos participantes podem atingir escala em dias. A HeyGen passou do lançamento a uma posição entre os cinco primeiros em uma semana, combinando preço baixo, integração amigável para desenvolvedores e uma base de clientes já existente. Os canais de distribuição se tornaram a rota mais rápida para o volume.
Os rankings de qualidade ainda importam para o segmento de ponta. Os modelos no topo das tabelas da Arena atendem clientes para os quais um clipe melhor vale mais do que um mais barato.
Quem for escolher um modelo de vídeo deveria ler os dois. As tabelas de qualidade dizem o que um modelo pode alcançar, e os volumes de requisições dizem quanto custa alcançar isso em escala. Nenhum ranking único captura as duas coisas, e essa é uma das razões pelas quais os fornecedores continuam publicando as tabelas de qualidade.
Artigos relacionados
A Ai2 Tornou Open Source o Stack de Treinamento, e Não Mais um Conjunto de Pesos
Pesos são fáceis de distribuir e difíceis de aprender com eles.
Qwen3.8-Max, da Alibaba, afirma que consegue programar sozinho por uma quinzena
Contagens de parâmetros deixaram de ser novidade há algum tempo. Doze dias é o número que vale examinar.
PixelUMM descarta os dois componentes dos quais todo modelo de IA visual depende
A difusão em nível de pixel já foi proposta antes e repetidamente esbarrou no custo computacional.
Data centers de IA agora esperam por linhas de energia, não por entregas de chips
Os projetos que entrarem em operação no prazo em 2027 serão aqueles que resolveram primeiro a conexão e a alocação de memória.