← Retour au blog
AiEnviron 8 min de lecture

Wan 3.0 domine le classement vidéo reconstruit, et Kling 3.0 en devient l'ancre

Publié le 7 oct. 2026
Wan 3.0 domine le classement vidéo reconstruit, et Kling 3.0 en devient l'ancre

Artificial Analysis a reconstruit son classement texte-vers-vidéo le 30 septembre. La nouvelle échelle, AA-Video-T2V v2.0, évalue chaque modèle en 1080p et s'appuie sur plus de 68 000 votes de préférence humaine sur environ 1 000 prompts, regroupés en dix catégories d'usage et dix axes de capacité. Wan 3.0 occupe la première place avec audio à un Elo de 1 156, et il décroche la première place dans dix des vingt classements par catégorie.

Le chiffre qui en dit le plus sur l'état du marché est celui du bas. Kling 3.0 à 1080p est l'ancre fixe à 1 000. Personne n'est classé en dessous, car l'échelle y est ancrée. Le précédent modèle phare de Kuaishou était la référence nationale pour la vidéo IA ; dans ce classement, il est le point de référence auquel tout le reste est mesuré.

Un peloton, pas un podium

Les quatre premiers modèles se tiennent à 18 points les uns des autres, avec des barres d'erreur d'environ neuf à dix. Wan 3.0 mène à 1 156. Utopai X, post-entraîné sur MiniMax H3 et dépourvu d'API publique, est deuxième à 1 148. Dreamina Seedance 2.5 suit à 1 142, et MiniMax H3 à 768p est quatrième à 1 138. H3 Max de fal complète le groupe à 1 134.

Lisez ces chiffres comme un peloton plutôt qu'une hiérarchie. Un modèle dont le score se situe dans la barre d'erreur du leader n'est pas mesurablement moins bon que le leader. Trois des cinq premiers sont H3 ou construits sur H3, ce qui est le fait le plus intéressant : la base à poids ouverts publiée par MiniMax est devenue le substrat sur lequel d'autres équipes font du post-entraînement, comme on construisait sur Stable Diffusion il y a trois ans.

Il y a une histoire de distribution sous le classement que celui-ci rend visible pour la première fois. Il y a un an, le sommet d'un classement vidéo était une liste de modèles fermés issus d'une poignée de laboratoires bien financés. Aujourd'hui, le top cinq comprend une base à poids ouverts et deux modèles post-entraînés sur celle-ci par des équipes plus petites. Utopai X n'a pas d'API publique, si bien que le modèle classé deuxième d'un classement public reste hors de portée de quiconque à l'extérieur de l'entreprise. C'est un nouveau type d'artefact de classement, et cela dit quelque chose de la rapidité avec laquelle un bon cycle de post-entraînement peut propulser une base ouverte dans la course.

Sur le classement compagnon sans audio, lancé le même jour, Wan 3.0 mène à 1 129, H3 et H3 Max occupant les deuxième et troisième places. Retirer l'audio resserre la compétition, ce qui suggère que l'avantage des modèles chinois passe par leur gestion de l'audio plutôt que par leurs seuls visuels. Cela inverse aussi l'interprétation du classement : un studio qui n'a besoin que d'images muettes voit un paysage concurrentiel différent de celui qui a besoin de dialogues synchronisés sur les lèvres.

Ce que dit la colonne des prix

Le classement comporte aussi un prix à la minute, et cette colonne se lit différemment de la colonne Elo. Wan 3.0 coûte 12 $ par minute de vidéo. Seedance 2.5 est le modèle le plus cher du top dix, à 34,12 $ la minute. MiniMax H3, que tout le monde peut télécharger, coûte 4,80 $ la minute.

Une carte de score blanche et vierge posée sur un bureau en chêne clair, avec un mince crayon posé en diagonale dessus, la carte entièrement sans inscription

Ainsi, le modèle à poids ouverts à la troisième place coûte un quart de ce que facture le leader et un septième de ce que facture le modèle commercial deuxième. Pour une équipe qui lance un produit, cet écart compte plus que dix-neuf points Elo. La question passe de « quel modèle est le meilleur » à « quel modèle est suffisamment bon pour que la facture à la minute ne tue pas le business case ».

H3 est la réponse pour beaucoup d'équipes qui auraient payé pour Seedance il y a un an.

Le chiffre de 34,12 $ la minute de Seedance 2.5 mérite un second regard, car c'est l'entrée la plus chère du top dix et elle se classe troisième. Ce prix implique un client qui accorde assez de valeur à la qualité pour payer sept fois le tarif du modèle à poids ouverts, et ces clients existent dans la publicité et le cinéma. Ce que le classement ne peut pas montrer, c'est si ce surcoût survit au contact d'un budget. Si une production nécessite deux cents plans, la différence entre 34 $ et 4,80 $ la minute est la différence entre un projet et un problème de tableur.

L'avance de Wan 3.0 s'accompagne d'une réserve : il est en bêta commerciale sur invitation. H3 est celui que vous pouvez réellement acheter aujourd'hui à un prix publié. La position dans un classement d'un modèle auquel vous n'avez pas accès est un signal sur la direction que prend le domaine, pas une décision d'achat.

Le classement d'édition vidéo ajoute une seconde dimension. Wan 3.0 y conserve la première place avec un Elo de 1 188, prenant la catégorie à MiniMax H3, qui la détenait depuis ses débuts en août. L'édition est là où vivent les flux de travail pratiques, car la plupart des travaux vidéo commerciaux partent de séquences qui existent déjà. Un modèle qui domine la génération mais est en retrait sur l'édition est moins utile à une équipe de production qu'un modèle fort dans les deux. Wan 3.0 mène actuellement dans les deux, ce qui est la position la plus forte qu'un modèle ait occupée dans ce classement.

Kling 4.0 livré sous forme de fiche technique

L'autre chose que ce classement clarifie, c'est la part de la récente sortie de Kling 4.0 qui existe en dehors d'un communiqué de presse. Le compte de Kuaishou a annoncé le modèle le 28 septembre : jusqu'à 4K, HDR 10 bits, 15 références multimodales, 10 images clés, génération native de 30 secondes, audio stéréo. La date de sortie était « prévue pour octobre ».

Ce qui est réellement disponible, c'est Kling 4.0 Flash, accessible aux abonnés Ultra Yearly. La page des fonctionnalités n'indique ni prix, ni date, ni résolution, ni mention d'octobre. La plus récente entrée Kling sur n'importe quel classement d'Artificial Analysis reste 3.0. Un post de créateur qui a divulgué que Kling l'avait payé affirme que la sortie au lancement est en 1080p et moins chère que Seedance, ce qui contredit le titre « jusqu'à 4K ».

Rien de tout cela ne rend les capacités annoncées fausses. Cela signifie que l'écart entre une annonce et un modèle utilisable est là où réside l'essentiel du travail, et ce lancement ne l'a pas encore comblé. Une fiche technique qui liste la 4K, le HDR, quinze références et dix images clés décrit un ensemble de capacités qui, s'il est livré, serait le plus fort du marché ouvert. Elle décrit aussi un ensemble de fonctionnalités auxquelles chaque concurrent devra répondre en l'espace d'un trimestre.

Le schéma est familier après les deux dernières années de lancements de modèles. Les annonces créent des attentes, et l'intervalle avant la disponibilité générale est là où le produit réel se construit. Pour un acheteur, le conseil pratique est toujours le même : ne planifiez pas un pipeline de production autour d'une page de fonctionnalités. Planifiez-le autour de ce que vous pouvez appeler aujourd'hui.

Ce qu'il faut surveiller

Le prochain signal sera de savoir si Wan 3.0 quitte la bêta sur invitation et publie un prix. Si c'est le cas, l'écart entre le leader et le peloton à poids ouverts devient une vraie décision budgétaire plutôt que théorique.

Le deuxième signal est Kling 4.0 lui-même. Son dernier modèle phare a établi l'ancre de cette échelle. Le prochain est déjà intégré aux attentes avant même que quiconque en dehors de Kuaishou ne l'ait testé. Quand il arrivera, il arrivera face à un classement où trois des cinq premières places sont déjà occupées par des modèles moins chers.

Le troisième est ce qui arrive à l'ancre elle-même. Kling 3.0 se situe à 1 000 par définition. Si Kling 4.0 sort et se place au-dessus, le point fixe de l'échelle se déplace et chaque Elo du classement devient une comparaison avec une nouvelle référence. C'est le moment où ce classement cesse de décrire septembre et commence à décrire où va l'année.

Articles associés