← Retour au blog
AiEnviron 9 min de lecture

La pile publicitaire vidéo s'est scindée en spécialistes, et Boreal-H3 montre pourquoi

Publié le 7 oct. 2026
La pile publicitaire vidéo s'est scindée en spécialistes, et Boreal-H3 montre pourquoi

Creatify Labs a lancé Boreal-H3 le 2 octobre, un modèle vidéo construit par post-entraînement de MiniMax H3 en partenariat avec MiniMax et destiné à une seule tâche : produire des clips publicitaires. La partie intéressante réside dans le benchmark que Creatify a inventé pour le vendre, et dans ce que ce benchmark implique quant à l'orientation de la génération vidéo.

L'argumentaire, en chiffres

Boreal-H3 obtient 133,3 sur l'Indice de qualité publicitaire de Creatify, où MiniMax H3 est normalisé à 100. L'ensemble de comparaison le place devant Gemini Omni 1.1 Flash à 122,2, Seedance 2.5 à 118,1 et Wan 3.0 Prime à 111,1.

Sur la fidélité de référence (mesurée à un seuil plus strict de 7 sur 10), Boreal-H3 a atteint 85,3 %, devant MiniMax H3 à 82,4 %, Wan 3.0 Prime à 79,4 %, Seedance 2.5 à 71,9 % et Omni 1.1 Flash à 70,6 %.

Par rapport à sa propre base, la boucle de post-entraînement a fait passer la cohérence du sujet de 83,3 à 94,4 %, a fait grimper l'achèvement du brief de 27,8 à 50,0 % sur un ensemble de briefs de production difficiles, et a réduit les défauts visibles de 1,11 à 0,33 par clip, soit une réduction de 70 %.

Les chiffres de coût et de vitesse sont là où l'argumentaire s'affûte. En 768p, Boreal-H3 génère à 1,1 seconde par seconde de vidéo, donc un clip de 10 secondes prend environ 11 secondes et coûte 0,40 $. Seedance 2.5 tourne à 46,5 secondes par seconde de vidéo et environ 0,47 $ par seconde. Sur une démo produit de 15 secondes, Boreal-H3 a rendu en 84 secondes contre 411 secondes pour Seedance 2.5.

Pourquoi le benchmark compte plus que le modèle

L'Indice de qualité publicitaire mesure quelque chose de précis : la fréquence à laquelle un modèle produit un clip qui fonctionne comme une publicité. Un clip est validé uniquement lorsque le suivi du prompt, la cohérence de référence et le réalisme visuel obtiennent chacun une note de 6 sur 10 ou plus. Le taux de réussite de chaque modèle est ensuite indexé sur MiniMax H3.

C'est une question différente de celle que posent la plupart des benchmarks vidéo. Artificial Analysis et les classements similaires notent les résultats selon la qualité générale et l'attrait esthétique. Qu'un clip garde l'étiquette d'un produit lisible, maintienne la silhouette de l'emballage stable et préserve le visage du créateur de la première à la dernière image n'est pas ce que ces classements mesurent, et c'est pourtant ce qu'un annonceur vérifie en premier.

La réserve honnête est que Creatify a construit l'indice, l'exploite et vend le modèle qui le remporte. L'entreprise affirme que ses juges automatisés ont été validés par rapport aux préférences humaines et que les études humaines ont utilisé des sorties anonymisées et randomisées. C'est une affirmation méthodologique raisonnable, et cela reste une affirmation de première main, émanant du fournisseur, à propos du produit du fournisseur. Aucune réplication indépendante n'existe encore.

Il y a aussi un détail plus discret : la comparaison inclut Seedance 2.5 et Wan 3.0 Prime, deux modèles vidéo polyvalents solides évalués selon des critères propres à la publicité. Perdre un benchmark spécialisé face à un modèle spécialisé est attendu. Le chiffre qui serait alarmant serait que Boreal-H3 perde face à un modèle généraliste sur son propre terrain.

La scission des spécialistes est réelle et structurelle

La place qu'occupe Boreal-H3 est plus intéressante que le fait qu'il gagne.

La génération vidéo en 2026 s'est visiblement scindée. D'un côté, les généralistes cinématographiques (Veo de Google, Kling, Gen-4.5 de Runway) vendent la qualité, le contrôle de la caméra et l'audio natif à quiconque a une histoire à raconter. De l'autre, les spécialistes de la publicité : Creatify, Arcads, HeyGen, tous construits autour de la vidéo de créateur de style UGC et des démos produit, vendus à des marketeurs à la performance qui ont besoin de volume et de vitesse d'itération plutôt que d'un plan héros.

L'économie explique cette scission. Une campagne publicitaire à la performance a besoin de dizaines de variantes pour trouver l'accroche qui fonctionne. Si chaque variante coûte 5 $, le calcul ne tient pas. Si chacune coûte 40 cents et se rend en 11 secondes, vous pouvez tester une douzaine d'accroches avant le déjeuner. La qualité cinématographique et le débit d'itération sont des produits différents, et tenter de vendre les deux à partir d'un seul modèle signifie faire des compromis sur celui auquel l'acheteur accorde le plus d'importance.

HeyGen a suivi une voie similaire la même semaine, en lançant un modèle vidéo universel à un cent par seconde, également post-entraîné sur MiniMax H3. Deux entreprises ont décidé indépendamment que la base de MiniMax était le bon substrat à spécialiser, ce qui dit quelque chose sur l'emplacement de la frontière des poids ouverts.

Ce que le modèle ne sait toujours pas faire

La section que la plupart des fournisseurs sautent : la déformation du produit.

La forme d'une bouteille peut se décaler subtilement entre les images, ou entre des variantes générées séparément du même produit. Les marques s'affichent de manière plausible mais techniquement erronée : un logo aux mauvaises proportions, un logotype en relief avec une lettre qui n'existe pas tout à fait. La cohérence des emballages d'une génération à l'autre est suffisamment courante pour que les flux de travail sérieux verrouillent une image de référence afin de la contraindre plutôt que de se fier à une description textuelle.

Creatify affirme avoir résolu ce problème et publié une réduction du taux de défauts. Ce que cette affirmation ne couvre pas, c'est le mode de défaillance qui compte le plus dans une campagne payante : un défaut qui survit à la revue parce qu'il semble correct à la taille d'une vignette et incorrect en taille réelle. Des juges automatisés notant le réalisme visuel à 6 sur 10 ne repéreront pas de manière fiable un logo mal dessiné. Un humain comparant le résultat au produit physique le fera.

Le conseil de flux de travail qui suit est peu glamour. Commencez chaque plan produit à partir d'une photographie du produit réel plutôt que d'une description textuelle, car un prompt uniquement textuel pousse le modèle à inventer l'étiquette en même temps que l'objet. Rédigez les prompts pour le mouvement (ce qui bouge, comment la caméra bouge, ce que fait la lumière), car la photo porte déjà le produit. Placez chaque clip à côté de l'objet physique avant de le livrer.

Ce que la spécialisation apporte, et ce qu'elle coûte

L'argument en faveur d'un modèle comme Boreal-H3 est simple : si votre production est de la publicité, un modèle ajusté sur la publicité vous fera économiser des cycles d'itération qu'un modèle généraliste dépense sur des capacités dont vous n'avez pas besoin.

L'argument contre est un verrouillage d'un type particulier. Un modèle post-entraîné sur la boucle d'évaluation d'une entreprise est optimisé pour la définition que cette entreprise donne d'une bonne publicité, et cette définition n'est pas publiée sous une forme que quiconque d'autre peut auditer. L'Indice de qualité publicitaire est un proxy raisonnable pour « est-ce que cela fonctionne comme un spot publicitaire ». Savoir s'il corrèle avec « est-ce que cette campagne performe » est une question à laquelle seuls les acheteurs média peuvent répondre, et ils y répondront avec leurs budgets au cours des deux prochains trimestres.

Il y a un effet de second ordre qu'il vaut la peine d'anticiper. Lorsqu'un modèle est post-entraîné sur un objectif commercial précis, il tend à s'améliorer sur les schémas que cet objectif récompense et à se dégrader sur ceux qu'il ne mesure pas. Un modèle axé sur la publicité, optimisé pour la fidélité du produit et la cohérence du créateur, peut s'éloigner de l'inventivité visuelle qui rend une campagne mémorable. L'Indice de qualité publicitaire ne comporte aucune composante mesurant si un clip est intéressant, et c'est un choix de périmètre délibéré, avec des conséquences.

L'exigence de matériel de référence est l'autre contrainte pratique. Le contrôle par image clé et le contrôle multi-références exigent tous deux que l'annonceur fournisse de bons intrants : une photo produit propre, un créateur cohérent, un style visuel établi. Cela convient aux marques qui disposent déjà d'une bibliothèque de photographies et d'un système de design. Pour un petit vendeur qui génère de la création à partir de zéro, la spécialisation est moins utile, car les intrants dont le modèle a besoin sont ceux que le vendeur n'a pas.

Ce que Boreal-H3 démontre vraiment, c'est que le marché de la génération vidéo a mûri au point qu'un seul classement ne tranche plus rien. La question pertinente pour un acheteur à la fin de 2026 n'est plus de savoir quel modèle est le meilleur. C'est de savoir quel modèle est le meilleur pour la chose précise que vous produisez, et si vous pouvez le mesurer vous-même plutôt que de faire confiance à l'indice du fournisseur.

Cette dernière proposition est la plus importante. Les fournisseurs qui construisent des modèles publicitaires sont aussi ceux qui vendent les benchmarks qui les classent. La seule évaluation fiable est un test contrôlé sur votre propre ensemble de produits, avec vos propres critères de revue, et un humain comparant chaque résultat à l'objet physique. C'est plus lent que de lire un classement et nettement plus utile.

Articles associés