Tencent Hunyuan fait entrer la génération d’images par IA sur les plateaux de tournage : prise en main de HyImage 3.5 preview

Le 22 septembre, Tencent Hunyuan a lancé HyImage 3.5 preview, son tout dernier modèle professionnel de génération d’images, intégré en premier lieu à WorkRally, la plateforme intelligente de production audiovisuelle de Tencent Video, et gratuit pour les créateurs de la plateforme pendant deux semaines. La nouvelle a circulé encore plus vite dans les milieux du cinéma et de la télévision que dans ceux de l’IA, pour une raison simple : ce n’est pas un énième modèle « capable de produire des images », mais un outil de productivité spécifiquement pensé pour le storyboard de séries, les supports visuels audiovisuels et la conception de personnages et de décors.
Cette fois, Hunyuan mise tout sur la création professionnelle
Ces deux dernières années, les modèles chinois de génération d’images se sont surtout livrés à une course au « grand public » : qui génère le plus vite, qui offre le plus de quota gratuit, qui permet à monsieur Tout-le-monde d’obtenir une image avec une simple phrase. HyImage 3.5 preview emprunte un chemin plus étroit et plus difficile : servir d’outil aux équipes de production professionnelles.
Selon les données officielles, lors de tests en aveugle menés auprès de plusieurs centaines de créateurs professionnels, ce modèle affiche une amélioration d’environ 30 % par rapport à HyImage 3.0. Il prend en charge à la fois la génération texte-image et image-image, accepte jusqu’à 5 images de référence par requête et produit une résolution maximale de 2K. Les progrès se concentrent sur trois axes : le rendu et la mise en page du texte, le réalisme et l’expressivité du style, ainsi que la cohérence des retouches.
Ces trois axes sont très bien choisis. Les trois choses qui donnent le plus de fil à retordre aux professionnels de l’audiovisuel sont précisément : le texte et la mise en page dans l’image sont-ils corrects, les matières et la lumière sont-elles assez réalistes, et un même personnage a-t-il la même apparence d’un plan à l’autre. Autrement dit, cette fois, Hunyuan s’attaque à la question « peut-on vraiment s’en servir sur un plateau ? » plutôt qu’à « l’image est-elle jolie ? ».

Avec « Xing Biao », c’est tout un flux de production qui voit le jour
HyImage 3.5 preview n’est pas un modèle lancé isolément : il arrive avec toute une chaîne de production complète. Le 20 septembre, Tencent Video a mis en ligne « Xing Biao », une série premium avec de vrais acteurs, réalisée en combinant prises de vues réelles et contenus générés par IA. Selon la présentation officielle, la génération des storyboards, la fusion des rushs réels avec les contenus générés et l’itération de plusieurs versions de plans ont toutes été réalisées sur WorkRally.
Qu’est-ce que cela signifie ? Que ce modèle Hunyuan n’est pas une démo de laboratoire, mais qu’il a déjà été rodé sur une série réellement diffusée. Cette approche « d’abord l’œuvre, ensuite les capacités » est encore rare dans la génération d’images IA en Chine.
WorkRally propose trois voies d’accès aux créateurs. La première est la « toile infinie » de la page d’accueil, où un réalisateur intelligent génère directement des images, idéale pour tester rapidement des directions. La deuxième consiste à créer une nouvelle toile puis à sélectionner HyImage 3.5 preview dans un nœud de génération d’image, afin de peaufiner plan par plan. La troisième est le flux de production de série, qui génère par lots des assets et des storyboards à partir du scénario. Ces trois voies correspondent respectivement à l’expérimentation rapide, à la retouche fine d’un plan unique et à la production en série de l’épisode, couvrant les principales étapes, de la conception visuelle jusqu’au storyboard final.
Les fonctions maison qui se cachent derrière
Au-delà du modèle lui-même, WorkRally a également développé en interne, sur la base de cette nouvelle fondation, plusieurs fonctions spécifiques au cinéma et à la télévision : génération d’images multi-caméras, rééclairage d’image, réglage de l’ouverture et édition par référence visuelle. Ces fonctions peuvent sembler très techniques, mais pour les professionnels, ce sont de vrais besoins incontournables.
Par exemple, pour le rééclairage d’image, la méthode traditionnelle consiste à bricoler les lumières dans un logiciel 3D ou à ajuster image par image en post-production. Désormais, une simple phrase permet de faire passer la lumière de la scène du crépuscule au midi, et les rapports d’ombre et de lumière entre les personnages et l’environnement évoluent en même temps, au lieu de simplement superposer un filtre. La génération d’images multi-caméras répond, elle, à un problème très concret : pour une même scène, un réalisateur veut plusieurs angles — champ/contrechamp, plan large, gros plan. Avant, il fallait générer version après version ; aujourd’hui, on peut déployer les angles tout en maintenant la cohérence de la scène.
L’édition par référence visuelle mérite aussi qu’on s’y arrête. Elle permet de modifier une image avec une phrase en langage naturel comme « remplace la tasse que tient la personne de gauche par un téléphone », au lieu de devoir redécrire toute l’image dans le prompt. Ce niveau de précision dans l’édition équivaut, sur un plateau, à économiser des dizaines d’allers-retours.
Au-delà du modèle, quelle est la véritable barrière ?
Le responsable produit de WorkRally a eu une remarque très réaliste : l’IA s’immisce de plus en plus dans le développement créatif, la prévisualisation, le design conceptuel, l’exploration stylistique, l’assistance en post-production et la génération de supports de promotion, transformant peu à peu des technologies autrefois inaccessibles en outils et en processus ; mais ce qui détermine réellement la valeur à long terme d’un contenu reste les personnages, les relations, l’univers et le lien émotionnel.
Cette phrase met le doigt sur le positionnement de la génération d’images IA dans l’industrie audiovisuelle. La capacité du modèle fixe le plancher : elle permet même à un storyboardeur sans formation artistique de produire des images utilisables. Mais ce qui fait qu’une série touche le public reste l’histoire elle-même. L’IA peut faire baisser le seuil de « dessiner », mais elle ne peut pas remplacer « ce que l’on veut raconter ».
Pour les créateurs ordinaires, cette mise à jour a aussi une autre signification : elle rend la génération d’images de niveau cinéma accessible à un coût relativement bas. Pendant les deux semaines d’accès gratuit, il suffit de s’inscrire et de se connecter à WorkRally avec WeChat ou un numéro de téléphone pour utiliser directement HyImage 3.5 preview. Par ailleurs, l’outil de création IA tourné vers l’international OnSolo a également intégré ce modèle, avec deux semaines d’accès gratuit pour ses membres.
Comment évaluer ce qu’il apporte ?
Si vous voulez simplement illustrer un article de compte WeChat, HyImage 3.5 preview n’est pas forcément le choix le plus pratique : les solutions grand public comme Jimeng ou Doubao suffisent. Mais si vous travaillez sur une création avec des personnages, des décors et des besoins multi-plans — qu’il s’agisse d’une bande dessinée animée, d’un court métrage ou d’une vraie prévisualisation audiovisuelle —, la valeur de cet outil devient évidente.
Ce qu’il change vraiment, c’est d’avoir fait passer la « génération d’images IA de niveau cinéma » d’un outil interne aux grandes entreprises à un outil accessible au créateur lambda. Quant à savoir jusqu’où ce modèle pourra aller, il faudra voir si, après « Xing Biao », d’autres œuvres réelles sauront en tirer parti.
Articles associés
ChatGPT Images 2.5 est plus rapide, plus net et vous permet enfin d'esquisser
Images 2.5 réduit la latence jusqu'à 50 %, ajoute Sketch et stabilise les modifications en plusieurs tours. Ce qui a changé et qui devrait s'y intéresser.
En septembre, les modèles open source chinois de génération d'images ripostent coup sur coup : SenseTime, Ant Group et InternLM ne restent pas les bras croisés
SenseTime 8B, Ant Group 6B et InternLumina-U2 ont été publiés coup sur coup en open source. Cet article décortique les différences d'approche des trois acteurs et l'impact réel de cette vague open source sur les créateurs.
Les meilleurs générateurs d'images IA de septembre 2026, classés
GPT Image 2.5, Midjourney V8.2, Nano Banana 2, Flux 2 et plus, classés avec les prix et des recommandations par usage.
Le MAI-Image-2.6 de Microsoft se rapproche discrètement de GPT Image 2
Le challenger de Microsoft a réduit l'écart Elo à 21 points. Ce que la montée de MAI-Image-2.6 signifie pour le marché de l'image par IA.