Tencent Hunyuan porta l'AI generativa sul set: prova sul campo di HyImage 3.5 preview

Il 22 settembre, Tencent Hunyuan ha rilasciato il nuovo modello professionale di generazione di immagini HyImage 3.5 preview, integrato per la prima volta in WorkRally, la piattaforma intelligente per il cinema e la TV di Tencent Video, e reso disponibile gratuitamente per due settimane ai creatori della piattaforma. La notizia si è diffusa più velocemente nel mondo dell'audiovisivo che in quello dell'IA, per un motivo semplice: non è l'ennesimo modello «capace di generare immagini», ma uno strumento di produttività pensato specificamente per storyboard di serie, materiali promozionali, progettazione di personaggi e ambientazioni.
Questa volta, Hunyuan punta sulla creazione professionale
Negli ultimi due anni, i modelli cinesi di generazione di immagini hanno gareggiato soprattutto sul fronte «consumer»: chi genera più velocemente, chi offre più crediti gratuiti, chi permette a chiunque di creare un'immagine con una sola frase. HyImage 3.5 preview intraprende una strada più stretta e più difficile: diventare uno strumento per i team di produzione professionisti.
Secondo i dati ufficiali, in un test cieco condotto con centinaia di creatori professionisti il modello migliora le capacità di circa il 30% rispetto a HyImage 3.0. Supporta sia la generazione testo-immagine sia immagine-immagine, consente di caricare fino a 5 immagini di riferimento per singola richiesta e arriva a una risoluzione massima di 2K. I miglioramenti si concentrano su tre dimensioni: rendering e layout del testo, realismo ed espressività stilistica, coerenza nell'editing.
Tre dimensioni scelte con precisione. I tre problemi più fastidiosi per chi lavora nel cinema e nella TV sono esattamente questi: il testo e l'impaginazione nell'immagine sono corretti? Materiali e luci sono abbastanza realistici? Lo stesso personaggio appare identico in inquadrature diverse? In breve, questa volta Hunyuan affronta la questione «può essere davvero usato sul set?», non quella «l'immagine è bella?».

Con «行镖» arriva un intero flusso di produzione
HyImage 3.5 preview non viene rilasciato come modello isolato: arriva insieme a una filiera di produzione completa. Il 20 settembre, Tencent Video ha lanciato «行镖», una serie di pregio con attori reali realizzata combinando riprese dal vivo e contenuti generati dall'IA. Secondo quanto comunicato ufficialmente, la generazione degli storyboard, la fusione tra materiale girato e contenuti generati e l'iterazione di più versioni delle inquadrature sono state tutte realizzate su WorkRally.
Cosa significa? Che questo modello di Hunyuan non è una demo da laboratorio, ma è già stato rodato in una serie realmente pubblicata. Un approccio «prima l'opera, poi le capacità» non è comune nella generazione di immagini AI cinese.
WorkRally offre ai creatori tre percorsi di utilizzo. Il primo è la «tela infinita» nella home page, dove un regista intelligente genera direttamente le immagini: adatta per provare rapidamente una direzione. Il secondo consiste nel creare una nuova tela e selezionare HyImage 3.5 preview nei nodi di generazione immagini per rifinire ripetutamente una singola inquadratura. Il terzo è il flusso di lavoro per serie TV, che genera asset e storyboard in batch a partire dalla sceneggiatura. I tre percorsi corrispondono rispettivamente a sperimentazione rapida, rifinitura della singola inquadratura e produzione su larga scala per l'intero episodio, coprendo le fasi principali dalla progettazione concettuale allo storyboard finale.
Le funzionalità proprietarie dietro le quinte
Oltre al modello in sé, WorkRally ha sviluppato internamente diverse funzionalità pensate per il cinema e la TV sulla base della nuova architettura: generazione di immagini multi-camera, ri-illuminazione dell'immagine, regolazione del diaframma e modifica tramite riferimento visivo. Possono sembrare funzioni specialistiche, ma per i professionisti sono esigenze concrete e irrinunciabili.
Per esempio, per la ri-illuminazione dell'immagine l'approccio tradizionale consiste nell'intervenire sulle luci in software 3D o regolare fotogramma per fotogramma in post-produzione. Ora si può chiedere con una frase di trasformare la luce della scena dal tramonto a mezzogiorno, e le relazioni di luminosità tra personaggi e ambiente cambiano di conseguenza, senza semplicemente sovrapporre un filtro. La generazione multi-camera risolve un problema molto pratico: per la stessa scena il regista vuole più inquadrature come campo/controcampo, totale e primo piano; prima bisognava generarle una per una, ora si possono distribuire le inquadrature mantenendo la coerenza della scena.
Vale la pena citare anche la modifica tramite riferimento visivo. Permette di modificare un'immagine usando un linguaggio naturale come «sostituisci con un telefono la tazza in mano alla persona a sinistra», invece di tornare al prompt e descrivere di nuovo l'intera immagine. Una capacità di editing di questa precisione, sul set, significa risparmiare decine di rifacimenti.
Oltre il modello, qual è il vero vantaggio competitivo
Il responsabile di prodotto di WorkRally ha detto una cosa molto concreta: l'IA sta penetrando fasi come sviluppo creativo, pre-visualizzazione, concept design, esplorazione dello stile, supporto alla post-produzione e generazione di materiali promozionali, trasformando progressivamente tecnologie un tempo inaccessibili in strumenti e processi; ma ciò che determina davvero il valore a lungo termine di un contenuto restano i personaggi, le relazioni, il mondo narrativo e la connessione emotiva.
Questa frase chiarisce il posizionamento della generazione di immagini AI nell'industria dell'audiovisivo. La capacità del modello determina il livello minimo: permette anche a uno storyboarder senza basi artistiche di produrre immagini utilizzabili; ma se una serie riesce a emozionare dipende ancora dalla storia in sé. L'IA può abbattere la soglia del «disegnare», ma non può sostituire il «cosa raccontare».
Per i creatori comuni, questo aggiornamento ha un ulteriore significato: rende disponibile una capacità di generazione di immagini di livello cinematografico a un costo relativamente basso. Durante le due settimane di accesso gratuito, basta registrarsi e accedere a WorkRally con WeChat o con il proprio numero di telefono per utilizzare direttamente HyImage 3.5 preview. Inoltre, lo strumento di creazione AI orientato all'estero OnSolo ha integrato questo modello e offre due settimane di accesso gratuito ai propri membri.
Come fare i conti
Se vuoi solo trovare un'immagine per un articolo su un account WeChat, HyImage 3.5 preview non è necessariamente la scelta più comoda: i modelli consumer come Jimeng e Doubao sono più che sufficienti. Ma se stai lavorando a un progetto con personaggi, ambientazioni e necessità di più inquadrature — che si tratti di comic drama, cortometraggi o vere e proprie pre-visualizzazioni per cinema e TV — il valore di questo strumento emerge chiaramente.
Ciò che cambia davvero è che la «generazione di immagini AI di livello cinematografico» non è più uno strumento interno delle grandi aziende, ma qualcosa che anche un creatore comune può toccare con mano. Quanto lontano saprà spingersi questo modello dipenderà dal fatto che, dopo «行镖», ci siano altre opere reali in grado di raccoglierne il testimone.
Articoli correlati
I migliori generatori di immagini AI di settembre 2026, in classifica
GPT Image 2.5, Midjourney V8.2, Nano Banana 2, Flux 2 e altri, classificati con prezzi e scelte per tipo di lavoro.
MAI-Image-2.6 di Microsoft si sta silenziosamente avvicinando a GPT Image 2
Lo sfidante di Microsoft ha ridotto il divario Elo a 21 punti. Cosa significa l'ascesa di MAI-Image-2.6 per il mercato delle immagini AI.
Settembre 2026: come scegliere gli strumenti AI cinesi per la generazione di immagini – confronto tra Jimeng, Tongyi Wan
Confronto dettagliato tra Jimeng, Tongyi Wanxiang, Kling, Doubao e LiblibAI: qualità dell'immagine, comprensione del cinese, copyright per uso commerciale, quota gratuita. Scegli lo strumento giusto in base alle tue esigenze.
Flux 2 vs Stable Diffusion 3.5: la corsa open-source alle immagini ha un chiaro vincitore
Flux 2 guida per qualità, Stable Diffusion 3.5 conserva l'ecosistema più profondo. Come scegliere tra i due nel 2026.