Vidu Q4 Preview rende economico il video ricco di riferimenti

Shengshu Technology ha messo Vidu Q4 Preview in anteprima pubblica il 7 ottobre 2026, e il numero che salta all'occhio e il prezzo. Il prezzo di lancio parte da circa 1,4 centesimi al secondo, che l'azienda descrive come fino a cinque volte piu output a parita di budget in condizioni comparabili. E un'affermazione del fornitore, e le note precisano che il prezzo e promozionale e varia per piano e regione. La traiettoria resta chiara: il costo di un secondo di video generato scende, e scende piu rapidamente dove e piu difficile difenderlo.
Se l'unico argomento fosse il prezzo, questo lancio non meriterebbe un esame attento. Lo rende interessante il fatto che l'economicita arrivi con controlli che un tempo stavano nella fascia costosa.
Quindici riferimenti, tre tracce audio
Q4 Preview accetta fino a 15 riferimenti immagine e fino a 3 riferimenti audio in un singolo lavoro. L'output arriva a 2K o 4K a 10 bit, e i livelli disponibili partono da 540p per chi vuole prima verificare una composizione. Shengshu posiziona il modello su tre cose: come recitano i personaggi, come parla la camera e come tengono gli effetti complessi.
Il numero di riferimenti e la parte che i creatori noteranno per prima. Guidare un modello video con una sola immagine e uno strumento grossolano. Puo bloccare un volto o uno stile, ma fatica a tenere piu cose insieme. Fornire molti riferimenti permette di fissare separatamente volto, costume, oggetto e scenario, e poi chiedere al modello di mantenerli coerenti mentre il piano si muove. Questa e la differenza tra generare una clip e pianificare una scena.
I riferimenti audio rispondono a una logica simile. Se puoi dare al modello una voce e una base musicale, ti avvicini a un piano finito in una sola passata invece di cucire immagine e suono dopo. L'azienda lo presenta come un abbassamento della barriera per persone, team e piccoli studi che non possono permettersi una troupe completa.
{{INLINE1}}
Perche i laboratori cinesi abbassano i prezzi
Vidu non e solo. La mossa di Shengshu cade nella stessa finestra del livello Lite piu economico di xAI e del lavoro continuo di ByteDance su riprese singole piu lunghe. Comune ai laboratori cinesi del video e una corsa al ribasso dei prezzi, unita a una spinta sulla controllabilita. Due forze lo spiegano.
Primo, l'efficienza di inferenza e migliorata abbastanza perche un prezzo al secondo piu basso resti sensato sul lato fornitore. Secondo, il mercato che paga prezzi alti e piccolo. Pochi studi e agenzie pagheranno per l'output migliore, ma il volume arriva da tutti gli altri: venditori e-commerce che testano creativita, team di miniserie, agenzie che iterano concetti ed educatori che producono contenuti esplicativi. Questo pubblico e sensibile al prezzo per tentativo, perche il suo flusso di lavoro si basa sul provare molte versioni e tenere quella che funziona.
Quando Shengshu parla di cinque volte l'output a parita di budget, in realta parla di tentativi. Un creatore che ieri poteva permettersi dieci generazioni oggi ne puo permettere cinquanta, e piu tentativi significano piu probabilita di trovare un piano utilizzabile. Il costo di una ripresa scartata e la voce nascosta di ogni budget video con IA, e le generazioni economiche la riducono.
Cosa verificare prima di passare
L'etichetta di anteprima merita rispetto. Q4 e descritto come il primo sguardo pubblico a un futuro ammiraglia, uscito prima del modello completo, il che significa che la versione stabile potrebbe differire per qualita, velocita e prezzo. Le affermazioni su coerenza e lip-sync provengono dai materiali dell'azienda, e test indipendenti a questa scala non sono ancora pubblici. Chi pensa di costruirci sopra una filiera di produzione dovrebbe prima provare sul proprio materiale.
L'altro punto da guardare e cio che l'economicita non copre. I lavori con molti riferimenti costano piu da elaborare di quelli con una sola immagine, e l'output 4K non e lo stesso prodotto di una bozza a 540p. Leggere un listino dal suo numero piu basso dice poco. Il confronto utile e il costo di un piano finito e accettato, dopo tutti i tentativi necessari.
C'e un fattore che non compare nel listino: cambiare modello significa reimparare a scrivere i prompt. Un modello che si appoggia a immagini di riferimento vuole un tipo di istruzione diverso da uno che si appoggia al testo. Chi ha passato mesi a sviluppare intuizione per un sistema paga una tassa reale al momento di migrare, ed e per questo che il prezzo da solo raramente vince un mercato. I modelli che trattengono gli utenti sono quelli che rendono ovvio il flusso di lavoro per riferimenti, cosi che saltare da uno strumento all'altro non costi una settimana di riapprendimento.
Il vero cambio e chi puo iterare
Per gran parte degli ultimi due anni, la generazione video di alta qualita e stata uno strumento per chi aveva budget e una ragione. L'interesse dell'attuale ondata di tagli ai prezzi e che avvicina lo strumento a chiunque abbia un'idea e un portatile. Questo cambia il tipo di lavoro che viene fatto. I team smettono di razionare le generazioni e le usano come uno schizzo: economiche, usa e getta, rapide.
La formulazione di Shengshu e rivelatrice. Il suo amministratore delegato parla di trasformare i guadagni di efficienza in una barriera piu bassa invece che in un margine piu alto, e di risolvere problemi reali in contesti reali. Se l'anteprima manterrà quella promessa resta una domanda aperta. Ma se il prezzo tiene e i controlli funzionano, il risultato piu importante non e un modello piu economico. E un numero maggiore di persone che possono permettersi di fabbricare cio che immaginano.
Articoli correlati
Il protocollo PACT di Decagon vuole rendere il consenso uno standard
Decagon ha aperto un protocollo per verificare l'identita di un agente personale e i permessi che un cliente gli ha concesso. E idraulica, e decide se l'economia degli agenti funziona.
L'onda dei ricongiungimenti con l'IA: un dibattito che la Cina non sa ancora come sentire
Film omaggio creati con l'IA hanno riportato figure scomparse sugli schermi cinesi e raccolto centinaia di migliaia di like. Poi e arrivata la reazione, e riguardava il consenso.
Apple ha pubblicato un modello multimodale aperto e non l'ha quasi detto
Questo rilascio orientato alla ricerca e passato sotto i radar, ma il suo grounding visivo a grana fine dice molto sulla direzione dello stack IA di Apple.
OpenCut e il momento del CapCut open source
Un editor video gratuito con licenza MIT continua a salire nelle tendenze di GitHub, e la sua roadmap include un server MCP per agenti IA. Gli strumenti attorno ai media IA stanno raggiungendo i modelli.