Luma Ray3 Modify mantiene la performance e rinegozia il mondo che la circonda

Gli strumenti di video AI hanno reso l'effetto la parte facile. Quello con cui ancora faticano è non rovinare la ripresa che hai già pagato.
La maggior parte degli strumenti di generazione video tratta il filmato sorgente come materia prima per una nuova clip. Lo strumento Modify Video di Luma assume una posizione diversa: la performance che hai filmato è la parte di valore, e il mondo che la circonda è negoziabile. La promessa, fatta per la prima volta quando la funzione è stata lanciata all'interno di Dream Machine a giugno 2025, non è cambiata. Ciò che è cambiato è il modello sotto, due volte, e i controlli che lo avvolgono.
Cosa fa ora lo strumento
L'app consumer ora etichetta la funzione come Video To Video. L'API la chiama richiesta video_edit, e gira su Ray 3.2, che Luma ha lanciato il 9 giugno 2026. Ray 3.2 ha portato il controllo dei keyframe, fino a 16 keyframe per clip in posizioni arbitrarie, il tracciamento della performance su un massimo di otto volti simultanei, la generazione HDR nativa con esportazione EXR a 16 bit e, per la prima volta, l'accesso completo alle API. La durata si estende a 20 secondi a 1080p.
Lo strumento Modify stesso è cresciuto fino a diventare qualcosa di più simile a una richiesta di editing completa rispetto al restyle con tre preset con cui era iniziato. Gli output sono disponibili in 540p, 720p o 1080p, a 5 o 10 secondi. L'API limita il video sorgente a 18 secondi e 200 MB, e consente fino a 64 immagini guida fissate lungo il video. La guida di Luma descrive il modello come in grado di leggere i segnali di performance dalla fonte, inclusi posa, espressione facciale e struttura della scena, e di usarli per decidere cosa preservare e cosa ricostruire.
Lo slider strength è una decisione di produzione
Il controllo che conta di più è l'impostazione strength, e non è uno slider di qualità. Stabilisce l'equilibrio tra fedeltà alla fonte e libertà generativa, e Luma lo organizza in tre fasce.
Adhere mantiene il modello vicino ai contorni originali, al posizionamento del soggetto, ai materiali e ai dettagli ambientali. È l'estremità giusta della scala per relighting, ricolorazione, lieve retexturing, piccoli aggiustamenti del guardaroba ed effetti che dovrebbero sovrapporsi a un'inquadratura altrimenti approvata. È anche il primo test più sicuro quando la fonte contiene coreografia, manipolazione precisa di prodotti, movimento delle labbra o un movimento di macchina deliberato.
Flex è il punto di partenza pratico per cambi evidenti del guardaroba, live action stilizzato, cambi d'epoca, aggiornamenti dell'ambiente e sostituzioni di personaggi che mantengono le proporzioni umane. Dà al prompt e al riferimento abbastanza influenza da diventare visibili senza scartare immediatamente la performance di origine.
Reimagine allenta la geometria della fonte, così il modello può inventare una nuova silhouette del personaggio, un ambiente o un linguaggio visivo. Questa è la fascia per animare creature come burattini, trasformare un performer in un personaggio basato su materiali o spostare una location ordinaria in un mondo fantasy.
C'è una specifica modalità di errore che vale la pena conoscere. Con impostazioni Reimagine più forti, il modello è meno vincolato ai bordi originali e può inferire il movimento dalla posa del soggetto trasformato. Quella libertà può introdurre zoom o spostamenti invece di preservare il percorso di macchina registrato. In altre parole, più chiedi al modello di reimmaginare, meno dovresti aspettarti che il movimento di macchina originale sopravviva.
Un workflow che si adatta allo strumento
La disciplina utile qui è scrivere una lock list prima di generare. Elenca identità del soggetto, timing della posa, percorso di macchina, guardaroba, sfondo, illuminazione, geometria del prodotto, testo e audio, e contrassegna ciascuno come preservare, modificare o irrilevante. Se cinque elementi devono restare invariati e solo il colore di una giacca deve cambiare, inizia basso. Se il performer deve diventare una creatura di vetro dentro un mondo diverso, inizia alto. Il risultato migliore è di solito l'impostazione più bassa che completa chiaramente la modifica richiesta, perché più libertà aumenta la probabilità di deriva della macchina da presa o dettagli instabili.

Il metodo di confronto deriva da questo: mantieni costanti fonte, crop, prompt e riferimenti, poi renderizza una piccola serie di varianti a un'impostazione più bassa, una media e una più alta, e giudicale rispetto alla lock list. Registra l'impostazione vincente insieme a fonte, prompt e riferimenti, così le inquadrature successive possono riprodurre la decisione.
Perché Luma è posizionata come infrastruttura
Luma è stata esplicita: Ray è un'infrastruttura professionale con prezzi pensati per volumi di produzione, non un'app consumer. Il contesto fa sembrare la scelta deliberata. L'azienda ha raccolto un round Series C da 900 milioni di dollari guidato da HUMAIN, ha aperto un ufficio a Londra e gestisce implementazioni enterprise di Luma Agents presso Publicis, Adidas e Mazda. La relazione con Mazda ha prodotto un risultato concreto nell'aprile 2026, quando l'agenzia di Johannesburg Boundless ha usato Luma Agents per realizzare il primo spot prodotto con l'AI della casa automobilistica in meno di due settimane.
Questo è il segnale di implementazione in produzione più credibile che qualsiasi piattaforma di video AI abbia mai messo in campo, e dipende dalla stessa promessa che fa Modify. Uno spot pubblicitario usa talenti reali, inquadrature approvate e l'intento di un regista. Uno strumento che rigenera l'intera ripresa è inutilizzabile in quella pipeline. Uno strumento che preserva la performance e cambia il mondo che la circonda può essere inserito.
Ray 3.2 e Ray 3.14 sono sottomodelli paralleli della famiglia Ray3. Ray 3.14, rilasciato a gennaio 2026, gestisce flussi di lavoro di cambio durata e loop, dove il suo output a lunghezza fissa è una risorsa più che un vincolo. Ray 3.2 gestisce la trasformazione standard video-to-video e la guida multi-keyframe.
Dove si colloca rispetto al resto dello stack
Modify è uno strumento di restyling, non un editor generico, e vale la pena rispettare quel confine. Per attività per cui non è stato creato, i team si rivolgono ancora a Seedance, Kling o Wan, spesso tramite la stessa API key su una piattaforma di aggregazione. Ciò che Luma vende è una capacità specifica all'interno di quello stack, non un suo sostituto.
Il punto in cui si distingue è la combinazione di preservazione del movimento e controllo dei keyframe. Uno strumento basato solo sul primo frame ti vincola a un'immagine iniziale. Modify ti vincola a un'intera performance registrata, e poi ti consente di posizionare fino a 64 immagini guida lungo di essa. Questo è più vicino a come un editor pensa a un'inquadratura che a come un prompt writer pensa a una clip.
Le avvertenze che contano prima di fare il budget
L'audio è la prima. Su endpoint di terze parti, l'output video-to-video di Ray 3.2 torna muto, quindi riattacchi la traccia originale nel tuo editor dopo il restyle. Il materiale di lancio di Luma non affronta la gestione dell'audio per l'app consumer, il che significa che una breve clip di test è il modo più sicuro per scoprire come la versione Dream Machine tratta il suono.
Il costo è la seconda. Su un provider cloud, un'esecuzione di 5 secondi a 720p costa circa 1,188 $ senza sconti attivi, e la versione da 10 secondi raddoppia quella cifra. Il modello di fatturazione è passato dai pixel alle clip, il che è più facile da prevedere ma significa che il costo di una serie di tre render di test è denaro reale su larga scala.
L'ampiezza è la terza. Modify è uno strumento di restyling, non un editor generico. Per attività per cui non è stato creato, vai comunque su Seedance, Kling o Wan, spesso tramite la stessa API key.
Cosa tenere d'occhio
L'affermazione da mettere alla prova è la preservazione. Se Modify mantiene una performance attraverso movimento complesso e un movimento di macchina deliberato con un'impostazione Flex, si guadagna un posto in un flusso di lavoro commerciale. Se fa derivare la macchina da presa ogni volta che il prompt diventa ambizioso, resta uno strumento di stilizzazione con un'etichetta professionale. Le prossime due revisioni del modello stabiliranno quale delle due cose è.
Articoli correlati
Gli strumenti video AI ottengono 9 su 10 per facilità d'uso. Il punteggio di conformità è un'altra storia.
Gli utenti adorano i generatori video AI. I reparti legali non sono ancora stati interpellati.
InternLumina-U2 riunisce testo, immagini, video e 3D in un unico modello da 16B, poi distribuisce due set di pesi
L'elenco delle attività è ambizioso. Il formato di rilascio porta più segnali.
HappyOyster vende un mondo in cui puoi entrare, non una clip da guardare
La maggior parte dei modelli video ti consegna un file. Questo ti consegna una stanza con dentro una porta.
Vidu Q3 ha diviso il reference-to-video in tre prodotti. È una decisione di packaging tanto quanto una decisione di modello.
Tre ID di modello allo stesso prezzo sono più una decisione di approvvigionamento che di marketing.