← Zurück zum Blog
Aica. 4 Min. Lesezeit

Vidu Q4 Preview macht referenzlastiges Video gunstig

Veröffentlicht 11. Okt. 2026
Vidu Q4 Preview macht referenzlastiges Video gunstig

Shengshu Technology hat Vidu Q4 Preview am 7. Oktober 2026 in die offentliche Vorschau gestellt, und die auffalligste Zahl ist der Preis. Der Startpreis beginnt bei etwa 1,4 Cent pro Sekunde, was das Unternehmen als bis zu funfmal mehr Ausgabe fur dasselbe Budget unter vergleichbaren Bedingungen beschreibt. Das ist eine Angabe des Anbieters, und das Kleingedruckte sagt, der Preis sei werblich und variiere nach Tarif und Region. Die Richtung ist dennoch klar: Die Kosten einer Sekunde generierten Videos sinken, und sie sinken am schnellsten dort, wo es am schwersten zu verteidigen ist.

Wenn nur der Preis zahlt, lohnt dieser Launch keine nahere Betrachtung. Interessant wird er, weil die Gunstigkeit mit Kontrollen kommt, die fruher in der teuren Klasse lagen.

Funfzehn Referenzen, drei Audiospuren

Q4 Preview akzeptiert in einem Auftrag bis zu 15 Bildreferenzen und bis zu 3 Audioreferenzen. Die Ausgabe reicht bis 2K oder 4K in 10 Bit, und die verfugbaren Stufen beginnen bei 540p fur alle, die zuerst eine Komposition prufen wollen. Shengshu positioniert das Modell entlang dreier Dinge: wie Figuren spielen, wie die Kamera spricht und wie komplexe Effekte zusammenhalten.

Die Zahl der Referenzen fallt Kreativen zuerst auf. Ein Videomodell mit einem einzigen Bild zu steuern, ist ein grobes Werkzeug. Es kann ein Gesicht oder einen Look fixieren, sturzt aber ab, wenn mehrere Dinge gleichzeitig halten sollen. Viele Referenzen lassen Gesicht, Kostum, Requisite und Szenerie getrennt fixieren und dann uber eine Kamerabewegung hinweg konsistent halten. Das ist der Unterschied zwischen einem Clip und einer geplanten Szene.

Audioreferenzen wirken ahnlich. Wer dem Modell eine Stimme und eine Musikspur geben kann, kommt einem fertigen Shot in einem Durchgang naher, statt Bild und Ton nachtraglich zusammenzufugen. Das Unternehmen beschreibt dies als Absenkung der Hürde fur Einzelpersonen, Teams und kleine Studios, die sich kein komplettes Produktionsteam leisten konnen.

{{INLINE1}}

Warum chinesische Videolabore die Preise senken

Vidu ist nicht allein. Der Schritt fallt in dasselbe Fenster wie xAIs gunstigere Lite-Stufe und ByteDances laufende Arbeit an langeren Einzelaufnahmen. Gemeinsam ist den chinesischen Videolaboren eine Abwartsbewegung der Preise, gepaart mit einem Vorstoss bei der Kontrollierbarkeit. Zwei Krafte treiben das.

Erstens hat sich die Inferenzeffizienz so weit verbessert, dass ein niedrigerer Preis pro Sekunde beim Anbieter noch aufgeht. Zweitens ist der Markt, der Spitzenpreise zahlt, klein. Ein paar Studios und Agenturen zahlen fur die beste Ausgabe, aber das Volumen kommt von allen anderen: E-Commerce-Verkaaufer, die Creatives testen, Kurzserien-Teams, Agenturen, die Konzepte iterieren, und Lehrende, die Erklarinhalte produzieren. Dieses Publikum ist preissensibel pro Versuch, weil sein Arbeitsablauf auf vielen Versionen und einer brauchbaren basiert.

Wenn Shengshu von funfmal mehr Ausgabe fur dasselbe Budget spricht, spricht es eigentlich von Versuchen. Wer gestern zehn Generierungen bezahlen konnte, kann heute funfzig bezahlen, und mehr Versuche bedeuten mehr Chancen auf einen brauchbaren Shot. Die Kosten einer verworfenen Aufnahme sind die verborgene Zeile in jedem KI-Videobudget, und gunstige Generierungen verkleinern sie.

Was vor dem Wechsel zu prufen ist

Das Wort Vorschau verdient Respekt. Q4 wird als erster offentlicher Blick auf ein nachstes Flaggschiff beschrieben, vor dem vollstandigen Modell veroffentlicht, was heisst, dass die stabile Version in Qualitat, Tempo und Preis abweichen kann. Die Aussagen zu Konsistenz und Lip-Sync stammen aus eigenen Materialien, und unabhangige Tests in dieser Grosse sind noch nicht offentlich. Wer eine Produktionskette darauf aufbauen will, sollte zuerst am eigenen Material testen.

Der zweite Punkt ist, was die Gunstigkeit nicht abdeckt. Referenzreiche Auftrage kosten mehr Verarbeitung als Einzelbilder, und 4K ist nicht dasselbe Produkt wie ein 540p-Entwurf. Eine Preisliste an ihrer kleinsten Zahl zu lesen, sagt wenig. Der nutzliche Vergleich ist der Preis eines fertigen, akzeptierten Shots nach beliebig vielen Versuchen.

Ein Faktor steht nicht auf der Preisliste: Ein Modellwechsel bedeutet, das Prompt-Schreiben neu zu lernen. Ein Modell, das sich auf Referenzbilder stutzt, will eine andere Art von Anweisung als eines, das sich auf Text stutzt. Wer monatelang ein Gefuhl fur ein System entwickelt hat, zahlt beim Umstieg eine echte Steuer, und deshalb gewinnt der Preis allein selten einen Markt. Modelle, die Nutzer halten, machen den Referenz-Workflow selbstverstandlich, sodass der Sprung von einem Werkzeug zum anderen keine Woche Nachlernen kostet.

Der eigentliche Wandel: wer iterieren darf

Den grossten Teil der letzten zwei Jahre war hochwertige Videogenerierung ein Werkzeug fur Menschen mit Budget und Grund. Das Interessante an der aktuellen Preissenkung ist, dass sie das Werkzeug jedem naher bringt, der eine Idee und einen Laptop hat. Das verandert die Art der Arbeit. Teams rationieren Generierungen nicht mehr, sondern nutzen sie wie eine Skizze: billig, wegwerfbar, schnell.

Shengshus eigene Formulierung ist bezeichnend. Sein Chef spricht davon, Effizienzgewinne in eine niedrigere Hürde statt in eine hohere Marge zu verwandeln, und echte Probleme in echten Kontexten zu losen. Ob die Vorschau das einlost, bleibt offen. Wenn der Preis halt und die Kontrollen funktionieren, ist das wichtigere Ergebnis aber nicht ein gunstigeres Modell. Es ist eine grossere Zahl von Menschen, die sich leisten konnen, das zu bauen, was sie sich vorstellen.

Verwandte Artikel