Das Video-Modell-Ranking, das niemand bewirbt: Wohin die Anfragen wirklich gehen

Jede Woche erscheint ein neues Ranking zur Videogenerierung, und fast alle sind nach demselben Muster aufgebaut. Forscher sammeln Ausgaben konkurrierender Modelle, legen sie Abstimmenden vor und veröffentlichen eine Elo-Tabelle. Diese Tabellen sind nützlich, um Qualität zu vergleichen. Über das, was Käufer tatsächlich tun, sagen sie fast nichts.
Eine andere Art von Ranking ist jetzt öffentlich. OpenRouter veröffentlicht die Anfragevolumina für Videomodelle über seinen Routing-Dienst, aggregiert aus der realen Nutzung. Die Zahlen für die Woche bis zum 1. Oktober erzählen eine Geschichte, die die Qualitäts-Leaderboards nicht erzählen.
Die Volumentabelle
Googles Veo 3.1 Lite behauptete mit rund 41.000 Anfragen den Spitzenplatz, ein Plus von etwa 15 Prozent. ByteDances Seedance 2.5 lag mit etwa 30.000 Anfragen auf Platz zwei, ein Plus von rund 28 Prozent. Seedance 2.0 Fast folgte mit 22.000 Anfragen auf Platz drei. Veo 3.1 Fast belegte mit 17.000 Anfragen Platz vier, ein Plus von fast 95 Prozent im Wochenvergleich. HeyGen Video stieg als Neueinsteiger mit etwa 17.000 Anfragen in die Liste ein.
Unterhalb der Top fünf verzeichnete Alibabas Wan 2.7 die größte Veränderung im Feld: ein Plus von mehr als 300 Prozent auf etwa 12.000 Anfragen. Wan 3.0 lag bei ungefähr demselben Volumen. Klings Video v3.0 Pro stieg mit etwa 10.000 Anfragen in die Top zehn ein.

Vergleichen Sie das nun mit den Qualitätstabellen. Auf Arenas Text-zu-Video-Board führt Gemini Omni 1.1 Flash. MiniMax H3 führt bei Bild-zu-Video. Kling 3.0 steht in mehreren kommerziellen Ranglisten beim Preis-Leistungs-Verhältnis an der Spitze. Keines dieser Modelle taucht in der Anfragevolumen-Liste oben auf.
Lite-Stufen gewinnen, weil sich die Arbeit verändert hat
Das Muster, das den größten Teil der Tabelle erklärt, sind Preis und Geschwindigkeit. Veo 3.1 Lite ist Googles günstigere, schnellere Stufe und das meistangefragte Modell des Dienstes. Veo 3.1 Fast verdoppelte sein Volumen innerhalb einer Woche fast. Seedance 2.0 Fast und Mini, beides Effizienzstufen, kommen zusammen auf mehr Anfragen als das vollwertige Seedance 2.0.
So sieht ein Markt aus, der von der Evaluierung in die Produktion übergeht. Wenn Menschen ein Modell testen, wählen sie das beste. Wenn sie etwas ausliefern, wählen sie das, bei dem die Stückkosten stimmen. Ein Modell, das einen etwas weniger beeindruckenden Clip für einen Bruchteil der Kosten erzeugt, gewinnt, sobald die Ausgabe in eine Pipeline statt in eine Demo-Showreel fließt.
Der Einstieg von HeyGen Video ist dasselbe Signal aus einem anderen Blickwinkel. HeyGen startete sein universelles Videomodell mit einem Preis von rund einem Cent pro Sekunde für den Aktionszeitraum – etwa die Hälfte des Standardpreises – und machte es sofort über Developer-Router verfügbar. Innerhalb weniger Tage war es nach Volumen unter den Top fünf. Preis und Distribution, nicht die Benchmark-Position, brachten dieses Ergebnis hervor.
Wans Sprung hat mit Offenheit zu tun
Die größte Veränderung im Wochenvergleich verzeichnet Alibabas Wan 2.7 mit einem Wachstum von mehr als 300 Prozent. Zur Wan-Familie gehören Modelle mit offenen Gewichten, und offene Gewichte verändern, wie sich ein Modell verbreitet. Jeder kann es hosten, seinen eigenen Preis festlegen und es als Option anbieten. Wenn die Gewichte verfügbar sind, braucht das Modell nicht die Erlaubnis des ursprünglichen Anbieters, um Nutzer zu erreichen.
Das ist der Mechanismus hinter der Open-Weight-Videostrategie. Das Volumen eines geschlossenen Modells wird durch die Kapazität und die Preisentscheidungen des Anbieters begrenzt. Das Volumen eines offenen Modells wird dadurch begrenzt, wie viele Anbieter es bereitstellen wollen. Die zweite Obergrenze liegt meist höher.
Wans Wachstum deutet auch darauf hin, wo Videogenerierung eingesetzt wird. Kostengünstige, selbst hostbare Modelle tauchen tendenziell in volumenstarken Anwendungen auf: Social-Content, E-Commerce-Varianten, Game-Assets. Diese brauchen keine filmreife Qualität. Sie brauchen genug Output zu geringen Kosten, und ein offenes Modell, das von vielen Anbietern bereitgestellt wird, passt dazu.
Nutzung und Qualität messen unterschiedliche Dinge
Nichts davon bedeutet, dass die Qualitätsführer scheitern. Es bedeutet, dass sie um ein anderes Segment konkurrieren. Ein Studio, das einen Werbespot produziert, braucht die beste Ausgabe und wird dafür bezahlen. Eine Plattform, die täglich Tausende Clips generiert, braucht Kosten pro Clip, Latenz und Verfügbarkeit.
Beide Segmente sind groß und ziehen in entgegengesetzte Richtungen. Deshalb ist ein einzelnes Ranking von Videomodellen irreführend. Ein Modell kann eine Tabelle anführen und in der anderen nahezu unsichtbar sein – und beide Ergebnisse können richtig sein.
Es gibt einen dritten Aspekt, den Volumendaten gut erfassen: Zuverlässigkeit. Anfragezahlen spiegeln abgeschlossene Arbeit wider, und ein Modell, das beim ersten Versuch einen brauchbaren Clip liefert, ist mehr wert als eines, das drei Neugenerierungen erfordert. Über Millionen von Anfragen zeigt sich dieser Unterschied im Volumen.
Was die Zahlen Ihnen nicht sagen können
Anfragevolumen hat blinde Flecken, und es lohnt sich, sie zu benennen, bevor man Schlussfolgerungen zieht.
Die Daten umfassen Modelle, die über einen einzigen Routing-Dienst bereitgestellt werden, nicht den gesamten Markt. Ein Labor, das sein eigenes Modell in seiner eigenen App anbietet – wie es mehrere der größten tun –, taucht gar nicht auf. Ein Modell, das bei einem einzelnen großen Kunden beliebt ist, wird zu niedrig gezählt. Und Anfragezahlen unterscheiden nicht zwischen einem Nutzer, der tausend Clips generiert, und tausend Nutzern, die je einen generieren – ein bedeutender Unterschied für einen Anbieter, der entscheidet, wo er investiert.
Die Zahlen hinken auch den Markteinführungen hinterher. Ein Modell, das letzte Woche veröffentlicht wurde, und eines, das letztes Jahr erschien, können dasselbe Volumen zeigen und sich dabei in entgegengesetzte Richtungen bewegen; die prozentualen Veränderungen erfassen das nur, wenn man sie liest. Dass sich Googles Veo 3.1 Fast in einer Woche fast verdoppelt hat, sagt mehr als sein absoluter Rang.
Die Tabelle liest sich daher am besten als Richtungssignal dafür, wohin der Produktionsverkehr geht, und nicht als Marktanteilsmessung. Sie beantwortet die Frage, welche Modelle die Leute tatsächlich aufrufen – eine Frage, die die Qualitätsrankings nie gestellt haben.
Wie der Markt Ende 2026 aussieht
Vier Beobachtungen, abgeleitet aus den Zahlen und nicht aus den Behauptungen irgendeines Anbieters.
Schnelle Stufen treiben die Kategorie jetzt an. Die meistangefragten Videomodelle sind die wirtschaftlichen, was bedeutet, dass die Käufer mit dem größten Volumen auf Kosten pro nutzbarer Sekunde optimieren.
Offene Gewichte haben einen Distributionsvorteil. Wans Wachstumsrate ist der klarste Beleg dafür, dass die Veröffentlichung von Gewichten den adressierbaren Markt schneller erweitert, als ein geschlossenes Modell seine eigene Kapazität ausbauen kann.
Neue Anbieter können in Tagen Skalierung erreichen. HeyGen schaffte es vom Launch in die Top fünf innerhalb einer Woche, indem es einen niedrigen Preis, eine entwicklerfreundliche Integration und einen bestehenden Kundenstamm kombinierte. Distributionskanäle sind zur schnellsten Route zum Volumen geworden.
Qualitätsrankings sind für das obere Segment weiterhin wichtig. Die Modelle an der Spitze der Arena-Tabellen bedienen Kunden, für die ein besserer Clip mehr wert ist als ein günstigerer.
Wer ein Videomodell auswählt, sollte beides lesen. Die Qualitätstabellen sagen, was ein Modell erreichen kann, und die Anfragevolumina sagen, was es kostet, das in großem Maßstab zu erreichen. Kein einzelnes Ranking erfasst beides – ein Grund, warum Anbieter die Qualitätstabellen weiterhin veröffentlichen.
Verwandte Artikel
Ai2 hat den Trainings-Stack als Open Source veröffentlicht – nicht nur ein weiteres Set Gewichte
Gewichte sind leicht weiterzugeben und schwer daraus zu lernen.
Alibabas Qwen3.8-Max behauptet, zwei Wochen lang selbstständig programmieren zu können
Parameterzahlen sind schon vor einer Weile keine Neuigkeit mehr. Zwölf Tage ist die Zahl, die es zu untersuchen lohnt.
PixelUMM verwirft die zwei Komponenten, auf die jedes visuelle KI-Modell angewiesen ist
Diffusion auf Pixelebene wurde schon früher vorgeschlagen und ist immer wieder an Rechenleistung gescheitert.
KI-Rechenzentren warten jetzt auf Stromleitungen, nicht auf Chip-Lieferungen
Die Projekte, die 2027 termingerecht eröffnen, werden diejenigen sein, die den Netzanschluss und die Speicherzuweisung zuerst gelöst haben.