← Volver al blog
Aiaprox. 8 min de lectura

Wan 3.0 lidera la clasificación de vídeo reconstruida y Kling 3.0 se convierte en su ancla

Publicado 7 oct 2026
Wan 3.0 lidera la clasificación de vídeo reconstruida y Kling 3.0 se convierte en su ancla

Artificial Analysis reconstruyó su clasificación de texto a vídeo el 30 de septiembre. La nueva escala, AA-Video-T2V v2.0, evalúa todos los modelos a 1080p y se basa en más de 68.000 votos de preferencia humana en aproximadamente 1000 prompts, agrupados en diez categorías de uso y diez ejes de capacidad. Wan 3.0 ocupa el primer puesto con audio con un Elo de 1156, y se lleva el primer lugar en diez de las veinte clasificaciones por categoría.

El número que más dice sobre el estado del mercado es el que está al final. Kling 3.0 a 1080p es el ancla fija en 1000. Nadie queda clasificado por debajo porque la escala está fijada ahí. El anterior buque insignia de Kuaishou solía ser el estándar nacional para el vídeo con IA; en esta clasificación es el punto de referencia con el que se mide todo lo demás.

Un pelotón, no un podio

Los cuatro mejores modelos están a menos de 18 puntos entre sí, con márgenes de error de aproximadamente nueve a diez. Wan 3.0 lidera con 1156. Utopai X, que ha recibido post-entrenamiento sobre MiniMax H3 y no tiene API pública, es segundo con 1148. Dreamina Seedance 2.5 le sigue con 1142, y MiniMax H3 a 768p es cuarto con 1138. H3 Max de fal cierra el grupo con 1134.

Lee esos números como un pelotón, no como una escalera. Un modelo que puntúa dentro del margen de error del líder no es mediblemente peor que el líder. Tres de los cinco primeros son H3 o están construidos sobre él, que es el hecho más interesante: la base de pesos abiertos que publicó MiniMax se ha convertido en el sustrato sobre el que otros equipos hacen post-entrenamiento, del mismo modo que la gente construyó sobre Stable Diffusion hace tres años.

Hay una historia de distribución bajo la clasificación que la tabla hace visible por primera vez. Hace un año, lo más alto de una clasificación de vídeo era una lista de modelos cerrados de un puñado de laboratorios con buena financiación. Hoy, los cinco primeros incluyen una base de pesos abiertos y dos modelos post-entrenados sobre ella por equipos más pequeños. Utopai X no tiene API pública, así que el modelo que ocupa el segundo puesto en una clasificación pública queda fuera del alcance de cualquiera fuera de la empresa. Ese es un nuevo tipo de artefacto de clasificación, y dice algo sobre la rapidez con la que una buena ronda de post-entrenamiento puede llevar una base abierta a la contienda.

En la clasificación complementaria sin audio, lanzada el mismo día, Wan 3.0 lidera con 1129, con H3 y H3 Max en segundo y tercer puesto. Eliminar el audio reduce el campo, lo que sugiere que la ventaja de los modelos chinos pasa por su manejo del audio y no solo por sus imágenes. También da la vuelta a la interpretación de la clasificación: un estudio que solo necesita metraje silencioso está viendo un panorama competitivo distinto del de uno que necesita diálogo sincronizado con los labios.

Lo que dice la columna de precios

La clasificación también incluye un precio por minuto, y esa columna se lee de forma distinta a la columna de Elo. Wan 3.0 cuesta 12 USD por minuto de vídeo. Seedance 2.5 es el modelo más caro de los diez primeros con 34,12 USD por minuto. MiniMax H3, que cualquiera puede descargar, cuesta 4,80 USD por minuto.

Una tarjeta de puntuación blanca en blanco apoyada sobre un escritorio de roble pálido con un único lápiz delgado colocado en diagonal sobre ella, la tarjeta completamente sin marcar

Así que el modelo de pesos abiertos en tercer lugar cuesta un cuarto de lo que cobra el líder y un séptimo de lo que cobra el modelo comercial en segundo lugar. Para un equipo que lanza un producto, esa diferencia importa más que diecinueve puntos de Elo. La pregunta cambia de “qué modelo es el mejor” a “qué modelo es lo bastante bueno como para que la factura por minuto no mate el caso de negocio”. H3 es la respuesta para muchos equipos que habrían pagado por Seedance hace un año.

La cifra de 34,12 USD por minuto de Seedance 2.5 merece una segunda mirada, porque es la entrada más cara de los diez primeros y ocupa el tercer puesto. El precio implica un cliente que valora la calidad lo suficiente como para pagar siete veces la tarifa de pesos abiertos, y esos clientes existen en publicidad y cine. Lo que la tabla no puede mostrar es si ese sobreprecio sobrevive al contacto con un presupuesto. Si una producción necesita doscientas tomas, la diferencia entre 34 USD y 4,80 USD por minuto es la diferencia entre un proyecto y un problema de hoja de cálculo.

El liderazgo de Wan 3.0 viene con una advertencia: está en beta comercial con acceso por invitación. H3 es el que realmente puedes comprar hoy a un precio publicado. Una posición en la clasificación para un modelo al que no puedes acceder es una señal sobre hacia dónde se dirige el sector, no una decisión de compra.

La clasificación de edición de vídeo añade una segunda dimensión. Wan 3.0 mantiene el primer puesto allí con un Elo de 1188, arrebatándole la categoría a MiniMax H3, que la había mantenido desde su debut en agosto. La edición es donde viven los flujos de trabajo prácticos, porque la mayoría del trabajo comercial de vídeo parte de metraje que ya existe. Un modelo que lidera en generación pero va por detrás en edición es menos útil para un equipo de producción que un modelo que es fuerte en ambas. Wan 3.0 actualmente lidera en ambas, que es la posición más fuerte que ha ocupado ningún modelo en esta clasificación.

Kling 4.0 se lanzó como una hoja de especificaciones

Lo otro que aclara esta tabla es cuánto del reciente lanzamiento de Kling 4.0 existe fuera de una nota de prensa. La cuenta de Kuaishou anunció el modelo el 28 de septiembre: hasta 4K, HDR de 10 bits, 15 referencias multimodales, 10 fotogramas clave, generación nativa de 30 segundos, audio estéreo. La fecha de lanzamiento era “llegará este octubre”.

Lo que realmente se lanzó es Kling 4.0 Flash, disponible para suscriptores de Ultra Yearly. La página de características no incluye precio, ni fecha, ni texto sobre resolución, ni mención de octubre. La entrada más reciente de Kling en cualquier clasificación de Artificial Analysis sigue siendo 3.0. Una publicación de un creador que reveló que Kling le pagó por ella dice que la salida del lanzamiento es 1080p y más barata que Seedance, lo que entra en conflicto con el titular de “hasta 4K”.

Nada de eso hace que las capacidades anunciadas sean falsas. Significa que la brecha entre un anuncio y un modelo utilizable es donde vive la mayor parte del trabajo, y este lanzamiento aún no la ha cerrado. Una hoja de especificaciones que enumera 4K, HDR, quince referencias y diez fotogramas clave describe un conjunto de capacidades que, si se lanza, sería el más fuerte del mercado abierto. También describe un conjunto de funciones que todos los competidores tendrán que responder en un trimestre.

El patrón es familiar de los últimos dos años de lanzamientos de modelos. Los anuncios crean expectativas, y el intervalo antes de la disponibilidad general es donde se construye el producto real. Para un comprador, el consejo práctico es el mismo de siempre: no planifiques una cadena de producción en torno a una página de características. Planifícala en torno a lo que puedes usar hoy.

Qué hay que vigilar

La próxima señal es si Wan 3.0 sale de la beta con acceso por invitación y publica un precio. Si lo hace, la diferencia entre el líder y el pelotón de pesos abiertos se convierte en una decisión presupuestaria real en lugar de teórica.

La segunda señal es Kling 4.0 en sí. Su último buque insignia estableció el ancla en esta escala. El siguiente se está incorporando a las expectativas antes de que nadie fuera de Kuaishou lo haya probado. Cuando llegue, lo hará contra una tabla donde tres de los cinco primeros puestos ya están ocupados por modelos que cuestan menos.

La tercera es qué ocurre con el propio ancla. Kling 3.0 está en 1000 por definición. Si Kling 4.0 se lanza y queda por encima, el punto fijo de la escala se mueve y cada Elo de la tabla pasa a ser una comparación contra una nueva línea base. Ese es el momento en que esta clasificación deja de describir septiembre y empieza a describir hacia dónde va el año.

Artículos relacionados