Wan 3.0 登上重建後的影片排行榜首位,Kling 3.0 成為其錨點

Artificial Analysis 於 9 月 30 日重建了自家的文字轉影片排行榜。全新的評分標準 AA-Video-T2V v2.0 以 1080p 評測每一個模型,並採用超過 68,000 張人類偏好投票,涵蓋約 1,000 組提示詞,歸類為十個使用類別與十個能力軸向。Wan 3.0 在含音訊項目以 Elo 1,156 位居第一,並在二十項分類排名中拿下其中十項榜首。
更能說明市場現況的數字,其實在榜單最下面。1080p 的 Kling 3.0 是固定在 1,000 的錨點。因為量表就釘在這個位置,沒有任何模型排在它之下。快手的前一代旗艦曾是中國國內 AI 影片的標準;在這份榜單上,它成了所有其他模型用來衡量的參考點。
是一群領先者,不是一座頒獎台
前四名模型彼此差距在 18 分以內,而誤差範圍約為 9 到 10 分。Wan 3.0 以 1,156 領先。以 MiniMax H3 進行後訓練、且沒有公開 API 的 Utopai X 以 1,148 居次。Dreamina Seedance 2.5 以 1,142 緊隨其後,768p 的 MiniMax H3 以 1,138 排名第四。fal 的 H3 Max 以 1,134 補齊這個集團。
把這些數字讀成一個集團,而不是一座階梯。分數落在領先者誤差範圍內的模型,並不能測出比領先者差。前五名中有三個是 H3 或以它為基礎打造,這才是更有意思的事實:MiniMax 釋出的開放權重基礎模型,已成為其他團隊進行後訓練的基底,就像三年前大家以 Stable Diffusion 為基礎一樣。
排行榜底下還藏著一個分布的故事,而這份榜單首次讓它現形。一年前,影片排行榜的前段是少數幾家資金充裕的實驗室所推出的閉源模型清單。如今前五名包含一個開放權重基礎模型,以及兩個由較小團隊以它後訓練而成的模型。Utopai X 沒有公開 API,因此這個在公開排行榜上排名第二的模型,對公司以外的人來說依然遙不可及。這是一種全新的排行榜現象,也說明了跑一輪好的後訓練,能多快把一個開放基礎模型拉進競爭行列。
在同日推出的無音訊對照榜單上,Wan 3.0 以 1,129 領先,H3 與 H3 Max 分居二、三名。移除音訊讓領先差距縮小,這意味著中國模型的優勢來自其音訊處理,而非單純的視覺表現。這也翻轉了排行榜的解讀方式:只需要無聲素材的製作公司,看到的是與需要唇形同步對白的公司截然不同的競爭圖像。
價格欄位透露的事
排行榜同時列出每分鐘價格,而這一欄讀起來與 Elo 欄完全不同。Wan 3.0 每分鐘影片要價 12 美元。Seedance 2.5 以每分鐘 34.12 美元成為前十名中最貴的模型。任何人都能下載的 MiniMax H3 則是每分鐘 4.80 美元。

所以,排名第三的開放權重模型,價格只有領先者的四分之一、第二名商業模型的七分之一。對一支要把產品出貨的團隊來說,這個差距比 19 點 Elo 更重要。問題從「哪個模型最好」轉變為「哪個模型夠好,好到每分鐘的帳單不會扼殺商業模式」。對許多一年前還會掏錢買 Seedance 的團隊來說,答案就是 H3。
Seedance 2.5 每分鐘 34.12 美元的數字值得再看一眼,因為它既是前十名中最貴的選項,排名又高居第三。這項定價暗示的客戶,重視品質到願意支付開放權重價格的七倍,而這樣的客戶確實存在於廣告與電影產業。榜單無法呈現的是,這樣的溢價在碰上預算時是否還站得住腳。如果一部製作需要兩百個鏡頭,每分鐘 34 美元與 4.80 美元的差距,就是一個專案與一個試算表難題之間的差距。
Wan 3.0 的領先附帶一個但書:它仍處於邀請制的商業測試階段。H3 才是你今天真的能以公開價格買到的模型。一個你無法存取的模型所拿下的榜位,是關於這個領域走向的訊號,而不是採購決策。
影片編輯榜單則增添了第二個維度。Wan 3.0 在該榜以 Elo 1,188 穩居第一,從自 8 月首次登場便一直保持領先的 MiniMax H3 手中拿下該類別。編輯才是實務工作流程的所在,因為多數商業影片工作都是從既有的素材開始。一個在生成上領先、在編輯上落後的模型,對製作團隊的用處不如一個兩方面都強的模型。Wan 3.0 目前兩邊都領先,這是任何模型在這份榜單上取得過的最強位置。
Kling 4.0 以規格表的形式問世
這份榜單澄清的另一件事,是近期 Kling 4.0 發表中有多少內容只存在於新聞稿裡。快手的帳號在 9 月 28 日宣布這款模型:最高 4K、10-bit HDR、15 個多模態參考、10 個關鍵影格、原生 30 秒生成、立體聲音訊。上市日期則是「今年十月即將推出」。
實際出貨的是 Kling 4.0 Flash,已對 Ultra 年繳訂閱者開放。該功能頁面沒有價格、沒有日期、沒有解析度說明,也沒有提到十月。Artificial Analysis 各榜單上最新的 Kling 項目仍是 3.0。一篇揭露 Kling 付費合作的創作者貼文指出,上市時的輸出為 1080p,且比 Seedance 便宜,這與「最高 4K」的標題相互矛盾。
這些都不代表所宣布的能力是假的。它意味著從宣布到可用模型之間的落差,正是大部分工作所在之處,而這次發表還沒把它填平。一份列出 4K、HDR、十五個參考與十個關鍵影格的規格表,描述的是若真的出貨、就會是公開市場上最強的一套能力。它同時也描述了一套每個競爭對手都得在一季內回應的功能。
這個模式在過去兩年的模型發表裡早已熟悉。發表會設定期待,而全面上市前的那段間隔,才是真正產品被打造出來的時候。對買方而言,實務建議一如往常:不要圍繞著功能頁面規劃製作流程。要圍繞你今天就能呼叫的東西來規劃。
值得觀察的重點
下一個訊號是 Wan 3.0 是否會脫離邀請制測試並公布價格。如果會,領先者與開放權重集團之間的差距,就會從理論上的差距變成真正的預算決策。
第二個訊號是 Kling 4.0 本身。它的上一代旗艦設定了這套量表的錨點。下一代在快手以外還沒有人跑過之前,就已經被納入期待之中定價。當它真的到來時,它面對的是一份前五名中有三席已被更便宜模型占據的榜單。
第三個是錨點本身會如何變化。Kling 3.0 依定義就落在 1,000。如果 Kling 4.0 出貨並落在它之上,這套量表的固定點就會移動,榜上每一個 Elo 都將變成與新基線的比較。那一刻,這份排名就不再描述九月,而是開始描述這一年將往哪裡去。