← 返回部落格
Ai預計閱讀 8 分鐘

誰在真的用:中國模型拿走了海外生成圖片與生成影片的過半使用量

發布於 2026年10月11日
誰在真的用:中國模型拿走了海外生成圖片與生成影片的過半使用量

八月二十四日到十月五日,Overchat AI 記錄了一百零九萬使用者、三千一百六十萬次模型互動。把這份匿名統計攤開來看,最刺眼的不是誰在某張榜單上高了一分,而是人們在真正動手的時候把票投給了誰:生成圖片和生成影片這兩件最耗算力、也最燒錢的事,過半交給中國模型完成。

這不是評測分數,是使用量。分數可以靠一次放大的測試刷出來,使用量只能靠一次接一次的重複點擊累積出來。

先把這份資料的計算基準說清楚,免得把它當成市場普查。它來自一個把多家模型放進同一個小程式的平台,統計的是八月二十四日到十月五日之間、一百零九萬使用者在一百二十萬個工作階段裡的三千一百六十萬次互動;份額的計算方式是「每個使用者在某個模型上用一次就算一次」,而不是按每次呼叫累計。樣本裡天然偏向願意同時嘗試多家模型的使用者,所以它更像一張「誰在被反覆打開」的快照,而不是整個行業的營收帳單。但正因為所有模型擺在同一個入口裡、面對同一批人,這種對比反而比廠商各自發布的跑分更有說服力。

文字還是美國的,畫面正在換手

先看沒變的部分。文字互動裡,Gemini、GPT、Claude 和 Grok 加起來佔 86.2%,美國廠商在這塊幾乎沒有對手。變的是畫面:中國模型的生成圖片份額從上期的 54.0% 升到 59.5%,生成影片從 43.5% 升到 53.6%。同期,中國模型在全部互動裡佔 36.9%。

把鏡頭拉近到具體家族,分工更清楚。圖像側,字節跳動的 Seedream 以 33.5% 穩坐第一,Google 的 Nano Banana 26.1%,阿里的 Qwen Image 26.0%,後者幾乎是上期 12.3% 的兩倍。影片側,xAI 的 Grok Imagine 仍是單品第一(30.6%,不過比上期的 39.6% 回落了),字節跳動的 Seedance 從 10.8% 衝到 25.2%,可靈守在 21.9%。

真正值得停下來看的是兩週時間窗口:九月二十二日到十月五日,Qwen Image 成為全類別使用量最高的模型家族,17.2%,壓過 GPT 文字的 10.9% 和 Gemini 的 10.8%。一個開源權重出身、以圖像編輯見長的家族,在一個聚合了各家模型的入口裡,被點開的次數超過了所有文字模型。

一張使用份額對比圖:生成圖片與生成影片兩條長條圖裡,中國模型的佔比超過一半

便宜不等於會被用,Qwen 那組數字說明了別的

最容易得出的解釋是價格。Overchat AI 特意補了一句:Qwen Image 和 GPT Image 2.5 在該平台上單價相同,也都包含在免費方案裡。價格持平,使用量卻差了大約四倍。所以這裡起作用的不是誰更便宜,而是別的東西:生成圖片的可用率、編輯時保留原圖的程度、以及使用者第一次試完之後願不願意再試第二次。

配套的一項資料很能解釋這種黏著度。新使用者的模型選擇裡,OpenAI 和 Anthropic 合計佔 23.8%;到了回訪使用者手裡,這個數字掉到 19.8%。與此同時,Google 從 20.9% 升到 28.0%,中國廠商從 36.3% 升到 39.8%。第一選擇靠熟悉度,之後靠實際體驗。人們會換,而且換的方向是往畫面能力那邊走。

用法在變,裝置也在變

區域差異比想像中大。日本有 74.4% 的 AI 使用量來自 Gemini,幾乎是一家獨大;西班牙和印尼明顯偏向 Qwen Image。美國是個例外:它是唯一一個把影片生成當成第一品類的主要市場,佔 36.8%。巴西最偏文字,49.3%。

行動端佔了約 74% 的工作階段,而且文字、圖像、影片幾乎三等分,各佔約 33%。桌面端則明顯偏文字,51.3%,主導家族是 GPT、Gemini 和 Claude。這個對比透露了一件事:圖像和影片生成正在變成一件「隨手就做」的事,使用者在手機上想到就試,而不是累積到電腦前再認真做。行動端的偏好家族也印證了這一點:Seedream、Grok Imagine、Seedance。

別把使用量當成產品品質

需要克制的地方同樣清楚。這是單一平台的樣本,使用者結構會偏向願意嘗試新模型的人群,不能直接外推到整個市場。使用量高只說明被反覆打開,不說明每一張圖都更好。Seedance 的成本大約是 Grok Imagine 1.5 的三倍,卻仍然漲了三倍多的份額,這說明使用者在意的從來不只是價格。

但把這個樣本和別的訊號放在一起,方向就不模糊了。同一段時間裡,阿里把 Qwen-Image 的權重開放出來(儘管授權改成了僅研究用途),字節跳動給 Seedance 上了先出 480P 草稿、滿意再出成片的模式,生數科技把旗艦影片模型的首發價壓到 0.09 元一秒。這些動作都指向同一個目標:讓「多試幾次」變得負擔得起。

把範圍再放寬一點,這份資料也能解釋一件更宏觀的事:文生影片和文生圖的採用,正在從專業工作室下沉到普通人手裡。行動端佔七成以上的工作階段、且三類內容幾乎平分,意味著大多數人不是在搭工作流程,而是在隨手試。這個人群決定不了前沿模型的跑分上限,卻決定了模型被用得有多頻繁、被推薦給多少人。誰能在「試一次就有可用結果」這件事上做得更穩,誰就更容易被留在手機的首屏。

圖像和影片的競爭,最後比的不是單張成品的上限,而是同樣預算下你能試多少次、改多少次、並且願意留下多少次。使用量資料只是把這個樸素的道理,用三千萬次點擊寫了出來。

相關文章