谁在真的用:中国模型拿走了海外生图生视频的过半使用量

八月二十四日到十月五日,Overchat AI 记录了一百零九万用户、三千一百六十万次模型交互。把这份匿名统计摊开看,最扎眼的不是谁在某张榜单上高了一分,而是人们在真正动手的时候把票投给了谁:生图和生视频这两件最耗算力、也最烧钱的事,过半交给中国模型完成。
这不是评测分数,是使用量。分数可以靠一次放大的测试刷出来,使用量只能靠一次接一次的重复点击攒出来。
先把这份数据的口径说清楚,免得把它当成市场普查。它来自一个把多家模型放进同一个小程序的平台,统计的是八月二十四日到十月五日之间、一百零九万用户在一百二十万个会话里的三千一百六十万次交互;份额的计算方式是"每个用户在某个模型上用一次就算一次",而不是按每次调用累计。样本里天然偏向愿意同时尝试多家模型的用户,所以它更像一张"谁在被反复打开"的快照,而不是整个行业的营收账单。但正因为所有模型摆在同一个入口里、面对同一批人,这种对比反而比厂商各自发布的跑分更有说服力。
文字还是美国的,画面正在换手
先看没变的部分。文本交互里,Gemini、GPT、Claude 和 Grok 加起来占 86.2%,美国厂商在这块几乎没有对手。变的是画面:中国模型的生图份额从上期的 54.0% 升到 59.5%,生视频从 43.5% 升到 53.6%。同期,中国模型在全部交互里占 36.9%。
把镜头拉近到具体家族,分工更清楚。图像侧,字节的 Seedream 以 33.5% 稳坐第一,谷歌的 Nano Banana 26.1%,阿里的 Qwen Image 26.0%,后者几乎是上期 12.3% 的两倍。视频侧,xAI 的 Grok Imagine 仍是单品第一(30.6%,不过比上期的 39.6% 回落了),字节的 Seedance 从 10.8% 冲到 25.2%,可灵守在 21.9%。
真正值得停下来看的是两周窗口:九月二十二日到十月五日,Qwen Image 成为全类别使用量最高的模型家族,17.2%,压过 GPT 文本的 10.9% 和 Gemini 的 10.8%。一个开源权重出身、以图像编辑见长的家族,在一个聚合了各家模型的入口里,被点开的次数超过了所有文本模型。

便宜不等于被用,Qwen 那组数字说明了别的
最容易得出的解释是价格。Overchat AI 特意补了一句:Qwen Image 和 GPT Image 2.5 在该平台上单价相同,也都包含在免费套餐里。价格持平,使用量却差了大约四倍。所以这里起作用的不是谁更便宜,而是别的东西:出图的可用率、编辑时保住原图的程度、以及用户第一次试完之后愿不愿意再试第二次。
配套的一个数据很能解释这种粘性。新用户的模型选择里,OpenAI 和 Anthropic 合计占 23.8%;到了回访用户手里,这个数字掉到 19.8%。与此同时,谷歌从 20.9% 升到 28.0%,中国厂商从 36.3% 升到 39.8%。第一选择靠熟悉度,之后靠实际体验。人们会换,而且换的方向是往画面能力那边走。
用法在变,设备也在变
区域差异比想象中大。日本有 74.4% 的 AI 使用量来自 Gemini,几乎是一家独大;西班牙和印尼明显偏向 Qwen Image。美国是个例外:它是唯一一个把视频生成当成第一品类的主要市场,占 36.8%。巴西最偏文本,49.3%。
移动端占了约 74% 的会话,而且文本、图像、视频几乎三等分,各占约 33%。桌面端则明显偏文本,51.3%,主导家族是 GPT、Gemini 和 Claude。这个对比透露了一件事:图像和视频生成正在变成一件"随手就做"的事,用户在手机上想到就试,而不是攒到电脑前再认真做。移动端的偏好家族也印证了这一点:Seedream、Grok Imagine、Seedance。
别把使用量当成品质量
需要克制的地方同样清楚。这是单一平台的样本,用户结构会偏向愿意尝试新模型的人群,不能直接外推到整个市场。使用量高只说明被反复打开,不说明每一张图都更好。Seedance 的成本大约是 Grok Imagine 1.5 的三倍,却仍然涨了三倍多的份额,这说明用户在意的从来不只是价格。
但把这个样本和别的信号放在一起,方向就不模糊了。同一段时间里,阿里把 Qwen-Image 的权重开放出来(尽管许可改成了仅研究用途),字节给 Seedance 上了先出 480P 草稿、满意再出成片的模式,生数科技把旗舰视频模型的首发价压到 0.09 元一秒。这些动作都指向同一个目标:让"多试几次"变得负担得起。
把范围再放宽一点,这份数据也能解释一件更宏观的事:文生视频和文生图的采用,正在从专业工作室下沉到普通人手里。移动端占七成以上的会话、且三类内容几乎平分,意味着大多数人不是在搭工作流,而是在随手试。这个人群决定不了前沿模型的跑分上限,却决定了模型被用得有多频繁、被推荐给多少人。谁能在"试一次就有可用结果"这件事上做得更稳,谁就更容易被留在手机的第一屏。
图像和视频的竞争,最后比的不是单张成品的上限,而是同样预算下你能试多少次、改多少次、并且愿意留下多少次。使用量数据只是把这个朴素的道理,用三千万次点击写了出来。
相关文章
Decagon 的 PACT 协议,想让「同意」成为一个标准
Decagon 开源了一个协议,用来验证个人智能体的身份,以及客户授予它的权限。这是管道工程,而它决定了智能体经济能不能跑起来。
AI「重逢」热潮:一场还没想好该如何感受的讨论
AI 致敬短片把逝去的公众人物带回中国荧幕,拿下数十万点赞。然后反弹来了,而它争论的是「同意」。
Apple 发布了一个开源多模态模型,却几乎没告诉任何人
苹果的这次「研究优先」式发布悄然越过了主流视野,但模型那种细粒度的视觉 grounding,透露了它的 AI 栈正走向哪里。
OpenCut 与「开源剪映」的那一刻
一款免费、MIT 许可的视频剪辑器持续冲上 GitHub 趋势榜,而它的路线图里包含一个面向 AI 智能体的 MCP server。围绕 AI 媒体的工具,正在追上模型本身。