← 返回博客
News11 分钟

中国图像模型正在走向全球,而本月讨论风向变了

发布于 2026年9月27日
中国图像模型正在走向全球,而本月讨论风向变了

过去两年的大部分时间里,西方对中国AI图像模型的讨论都困在一个简单的循环里:抄袭、审查、翻篇。过去三十天打破了这个循环,而这种转变同时出现在三个地方:基准测试、评论区,以及华盛顿的政策辩论。

基准测试时刻

Qwen Image 2.1 挑起了大梁。Tom's Hardware 在9月下旬的一篇报道称,这个70亿参数的开源权重模型在多项基准测试中击败了谷歌的 Nano Banana 2.0,同时与 OpenAI 和 Meta 的系统相比也不落下风。Hacker News 上关于此次发布的帖子获得了739分和近200条评论,这对任何模型来说都是前沿模型级别的流量,更不用说一个可以下载并在笔记本电脑上运行的模型了。几天后又出现了一个 M1 Max 演示:完整的文生图和编辑,512x512 输出每张约24秒,全程不涉及云端。

捕捉到更广泛情绪的 r/singularity 帖子标题是“中国AI模型全球热度飙升——华盛顿感到担忧”。这个标题借用了新闻报道,但下面的讨论与其说是地缘政治,不如说是一种切身经历:那些对哪些模型值得测试抱有默认假设的人,不断在自己的对比中发现中国模型位居或接近榜首。

这些模型真正擅长什么

这些优势与社区证据一致。Qwen 的编辑功能是人们演示最多的特性,它可以生成角色设计图和多重参考构图,而过去这种工作流需要一整套 LoRA 堆栈。文本渲染,尤其是中日韩文字,一直是 Qwen 的稳定优势,这对任何在亚洲市场制作包装或营销材料的人来说都有商业意义。字节跳动的 Seedream 系列——即梦背后的模型家族——因竖版格式生成和照片级真实感而备受好评,并支撑着中国使用最广泛的消费者创作应用之一。Z-Image Turbo 之所以成为西方社区默认的轻量级本地模型,正是因为它在普通 GPU 上也能运行。

移植速度本身就是一种信号。Qwen 发布后一周内,该模型就能在带 GGUF 量化的 TensorSharp 中运行,在原生 Apple Silicon 运行时中运行,也能在支持蒙版和姿势参考的 Fooocus 风格工作室中运行。这样的生态采用不是厂商能买来的。它发生在维护者社区认定一个模型值得他们牺牲周末时,而这是现存最强的采用证据,因为采用者为此付出了真实的时间。

中国平台的讨论补充了英文信息流所缺失的质感。节日驱动的工作流是那里的主流消费者用例:中秋节和国庆节接踵而至,豆包、即梦和通义万相等工具正被数百万制作促销海报的小商家实时评估,熟悉的分类问题也随之而来——哪个工具擅长中文字体排版,哪个擅长产品图,哪个擅长竖版视频封面。商业使用条款是这些帖子中的摩擦点,与西方社区关于授权的争论如出一辙。有一个实用细节很通行:中国消费者工具在每日免费额度上竞争激烈,这让休闲用户的单图成本接近零,并将竞争转向编辑便利性和风格控制。

消费产品层在一个特定方面领先

直说也值得:中国消费级应用一直在进行一场西方服务大多跳过的产品实验,而且奏效了。豆包把图像生成放进聊天界面,提供免费无限生成和对话式编辑,所以用户说一句“把月亮变成金色”,而不必从头重新写提示词。即梦把生成直接接入短视频剪辑流程,一张海报无需导出任何东西就能变成视频封面。通义万相为服装商家打造了虚拟模特功能,用一次上传取代了拍摄。

这些功能每一个都是狭窄、不起眼、面向特定任务的整合,而每一个所获得的日常使用量,都超过了那些更惊艳的演示。西方服务正从另一个方向汇聚到同样的想法上:Gemini 中的基于聊天的编辑、生产力套件内部的生成。但中国应用率先在消费者规模上进行了这场实验,而且是在一个用户为便利性而非订阅付费的市场里。给各地产品人的启示:免费额度加上与现有工作流的紧密整合,在大规模采用上胜过付费墙后的更大模型;质量差距已经缩小到如今整合比模型更能决定结果的程度。

华盛顿的变数

政策角度值得比标题所给的更多审慎。Hacker News 上流传的一篇 Heise 报道指出,德国公司几乎只依赖美国模型,中国模型鲜有使用——这描述的是欧洲。r/singularity 的担忧则不同:开源权重的中国模型正在那些自我筛选出怀疑者的社区中凭实力胜出,而这些社区正是以拆解厂商基准测试为生的。当最具技术性的受众自愿采用一个模型时,惯常的“这不过是炒作”的折扣就不再适用了。

对华盛顿来说,这种紧张是结构性的。限制封闭 API 很直接;限制已经躺在 Hugging Face 上的权重就没那么容易了。那个基准测试表现出色的70亿参数模型,从构造上就已经无处不在。任何政策回应都将至少落后采用曲线数月,而德国的数据点表明,企业采用侧也有自己的滞后,比技术社区落后数年。

还有一个基准测试合法性的角度,将在下一个新闻周期中变得重要。当阿里巴巴声称其模型击败谷歌模型时,西方报道会附带厂商基准的保留意见。这些保留意见是恰当的。但当权重开放、任何人都能运行对比时,它们也变得更难维持。开源权重实验室的厂商声明比封闭实验室的声明更快被验证或证伪,这是一种会不断累积的结构性优势。

接下来值得关注什么

有三个指标值得追踪。第一,下一次 Qwen 或 Seedream 发布是否能在保持基准测试优势的同时,缩小批评者指出的差距,尤其是在复杂多主体构图上。第二,西方托管平台是否会在价格上做出回应,因为一个免费、效果达到90%的本地模型是一个定价事件,而不仅仅是技术事件;第一个被归因于开放竞争的托管服务降价将是信号。第三,预测市场是否会增加开放模型类别;Polymarket 目前关于最佳图像 AI 的盘口只追踪托管厂商,这越来越低估了整个领域。

关于这个故事如何被讲述的一点说明

有一种叙事风险值得点明。对中国AI的报道一直在轻视与警报之间摇摆,而两种模式都模糊了真实图景。轻视低估了真实的工程能力,尤其是在训练效率和消费产品整合方面。警报则把每一项基准都夸大成战略事件,从而招致那种事后又被引述为证据的过度反应。本月最健康的信号并非来自这两种模式:它来自用户在自己的硬件上运行自己的对比,并报告他们所见。这个渠道无法从任何一方被操纵,而它正是发生转变的那一个。

讨论之所以改变,是因为证据变了。一个能在笔记本电脑上运行、击败基准测试、且尝试成本为零的模型,很难用旧模板打发。写出新模板的,正是那些尝试过的人。

相关文章