← 返回博客
Ai10 分钟

本地模型挤压:为何创作者不断追逐无限制图像模型

发布于 2026年9月27日
本地模型挤压:为何创作者不断追逐无限制图像模型

本周一个 Reddit 帖子实际上在问:对于 RTX 5070 Ti,有没有比 Z-Image-Turbo 更好的无限制图像模型。如今这个问题几乎每天都会以不同形式出现在 r/StableDiffusion 上。拥有强大本地硬件的人不断寻找一个不会拒绝他们的模型,而答案一直在变。值得理解为什么这个问题反复出现,因为它真实地反映了 AI 图像生成的发展方向。

“无限制”究竟意味着什么

这个词承载了很多含义。大多数要求无限制模型的人并不是想做什么违法的事。他们只是厌倦了云服务拒绝某些提示词、给输出打水印,或者悄悄弱化某种风格。本地运行完全去掉了审核层,因为模型就在你自己的机器上,没有人能说不。这就是它的吸引力,而且这种吸引力比“未审查”一词所暗示的更广泛。

这种吸引力真实且仍在增长。Nanosaur 2 被宣传为一款未审查的开放图像模型,本周登上了 r/StableDiffusion,一天内获得 300 多个赞和近 100 条评论。评论中既有真正的热情,也有常见的玩笑,但数量本身就说明了需求。人们想要控制权,并愿意为此牺牲一些精致度。

为什么本地模型进步如此之快

硬件已经跟上来了。像 RTX 5070 Ti 这样的 16GB 显卡,现在能运行三年前还需要数据中心才能跑的模型。Qwen-Image 2.1 的 7B 生成器在这类显卡上渲染一张 100 万像素图像大约需要 25 秒。Z-Image Turbo、Flux,以及不断轮换的一批小型微调模型,都能在家中舒适运行。入行门槛已经从“你需要一台服务器”降到了“你需要一块不错的显卡”。

一块带有发光点缀的现代显卡,本地 AI 图像生成的核心

软件也同样跟上了。ComfyUI 让你通过节点图连接遮罩、修复和控制,而无需编写代码。一波对初学者友好的前端已经出现,用来解决社区不断遇到的问题:人们想要 ComfyUI 的能力,却还没做出第一张图就被节点图卡住了。EasyAI 这个项目明确要解决这一点,它把 ComfyUI 包装进一个桌面应用,将流程简化为选择模型、输入提示词、生成。

炒作帖里没人提到的取舍

本地运行并非没有成本。你要付出显存、模型文件的磁盘空间,以及依赖更新时防止工作流崩溃所花的时间。量化有帮助,但它是一种妥协,不是魔法。一些用户指出,为了让模型在 5090 上跑起来,他们不得不将量化后的文本编码器与全精度去噪器搭配运行。这类折腾正是炒作帖省略掉的内容。

还有编辑方面的差距。多图像条件控制在消费级硬件上扩展性很差。每添加一张参考图都会增加延迟,而编辑始终是最慢的操作。对于任何需要大量空间推理或一次性输入许多参考图的任务,云服务仍然领先。如果你的工作流是“快速生成一个想法并迭代”,本地很棒。如果是“把十张参考图融合成一个连贯场景”,你会感受到等待。

然后还有房间里的大象:版权和肖像。那个询问无限制模型的帖子中,也有人问如何生成在新姿势和新服装下保留真实演员面孔的图像。这是一个灰色地带,工具越好,它就越棘手。模型会很乐意这么做。但你是否应该这么做,是另一个问题,再多的本地硬件也解决不了。

现实地看待你放弃了什么

这里有一个被埋没的、关于质量的真实讨论。“无限制”的开放模型在困难任务上——文本渲染、复杂构图和边缘情况——往往比旗舰闭源模型落后一步。追逐它们的人通常是在优化自由度,而非精致度,这是一个站得住脚的选择,但它仍然是一个选择。如果你需要一个能优雅处理杂乱提示词的模型,无限制选项可能会让你失望。

生态系统正在填补空白

围绕模型本身,一个完整的支持性生态系统正在快速增长,值得了解,因为它改变了新手的权衡。AI Horde 是一个免费的众包推理服务,自 2022 年以来一直在运行,本月重新启动,带来了新界面、新的图像生成前端、新后端和全新文档。它的宣传很简单:你可以在不用 GPU 时贡献闲置算力,当你需要运行本地跑不了的渲染时,也可以使用社区汇聚的算力。

这类基础设施悄无声息地具有重要意义。它意味着本地圈子不再只是一个硬件门槛很高的小众爱好。没有好显卡的人也有办法参与其中,要么贡献算力,要么借用算力,而无需订阅云服务。这是一种与 API 巨头真正不同的模式,而且完全建立在自愿合作之上。

工具层也在填补空白。除了 ComfyUI 及其更友好的封装之外,人们还在为特定工作流构建专门的前端,例如角色设定图、透明素材、姿势控制。这种模式与开源软件中曾出现的一样:核心工具仍然难学,而围绕它会长出一片专用工具云,一次一个细分领域地让困难部分变得更容易。

人们为自己划下的伦理界线

很容易把整个讨论压扁成“人们想要未审查模型”,但这忽略了细微差别。这个社区实际上相当认真地思考界线在哪里,而界线并不是“什么都可以”。那些想要一个不会拒绝前卫艺术风格的模型的人,往往也是看到滥用时最先发声的人。

对他们来说,重要的区别在于主题与执行。他们想要的是对风格、对能制作的图像类型、对创意探索的自由。大多数人对深度伪造、未经同意的图像或真正有害的用例并不感兴趣。对“无限制”的需求,主要是在要求创作自由,而不是要求移除所有伦理护栏。

云服务提供商在很大程度上未能尊重这一区别,而这正是本地圈子持续增长的重要原因。当一个模型因为触发关键词过滤而拒绝一个无害的提示词时,这感觉不像是安全。它感觉像是审查,并驱使人们运行自己的模型,以便自行做出判断。讽刺的是,铁腕式的审核可能正在制造它所想要防止的、对无审核模型的需求。

这将走向何方

对本地、无限制模型的需求不会消失,供给也不会消失。每一次小型开放模型的发布,都会减少继续订阅云服务的理由。有趣的问题不是本地是否会追上,而是当“完全控制、无需账户、不会拒绝”成为默认期望,而不再是高级用户的专属小众需求时,云服务提供商会怎么做。

目前,对 RTX 5070 Ti 那个问题的诚实答案是:这取决于你想制作什么,以及你愿意花多少时间折腾。模型是存在的。取舍只是移动的目标,而且每周都会移动一点。

相关文章