Flux 2 对比 Stable Diffusion 3.5:开源图像竞赛已有明显领先者

AI 图像生成的开源阵营过去只意味着一件事:Stable Diffusion。到 2026 年,这已不再成立。势头已经转向 Black Forest Labs 及其 Flux 系列,这两个项目如今代表着不同的方向。
如果你正在决定基于哪一个来构建,答案取决于你是想要活跃的生态系统,还是久经考验的主力模型。
项目现状
Stable Diffusion 3.5 是 Stability AI 的旗舰开源模型,自 2024 年 10 月以来一直没有变化。尽管旧文章和搜索结果仍会给出不同暗示,但并不存在 Stable Diffusion 4。该模型提供 Large、Turbo 和 Medium 三种规模,可在本地运行,并拥有所有图像模型中最深厚的第三方生态。
Flux 2 是 Black Forest Labs 当前的产品线,提供 Pro、Flex、Dev 和 Klein 版本。Klein 版本可以自行托管,这对想要开放权重但不想依赖云端的用户很重要。Black Forest Labs 已表示 Flux 3 骨干的开放权重即将推出,但截至 2026 年 9 月下旬尚未发布。

Flux 2 表现更好的方面
最显著的差异在于照片真实感。Flux 是评测者反复形容为能够在影棚人像上骗过未经训练眼睛的模型。它的控制功能也更精确:用于品牌工作的十六进制颜色控制,以及最多支持十张图像的多参考功能。
排版是 Flux 的另一项优势。它被公认为图像中文字生成最好的开源模型,因此对于任何制作海报、标签或界面工作而又不想为闭源模型付费的人来说,它是默认推荐。
在实用层面,Flux 通过简洁的 API 工作,按百万像素计价,Klein 版本则提供了可自托管的选项。对于希望在技术栈中引入现代开源模型的产品团队来说,Flux 是更具前瞻性的选择。
Stable Diffusion 3.5 仍然拥有的优势
生态系统。这就是选择 Stable Diffusion 的全部理由,而且这个理由很充分。
Stable Diffusion 拥有 LoRA、ControlNet、ComfyUI 工作流,以及多年积累的教程、扩展和社区模型。如果你想精确控制姿势、在多张图像中锁定角色面部,或者构建自定义流程,Stable Diffusion 拥有比其他任何方案都更多的现成组件。围绕它的工作流工具是业内最深厚的。
它还可以在更普通的硬件上运行。Medium 和 Turbo 版本更轻量,这使得本地部署的门槛低于更重的开源模型。
问题在于它正在老化。模型本身已接近两岁,而且没有继任者取代它。社区仍然活跃,但前沿已经转移,Stability AI 尚未发布下一款旗舰开源模型。
各自的入门方式
两者在最初一小时内的体验差异很大,值得详细说明。
Flux 2 对新项目来说更容易上手。注册 API、获取密钥,就可以开始生成。Pro 层在云端处理繁重任务,如果你想自行托管,Klein 版本就是官方文档提供的路径。Black Forest Labs 会定期发布更新说明,近期更新主要集中在计费和自动充值上,这表明产品正在积极维护。
Stable Diffusion 3.5 则相反。入门门槛更高,因为你要自己组装技术栈:下载模型、安装 ComfyUI 或 Automatic1111,然后再添加各种插件。但一旦设置完成,其深度无与伦比。用于姿态控制的 ControlNet、用于角色锁定的 LoRA、区域提示、局部重绘。工具本身就是产品,模型只是起点。
硬件要求是两者共同的实际门槛。Stable Diffusion 的 Medium 和 Turbo 版本可以在普通 GPU 上运行,这是一个真正的优势。更重的开源模型需要更多显存,如果你没有相应硬件,云端 API 访问是绕过这一限制的方式。
开源竞赛的结论
开源图像的故事已经分成两条赛道,而且比看上去更清晰。
Flux 2 是开源图像质量的前沿所在。它是更现代的选择,拥有发布势头,并在照片真实感和排版方面胜出。如果你从零开始,它就是默认选项。
Stable Diffusion 3.5 是生态系统的所在。它更老,但围绕它的社区是业内最深厚的,控制工具无人能及。如果你已经拥有工作流,它仍然能用,仅仅为了拥有最新模型而迁移通常是不划算的。
更诚实的说法不是“其中一方正在消亡”,而是开源图像世界如今在 Flux 中拥有前行的道路,在 Stable Diffusion 中拥有深厚且仍在运转的积淀。你选择哪一个,更多说明的是你的起点,而不是谁更好。
如何选择
如果你想要当前可用的最佳开源图像质量和排版,并且是在启动新项目而不是扩展旧项目,请选择 Flux 2。它的 API 简单直接,而且如果你需要开放权重,还有可自托管的 Klein 版本。
如果你已经拥有基于 Stable Diffusion 构建的工作流,或者需要 ControlNet 和 LoRA 这类在其他地方无可匹敌的特定控制工具,请选择 Stable Diffusion 3.5。仅仅为了追逐更新模型而迁移一个正常运转的流程通常是个错误。
开源权重图像领域也不再是过去的两强争霸。Ideogram 4 拥有开放权重和强大的排版能力,腾讯的 HunyuanImage 3.0 也是一个值得测试的大型开源模型。但对于大多数在 2026 年 9 月做这个决定的人来说,最终还是在 Flux 2 和 Stable Diffusion 3.5 之间选择。诚实的总结是:Flux 是现在,Stable Diffusion 是仍然好用的过去。
最后对仍然犹豫不决的人说一句。最坏的结果不是选错了模型,而是花数周时间重建一个本来就能用的流程。如果 Stable Diffusion 今天就能生成你需要的内容,就继续用它,并在副项目上评估 Flux。模型会不断前进,而一个正常工作的流程比保持最新更有价值。
相关文章
谁拥有 AI 生成图像?版权与 Firefly 漏洞
许可、赔偿以及 Adobe Firefly 的法律保障:2026 年你可以安全发布什么。
AI终于学会拼写:为什么文字渲染突破如此重要
2026年文字渲染突破对设计、招牌、多语言工作和内容检测意味着什么。
GPT Image 2 对比 Nano Banana Pro:2026 年无人能达成共识的对决
速度与文字,对阵分辨率与一致性:一份关于 GPT Image 2 与 Nano Banana Pro 的 2026 务实对比。
Midjourney V8.2 在 2026 年:仍是 AI 美学之王,但代价不菲
V8.1和V8.2改变了什么,订阅费用是多少,以及2026年谁才真正应该为Midjourney付费。