Flux 2 vs Stable Diffusion 3.5: 오픈소스 이미지 경쟁, 이제 확실한 선두가 있다

AI 이미지 생성의 오픈소스 쪽은 한때 스테이블 디퓨전(Stable Diffusion) 하나를 의미했다. 하지만 2026년에는 더 이상 그렇지 않다. 추진력은 블랙 포레스트 랩스(Black Forest Labs)와 플럭스(Flux) 제품군으로 옮겨갔고, 이제 두 프로젝트는 서로 다른 것을 대표한다.
어느 쪽을 기반으로 개발할지 결정 중이라면, 살아 있는 생태계를 원하는지 검증된 일꾼을 원하는지에 따라 답이 달라진다.
두 프로젝트의 현재 위치
Stable Diffusion 3.5는 Stability AI의 대표 오픈 모델로, 2024년 10월 이후 달라지지 않았다. 오래된 글과 검색 결과가 여전히 암시하는 것과 달리 Stable Diffusion 4는 없다. 이 모델은 Large, Turbo, Medium 크기로 제공되며 로컬에서 실행되고, 어떤 이미지 모델보다 깊은 서드파티 생태계를 갖고 있다.
Flux 2는 Black Forest Labs의 현재 라인업으로 Pro, Flex, Dev, Klein으로 출시된다. Klein 변형은 자체 호스팅이 가능해 클라우드 의존 없이 오픈 웨이트를 원하는 사람들에게 중요하다. Black Forest Labs는 Flux 3 백본의 오픈 웨이트가 나올 것이라고 밝혔지만 2026년 9월 말 기준 아직 출시되지 않았다.

Flux 2가 더 나은 점
가장 큰 차이는 포토리얼리즘이다. Flux는 리뷰어들이 스튜디오 인물 사진에서 훈련되지 않은 눈을 속일 수 있다고 계속 묘사하는 모델이다. 제어 기능도 더 정밀하다. 브랜드 작업을 위한 16진수 색상 제어와 최대 10장까지 지원하는 다중 참조 기능이 있다.
타이포그래피도 Flux의 강점이다. 이미지 속 텍스트 처리에서 최고의 오픈 모델로 평가받으며, 비공개 모델에 비용을 들이지 않고 포스터, 라벨, 인터페이스 작업을 하는 사람에게 기본 추천 모델이 된다.
실용적인 측면에서 Flux는 메가픽셀 단위 가격이 책정된 깔끔한 API로 작동하며, Klein 변형은 자체 호스팅 옵션을 제공한다. 스택에 현대적인 오픈 모델을 원하는 제품 팀에게 Flux는 더 미래지향적인 선택이다.
Stable Diffusion 3.5가 여전히 가진 것
생태계다. Stable Diffusion을 선택해야 할 이유는 전적으로 이것이며, 그 근거는 강력하다.
Stable Diffusion에는 LoRA, ControlNet, ComfyUI 워크플로와 수년간 축적된 튜토리얼, 확장 기능, 커뮤니티 모델이 있다. 포즈를 정밀하게 제어하거나, 여러 이미지에서 캐릭터 얼굴을 고정하거나, 커스텀 파이프라인을 구축하려는 경우 Stable Diffusion은 그 어떤 것보다 즉시 사용 가능한 부품이 많다. 이를 둘러싼 워크플로 도구는 업계에서 가장 깊다.
또한 더 겸손한 하드웨어에서도 실행된다. Medium과 Turbo 변형은 더 가벼워서, 무거운 오픈 모델보다 로컬 배포의 진입 장벽을 낮춘다.
문제는 노후화되고 있다는 점이다. 모델 자체가 2년 가까이 되었고, 이를 대체할 후속 모델이 나오지 않았다. 커뮤니티는 여전히 활발하지만 최전선은 이동했고, Stability AI는 차세대 주력 오픈 모델을 내놓지 못했다.
각 모델 시작하기
첫 한 시간의 경험이 상당히 다르기 때문에 짚어볼 가치가 있다.
Flux 2는 새 프로젝트에 더 쉬운 진입로다. API에 가입하고 키를 받으면 바로 생성을 시작할 수 있다. Pro 티어가 클라우드에서 무거운 작업을 처리하며, 자체 호스팅을 원한다면 Klein 변형이 공식 경로다. Black Forest Labs는 정기적으로 릴리스 노트를 제공하며 최근 업데이트는 과금 및 자동 충전에 집중되어 있는데, 이는 제품이 활발히 유지보수되고 있다는 신호다.
Stable Diffusion 3.5는 그 반대다. 모델 다운로드, ComfyUI 또는 Automatic1111 설치, 그다음 애드온까지 직접 스택을 조립해야 하므로 진입로가 더 가파르다. 하지만 일단 설정하고 나면 그 깊이는 타의 추종을 불허한다. 포즈 제어용 ControlNet, 캐릭터 고정용 LoRA, 영역별 프롬프트, 인페인팅까지. 도구가 곧 제품이고 모델 자체는 시작점일 뿐이다.
하드웨어 요구 사항은 둘 다의 현실적인 문턱이다. Stable Diffusion의 Medium과 Turbo 변형은 적당한 GPU에서 실행되며 이는 실질적인 장점이다. 더 무거운 오픈 모델은 더 많은 VRAM을 요구하며, 하드웨어가 없다면 클라우드 API 액세스가 그 대안이다.
오픈소스 경쟁의 결론
오픈소스 이미지 이야기는 두 갈래로 나뉘었고, 보기보다 훨씬 명확하다.
Flux 2는 오픈 이미지 품질의 최전선이다. 현대적인 선택이며 출시 추진력이 있고, 포토리얼리즘과 타이포그래피에서 앞선다. 새로 시작한다면 기본 선택이다.
Stable Diffusion 3.5는 생태계가 있는 곳이다. 더 오래됐지만 주변 커뮤니티는 이 분야에서 가장 깊고, 제어 도구는 대적할 것이 없다. 이미 워크플로가 있다면 여전히 작동하며, 단지 최신 모델을 갖기 위해 이전하는 것은 대개 나쁜 거래다.
솔직한 표현은 “둘 중 하나가 죽어가고 있다”가 아니다. 오픈소스 이미지 세계에는 이제 Flux라는 앞으로의 길과 Stable Diffusion이라는 깊고 작동하는 과거가 있으며, 어느 쪽을 선택하는지는 어느 쪽이 더 나은가보다는 어디서 시작하는가를 더 많이 말해준다.
선택하는 방법
지금 당장 사용할 수 있는 최고의 오픈 이미지 품질과 타이포그래피를 원하고, 기존 프로젝트를 확장하기보다 새 프로젝트를 시작한다면 Flux 2를 선택하라. API는 직관적이고, 오픈 웨이트가 필요하다면 자체 호스팅 가능한 Klein 변형도 있다.
이미 구축된 워크플로가 있거나, 다른 곳에 대안이 없는 ControlNet과 LoRA 같은 특정 제어 도구가 필요하다면 Stable Diffusion 3.5를 선택하라. 단지 최신 모델을 좇아 작동하는 파이프라인을 이전하는 것은 대개 실수다.
오픈 웨이트 이미지 공간도 더 이상 과거의 2파전이 아니다. Ideogram 4는 강력한 타이포그래피를 갖춘 오픈 웨이트를 제공하고, 텐센트의 HunyuanImage 3.0은 테스트해볼 가치가 있는 대형 오픈 모델이다. 하지만 2026년 9월에 이 결정을 내리는 대부분의 사람에게는 Flux 2와 Stable Diffusion 3.5의 대결로 귀결되며, 솔직한 요약은 이렇다. Flux는 현재이고, Stable Diffusion은 여전히 작동하는 과거다.
아직 결정을 못 내린 사람에게 마지막으로 한마디. 최악의 결과는 잘못된 모델을 고르는 것이 아니다. 이미 작동하는 파이프라인을 다시 구축하느라 몇 주를 허비하는 것이다. 오늘 필요한 것을 Stable Diffusion이 생성하고 있다면 그대로 유지하고, 사이드 프로젝트에서 Flux를 평가하라. 모델은 계속 발전할 것이며, 작동하는 워크플로는 최신 상태를 유지하는 것보다 가치 있다.
관련 글
AI 생성 이미지의 소유권은 누구에게? 저작권, 그리고 Firefly 예외
라이선스, 면책, 그리고 Adobe Firefly의 법적 보호: 2026년에 안전하게 게시할 수 있는 것.
AI가 마침내 철자를 배웠다: 텍스트 렌더링 혁신이 중요한 이유
2026년 텍스트 렌더링 혁신이 디자인, 간판, 다국어 작업, 콘텐츠 감지에 의미하는 바.
GPT Image 2 vs Nano Banana Pro: 2026년, 아무도 합의하지 못하는 대결
속도와 텍스트 대 해상도와 일관성: GPT Image 2와 Nano Banana Pro의 2026년 현실적인 비교.
2026년 Midjourney V8.2: 여전히 AI 미학의 왕, 그러나 비용이 따른다
V8.1과 V8.2가 바꾼 것, 구독 비용, 그리고 2026년에 실제로 Midjourney에 비용을 지불해야 할 사람.