← 블로그로
News11 분

ChatGPT Images 2.5, 더 빠르고 선명해졌으며 드디어 스케치를 지원합니다

게시일 2026년 9월 26일
ChatGPT Images 2.5, 더 빠르고 선명해졌으며 드디어 스케치를 지원합니다

OpenAI가 2026년 9월 8일 ChatGPT Images 2.5를 출시했고, 모두가 주목한 핵심 수치는 속도였습니다. 이전 버전 대비 지연 시간이 최대 50% 단축되었습니다. 이는 중요하지만 변화의 전모를 다 담지는 못합니다. 더 흥미로운 점은 이제 모델에 대략적인 스케치를 그려 참조로 넘길 수 있고, 편집이 여러 차례 반복되어도 어긋나지 않고 유지된다는 것입니다.

봄에 마지막으로 이 도구를 사용해봤다면, 차이를 즉시 느낄 수 있습니다. 먼저 체감되는 것은 대기 시간입니다. 예전에는 6초쯤 걸리던 생성이 이제 약 3초면 끝납니다. 두 번째는 작은 변경을 요청했을 때 나머지 이미지가 그대로 유지된다는 점입니다.

실제로 개선된 것

공식 발표는 속도, 디테일, 편집 안정성 세 가지 영역을 다룹니다.

속도는 확인하기 쉽습니다. OpenAI는 지연 시간이 최대 절반까지 줄었다고 밝혔고, 모델이 데스크톱, 모바일, 웹 전반에 제공되므로 개선 효과가 API에만 국한되지 않고 모든 환경에 적용됩니다.

디테일은 모델이 가장 크게 성장할 여지가 있던 부분입니다. 이전 버전은 구도에는 강했지만 미세한 질감을 뭉개고 재질의 디테일을 잃을 수 있었습니다. 2.5는 조명과 재질 렌더링을 개선해 피부, 직물, 금속이 매끄럽게 근사된 느낌이 아니라 실제 재질처럼 보이도록 합니다.

편집 안정성은 실제로 이 도구를 사용하는 사람들이 가장 중요하게 여기는 부분입니다. 이미지 모델에 대한 오랜 불만은 여러 차례 편집하면 결과가 어긋난다는 것이었습니다. 셔츠 색만 바꿨을 뿐인데 갑자기 얼굴이 달라지는 식입니다. 2.5는 특정 변경을 요청했을 때 피사체, 제품 형태, 구도, 전반적인 스타일을 유지하도록 설계되었습니다. 이 하나의 개선이 어떤 지연 시간 수치보다 실무 시간을 더 많이 아껴줍니다.

거친 연필 스케치가 세련된 포토리얼리스틱 이미지로 변환되는 모습

스케치 기능, 숨은 주인공

가장 큰 제품 추가 사항은 스케치 기능입니다. ChatGPT 안에서 직접 대략적인 레이아웃을 그리면 모델이 이를 완성된 이미지로 바꿔줍니다. 그림을 잘 그릴 필요는 없습니다. 상자 몇 개, 막대기 사람, 수평선, 색상 메모 정도면 프롬프트 세 문단으로 설명해야 할 의도를 전달하기에 충분합니다.

이것은 첫 텍스트-이미지 도구부터 존재해 온 공백을 메워줍니다. 프롬프트는 공간적 사고에 약합니다. "제품은 왼쪽에, 헤드라인은 오른쪽 위에, 사람은 아래 1/3 지점에 배치해줘"는 스케치로 10초면 전달할 것을 굉장히 많은 단어로 설명하는 셈입니다. 스케치는 모델에게 스토리보드에 더 가까운 것을 제공하며, 스토리보드는 실제로 시각 작업이 브리핑되는 방식입니다.

서로 다른 작업을 위한 두 가지 API 버전

API 측면에서 OpenAI는 이번 릴리스를 역할이 명확한 두 가지 변형으로 나누었습니다.

GPT-Image-2.5 Flare는 범용 모델입니다. 2.5 시리즈의 속도, 품질, 편집 기능을 그대로 갖추고 있으며, 소셜 미디어 에셋, 제품 프로토타입, 많은 이미지를 빠르게 생성해야 하는 대량 생성 작업을 겨냥했습니다.

GPT-Image-2.5 Sunburst는 정밀 모델입니다. 처리량보다 제어가 더 중요한 광고 스틸컷과 상업용 제품 촬영을 위해 만들어졌습니다. 이미지에 대한 제어력이 더 강하며, 그 대가로 생성 시간이 더 걸립니다.

이러한 구분은 시장이 얼마나 성숙했는지를 보여주는 유용한 신호입니다. 2년 전만 해도 하나의 모델이 모두를 만족시키려 했습니다. 이제 벤더들은 작업 부하에 따라 모델을 세분화합니다. "밈 100개 만들기"와 "캠페인 히어로 이미지 하나 만들기"는 본질적으로 다른 작업이기 때문입니다.

실용적 전환: 생성기가 아니라 편집기로 다루기

이번 업그레이드는 모델을 슬롯머신처럼 다루지 말고 편집기처럼 다루기 시작할 때 가장 유용합니다. 기존 작업 방식은 프롬프트를 작성하고, 이미지 네 장을 뽑아 가장 나은 것을 고르고, 모두 마음에 들지 않으면 더 나은 프롬프트를 작성해 다시 뽑는 것이었습니다. 바로 그 반복이 대부분의 불만이 머무는 지점이었습니다.

2.5의 작업 방식은 다릅니다. 대략적인 아이디어에서 시작해 그럭저럭 쓸 만한 것을 생성한 다음, 일련의 작고 구체적인 편집을 통해 다듬어 나갑니다. 배경을 바꾸고, 조명을 조정하고, 물체 하나를 이동합니다. 이제 편집 시 나머지 이미지가 안정적으로 유지되므로 각 단계가 도박이 아니라 실제 개선이 됩니다.

이때 스케치 기능이 진가를 발휘합니다. 공간 배치가 중요할 때는 서툰 그림이 긴 설명보다 낫습니다. 헤드라인이 들어갈 위치, 제품이 놓일 위치, 사람이 서 있을 위치를 그리세요. 품질은 모델이 채워줍니다. 의도는 사용자가 공급하면 됩니다.

유지할 가치가 있는 습관이 하나 있습니다. 끝났다고 선언하기 전에 세부 사항을 확인하세요. 완벽한 모델은 없으며, 2.5도 여전히 가끔 엉망인 손이나 잘못된 글자를 만들어냅니다. 지금 달라진 점은 오류가 이미지를 포기하고 처음부터 다시 시작할 이유가 아니라 편집을 한 번 더 할 가치가 있을 만큼 드물어졌다는 것입니다. 이것이 어떤 벤치마크보다 "쓸 만하다"는 말의 진짜 의미입니다.

이것이 업계에 미치는 영향

알아둘 만한 맥락은 규모입니다. OpenAI는 ChatGPT Images 제품군과 API가 매주 30억 개 이상의 이미지를 생성한다고 밝혔습니다. 이는 2023년에는 터무니없게 들렸을 숫자이지만, 이제는 그저 기본 수치입니다.

이는 OpenAI가 통합을 감행할 수 있었던 이유도 설명해줍니다. 2.5를 출시한 같은 주에 회사는 ChatGPT 안의 기존 DALL-E GPT를 조용히 단종시키고 모든 사용자를 ChatGPT Images로 안내했습니다. DALL-E라는 이름은 사라졌을지 몰라도, 그 역할은 더 빠르고 선명한 파이프라인에 완전히 흡수되었습니다.

경쟁 구도에서 압박은 구체적입니다. Midjourney는 여전히 순수한 미적 스펙트럼을 장악하고 있으며, 이를 진지하게 반박할 사람은 없습니다. Adobe Firefly는 신중한 기업을 위한 상업적 라이선스 측면을 계속 장악하고 있습니다. Google의 Nano Banana 라인은 네이티브 고해상도와 캐릭터 일관성에서 여전히 우위를 점합니다. ChatGPT Images 2.5는 각자의 강점에서 그들을 이기려 하지 않습니다. 오히려 최고의 기본 도구가 되려 합니다. 충분히 빠르고, 충분히 선명하며, 이제는 편집이 충분히 잘 되어 두 번째 도구를 찾지 않게 만드는 것입니다.

솔직한 결론은 2.5가 혁명이 아니라 반복적 개선이라는 것입니다. 하지만 실무에서 이미지 모델을 쓰기 어렵게 만들었던 바로 그 세 가지를 개선한 반복적 개선입니다. 속도, 디테일, 편집 안정성은 화려하지 않습니다. 그저 사람들이 도구를 포기하게 되는 이유일 뿐입니다. OpenAI는 이번 릴리스를 통해 그 이유들을 하나씩 제거했습니다.

관련 글