누가 실제로 사용하는가: 중국 모델이 해외 이미지·영상 생성 사용량의 절반 이상을 차지했다

8월 24일부터 10월 5일까지 Overchat AI는 109만 명의 사용자와 3,160만 건의 모델 상호작용을 기록했다. 이 익명 통계를 펼쳐 보면 가장 눈에 띄는 것은 누군가 특정 리더보드에서 1점 더 높았는지가 아니라, 사람들이 실제로 손을 움직일 때 누구에게 표를 던졌는가이다. 이미지 생성과 영상 생성이라는 가장 많은 연산력을 요구하고 가장 비용이 많이 드는 두 작업에서 절반 이상이 중국 모델에 의해 수행되었다.
이것은 평가 점수가 아니라 사용량이다. 점수는 한 번의 확대된 테스트로 올릴 수 있지만, 사용량은 연달아 이어지는 반복 클릭으로만 쌓을 수 있다.
먼저 이 데이터의 기준을 분명히 해 두자. 시장 전수 조사로 오해하지 않도록. 이는 여러 모델을 같은 미니프로그램에 넣은 플랫폼에서 나온 것으로, 8월 24일부터 10월 5일 사이 109만 명의 사용자가 120만 개 세션에서 만든 3,160만 건의 상호작용을 집계한 것이다. 점유율 계산 방식은 “각 사용자가 특정 모델을 한 번 사용하면 한 번으로 센다”이며, 호출마다 누적하는 방식이 아니다. 표본은 여러 모델을 동시에 시도하려는 사용자에게 자연스럽게 치우쳐 있으므로, 이것은 “누가 반복적으로 열리는가”에 대한 스냅샷에 가깝고 업계 전체의 매출 청구서는 아니다. 하지만 모든 모델이 같은 진입점에 놓여 같은 사람들을 상대하기 때문에, 이런 비교는 각 제조사가 따로 발표한 벤치마크보다 오히려 더 설득력이 있다.
텍스트는 여전히 미국, 이미지는 주도권이 바뀌는 중
변하지 않은 부분부터 보자. 텍스트 상호작용에서 Gemini, GPT, Claude, Grok을 합치면 86.2%를 차지하며, 미국 제조사는 이 영역에서 거의 상대가 없다. 변한 것은 이미지다. 중국 모델의 이미지 생성 점유율은 이전 기간 54.0%에서 59.5%로 올랐고, 영상 생성은 43.5%에서 53.6%로 상승했다. 같은 기간 중국 모델은 전체 상호작용에서 36.9%를 차지했다.
구체적인 모델 패밀리로 확대해 보면 분업이 더 선명하다. 이미지 쪽에서는 바이트의 Seedream이 33.5%로 1위를 굳건히 지켰고, 구글의 Nano Banana가 26.1%, 알리의 Qwen Image가 26.0%로, 후자는 이전 기간 12.3%의 거의 두 배다. 영상 쪽에서는 xAI의 Grok Imagine이 여전히 단일 제품 1위(30.6%, 다만 이전 기간 39.6%에서 하락)이며, 바이트의 Seedance가 10.8%에서 25.2%로 치고 올라왔고, Kling은 21.9%를 지켰다.
정말 멈춰서 볼 만한 것은 2주 구간이다. 9월 22일부터 10월 5일까지 Qwen Image는 전체 카테고리 사용량에서 가장 높은 모델 패밀리가 되었으며, 17.2%로 GPT 텍스트의 10.9%와 Gemini의 10.8%를 앞질렀다. 오픈 소스 가중치에서 출발해 이미지 편집에 강점을 가진 패밀리가, 여러 모델을 모은 진입점에서 모든 텍스트 모델보다 더 많이 클릭되었다.

저렴함이 사용을 뜻하지 않는다, Qwen 수치가 말하는 다른 것
가장 쉽게 나오는 설명은 가격이다. Overchat AI는 특별히 한 가지를 덧붙였다. Qwen Image와 GPT Image 2.5는 해당 플랫폼에서 단가가 같고 둘 다 무료 요금제에 포함된다. 가격은 같은데 사용량은 약 네 배 차이가 났다. 따라서 여기서 작용하는 것은 누가 더 저렴한가가 아니라 다른 것이다. 이미지 출력의 가용률, 편집 시 원본을 얼마나 보존하는지, 그리고 사용자가 처음 시도한 뒤 두 번째 시도도 할 의향이 있는지다.
이를 뒷받침하는 한 가지 데이터가 이런 점착성을 잘 설명한다. 신규 사용자의 모델 선택에서 OpenAI와 Anthropic은 합쳐 23.8%를 차지했지만, 재방문 사용자에게서는 이 수치가 19.8%로 떨어졌다. 동시에 구글은 20.9%에서 28.0%로, 중국 제조사는 36.3%에서 39.8%로 올랐다. 첫 선택은 친숙함에 기대고, 이후에는 실제 경험에 기댄다. 사람들은 바꾸며, 그 방향은 이미지 능력 쪽으로 향한다.
사용법도 변하고, 기기(디바이스)도 변한다
지역 차이는 생각보다 크다. 일본은 AI 사용량의 74.4%가 Gemini에서 나와 거의 독점에 가깝다. 스페인과 인도네시아는 분명히 Qwen Image 쪽으로 기운다. 미국은 예외다. 비디오 생성을 첫 번째 카테고리로 삼는 유일한 주요 시장이며 36.8%를 차지한다. 브라질은 텍스트에 가장 치우쳐 49.3%다.
모바일은 세션의 약 74%를 차지했고, 텍스트, 이미지, 비디오가 거의 3등분되어 각각 약 33%를 차지했다. 데스크톱은 텍스트에 뚜렷이 치우쳐 51.3%였고, 주도 패밀리는 GPT, Gemini, Claude였다. 이 대비는 한 가지를 드러낸다. 이미지와 비디오 생성이 “생각나면 바로 하는” 일이 되고 있으며, 사용자는 컴퓨터 앞에 모아 두고 진지하게 하기보다 휴대폰에서 떠오르면 바로 시도한다. 모바일에서 선호되는 패밀리도 이를 뒷받침한다. Seedream, Grok Imagine, Seedance.
사용량을 제품 품질로 착각하지 말 것
절제가 필요한 지점도 분명하다. 이것은 단일 플랫폼의 표본이고, 사용자 구조는 새 모델을 시도하려는 사람들에게 치우쳐 있어 전체 시장으로 바로 외삽할 수 없다. 사용량이 높다는 것은 반복적으로 열린다는 뜻일 뿐, 모든 이미지가 더 낫다는 뜻은 아니다. Seedance의 비용은 Grok Imagine 1.5의 약 세 배지만, 여전히 점유율이 세 배 넘게 올랐다. 이는 사용자가 신경 쓰는 것이 결코 가격만이 아님을 보여준다.
하지만 이 표본을 다른 신호와 함께 놓으면 방향은 흐릿하지 않다. 같은 기간에 알리는 Qwen-Image의 가중치를 공개했고(라이선스는 연구용으로만 바뀌었지만), 바이트는 Seedance에 먼저 480P 초안을 내고 만족하면 완성본을 내는 모드를 도입했으며, 생수과기는 플래그십 비디오 모델의 첫 출시 가격을 초당 0.09위안까지 낮췄다. 이런 움직임은 모두 같은 목표를 향한다. “여러 번 시도하기”를 감당할 수 있게 만드는 것.
범위를 조금 더 넓히면, 이 데이터는 더 거시적인 일도 설명해 준다. 텍스트→비디오와 텍스트→이미지의 채택이 전문 스튜디오에서 일반인 손으로 내려오고 있다. 모바일이 세션의 70% 이상을 차지하고 세 가지 콘텐츠가 거의 균등하게 나뉜다는 것은 대부분의 사람이 워크플로를 짜는 것이 아니라 즉흥적으로 시도한다는 뜻이다. 이 집단은 최전선 모델의 벤치마크 상한을 결정하지는 못하지만, 모델이 얼마나 자주 사용되고 얼마나 많은 사람에게 추천되는지는 결정한다. “한 번 시도하면 쓸 만한 결과가 나온다”는 점에서 더 안정적으로 해내는 쪽이 휴대폰 첫 화면에 남기 쉬워진다.
이미지와 비디오의 경쟁에서 마지막에 겨루는 것은 단일 결과물의 상한이 아니라, 같은 예산으로 얼마나 많이 시도하고, 얼마나 많이 수정하고, 그리고 얼마나 많이 남길 의향이 있는가다. 사용량 데이터는 이 소박한 이치를 3천만 번의 클릭으로 써 내려간 것일 뿐이다.
관련 글
Decagon의 PACT 프로토콜, '동의'를 표준으로 만들려 한다
Decagon은 개인 에이전트의 신원과 고객이 부여한 권한을 검증하는 프로토콜을 오픈소스로 공개했다. 지루한 배관이지만, 에이전트 경제가 작동할지를 결정한다.
AI '재회' 물결: 중국이 아직 어떻게 느껴야 할지 정하지 못한 논쟁
AI 추모 영상이 세상을 떠난 공인을 중국의 화면으로 데려와 수십만 개의 좋아요를 모았다. 그리고 반발이 왔다. 쟁점은 '동의'였다.
애플이 오픈 멀티모달 모델을 공개했지만 거의 아무에게도 알리지 않았다
연구 우선의 이번 릴리스는 주류 시야를 조용히 지나갔다. 그러나 세밀한 시각 그라운딩은 애플의 AI 스택이 어디로 가는지 말해 준다.
OpenCut과 '오픈소스 CapCut'의 순간
무료 MIT 라이선스 영상 편집기가 GitHub 트렌드를 계속 오르고, 로드맵에는 AI 에이전트용 MCP 서버가 들어 있다. AI 미디어를 둘러싼 도구가 모델을 따라잡고 있다.