메타, Vibes를 독립형 앱으로 출시하다 — 피드는 전부 AI

메타는 9월 27일 Vibes를 별도 앱으로 전환했는데, 그 콘셉트는 특이해서 풀어 설명할 가치가 있다. 아무것도 촬영되지 않은 숏폼 피드다. 사용자가 프롬프트를 입력하면 세로형 클립을 받고, 생성된 영상으로만 구성된 스트림을 스크롤한다. 회사는 이 앱을 북미, 호주, 뉴질랜드, 영국, 유럽 일부에 “early preview”라는 라벨로 출시했는데, 이는 일부러 미완성 상태로 내놓는다는 기업식 표현이다.
Vibes는 2025년 9월 Meta AI 앱 내부의 버튼으로 시작했다. TechCrunch는 2월에 메타가 강한 초기 반응을 얻었다며 브라질과 멕시코에서 독립형 버전을 이미 테스트 중이라고 보도했다. 9월 출시는 그 테스트를 확장한 것이다. 피드를 메인 앱에서 분리하면 메타가 어시스턴트를 끌고 다니지 않고도 계속 개선할 수 있고, AI 영상을 기능이 아니라 제품 라인으로 다룰 수 있다.
앱이 실제로 하는 일
Vibes 안에서는 네 가지 일이 일어나며, 첫 번째만 생성에 관한 것이다.
텍스트-투-비디오가 진입점이다. 사용자가 고양이가 반죽을 치대는 모습이나 사이버펑크 정거장에서 춤추는 우주비행사 같은 걸 쓰면, 앱이 이미지와 사운드가 있는 짧은 클립을 돌려준다. 기존 자산에서 생성하는 것이 두 번째 문이다. 사진이나 클립을 업로드하면 앱이 이를 애니메이션화하거나, 스타일을 바꾸거나, 장면을 재구성한다. 메타는 이 처리 대부분이 기기에서 이뤄진다고 밝혔으며, 이를 클라우드 전용 파이프라인보다 속도와 개인정보 보호 측면에서 유리하다고 본다.
리믹싱은 메타가 실제로 홍보하는 기능이다. 대부분 플랫폼이 쓰는 듀엣 형식 대신, Vibes는 사용자가 피드에서 클립을 꺼내고, Instagram의 일부 콘텐츠까지 포함해, 모델이 이를 재해석하게 한다. 캐릭터가 바뀌고, 환경이 달라지고, 색감이 이동한다. 원본의 구조는 살아남는다.
다음은 배포다. 완성된 클립은 Vibes 피드로 가거나, 다이렉트 메시지로 들어가거나, Instagram과 Facebook 스토리 및 릴스로 나갈 수 있다. Instagram에는 이미 다시 들어오는 경로가 있다. Instagram에서 본 Meta AI 영상을 탭하면 앱에서 리믹스할 수 있다. 이 루프가 주목할 만한 부분인데, AI 전용 피드를 수억 명이 이미 촬영 영상을 게시하는 표면으로 보내는 공급원으로 만들기 때문이다.

편집 도구도 앱과 함께 성장했다. 현재 버전은 재사용 가능한 AI 캐릭터, 말하는 인물의 립싱크, 더 긴 프로젝트를 위한 타임라인 편집기를 추가했다. 생성된 음악을 포함한 음악과 오버레이, 필터도 있다.
뒤에 있는 모델들
출시 당시 메타의 최고 AI 책임자 알렉상드르 왕은 초기 버전이 Midjourney와 Black Forest Labs와의 파트너십에 기대고 있었고 메타는 자체 모델을 개발 중이라고 말했다. Social Media Today는 같은 뉴스 주기에서 Midjourney 파트너십을 보도했다. 따라서 제품으로서의 Vibes는 외부 이미지 모델과 메타 자체 비디오 엔진의 혼합 위에 서 있으며, 언어 계층은 Llama 모델이 처리한다. 이러한 구성은 피드 품질을 논할 때 기억할 가치가 있다. 단일 벤더 스택이 아니기 때문이다.
부분 유료화, 그리고 AI 슬롭 문제
메타는 Vibes를 부분 유료 모델로 운영한다. 기본 접근은 무료로 유지되고, 유료 등급은 월 생성 한도를 높여준다. 구독은 Facebook, Instagram, WhatsApp 전반에서 검토 중이며 Vibes가 중심 역할을 한다. 익숙한 형태다. 발견은 무료로 주고, 헤비 크리에이터에게는 비용을 받는다.
명백한 위험은 비평가들이 AI 슬롭이라고 부르는 것이다. 생성된 영상으로만 만들어진 피드는 이를 고정해 줄 실제 영상의 바닥이 없고, 품질은 따라오지 않은 채 양만 늘어날 수 있다. 생성형 콘텐츠를 물폭포처럼 쏟아낸 모든 플랫폼이 이 문제를 겪었다. 지금까지 메타의 답은 라벨링이다. C2PA와 IPTC 메타데이터에 자기 공개를 더한 메타의 공개 체계는 릴스로 이어진다. 정책 담당자들이 묻는 것은, 클립이 실제 인물이나 사건을 닮았을 때 Vibes의 출처 태그가 유럽 규칙이 최초 노출 시 요구하는 가시적 라벨로 인정되느냐이다. 다른 사람의 생성물을 리믹스해도 그 결과가 이 의무에서 면제되지는 않는다.
재미있는 부분 안에는 권리 문제가 접혀 있다. 리믹스는 업스트림 프롬프트, 업스트림 초상, 업스트림 음악 베드의 다운스트림이다. 그 출력을 독자적인 브랜드 작업으로 취급하는 것은 엉망이고, 메타 내부에서 레이어링된 음악은 메타를 떠나는 파일과 함께 이동하지 않는다. 클라이언트나 실제 얼굴이 들어간 작업이라면, 보유한 자산에서 시작하는 것이 유일하게 깨끗한 경로다.
다른 도구들과 비교한 위치
Vibes는 빈 들판에 들어가는 게 아니다. 계속 나오는 비교는 Sora다. Sora는 더 높은 품질의 생성과 최대 60초의 더 긴 클립을 제공하지만, 구독 비용과 더 느린 생성이라는 대가가 따른다. Runway는 일관된 캐릭터와 샷 간 장면 일관성을 갖춘 전문가용 끝에 있으며 클립당 약 16초를 제공한다. Pika는 스타일 중심 쪽을 담당한다. Vibes는 그 어느 가격대에도 위치하지 않는다. 진짜로 생성 자체를 파는 게 아니기 때문이다. 발견을 팔고, 생성은 덤으로 붙인다.
이 구분은 앱이 무엇에 강한지를 이해하는 데 중요하다. 잘 다듬어진 30초 광고 하나가 필요한 크리에이터에게 Vibes는 맞는 도구가 아니다. 알고리즘이 누가 볼지 결정하는 피드에 하루 세 개의 클립을 게시하고 싶은 사람이라면 바로 이 영역이다. 클립당 15초 상한은 이 점을 더 강화한다. Vibes는 양과 속도를 위해 만들어졌지, 누군가 다시 찾을 작품을 위해 만들어진 게 아니다.
초기 사용자 보고도 이를 뒷받침한다. 한 직접 작성 글은 세 장의 제품 이미지와 슬라이드 덱을 앱에 넣어 약 2분 만에 10초 제품 장면을 생성하고, 그다음 360도 회전을 요청했더니 수동 3D 렌더보다 더 사실적으로 보였으며, 마지막으로 두 클립을 하나의 광고로 붙였다고 설명했다. 같은 사용자는 다운로드에 AI 워터마크가 없다고 언급했는데, 이를 앱의 장점으로 계산했고 다른 사람들은 단점으로 계산할 것이다. 메타의 공개 체계는 파일에 눈에 보이는 표시와 같은 것이 아니다.
유럽 출시가 더 어려운 시험이다
메타는 Vibes를 유럽 일부로 가져갔는데, 이는 미국 출시보다 더 까다로운 환경이다. EU의 AI 투명성 규칙은 더 엄격하고, 실무 요건은 실제 인물, 장소, 사건을 닮은 콘텐츠가 파일 내부 메타데이터만이 아니라 최초 노출 시 가시적 라벨을 달아야 한다는 것이다. C2PA 출처 태그는 클립과 함께 이동할 수 있지만, 시청자는 자신이 보는 것이 생성된 것임을 여전히 알지 못할 수 있다. 화면 위 라벨이 실제로 일을 하는 부분이고, 플랫폼에 맡기기 쉬운 부분이기도 하다.
리믹스 기능은 라벨링 문제를 더 날카롭게 만든다. 클립이 생성되고, 리믹스되고, 릴스로 교차 게시되면 출처의 사슬은 여러 세대를 거치며, 게시자는 원본의 출처를 모를 수 있다. 업로드당 하나의 깨끗한 출처를 가정하는 공개 체계는 여러 출처의 스택을 처리해야 한다. 메타는 이를 어떻게 해결하는지 공개하지 않았고, 이런 세부 사항은 민원이 들어오기 전보다 들어온 뒤에 정리되는 경향이 있다.
이번 출시가 시사하는 것
Vibes는 릴스를 대체하려는 게 아니고, 메타도 그렇게 약속하지 않았다. 그것이 하는 일은 AI 네이티브 영상에 전용 방과 메인 플랫폼으로 들어가는 문을 주는 것이다. 이 형식이 자리 잡는다면, 흥미로운 교훈은 메타가 또 하나의 모델을 만들었다는 게 아닐 것이다. 생성보다 배포가 더 중요했다는 것이 교훈일 것이다. 생성은 일부 사들였기 때문이다.
반론은 합성 영상의 폐쇄된 피드가 습관을 만들기에는 좁은 장소라는 점이다. TikTok의 흡인력은 알고리즘이 예측할 수 없었던 일을 하는 실제 사람들에게서 나온다. 모델이 상상한 것만 담을 수 있는 피드는 같은 관심을 얻기 위해 더 열심히 일해야 한다. Vibes가 그 기준을 넘는지는 열린 질문이며, 얼리 프리뷰라는 라벨은 메타도 확신하지 못한다는 것을 시사한다.
관련 글
바퀴 달린 세미휴머노이드, 도움 없이 한 시간 동안 세탁 마쳐
개별 작업은 성공해도 워크플로는 여전히 실패할 수 있다. Dyna는 측정 지표를 바꿨다.
LTX 2.5, 투박한 블렌더 초안을 완성된 샷으로 렌더링하려 한다
텍스트-투-비디오에서는 무슨 일이 일어날지 통제할 수 없다. 이것이 그 문제를 해결하려 한다.
ServiceNow, 에이전트 실패를 학습 데이터로 전환하다
검증 없는 생성은 잡음이다. 게이트가 제품이다.
언어와 비전을 위한 단일 프레임워크: Horizon의 16억 파라미터 오픈 모델
언어와 비전 사이의 다리는 애초에 필요하지 않았다는 내기.