리카이푸의 '슈퍼 직원': 01.AI 완짜이, 에이전트를 사무실 자리에 밀어 넣다

국경절 연휴 동안에도 중국 내 여러 모델 기업은 멈추지 않았다. 문샷 AI는 API 백엔드에 kimi-k3-1 등록 표식을 걸었고, 스텝펀은 Step 5 Preview를 공개했으며, 클링은 4.0을 내부 테스트에 들어갔다. 01.AI가 택한 진입점은 달랐다. 파라미터 규모를 겨루는 대신 제품을 곧바로 사무실 안에 넣은 것이다.
10월 초, 리카이푸가 창립한 01.AI는 베이징에서 첫 에이전트 제품 '완짜이'를 발표하고, 동시에 완즈 기업 대형모델 통합 플랫폼 2.0을 선보였다. 공식적으로 완짜이에 붙인 포지션은 '슈퍼 직원'이다. 이 단어는 발표회 현장에서 전파되기 좋았지만, 실제로 말하려는 것은 다른 것이었다. 에이전트가 하드코딩된 절차를 실행하는 단계에서 스스로 실행 계획을 짜는 단계로 나아가게 하는 것이다.
완짜이는 구체적으로 무엇을 하는가
01.AI가 공개한 정보에 따르면 완짜이의 역량은 네 가지로 나뉜다. 복잡한 작업을 깊이 사고하고 계획하는 일, 휴대폰과 네트워크 기기에 연결하는 일, 기업의 기존 서비스 시스템에 접속하는 일, 그리고 구체적인 업무에 맞춰 커스터마이징하는 일이다.
앞의 두 가지는 그것이 '손을 쓸 수 있는지'를, 뒤의 두 가지는 '현장에 안착할 수 있는지'를 결정한다. 기업 구매 시 가장 자주 나오는 두 질문은 마침 뒤쪽에 대응한다. 데이터는 어디에 저장되는가, 결과는 누가 검증하는가. 완짜이가 내놓은 답은 프라이빗 배포 지원과 결과 검증 메커니즘 한 세트다.
표준적인 수순처럼 들리지만, 중국 내 기업 주문에서는 프라이빗화가 가산점이 아니라 거의 진입 장벽이다. 금융, 에너지, 제조 같은 고객은 핵심 프로세스를 남의 클라우드에서만 돌아가는 어시스턴트에 맡기지 않는다. 완즈 플랫폼 2.0이 맡은 역할이 바로 이 토대다. 모델, 지식베이스, 권한, 감사가 모두 고객 자체 환경 안에 있다.

발표 리듬 자체도 문제를 말해준다. 01.AI는 클라우드 체험판을 먼저 내놓고 기업용을 논하지 않았다. 프라이빗화 옵션을 제품과 함께 내놓았다. 이는 '먼저 신규 유입을 늘린 뒤 전환'하는 소비자용 전술을 겨냥한 게 아니라, 첫날부터 기업 구매 체크리스트에 맞춰 만들고 있음을 뜻한다.
반복해서 제기되는 질문
지난 한 해 기업이 에이전트에 대해 가장 많이 불평한 점은 '손을 떼지 못하겠다'였다. 스스로 API를 호출하고 파일을 고칠 수 있는 에이전트는 권한을 조금만 넓게 주면 잘못된 작업 하나를 열 개 시스템에 복제할 수 있다. 9월 말부터 10월 초까지 국내외 움직임은 거의 모두 이 문제를 둘러쌌다. 어떤 벤더는 권한 범위(scope) 정의를, 어떤 벤더는 변조 불가능한 감사 흔적을, 또 어떤 벤더는 밀리초 단위의 서킷브레이커 격리를 만든다.
완짜이가 '결과 검증'을 제품 설명에 넣은 것은 같은 사실을 인정한 셈이다. 능력이 아무리 강해도 '오류가 났을 때 어떻게 할 것인가'에 먼저 답해야 한다. 구매자에게 이 항목의 무게는 종종 리더보드 점수보다 크다. 2위 모델이라도 모든 동작을 추적하고 롤백할 수 있다면, 1위보다 프로덕션 환경에 더 쉽게 들어간다.
실행자에서 의사결정자로
리카이푸는 발표회에서 한 가지 대비를 들었다. 흔한 AI 도구는 정해진 워크플로를 끝까지 돌리는 역할을 맡지만, 완짜이는 기업 지식베이스와 생산 과업을 결합해 실행 방안을 동적으로 생성한다. 그는 이 전환을 '도구 흐름의 실행자'에서 '인간-기계 협업 의사결정자'로 나아가는 것이라고 설명했다.
차이는 실무에서 확대된다. 어시스턴트가 버튼만 누른다면 프로세스 자체를 사람이 먼저 명확히 분해해야 하며, 절약되는 것은 클릭 시간뿐이다. 어떤 시스템을 어떤 순서로 호출하고 어느 지점에서 사람에게 되돌려줄지 스스로 판단할 수 있다면, 절약되는 것은 프로세스를 분해하는 두뇌 노동이다. 후자야말로 '슈퍼 직원'이라는 표현의 가치이며, 이런 제품이 실제 업무 자리에서 받아들여질 수 있는 분수령이다.
기술 경로에서 01.AI는 자체 개발 강화학습과 풀스택 연구개발을 강조하며, 이를 통해 작업 계획 능력을 높인다고 한다. 이런 주장은 따로 검증할 수 없다. 진짜 문제를 설명하는 것은 작업 완료율과 인간 개입 빈도이며, 이 두 가지는 고객 현장에서 돌려봐야만 의미가 있다.
세 단계 계단
리카이푸는 에이전트의 진화를 세 단계로 나눴다. L1은 워크플로 에이전트로, 작업을 사람이 지정하고 자율성은 제한적이다. L2는 추론 에이전트로, 스스로 작업을 계획할 수 있으며, 그는 완짜이가 이 단계에 있다고 본다. L3는 다중 에이전트 협업으로, 여러 에이전트가 탈중앙화 네트워크에서 분업한다.
그가 현재 제품을 L2에 놓은 것은 현실적인 표현이다. 2026년 실제로 끝까지 돌아가는 대다수 기업용 에이전트는 이 단계에 머문다. 계획할 수 있지만 권한 경계가 필요하고 인간의 안전판이 필요하다. 정말 희소한 것은 계획이 틀어진 뒤 그 비용을 누가 부담하느냐다. 발표회는 이 점을 자세히 다루지 않았지만, L2에서 L3로 가는 그 길이 얼마나 걸릴지를 결정한다.
그는 또 완짜이의 능력이 OpenAI가 이전에 공개한 ChatGPT Agent 기술과 같은 수준에 있다고 언급했다. 이 비유는 비전문가의 이해를 돕고, 01.AI가 스스로를 글로벌 에이전트의 동일한 비교 프레임에 놓았음을 의미한다.
결과 지향의 신호
완짜이를 국경절 연휴 며칠간의 움직임 속에 다시 놓고 보면 신호는 비교적 명확하다. 중국산 대형모델은 서비스를 말하는 데서 결과를 말하는 쪽으로 이동하고 있다. Kimi K3.1은 장문을, Step 5 Preview는 효율을, 클링 4.0은 영상을 걸고, 01.AI는 프로세스 자체를 건다. 네 회사는 네 갈래 길을 가지만 가격과 현장 적용 방식은 같은 선 위에서 조여지고 있다. 고객이 직원 한 명을 덜 고용하고 승인 절차 하나를 덜 거치게 만드는 쪽이 갱신 계약을 받는다.
'슈퍼 직원'은 좋은 판매 포인트이자 높은 문턱의 약속이다. 기업이 진짜 사려는 것은 감사하고 책임을 물을 수 있으며 대체할 수 있는 업무 한 단위다. 말을 하는 어시스턴트는 입장권에 불과하다. 완짜이가 약속을 지킬 수 있는지는 자신의 실행 기록을 고객에게 기꺼이 펼쳐 보이느냐에 달려 있다.
관련 글
Agility Digit 5, 단순한 스펙 시트가 아닌 안전성 입증 자료와 함께 출시되다
창고 현장은 실험실이 아니다. 관문은 인증이지 데모가 아니다.
프론티어 에이전트가 연구 워크플로의 30퍼센트를 완료했다. 그 숫자가 핵심이다.
에이전트는 연구를 운영할 수 있다. 절차를 새로 고안하는 일은 아직 요원하다.
Figure AI, 판매할 제품도 없이 35억 달러어치 컴퓨팅을 확보하다
베팅의 핵심은 일반화가 컴퓨팅 문제라는 것이다. 업계는 아직 결론을 내리지 못했다.
OpenAI, 마침내 이미지 API에 투명 배경 추가
파이프라인에서 한 단계를 통째로 없애는 작은 기능.