Aleph Alpha, 유럽의 데이터 경계 안에 780억 파라미터 오픈 웨이트 모델을 세우다

10월 3일, Aleph Alpha는 780억 개 파라미터 규모의 전문가 혼합(MoE) 언어 모델인 Kolibri-1을 공개하고 Apache 2.0 라이선스로 전체 가중치를 Hugging Face에 게시했다. 이 독일 기업은 이 모델을 독일어와 영어에 맞춰 조정했고, 명시적인 추론 모드와 도구 호출 기능을 부여했으며, 자사 업무를 미국 하이퍼스케일러를 통해 처리할 수 없거나 처리하지 않으려는 공공 부문 및 규제 업종 구매자를 겨냥해 마케팅하고 있다.
기술적 수치는 쉬운 부분이다. 100만 토큰 컨텍스트 윈도, 파라미터 수가 시사하는 것보다 추론 비용을 낮게 유지해 주는 전문가 혼합 구조, 그리고 작업에 필요할 때 켤 수 있는 별도의 추론 모드가 그것이다. 2026년 말 기준으로 최전선에 근접한 모델이라면 갖춰야 할 기본 조건에 불과하다. Kolibri-1을 두 번 보게 만드는 것은 바로 이 프레이밍이다.
제품은 주권이지 라이선스가 아니다
이제 누구나 오픈 웨이트를 내려받을 수 있다. Llama 파생 모델, Qwen 파생 모델, DeepSeek 파생 모델, Mistral 파생 모델. 더미는 두텁고 매주 커지고 있다. Aleph Alpha는 순수한 성능으로 경쟁할 생각이 없으며, 그 점을 스스로도 아는 듯하다. 이 회사는 같은 아이디어에 규정 준수 이야기를 붙인 버전을 판다. 이 모델은 유럽에서, 유럽 언어를 위해, 유럽 규칙에 따라 만들어졌고, 자체 인프라 안에서 돌릴 수 있다는 것이다.
독일의 정부 부처, 병원 네트워크, 또는 엄격한 데이터 상주 의무를 지닌 은행에게 이 프레이밍은 설득력이 있다. 대안은 트래픽이 대양을 건너고 서비스 약관이 제품 발표 한 번으로 바뀔 수 있는 미국 API다. 대안은 또한 중국의 오픈 웨이트 모델인데, 이는 유럽의 공공 구매자에게 그 나름의 조달 문제를 안긴다.
여기에는 실재하는 시장이 있고, 그 시장은 세계에서 가장 뛰어난 모델에 보상을 주지 않는다. 구매자가 사용을 허용받은 최선의 모델에 보상을 준다.
컨텍스트 윈도는 대화가 아니라 문서를 겨냥한다
100만 토큰을 광고한다는 건 다소 묘한 일이다. 대부분의 대화는 그 근처에도 가지 않는다. 이것을 신경 쓰는 구매자는 법률 아카이브, 조달 기록, 내부 정책 매뉴얼, 수십 년치 규제 제출 문서를 시스템에 집어넣고, 컨텍스트의 절반을 흘려버리는 검색 단계 없이 그 전체를 가로질러 추론해 달라고 요청하는 이들이다.

Aleph Alpha는 긴 윈도에 답변 보류(abstention) 학습을 결합했는데, 이것이야말로 간과되기 쉽지만 시스템의 실사용 가능성을 좌우하는 부분이다. “이 질문에 답하기에 충분한 정보가 없다”고 말하는 모델은 출처를 지어내는 모델보다 준법 담당자에게 더 가치 있다. 규제 업무에서는 자신 있게 내놓은 오답이 무응답보다 나쁘다. 누군가 그것이 틀렸음을 증명하는 데 일주일을 써야 하기 때문이다.
오픈 웨이트 더미는 점점 붐비고 전문화되고 있다
Kolibri-1은 혼자 등장하지 않았다. 10월 초에는 각기 다른 틈새를 차지하겠다고 나선 오픈 웨이트 모델들이 잇달아 공개됐다. Cloudflare의 Workers AI 플랫폼을 통해 공적 자금으로 개발된 유럽 모델 두 개가 상용화됐다. EU의 24개 공식 언어를 모두 지원하는 EuroLLM과, 1,500개 이상의 언어로 학습되고 데이터의 40퍼센트가 영어 이외 언어인 스위스 모델 Apertus가 그것이다. Cloudflare는 또한 더 좁은 용도를 겨냥한 270억 파라미터 Apache 2.0 모델 Clef도 내놓았다.
함께 놓고 보면 패턴은 ‘자기 차선 정하기’다. 이 그룹의 어느 누구도 일반 추론에서 가장 큰 폐쇄형 모델을 이기려 하지 않는다. 오픈 진영에서는 그 경쟁이 이미 끝났고 모두가 그것을 알기 때문이다. 그들이 노리는 것은 특정한 제약을 가진 구매자다. 거대 모델이 서툴게 다루는 언어, 데이터 흐름을 규제하는 관할권, 더 작은 특화 모델이 더 저렴하게 돌아가는 작업이 그것이다.
이는 모든 릴리스가 최전선에 대한 정면 공격인 시장보다 건강한 시장이다. 유럽의 정부 부처가 독일어 장문 컨텍스트 작업에는 Kolibri-1을, 희귀 언어에는 Apertus를, 연합 전체의 번역에는 EuroLLM을 골라, 어떤 단일 미국 벤더도 제공하지 못하는 스택을 조립할 수 있다는 뜻이다. 오픈 웨이트 생태계는 값싼 대체재에서 벗어나 하나의 메뉴가 되기 시작한다.
같은 논리는 라이선스에도 적용된다. 상업적 도입을 원하는 모델에게 Apache 2.0과 MIT가 기본값이 되어가고 있다. 더 엄격한 조건은 파일럿 자체를 죽이는 법률 검토를 불러오기 때문이다. Aleph Alpha는 의도적으로 허용적 경로를 택했고, 상하이 AI 연구소도 최근 자체 릴리스에서 같은 선택을 했다. 이제 라이선스는 제품 제안의 일부다.
오픈 웨이트가 실제로 바꾸는 것
Apache 2.0은 법적 마찰의 대부분을 없앤다. 기업은 내부 데이터로 Kolibri-1을 파인튜닝하고, 자체 하드웨어에 배포하고, 라이선스 비용을 내거나 허가를 구하지 않고도 그 결과를 제품에 담아 출시할 수 있다. 감사할 수 없는 유능한 폐쇄형 API와 출시할 수 없는 약한 오픈 모델 사이에서 발이 묶여 있던 팀에게 이것은 새로운 문이다.
이는 또한 다른 모든 이의 최저 기준을 끌어올린다. 100만 토큰 컨텍스트를 갖춘 780억 파라미터 오픈 웨이트 시스템이 허용적 라이선스로 존재하는 순간, 다음 소버린 모델은 그 기준을 넘어서거나 넘어서지 못하는 이유를 설명해야 한다. 프랑스, 한국, 일본, 걸프 지역의 국립 연구소들도 모두 비슷한 움직임을 보여왔다. Kolibri-1이 그 경쟁을 끝내지는 않지만, 유럽 구간의 속도를 정한다.
아마 부족할 지점
이 규모의 오픈 웨이트는 돌리기 어렵다. FP8 또는 전체 정밀도 변형을 갖춘 780억 파라미터 전문가 혼합 모델은 상당한 하드웨어를 요구하며, “직접 호스팅할 수 있다”는 말은 이미 하드웨어를 보유했거나 구매 예산이 있는 조직에만 해당한다. 개인 개발자에게 Kolibri-1은 연구용 대상이지 매일 쓰는 도구가 아니다.
기업이 보고하는 모든 벤치마크에 따라붙는 정직성 문제도 있다. 모델 카드는 좋은 결과를 주장한다. 독립적인 평가에는 몇 주가 걸리며, 그것이 나오기 전까지 Llama급이나 Qwen급 모델과의 비교는 측정된 사실이 아니라 제조사의 주장일 뿐이다. 흥미로운 질문은 Kolibri-1이 가장 큰 폐쇄형 모델을 이기느냐가 아니다. 거의 확실히 이기지 못한다. 질문은 유럽 구매자가 이미 내려받을 수 있었던 오픈 웨이트 모델들을 이기느냐, 그리고 어느 정도 규모의 지출로 그렇게 할 수 있느냐다.
논리의 형태 자체가 이야기다
마케팅을 걷어내면 Kolibri-1은 AI 조달의 미래가 국경을 따라 갈라질 것이라는 베팅이다. 한 진영은 사용 가능한 가장 똑똑한 모델을 원하고 그에 따르는 의존성을 감수한다. 다른 진영은 업무를 수행할 만큼 충분히 좋으면서 완전히 자기 통제 아래 있는 모델을 원한다. Aleph Alpha는 두 번째 진영을 위해 만들었고, 두 번째 진영에 맞춰 모델 크기를 정했으며, 라이선스 가격도 그에 맞춰 책정했다.
그 베팅이 성공할지는 알 수 없다. 하지만 한 기업이 자금을 조달하고, 780억 파라미터 모델을 학습시키고, 소버린 구매자를 확보하기 위해 Apache 2.0으로 그것을 무료로 배포할 수 있다는 사실은 시장의 적어도 일부가 어디로 향하는지 말해준다. 성능은 더 이상 유일한 축이 아니다. 통제는 판매할 수 있는 기능이 되고 있다.
더 어려운 질문은 모든 지역이 자기만의 버전을 갖게 되면 무슨 일이 일어나느냐다. 파편화에는 비용이 따른다. 독일어와 영어에 맞춰 조정된 단일 가중치 세트는 한국의 병원 시스템이나 브라질의 은행에는 쓸모가 없고, 그런 구매자들은 각자 자기 규칙에 맞춰 만든 자기 모델을 원할 것이다. 이는 유지해야 할 소버린 스택이 더 많아지고, 중복 작업이 늘어나며, 하나의 생태계가 지배하던 시절 모두에게 이로웠던 공통 개선에 도달하는 길이 느려진다는 뜻이다.
Aleph Alpha의 답은 이번 릴리스에 암시되어 있다. 모든 사람을 상대하겠다는 야심은 없다. 통제가 편의보다 중요하다고 이미 결론 내린 구매자를 상대하며, 그런 구매자는 회사 하나를 먹여 살릴 만큼 충분히 많다. 그것이 지속 가능한 사업인지, 규제 분위기에 잘 맞춘 시의적절한 베팅인지는 향후 2년이 답할 질문이다. 어느 쪽이든 이 모델은 이제 존재하고 무료로 내려받을 수 있으며, 이는 허가를 기다리던 모든 이의 계산법을 바꾼다.
관련 글
워터마크는 가짜를 따라가지 못하고 있다
시스템은 작동한다. 커버리지는 그렇지 않다. 격차는 시청자가 가정하는 무엇으로 채워지고 있다.
이제 AI 에이전트가 고객 지원에 전화를 걸고, 기업은 응답해야 한다
승인되지 않은 요청에 완벽한 목소리는 검증된 요청에 어설픈 목소리보다 나쁘다.
레딧, 마지막 열린 문을 닫으며 스크래퍼 탓으로 돌리다
레딧이 라이선스를 부여하지 않은 스크래퍼는 악용이다. 레딧이 라이선스를 부여한 스크래퍼는 매출이다.
영란은행, AI 부채를 금융 안정성 위험으로 공식 인식
유보 이익으로 자금을 조달한 붐은 비공개로 해소될 수 있다. 이번 붐은 4,500억 달러의 신규 부채로 굴러간다.