중국 AI 연구소들의 오픈 웨이트, 네 가지 전략으로 분화

칼럼 개요
7월 25일, 엔비디아 CEO 젠슨 황은 X(구 트위터)에 첫 게시물을 올리며 이례적인 행보를 보였다. 메타, 마이크로소프트, 허깅페이스 등이 공동 서명한 성명에 자신의 이름을 올린 것이다. 이 서한은 오픈 웨이트 모델이 AI 생태계에서 열등하거나 뒤처지는 tiers가 아닌, 폐쇄형 프론티어 시스템과 함께 영속적인 존재로서 자리 잡아야 한다고 주장했다. 이는 특정 제품의 발표보다는 원칙에 기반한 선언에 가까웠다. 그러나 그 타이밍은 특이한 공명을 일으켰다. 해당 서한이 나온 양쪽 며칠 사이에, 중국의 4개 AI 연구소가 각각의 릴리즈를 내놓았기 때문이다. 이를 종합하면 서한의 추상적인 주장을 구체화하면서도 동시에 복잡하게 만든다. 문샷 AI, 딥시크, 알리바바, 미니맥스는 모두 현재 오픈 웨이트를 출시하고 있지만, 그들은 동일한 이유로, 동일한 방식으로 그것을 수행하지는 않는다. "오픈 웨이트"는 이러한 기업들이 수렴한 단일 전략이 아니다. 그것은 네 개의 서로 다른 기업이 네 가지 다른 도박(bet)을 담고 있는 라벨이다.
조용히 말해야 할 부분을 loud하게 밝힌 서한
황의 서한이 주목받은 이유는 주장 자체 때문이 아니다. 많은 연구자들이 오픈 웨이트가 하류 연구를 가속화하고 소규모 개발자에게 프론티어급 기술을 기반으로 구축할 공정한 기회를 제공한다고 이미 주장해 왔다. 중요한 것은 누가, 언제 서명했는가였다. 하드웨어 회사, 파운데이션 모델 연구소, 클라우드 플랫폼, 오픈 모델 호스팅 허브가 공개적으로 오픈 웨이트가 임시방편이 아니라 지속 가능한 카테고리라고 동의했다는 점은, 오픈 모델 주변 상업 생태계(칩, 호스팅, 파인튜닝 서비스, 엔터프라이즈 배포)가 서면으로 방어할 만큼 충분히 성숙했다는 신호다. 바로 그 생태계가 지난 몇 달간 중국 연구소들이 가장 활발했던 곳이며, 이것이 그들의 거의 동시적인 릴리즈들을 고립된 뉴스 아이템으로 보기보다 나란히 읽어야 하는 이유다.
문샷의 도박: 더 큰 것이 핵심이다
문샷 AI는 "오픈 웨이트"가 마케팅 및 기술적 주장으로 의미할 수 있는 바를 가장 직설적으로 표현해 왔다. 7월 19일 2.8조 파라미터와 백만 토큰 규모의 메모리를 갖춘 Kimi K3의 프리뷰 버전을 출시한 데 이어, 7월 28일에는 지금까지 출시된 최대 규모의 오픈 웨이트 모델로 전체 릴리즈를 진행했다. 이는 상위 미국 폐쇄형 시스템들과 성능 면에서 경쟁할 수 있도록 포지셔닝되었다. 벤치마크가 독립적으로 재현될 때 "최대 규모"라는 주장이 타당성을 유지할지는 알 수 없지만, 전략적 논리는 그 자체로 명확하다. 문샷은 원본 스케일을 오픈 웨이트의 신뢰성 형태로 간주한다. 만약 모델을 무료로 준다면, 누구나 오픈 티어를 정품의 할인판으로 치부하지 않을 만큼 충분히 큰 것을 주는 것이다. 이는 스케일 자체가 헤드라인이며, 그 헤드라인이 지금 문샷에게 더 가볍고 효율적인 모델보다 더 큰 가치를 지닌다는 도박이다.
딥시크의 이원화 전략: 가중치는 공개하되, 가격은 낮추다
딥시크는 다른 실험을 진행하고 있으며, 이는 한 가지가 아닌 두 가지 움직이는 부분으로 구성되어 있다는 점이 중요하다. 4월,该公司는 백만 토큰 컨텍스트를 가진 1조 파라미터 모델인 DeepSeek V4의 오픈 프리뷰를 출시했다. 이는 문샷의 릴리즈와 같은 스케일 논의권에 속한다. 하지만 한 달 후, 딥시크는 오픈 웨이트와 무관한 일을 했다. 그것은 플래그십 V4-Pro API 가격에 75% 할인을 한정 기간 프로모션이 아닌 영구적인 것으로 만들었다. 이는 사실상 시장에서 가장 저렴한 프론티어급 API가 됨을 의미한다. 이 두 움직임을 결합하면 딥시크의 전략이 단일한 것이 아닌 이원화되어 있음을 알 수 있다. 오픈 웨이트는 모델을 자체 호스팅하거나 파인튜닝, 감사하고자 하는 고객을 위한 것이고, 공격적인 API 가격은 그러한 오버헤드 없이 추론만 원하는 훨씬 더 큰 고객을 위한 것이다. 딥시크는 "오픈"과 "저렴함"을 경쟁하는 정체성 사이에서 선택하지 않는다. 대신 각자를 사용하여 서로 다른 고객층에 도달하며, 그 중 한 쪽은 다른 쪽으로는 충족되지 않았을 고객을 대상으로 한다.
알리바바의 포트폴리오 접근법: 하나의 플래그십, 하나의 전문가
알리바바의 Qwen 팀은 또 다른 경로를 취했다. 오픈 웨이트를 단일 플래그십 도박으로 보기보다 의도적으로 채워나갈 포트폴리오로 취급한다. 프로그래밍 작업을 위해 특별히 출시된 4800억 파라미터 모델 Qwen3-Coder와 1조 파라미터 일반 목적 플래그십인 Qwen3-Max-Preview는 약 6주 이내에 등장했으며, 둘이 서로 경쟁하기 위한 것이 아님을 분명히 했다. 그들은 서로 다른 업무를 커버하기 위한 것이다. 이는 "가장 큰 것을 출시하자"는 오픈 웨이트 전략과는 의미 있게 다르다. 이는 단일 제품이라기보다 제품 라인처럼 읽힌다. 가장 넓은 잠재 개발자 기반을 위한 제너럴리스트 모델과, 엔터프라이즈가 미미한 품질 향상에 대해 지불 의사가 가장 높은 한 분야인 코드 생성 및 에이전틱 코딩 워크플로우를 위한 스페셜리스트 모델이다. 조직의 중심 아이디어는 스케일이 아닌 커버리지다.
미니맥스의 좁은 도박: 스스로 개선하는 에이전트
미니맥스는 네 곳 중 가장 좁은, 그리고 아마도 가장 기술적으로 구체적인 레인을 선택했다. 4월 오픈 웨이트로 출시된 M2.7은 일반적인 채팅이나 추론 능력보다는 자가 진화형 에이전트 아키텍처를 중심으로 홍보된다. 보고된 점수는 SWE-bench Pro에서 56.22, Terminal-Bench 2에서 57.0으로, 이는 단순히 질문에 잘 답하는 것이 아니라 자율적으로 실제 코딩 및 터미널 기반 작업을 완료하는 에이전트의 능력을 측정하는 벤치마크다. 문샷이 스케일을 판매하고 알리바바가 커버리지를 판매하는 반면, 미니맥스는 하나의 기능을 판매한다. 즉, 더 큰 기본 모델이나 더 많은 파인튜닝 데이터가 필요하지 않고, 에이전트가 자신의 반복(iteration)을 통해 작업에서 더 나아져야 한다는 아이디어를 바탕으로 구축된 오픈 모델이다. 이는 오픈 웨이트 모델에서의 다음 경쟁 축이 파라미터 수가 아니라, 모델이 자율 시스템의 핵심으로서 얼마나 잘 기능하는지에 있을 것이라는 도박이다.
"오픈 웨이트"가 실제로 각자에게 가져오는 것
이 네 곳을 나열했을 때 흥미로운 결론은 중국 AI 연구소들이 모두 오픈 웨이트가 미래라고 결심했다는 사실이 아니다. 그들이 오픈 웨이트를 무엇을 위해 사용하는지에 대해 서로 다른 결론에 도달했다는 사실이다. 문샷에게 오픈 웨이트는 신뢰성 주장으로도 작용하는 스케일 주장이다. 딥시크에게 그것은 가격 정책이 나머지 역할을 하는 이원화 유통 전략의 절반이다. 알리바바에게 그것은 일반 플래그십과 코딩 전문가 간의 경쟁 없이 시장 커버리지를 구축하는 방법이다. 미니맥스에게 그것은 에이전틱 자기 개선에 대한 훨씬 더 좁고 기술적인 도박을 위한 수단이다. 젠슨 황의 서한은 "오픈 웨이트"를 원칙적으로 방어할 가치가 있는 카테고리로 취급했다. 이 네 가지 릴리즈가 보여주는 것은 그 카테고리 내부에서 실제 전략적 내용이 매우 다양하다는 것이며, 어떤 단일 릴리스보다 이러한 다양성이 오픈 모델이 앞으로 어디로 향하고 있는지에 대한 더 지속 가능한 이야기일 가능성이 높다.