알리바바의 Qwen3.8, 2.4조 개 매개변수와 100만 토큰 컨텍스트로 공개

뉴스 요약
알리바바는 미 동부 시간 기준 2026년 8월 3일 오전 9시에 자사의 최신 기반 모델인 Qwen3.8을 공식 출시하며, 이번 공개를 현재까지 회사가 선보인 가장 성능이 뛰어난 대규모 언어 모델로 규정했습니다. 이 모델은 희소 전문가 혼합 아키텍처를 기반으로 구축되었으며 총 매개변수 수는 약 2.4조 개입니다. 알리바바는 이 모델의 벤치마크 결과가 현재 사용 가능한 가장 강력한 범용 모델 반열에 속하며, 다른 연구소의 소수 선도적인 최첨단 시스템에만 뒤진다고 밝혔습니다.
배경 및 출시 일정
알리바바는 2026년 7월 19일 미 동부 시간 오전 11시에 열린 공개 기술 시연회에서 이 모델의 초기 변형인 Qwen3.8-Max Preview를 처음으로 선보이며, 클라우드 토큰 플랜을 통해 개발자들에게 제한적인 조기 액세스를 제공했습니다. 8월 3일 발표는 약 2주 후에 이어지는 전면적인 프로덕션 출시를 의미하며, 알리바바는 자사 클라우드 생태계 전반에 걸쳐 채택이 가속화됨에 따라 향후 몇 주 안에 더 폭넓은 가용성과 확장된 도구 지원이 이어질 것이라고 밝혔습니다.
기술 역량
Qwen3.8은 텍스트 처리를 넘어 이미지, 비디오 및 긴 문서를 처리할 수 있도록 확장되었으며, 이는 멀티모달 기반 모델로 향하는 업계의 광범위한 전환을 반영합니다. 이 모델은 최대 100만 토큰의 컨텍스트 창을 지원하여 이전 컨텍스트를 잃지 않고도 긴 문서, 코드베이스 및 다중 턴 대화를 처리할 수 있습니다. 알리바바는 코딩 지원 및 전문적인 오피스 생산성 작업에서 특히 큰 성능 향상을 강조했으며, 이 부분들이 이전 Qwen 출시와 비교해 이번 세대에서 가장 중대한 아키텍처 개선을 받았다고 회사는 밝혔습니다.
벤치마크 성능
대규모 언어 모델 전반의 코딩 능력을 평가하는 널리 인용되는 커뮤니티 벤치마크인 CodeArena 리더보드에서 Qwen3.8은 테스트된 모든 모델 중 전 세계 4위를 차지했습니다. AI 에이전트가 컴퓨터 인터페이스를 자율적으로 조작하는 능력을 측정하는 벤치마크인 OSWorld-Verified에서 Qwen3.8-Max 변형은 86.1점을 기록하며, 2026년 8월 초 기준 해당 테스트에서 평가된 주류 모델 중 최상위에 올랐습니다.
가격 및 액세스
알리바바는 토큰 기반 가격제를 통해 자사의 Qwen AI 클라우드 플랫폼에서 이 모델을 이용할 수 있도록 했습니다. 회사에 따르면 입력 및 출력에 대한 국제 토큰당 가격은 일부 고가 경쟁 제품보다 훨씬 낮게 책정되었으며, 이 플랫폼은 반복적이거나 컨텍스트 기반 쿼리의 비용을 낮추기 위해 캐시된 입력 토큰에 대한 할인 가격도 제공합니다. 알리바바는 더 가벼운 오픈소스 모델 변형이 향후 출시될 예정이며, 여기에는 개발자 커뮤니티의 액세스를 넓히기 위해 더 작은 매개변수 구성도 포함될 것이라고 밝혔습니다.
업계 맥락
이번 출시는 중국 기술 기업들이 2026년에 발표한 대규모 모델의 물결에 추가된 것으로, 국내 AI 연구소들이 멀티모달 추론, 코딩 숙련도 및 컴퓨터 사용 에이전트 역량을 강조하는 플래그십 시스템을 계속해서 추진하고 있음을 보여줍니다. Qwen 모델 제품군에 대한 알리바바의 지속적인 투자는 기업 개발자와 광범위한 글로벌 연구 커뮤니티를 모두 겨냥한 경쟁력 있는 가격의 높은 컨텍스트 창 모델을 제공하려는 회사의 전략을 강조합니다.