Google Gemma 4, Apache 2.0 라이선스 및 오픈 모델 순위 상위 3위로 출시

뉴스 요약
2026년 4월 2일 (ET) — Google은 현재까지 가장 강력한 오픈 모델 제품군인 Gemma 4의 출시를 공식 발표했습니다. Google의 독점 모델인 Gemini 3와 동일한 기반 연구 및 기술을 바탕으로 구축된 Gemma 4는 스마트폰부터 고성능 워크스테이션에 이르기까지 다양한 기기에 엔터프라이즈급 지능을 제공하며 오픈 AI 생태계에 중요한 이정표를 세웠습니다.
모든 사용 사례를 위한 4가지 모델 크기
Gemma 4는 서로 다른 하드웨어 기능과 성능 요구 사항에 맞춰 각각 맞춤 제작된 4가지 구성으로 제공됩니다.
**E2B (Effective 2 Billion Parameters)**는 엣지 하드웨어에서 최대 속도와 초저지연 시간을 위해 설계된 가장 컴팩트한 변형입니다. 128K 토큰 컨텍스트 창을 지원하며 Android 휴대폰, Raspberry Pi, NVIDIA Jetson Orin Nano에서 실행되고 텍스트 및 이미지 처리와 함께 오디오 입력도 독점적으로 지원합니다.
**E4B (Effective 4 Billion Parameters)**는 모바일 및 임베디드 장치에 최적화된 상태로 더 강력한 추론 능력을 제공합니다. E2B와 마찬가지로 128K 컨텍스트 창과 오디오를 포함한 멀티모달 지원 기능을 갖추고 있습니다. Google은 E4B가 이전 세대 모델보다 최대 4배 빠르고 배터리 사용량이 최대 60% 적다고 보고했는데, 이는 온디바이스 AI 애플리케이션에 대한 주목할 만한 성과입니다.
**26B MoE (Mixture-of-Experts)**는 추론 시 38억 개의 매개변수만 활성화하는 260억 개의 매개변수 모델로, 소비자용 GPU 및 워크스테이션에서 빠른 토큰 생성을 가능하게 합니다. 256K 컨텍스트 창을 지원하며 현재 Arena AI 텍스트 리더보드에서 모든 오픈 모델 중 6위를 차지하고 있습니다.
31B Dense는 최대 출력 품질을 위해 설계된 Gemma 4의 주력 모델입니다. 256K 토큰 컨텍스트 창을 갖추고 있으며 기본 bfloat16 형식으로 단일 80GB NVIDIA H100 GPU에 맞습니다. 양자화된 버전은 소비자용 그래픽 카드에서도 실행할 수 있습니다. 현재 Arena AI 리더보드에서 모든 오픈 모델 중 전 세계 3위를 차지하고 있으며, 이 정도 규모의 오픈 가중치 모델로는 상당한 성과입니다.
상업적 사용을 위한 최초의 Apache 2.0 라이선스
Gemma 4 출시에서 가장 영향력 있는 발표 중 하나는 Gemma 모델 제품군 최초로 Apache 2.0 라이선스를 채택했다는 것입니다. 이전 Gemma 버전은 더 제한적인 Google 독점 라이선스로 출시되었습니다.
Apache 2.0 라이선스는 개발자에게 로열티 의무 없이 상업용 애플리케이션에서 모델을 사용, 수정 및 배포할 수 있는 완전한 자유를 부여합니다. 이러한 변화는 Gemma 4를 엔터프라이즈 오픈 소스 AI 공간에서 진지한 경쟁자로 자리매김하게 하며, 개발자에게 온프레미스 또는 클라우드 환경에서 데이터, 인프라 및 배포 환경에 대한 완전한 제어권을 제공합니다.
성능이 무게를 능가합니다
Google은 Gemma 4 모델이 매개변수 크기의 최대 20배에 달하는 경쟁업체를 일관되게 능가한다고 주장합니다. 발표와 함께 공개된 벤치마크 데이터는 여러 표준 평가에서 이러한 주장을 뒷받침합니다.
AIME 2026(고급 수학)에서 Gemma 4 31B 모델은 89.2%라는 인상적인 점수를 기록한 반면, Gemma 3 27B는 20.8%에 불과했습니다. LiveCodeBench v6(경쟁 프로그래밍)에서 31B 모델은 80.0%를 기록했으며, 더 작은 E4B 및 E2B 변형은 각각 52.0%와 44.0%를 기록했습니다. 이는 소비자 등급 하드웨어에서 실행되도록 설계된 모델에 대한 강력한 결과입니다. GPQA Diamond(과학적 추론)에서 31B는 84.3%를 달성하여 이전 모델을 다시 한번 크게 앞섰습니다.
에이전트 AI 워크플로우를 위해 구축됨
원시 벤치마크 성능을 넘어 Gemma 4는 에이전트 애플리케이션을 염두에 두고 설계되었습니다. 모든 모델 크기는 함수 호출, 구조화된 JSON 출력 및 시스템 지침을 기본적으로 지원합니다. 이러한 기능은 AI 에이전트가 수동 오케스트레이션 없이 여러 도구 및 API 간에 조정할 수 있도록 합니다.
Google은 Gemma 4 애플리케이션의 전체 범위를 "간단한 채팅부터 복잡한 논리 및 에이전트 워크플로우"에 걸쳐 있다고 설명하며, 이 모델 제품군은 개인 비서 앱부터 자동화된 소프트웨어 파이프라인까지 모든 것에 적합합니다.
기본적으로 다국어 및 멀티모달
Gemma 4는 140개 이상의 언어를 기본적으로 지원하며, Google은 이를 통해 "전 세계 사용자를 위한 개선된 현지화된 다국어 경험"을 제공한다고 밝혔습니다. 멀티모달 측면에서 네 가지 모델 변형 모두 비전 입력(이미지 및 비디오)을 지원하며, E2B 및 E4B 엣지 모델은 추가로 오디오 입력을 지원합니다. 이는 실제 멀티모달 작업을 위한 가장 유능한 소형 모델 중 일부입니다.
Android 통합 및 개발자 액세스
Google의 Android 개발자 블로그는 2026년 4월 2일(ET)에 Gemma 4가 Android 스마트폰을 구동하는 온디바이스 AI인 차세대 Gemini Nano의 기반이 될 것이라고 확인했습니다. 오늘날 Gemma 4용으로 작성된 코드는 향후 Gemini Nano 4 지원 장치와 호환되어 개발에서 프로덕션까지의 경로를 용이하게 합니다.
개발자는 여러 채널을 통해 Gemma 4에 액세스할 수 있습니다. 31B 및 26B MoE 모델은 Google AI Studio에서 사용할 수 있습니다. E4B 및 E2B 엣지 모델은 AI Edge Gallery 앱을 통해 테스트할 수 있습니다. 모델 가중치는 Hugging Face, Kaggle 및 Ollama에서 무료로 다운로드할 수 있습니다. Android 개발자는 AICore 개발자 미리 보기 프로그램에 참여하여 Google, MediaTek 및 Qualcomm Technologies의 특수 AI 가속기를 활용하여 지원되는 장치에서 직접 모델을 실행할 수도 있습니다.
산업 생태계 지원
이번 출시는 이미 주요 산업 파트너들의 지원을 받고 있습니다. NVIDIA는 로컬 에이전트 AI 사용 사례에 중점을 두고 RTX PC 라인업 및 DGX Spark 하드웨어 전반에 걸쳐 Gemma 4에 대한 최적화를 발표했습니다. Qualcomm 및 MediaTek은 모바일 SoC에서 효율적인 추론을 보장하기 위해 엣지 모델 변형에 대해 Google과 협력했습니다.
Gemma 4를 얻는 곳
Gemma 4 모델 가중치는 현재 다음 플랫폼을 통해 사용할 수 있습니다.
Hugging Face, Kaggle 및 Ollama는 모두 다운로드 가능한 모델 가중치를 호스팅합니다. Google AI Studio는 26B MoE 및 31B Dense 모델에 대한 호스팅 액세스를 제공합니다. AI Edge Gallery 앱은 E2B 및 E4B 변형에 대한 모바일 최적화 액세스를 제공합니다. Android 개발자는 온디바이스 테스트를 위해 AICore 개발자 미리 보기 프로그램에 등록할 수 있습니다.
마무리 관점
Gemma 4의 출시는 AI 산업의 더 넓은 추세를 강조합니다. 즉, 기능적이고 프로덕션 준비가 된 AI 모델이 독점 클라우드 서비스 외부에서 점점 더 많이 액세스할 수 있게 된다는 것입니다. Apache 2.0 라이선스, 광범위한 하드웨어 호환성, 강력한 벤치마크 성능 및 내장된 멀티모달 기능을 갖춘 Gemma 4는 자체 조건에 따라 강력한 AI 도구를 배포하고 사용자 정의하려는 개발자, 연구원 및 조직에게 의미 있는 발걸음을 나타냅니다.