Google Gemma 4がApache 2.0ライセンスとオープンモデルランキングでトップ3入りして登場

ニュースサマリー
2026年4月2日(米国東部時間) — Googleは、これまでで最も強力なオープンモデルファミリーであるGemma 4のリリースを正式に発表しました。GoogleのプロプライエタリなGemini 3と同じ基盤研究と技術に基づいて構築されたGemma 4は、オープンAIエコシステムにおける重要なマイルストーンとなり、スマートフォンから高性能ワークステーションまで、幅広いデバイスにエンタープライズグレードのインテリジェンスをもたらします。
あらゆるユースケースに対応する4つのモデルサイズ
Gemma 4は、異なるハードウェア機能とパフォーマンスニーズに合わせてそれぞれ調整された、4つの異なる構成で提供されます。
**E2B(Effective 2 Billion Parameters)**は最もコンパクトなバリアントで、エッジハードウェアでの最大速度と超低遅延を実現するために設計されています。128Kトークンのコンテキストウィンドウをサポートし、Androidフォン、Raspberry Pi、NVIDIA Jetson Orin Nanoで動作し、テキストおよび画像処理に加えて音声入力をユニークにサポートします。
**E4B(Effective 4 Billion Parameters)**は、モバイルおよび組み込みデバイス向けに最適化されたまま、より強力な推論能力を提供します。E2Bと同様に、128Kのコンテキストウィンドウと音声を含むマルチモーダルサポートを備えています。Googleによると、E4Bは前世代モデルよりも最大4倍高速で、バッテリー消費量を最大60%削減しており、オンデバイスAIアプリケーションにとって注目すべき成果です。
**26B MoE(Mixture-of-Experts)**は、推論時にわずか38億パラメータのみをアクティブにする260億パラメータのモデルで、コンシューマーGPUおよびワークステーションでの高速なトークン生成を可能にします。256Kのコンテキストウィンドウをサポートし、現在Arena AI Text Leaderboardの全オープンモデルの中で6位にランクされています。
31B Denseは、Gemma 4のフラッグシップモデルであり、最高の出力品質を実現するために設計されています。256Kトークンのコンテキストウィンドウを備え、ネイティブのbfloat16形式で単一の80GB NVIDIA H100 GPUに収まります。量子化されたバージョンは、コンシューマーグラフィックスカードでも実行できます。現在、Arena AIリーダーボードの全オープンモデルの中で世界第3位にランクされており、このクラスのオープンウェイトモデルとしては顕著な成果です。
商用利用のための初のApache 2.0ライセンス
Gemma 4のリリースで最も影響力のある発表の1つは、Gemmaモデルファミリーとしては初のApache 2.0ライセンスの採用です。以前のGemmaバージョンは、より制限的なGoogleプロプライエタリライセンスの下でリリースされていました。
Apache 2.0ライセンスは、開発者にロイヤリティ義務なしに、商用アプリケーションでモデルを使用、変更、展開する完全な自由を与えます。この移行により、Gemma 4はエンタープライズオープンソースAI分野で真剣な競合相手となり、オンプレミスまたはクラウドのいずれであっても、開発者にデータ、インフラストラクチャ、および展開環境を完全に制御できるようになります。
その重量をはるかに超えるパフォーマンス
Googleは、Gemma 4モデルがパラメータサイズの最大20倍の競合他社を常に上回ると主張しています。発表と同時に公開されたベンチマークデータは、いくつかの標準的な評価でこの主張を裏付けています。
AIME 2026(高度数学)では、Gemma 4 31Bモデルは印象的な89.2%のスコアを達成しました。一方、Gemma 3 27Bはわずか20.8%でした。LiveCodeBench v6(競技プログラミング)では、31Bモデルは80.0%のスコアを記録し、より小型のE4BおよびE2Bバリアントはそれぞれ52.0%と44.0%でした。これらは、コンシューマーグレードのハードウェアで実行するように設計されたモデルとしては強力な結果です。GPQA Diamond(科学的推論)では、31Bは84.3%を達成し、再びその前身を大幅に上回りました。
エージェント型AIワークフローのために構築
生のベンチマークパフォーマンスを超えて、Gemma 4はエージェント型アプリケーションを念頭に置いて設計されています。すべてのモデルサイズは、関数呼び出し、構造化JSON出力、およびシステム命令をネイティブでサポートしています。これらの機能により、AIエージェントは手動のオーケストレーションなしに複数のツールやAPI間で連携できます。
Googleは、Gemma 4のアプリケーションの全範囲を「単純なチャットから複雑なロジックおよびエージェント型ワークフロー」にまで及ぶと説明しており、このモデルファミリーはパーソナルアシスタントアプリから自動化されたソフトウェアパイプラインまで、あらゆるものに適しています。
デフォルトで多言語・マルチモーダル
Gemma 4は140以上の言語をネイティブでサポートしており、Googleはこれにより「グローバルな視聴者向けのローカライズされた、多言語体験の向上」が可能になると述べています。マルチモーダル側では、4つのモデルバリアントすべてがビジョン入力(画像およびビデオ)をサポートしており、エッジモデルのE2BおよびE4Bはさらに音声入力をサポートしています。これにより、現実世界のマルチモーダルタスクで利用可能な最も有能な小型モデルの1つとなっています。
Android統合と開発者アクセス
GoogleのAndroid Developers Blogは、2026年4月2日(米国東部時間)に、Gemma 4がAndroidスマートフォンを駆動するオンデバイスAIである次世代Gemini Nanoの基盤となることを確認しました。今日Gemma 4用に書かれたコードは、将来のGemini Nano 4対応デバイスと互換性があり、開発から本番への移行を容易にします。
開発者は複数のチャネルを通じてGemma 4にアクセスできます。31Bおよび26B MoEモデルはGoogle AI Studioで利用可能です。エッジE4BおよびE2Bモデルは、AI Edge Galleryアプリを通じてテストできます。モデルウェイトは、Hugging Face、Kaggle、およびOllamaから無料でダウンロードできます。Android開発者は、AICore Developer Previewにオプトインして、Google、MediaTek、およびQualcomm Technologiesの専用AIアクセラレータを活用して、サポートされているデバイスで直接モデルを実行することもできます。
業界エコシステムのサポート
このリリースはすでに主要な業界パートナーからのサポートを集めています。NVIDIAは、ローカルエージェント型AIユースケースに焦点を当て、RTX PCラインナップおよびDGX Sparkハードウェア全体でGemma 4の最適化を発表しました。QualcommとMediaTekは、モバイルSoCでの効率的な推論を確保するために、Googleと協力してエッジモデルバリアントを開発しました。
Gemma 4の入手方法
Gemma 4モデルウェイトは、以下のプラットフォームで現在利用可能です。
Hugging Face、Kaggle、およびOllamaはすべて、ダウンロード可能なモデルウェイトをホストしています。Google AI Studioは、26B MoEおよび31B Denseモデルへのホストアクセスを提供します。AI Edge Galleryアプリは、E2BおよびE4Bバリアントへのモバイル最適化アクセスを提供します。Android開発者は、オンデバイステストのためにAICore Developer Previewに登録できます。
締めくくりの視点
Gemma 4のリリースは、AI業界におけるより広範なトレンドを強調しています。つまり、有能で本番準備ができたAIモデルは、プロプライエタリなクラウドサービス以外でもますますアクセス可能になっています。Apache 2.0ライセンス、幅広いハードウェア互換性、強力なベンチマークパフォーマンス、および組み込みのマルチモーダル機能により、Gemma 4は、独自の条件で強力なAIツールを展開およびカスタマイズしたい開発者、研究者、および組織にとって、意味のある一歩前進を表しています。