xAIがGrok 4.3を全開発者に公開:100万トークンコンテキスト、動画入力、音声クローンを40%低コストで提供

ニュースサマリー
xAIは、2026年4月30日(太平洋時間)にGrok 4.3モデルのAPIアクセスを全面的に公開しました。これは、2026年4月17日(太平洋時間)に開始されたSuperGrok Heavyサブスクライバー向けベータ版からの段階的なロールアウトを完了したものです。今回のリリースには、100万トークンのコンテキストウィンドウ、常時オンの思考連鎖推論、ネイティブ動画入力、約40%の価格引き下げ、新しい音声クローニングスイートという5つの重要なアップグレードが含まれており、これまでのGrokモデルの lineage における最も機能が豊富なアップデートの1つとなっています。
Grok 4.3とは何か、そしてその位置づけ
Grok 4.3はxAIの最新の大規模言語モデルであり、Grok 4.20の後継です。このモデルは、長いコンテキスト、低遅延、予測可能な推論が重要な、エージェント型およびエンタープライズアプリケーションを構築する開発者を対象としています。xAI APIから直接、Vercel AI Gateway経由、OpenRouter経由でアクセス可能です。OpenAI SDKエコシステム内で既に作業している開発者向けに、Grok 4.3はOpenAI互換のベースURLを使用しており、モデルフィールドをgrok-4.3に切り替える以外にコード変更は必要ありません。この互換性により、移行コストが大幅に削減され、競合プラットフォームからの開発者を引き付けるための意図的な取り組みと広く見なされています。
100万トークンのコンテキストウィンドウ
主要な機能の1つは、100万トークンのコンテキストウィンドウであり、以前のGrok世代から大幅な進歩です。1トークンあたり約750語とすると、100万トークンは数万ページに相当するテキストを収容でき、大規模なソフトウェアコードベース、複数の長文リサーチレポート、または長期間の顧客インタラクション履歴に匹敵します。コストは20万トークンの入力境界で増加し、トークンあたりの価格が2倍になるため、非常に大きなペイロードを処理する開発者は、アーキテクチャで段階的な請求を考慮する必要があります。
常時オンの推論
Grok 4.3は、永続的で切り替え不可能な思考連鎖(CoT)メカニズムを実装しています。拡張推論がオプションパラメータであるモデルとは異なり、すべてのGrok 4.3 API呼び出しは、応答を生成する前に内部的に推論を実行します。xAIはこれを「常時オン」の推論と説明しています。エージェント型カスタマーサポートの精度基準であるτ²-Bench Telecomベンチマークにおいて、Grok 4.3は98%を達成し、Grok 4.20から5ポイント向上しました。
GDPval-AAエージェント型ベンチマークでは、Grok 4.3はELOスコア1,500を記録し、Grok 4.20のスコア1,179から321ポイント上昇し、同じ評価期間で複数の競合モデルを上回りました。Artificial Analysisによる独立した分析では、同社の総合知能指数において、Claude Sonnet 4.6およびMuse Sparkをわずかに上回るモデルとしてランク付けされ、同時にベンチマーク実行あたりのコストを削減しました。永続的な推論は、呼び出しごとにいくらかの追加遅延をもたらすため、開発者はアプリケーションの応答時間要件と比較して評価する必要があります。
ネイティブ動画入力
Grok 4.3は、xAI APIでネイティブ動画入力をサポートする最初のモデルです。開発者は、フレーム抽出やトランスコーディングなどの前処理ステップなしに、動画URLを直接モデルに渡すことができます。ユースケースには、自動コンテンツ分析、動画ベースの質問応答、視覚情報の時間的理解を必要とするマルチモーダルエージェント型ワークフローが含まれます。
価格と出力速度
新しい価格設定では、入力トークンは100万あたり1.25ドル(Grok 4.20の約2.00ドルから低下)、出力トークンは100万あたり2.50ドル(約6.00ドルから低下)となり、入力で37.5%、出力で58.3%の削減、全体で平均約40%の削減となります。報告されている1秒あたり159トークンのスループットにより、Grok 4.3は前モデルよりも高速な出力を提供します。トークンあたりの低価格と高いスループットを組み合わせることで、高ボリュームまたはリアルタイム展開の経済性が大幅に向上します。
カスタムボイス:音声クローニングスイート
言語モデルのアップデートと並行して、xAIはCustom Voices、つまり音声クローニングAPIとWebベースの作成スイートをリリースしました。開発者は、わずか120秒の参照オーディオクリップから音声をクローニングできます。生成されたボイスIDは、xAIのText-to-Speech(TTS)およびVoice Agent API全体で使用でき、会話型および顧客向けアプリケーションで一貫した合成音声を実現します。これにより、xAIは音声ファーストのエージェント型製品向けのより完全なプラットフォームとして位置づけられ、同社の対象市場をテキスト推論を超えて拡大します。
アクセスと利用可能性
段階的なロールアウトは2026年4月17日(太平洋時間)に開始され、SuperGrok Heavyサブスクライバー(月額30ドル)およびX Premium+サブスクライバー(月額最大40ドル)にiOS、Android、Web経由で早期アクセスが提供されました。完全な公開APIアクセスは2026年4月30日(太平洋時間)に開始されました。このモデルは現在、Oracle Cloud InfrastructureのGenerative AIサービスに、xAIのAPIおよびOpenRouterと共にリストされており、これらのクラウド環境で既に運用しているチーム向けのエンタープライズ展開オプションを広げています。