Start / News / xAI öffnet Grok 4.3 für alle Entwickler: Millionen-Token-Kontext, Video-Input und Stimmklonung zu 40 % geringeren Kosten
xAI

xAI öffnet Grok 4.3 für alle Entwickler: Millionen-Token-Kontext, Video-Input und Stimmklonung zu 40 % geringeren Kosten

May 6, 20261 Min. Lesezeit
xAI öffnet Grok 4.3 für alle Entwickler: Millionen-Token-Kontext, Video-Input und Stimmklonung zu 40 % geringeren Kosten

News Summary

xAI hat sein Grok 4.3 Modell am 30. April 2026 (Pacific Time) für den vollständigen API-Zugriff freigegeben und damit eine gestaffelte Einführung abgeschlossen, die am 17. April 2026 (Pacific Time) mit einer Betaversion für SuperGrok Heavy-Abonnenten begann. Das Release bündelt fünf wesentliche Upgrades – ein Kontextfenster von 1 Million Tokens, Always-On Chain-of-Thought-Reasoning, native Videoeingabe, eine Preissenkung von rund 40 % und eine neue Voice-Cloning-Suite – und stellt damit eines der inhaltsreichsten Updates in der bisherigen Grok-Modellreihe dar.

Was ist Grok 4.3 und wo passt es hinein?

Grok 4.3 ist das neueste große Sprachmodell von xAI und folgt auf Grok 4.20. Das Modell richtet sich an Entwickler, die agentenbasierte und Unternehmensanwendungen erstellen, bei denen langer Kontext, geringe Latenz und vorhersagbares Reasoning entscheidend sind. Es ist direkt über die xAI API, über Vercel AI Gateway und über OpenRouter zugänglich. Für Entwickler, die bereits im OpenAI SDK-Ökosystem arbeiten, verwendet Grok 4.3 eine OpenAI-kompatible Basis-URL – es sind keine Codeänderungen erforderlich, abgesehen vom Austausch des Modellfeldes in grok-4.3. Diese Kompatibilität senkt die Migrationskosten erheblich und wird weithin als bewusste Anstrengung angesehen, Entwickler von konkurrierenden Plattformen anzuziehen.

Das 1-Million-Token-Kontextfenster

Eine der herausragenden Funktionen ist ein Kontextfenster von 1.000.000 Tokens, ein deutlicher Fortschritt gegenüber früheren Grok-Generationen. Bei etwa 750 Wörtern pro Token kann eine Million Tokens Zehntausende von Seiten Text aufnehmen – das Äquivalent einer großen Software-Codebasis, mehrerer langer Forschungsberichte oder einer erweiterten Kundeninteraktionshistorie. Die Kosten steigen bei der Eingabegrenze von 200.000 Tokens, wo sich die Preise pro Token verdoppeln, sodass Entwickler, die sehr große Payloads verarbeiten, die gestaffelte Abrechnung in ihrer Architektur berücksichtigen müssen.

Always-On Reasoning

Grok 4.3 implementiert einen persistenten, nicht umschaltbaren Chain-of-Thought (CoT)-Mechanismus. Im Gegensatz zu Modellen, bei denen erweitertes Reasoning ein optionaler Parameter ist, führt jeder Grok 4.3 API-Aufruf automatisch ein internes Reasoning durch, bevor eine Antwort generiert wird. xAI bezeichnet dies als "Always-On"-Reasoning. Auf dem τ²-Bench Telecom-Benchmark – einem Standard für die Genauigkeit von agentenbasiertem Kundensupport – erreichte Grok 4.3 98 %, eine Verbesserung um 5 Punkte gegenüber Grok 4.20.

Auf dem agentenbasierten GDPval-AA-Benchmark erzielte Grok 4.3 einen ELO-Score von 1.500, was einer Steigerung von 321 Punkten gegenüber dem Score von Grok 4.20 (1.179) entspricht und mehrere konkurrierende Modelle im selben Bewertungszeitraum übertraf. Unabhängige Analysen von Artificial Analysis platzierten das Modell in ihrem Composite Intelligence Index knapp über Claude Sonnet 4.6 und Muse Spark, während gleichzeitig die Kosten pro Benchmark-Lauf reduziert wurden. Das persistente Reasoning führt zu einer zusätzlichen Latenz pro Aufruf, die Entwickler gegen die Antwortzeitanforderungen ihrer Anwendung abwägen sollten.

Native Videoeingabe

Grok 4.3 ist das erste Modell in der xAI API, das native Videoeingaben unterstützt. Entwickler können eine Video-URL direkt an das Modell übergeben, ohne Vorverarbeitungsschritte wie Frame-Extraktion oder Transkodierung. Anwendungsfälle umfassen die automatisierte Inhaltsanalyse, video-basierte Fragenbeantwortung und multimodale agentenbasierte Workflows, die ein zeitliches Verständnis visueller Informationen erfordern.

Preise und Ausgabegeschwindigkeit

Die neuen Preise setzen Eingabe-Tokens bei 1,25 $ pro Million (gegenüber ca. 2,00 $ bei Grok 4.20) und Ausgabe-Tokens bei 2,50 $ pro Million (gegenüber ca. 6,00 $) fest – eine Reduzierung von 37,5 % bei Eingaben und 58,3 % bei Ausgaben, was im Durchschnitt etwa 40 % insgesamt entspricht. Mit einem gemeldeten Durchsatz von 159 Tokens pro Sekunde liefert Grok 4.3 auch eine schnellere Ausgabe als sein Vorgänger. Zusammen verbessern die niedrigeren Kosten pro Token und der höhere Durchsatz die Wirtschaftlichkeit von hochvolumigen oder Echtzeit-Bereitstellungen erheblich.

Benutzerdefinierte Stimmen: Die Voice-Cloning-Suite

Parallel zum Sprachmodell-Update hat xAI Custom Voices veröffentlicht – eine Voice-Cloning-API und eine webbasierte Erstellungssuite. Entwickler können eine Stimme aus einem Referenz-Audioclip von nur 120 Sekunden klonen. Die resultierende Voice-ID kann dann über die Text-to-Speech (TTS)- und Voice Agent-APIs von xAI verwendet werden, was konsistente synthetische Stimmen in konversationellen und kundenorientierten Anwendungen ermöglicht. Dies positioniert xAI als eine umfassendere Plattform für sprachgesteuerte agentenbasierte Produkte und erweitert den adressierbaren Markt des Unternehmens über die Textinferenz hinaus.

Zugriff und Verfügbarkeit

Die gestaffelte Einführung begann am 17. April 2026 (Pacific Time) und bot SuperGrok Heavy-Abonnenten (30 $/Monat) und X Premium+-Abonnenten (bis zu 40 $/Monat) frühen Zugriff über iOS, Android und das Web. Der vollständige öffentliche API-Zugriff wurde am 30. April 2026 (Pacific Time) eröffnet. Das Modell ist derzeit im Generative AI Service der Oracle Cloud Infrastructure neben der xAI API und OpenRouter aufgeführt, was die Optionen für Enterprise-Bereitstellungen für Teams, die bereits in diesen Cloud-Umgebungen tätig sind, erweitert.

xAIKI-Modelle