Alibabas Qwen3.8 debütiert mit 2,4 Billionen Parametern und Million-Token-Kontext

Nachrichtenübersicht
Alibaba hat Qwen3.8, sein neuestes Flaggschiff-Basismodell, am 3. August 2026 um 9:00 Uhr US-Ostküstenzeit offiziell vorgestellt und die Veröffentlichung als das bisher leistungsfähigste große Sprachmodell des Unternehmens positioniert. Das Modell verfügt über eine Gesamtzahl von etwa 2,4 Billionen Parametern, basiert auf einer sparsamen Mixture-of-Experts-Architektur, und Alibaba gibt an, dass seine Benchmark-Ergebnisse es zu den stärksten derzeit verfügbaren Allzweckmodellen zählen, wobei es nur einer kleinen Zahl führender Modelle aus anderen Spitzenlaboren unterlegen ist.
Hintergrund und Zeitplan der Einführung
Alibaba präsentierte erstmals eine frühe Variante des Modells, Qwen3.8-Max Preview, am 19. Juli 2026 um 11:00 Uhr US-Ostküstenzeit während einer öffentlichen Technologiepräsentation und gewährte Entwicklern über seinen Cloud-Token-Plan einen eingeschränkten frühen Zugang. Die Ankündigung vom 3. August markiert die vollständige Produktionsveröffentlichung, die etwa zwei Wochen später folgt, wobei Alibaba erklärt, dass in den kommenden Wochen eine breitere Verfügbarkeit und eine erweiterte Tool-Unterstützung folgen werden, sobald die Akzeptanz in seinem Cloud-Ökosystem zunimmt.
Technische Fähigkeiten
Qwen3.8 geht über die Textverarbeitung hinaus und verarbeitet Bilder, Videos und lange Dokumente, was einen breiteren Branchentrend hin zu multimodalen Basismodellen widerspiegelt. Das Modell unterstützt ein Kontextfenster von bis zu einer Million Token, wodurch es in der Lage ist, umfangreiche Dokumente, Codebasen und Gespräche mit mehreren Runden zu verarbeiten, ohne den früheren Kontext zu verlieren. Alibaba hob insbesondere Fortschritte bei der Programmierunterstützung und bei professionellen Büroproduktivitätsaufgaben hervor, Bereiche, die laut dem Unternehmen in dieser Generation im Vergleich zu früheren Qwen-Veröffentlichungen die umfangreichsten architektonischen Verbesserungen erfahren haben.
Benchmark-Leistung
Auf der CodeArena-Bestenliste, einem weithin zitierten Community-Benchmark zur Bewertung der Programmierfähigkeit großer Sprachmodelle, belegte Qwen3.8 weltweit den vierten Platz unter allen getesteten Modellen. Bei OSWorld-Verified, einem Benchmark, der die Fähigkeit eines AI-Agenten misst, autonom eine Computerschnittstelle zu bedienen, erzielte die Variante Qwen3.8-Max 86,1 Punkte und belegte damit Anfang August 2026 unter den auf diesem speziellen Test bewerteten Mainstream-Modellen den ersten Platz.
Preise und Zugang
Alibaba hat das Modell über seine Qwen-AI-Cloud-Plattform unter einem tokenbasierten Preisplan verfügbar gemacht. Laut dem Unternehmen liegt sein internationaler Preis pro Token für Eingabe und Ausgabe deutlich unter dem einiger teurerer Konkurrenzangebote, und die Plattform bietet zudem einen reduzierten Preis für zwischengespeicherte Eingabe-Token, um die Kosten für wiederholte oder kontextbezogene Abfragen zu senken. Alibaba hat darauf hingewiesen, dass in naher Zukunft leichtere Open-Source-Varianten der Modellfamilie, darunter eine kleinere Parameterkonfiguration, veröffentlicht werden sollen, um den Zugang für die Entwickler-Community zu erweitern.
Branchenkontext
Die Veröffentlichung reiht sich in eine Welle von Großmodell-Ankündigungen chinesischer Technologieunternehmen im Jahr 2026 ein, da inländische AI-Labore weiterhin Flaggschiff-Systeme vorantreiben, die multimodales Schließen, Programmierkenntnisse und Fähigkeiten von Agenten zur Computerbedienung betonen. Alibabas anhaltende Investitionen in die Qwen-Modellfamilie unterstreichen die Strategie des Unternehmens, wettbewerbsfähig bepreiste Modelle mit großem Kontextfenster anzubieten, die sich sowohl an Unternehmensentwickler als auch an die breitere globale Forschungsgemeinschaft richten.