Alibaba veröffentlicht Qwen3.8-27B, ein 27B-Multimodalmodell mit offenen Gewichten für lokale KI-Bereitstellung

Zusammenfassung der Neuigkeiten
Das Qwen-Team von Alibaba hat die offenen Gewichte für Qwen3.8-27B veröffentlicht, ein dichtes Multimodalmodell mit 27 Milliarden Parametern, das unter der Apache-2.0-Lizenz kostenlos auf Hugging Face und ModelScope heruntergeladen werden kann. Die Veröffentlichung erfolgt rund zehn Tage, nachdem Alibaba erstmals die Gewichte seines deutlich größeren Flaggschiffs Qwen3.8-Max geöffnet hatte, und rundet die Qwen3.8-Generation mit einem kompakten Modell ab, das Entwickler auf einer einzigen High-End-GPU statt auf einem Rechenzentrumscluster betreiben können.
Was veröffentlicht wurde
Qwen3.8-27B ist ein dichtes Modell (kein Mixture-of-Experts), was bedeutet, dass alle 27 Milliarden Parameter bei jedem Inferenzdurchlauf aktiv sind, im Gegensatz zum spärlichen Qwen3.8-Max, das nur 95 Milliarden seiner insgesamt 2,4 Billionen Parameter pro Token aktiviert. Das Modell ist nativ multimodal, verarbeitet Text-, Bild- und Videoeingaben und unterstützt ein Kontextfenster von bis zu 262.144 Token. Alibaba veröffentlichte die Gewichte, einschließlich FP8- und NVFP4-quantisierter Varianten, am 13.–14. August 2026 (US-Ostküstenzeit) im offiziellen Repository Qwen/Qwen3.8-27B auf Hugging Face, zusammen mit von der Community beigesteuerten Quantisierungen, die innerhalb weniger Stunden nach dem Start erschienen.
Warum ein dichtes 27B-Modell wichtig ist
Die größten Leistungssprünge in der KI-Branche in diesem Jahr gingen meist von massiven Mixture-of-Experts-Systemen aus, die für den Betrieb Multi-GPU-Serverracks benötigen. Qwen3.8-27B richtet sich an eine andere Zielgruppe: Forscher, Startups und Hobbyisten, die starke Reasoning- und Programmierleistungen auf bereits vorhandener Hardware, wie etwa einer einzelnen Workstation-GPU, erzielen möchten. Basierend auf der architektonischen Grundlage der früheren Qwen3.5-Serie positioniert sich das Modell als bereitstellungsfreundliche Option für lokale Inferenz, agentenbasierte Workflows und Fine-Tuning-Experimente, die keine Infrastruktur der Max-Klasse erfordern.
Benchmark-Leistung
Alibaba berichtet, dass Qwen3.8-27B seinen Vorgänger Qwen3.7-Plus übertrifft, insbesondere bei Programmieraufgaben und realen Szenarien der Büroproduktivität. Unabhängige Berichte stellen fest, dass das Modell gegenüber dem früheren Qwen3.6-27B in mehreren Benchmark-Suiten Fortschritte erzielt, während es eine ähnliche veröffentlichte Decoder-Architektur beibehält. Damit positioniert es sich Mitte August 2026 als eines der leistungsstärksten offen verfügbaren dichten Modelle in der Klasse um 30 Milliarden Parameter.
Kontext: Der umfassendere Rollout von Qwen3.8
Qwen3.8-27B ist die zweite Hälfte eines zweiteiligen Rollouts mit offenen Gewichten. Alibaba stellte Qwen3.8-Max erstmals Mitte Juli 2026 vor und veröffentlichte dessen offene Gewichte am 3. August 2026 (US-Ostküstenzeit), wodurch es zum ersten Qwen-Modell der Max-Klasse wurde, das jemals mit offenen Gewichten ausgeliefert wurde. In Benchmark-Runden wie Terminal-Bench 2.1, OSWorld-Verified und OmniDocBench erzielte Qwen3.8-Max wettbewerbsfähige Ergebnisse gegenüber anderen Modellen der Spitzenklasse aus der breiteren KI-Forschungsgemeinschaft, wobei Gutachter besonders starke Resultate beim multimodalen Dokumentenverständnis und bei Aufgaben für Computer-Use-Agenten hervorhoben. Die 27B-Version vervollständigt die Generation, indem sie Entwicklern neben dem Flaggschiff einen leichtgewichtigen Einstiegspunkt bietet.
Verfügbarkeit und Lizenzierung
Sowohl Qwen3.8-27B als auch Qwen3.8-Max werden unter der Apache-2.0-Lizenz vertrieben, die kommerzielle Nutzung, Modifikation und Weiterverbreitung ohne Lizenzgebühren erlaubt. Die Gewichte stehen zum direkten Download auf Hugging Face und ModelScope zur Verfügung, und mehrere Drittanbieter haben bereits quantisierte Builds (einschließlich FP8- und NVFP4-Formaten) veröffentlicht, um den Speicherbedarf für die lokale Bereitstellung zu senken.