Blog

Qwen3.8-Max

Qwen3.8-Max ist ein von Alibaba Cloud entwickeltes Mixture-of-Experts-Sprachmodell aus der Qwen-Familie. Vorgestellt wurde es am 19. Juli 2026 auf der World Artificial Intelligence Conference in Shanghai, offiziell veröffentlicht am 3. August 2026.

Mit 2,4 Billionen Gesamtparametern und 95 Milliarden aktiven Parametern pro Token (Razzaq 2026a) ist es das bis dahin größte Modell der Qwen-Reihe und das erste Modell der proprietären Max-Linie, dessen Gewichte offengelegt wurden.

Zusammenfassung

Qwen3.8-Max baut auf der im Qwen-Familienartikel beschriebenen Qwen3.5-Architektur auf. Es markiert methodisch zwei Neuerungen gegenüber den vorherigen Max-Modellen: erstens die native multimodale Verarbeitung von Text, Bild und Video in einem einzigen Modell, zweitens die teilweise Öffnung der Gewichte einer Max-Variante.

Damit bricht Qwen3.8-Max mit der seit Qwen 2.5-Max verfolgten Closed-Weights-Strategie für Flaggschiff-Modelle.

Zum Start war Qwen3.8-Max ausschließlich über die Alibaba-Cloud-API zugänglich, zu 2 US-Dollar je Million Input- und 6 US-Dollar je Million Output-Token.

Am 12. August 2026 veröffentlichte das Qwen-Team die post-trainierten Modellgewichte unter dem Namen Qwen3.8-2.4T-A95B unter einer eigenen Qwen-Lizenz mit zusätzlichen Nutzungsbedingungen.

Kurz nach Veröffentlichung wurde die anfängliche Einordnung als größtes je veröffentlichte Sprachmodell relativiert: Moonshot AI hatte bereits am 17. Juli 2026 mit Kimi K3 ein Modell mit 2,8 Billionen Gesamtparametern offengelegt (Razzaq 2026b) – rund zwei Wochen vor Qwen3.8-Max und mit größerer Parameterzahl.

Abgrenzung

Qwen (Familie) – der übergeordnete Artikel behandelt die gesamte Modell-Genealogie von Qwen 1 (2023) bis zu den aktuellen Iterationen; dieser Artikel beschränkt sich auf die konkrete Version Qwen3.8-Max.

Qwen 3.7-Max – der unmittelbare Vorgänger (Mai 2026) blieb vollständig proprietär; Qwen3.8-Max ist die erste Max-Version mit teilweiser Gewichtsoffenlegung.

Qwen3.8-27B – eine parallel veröffentlichte, deutlich kleinere Open-Weights-Variante derselben Generation, die sich an lokale Inferenz auf Consumer-Hardware richtet und nicht mit dem Flaggschiff zu verwechseln ist.

Methodische Grundlagen

Qwen3.8-Max ist ein Sparse-Mixture-of-Experts-Modell mit 2,4 Billionen Gesamtparametern, von denen pro Token 95 Milliarden aktiviert werden (Razzaq 2026a). Diese Architektur setzt die in Mixture of Experts beschriebene Router-basierte Auswahl spezialisierter Teilnetze fort, wie sie bereits bei Qwen 3 (235B-A22B) und Qwen 3.6-Max-Preview eingesetzt wurde – allerdings mit einer deutlich größeren Gesamtkapazität.

Das Modell verarbeitet ein Kontextfenster von bis zu 1.000.000 Token und nimmt neben Text auch Bild- und Video-Eingaben nativ entgegen, ohne separate Vision-Adapter (Alibaba Cloud 2026). Damit reiht sich Qwen3.8-Max in die Reihe multimodal integrierter Frontier-Modelle ein, die im Artikel zu Large Language Models beschrieben wird.

Die offengelegte Version Qwen3.8-2.4T-A95B ist auf Hugging Face verfügbar und mit gängigen Inferenz-Stacks wie vLLM und SGLang kompatibel (Hugging Face 2026).

Die begleitende Lizenz („qwen3.8-max“) ist einer MIT-Lizenz nachempfunden, enthält aber zusätzliche Bedingungen für große Anbieter – eine restriktivere Konstruktion als die Apache-2.0-Lizenz früherer offener Qwen-Modelle.

Stand 2025/2026

Alibaba positionierte Qwen3.8-Max mit Benchmark-Werten, die das Modell vor mehreren Konkurrenzmodellen der zeitgenössischen Frontier-Generation zeigen sollten, darunter ein Wert von 86,1 auf OSWorld-Verified.

Unabhängige Nachtests bestätigten die statischen Benchmark-Werte weitgehend – etwa einen GPQA-Diamond-Wert von 92,6 Prozent (Yotta Labs 2026). Die deutlich höheren agentischen Benchmark-Ergebnisse ließen sich hingegen nicht in vergleichbarem Maß reproduzieren (Yotta Labs 2026).

Zum Erscheinungszeitpunkt bewarb Alibaba Qwen3.8-Max als größtes veröffentlichtes Sprachmodell überhaupt. Diese Einordnung war bereits bei Veröffentlichung nicht mehr zutreffend: Moonshot AI hatte mit Kimi K3 zwei Wochen zuvor ein Modell mit 2,8 Billionen Gesamtparametern offengelegt (Razzaq 2026b).

Qwen3.8-Max bleibt damit, Stand September 2026, das zweitgrößte veröffentlichte Sprachmodell – eine Präzisierung, die zur ursprünglichen Verkaufsaussage im Widerspruch steht und bei künftigen Übernahmen der Behauptung berücksichtigt werden sollte.

Kontroversen und Kritik

Relativierte Größenbehauptung. Die Einordnung als größtes veröffentlichtes Sprachmodell hielt der zeitlichen Prüfung nicht stand, da Kimi K3 bereits zuvor erschienen war und mehr Parameter aufweist – ein Beispiel für die Kurzlebigkeit solcher Superlative in der aktuellen Modell-Veröffentlichungsdichte.

Benchmark-Marketing bei agentischen Aufgaben. Während statische Benchmarks wie GPQA Diamond unabhängige Nachtests im Wesentlichen bestätigten, ließen sich die von Alibaba kommunizierten agentischen Ergebnisse nicht in vergleichbarem Umfang reproduzieren – ein Muster, das Analyst:innen im selben Zeitraum auch bei Modellen anderer Anbieter beobachteten.

Serverseitige Inhaltsfilterung. Bei sensiblen Anfragen über die Alibaba-Cloud-API liefert Qwen3.8-Max HTTP-400-Fehler statt inhaltlicher Antworten – ein Hinweis auf eine der Modellebene vorgelagerte Filterung, die mit chinesischen Regulierungsvorgaben für KI-Dienste im Einklang steht. Wie bei anderen Qwen-Modellen zeigen lokal betriebene Instanzen der offengelegten Gewichte teils abweichendes Verhalten gegenüber der API-Version.

Lizenzkomplexität. Die Kombination aus MIT-naher Grundlizenz, umsatzabhängiger Namensnennungspflicht und separater Model-as-a-Service-Klausel wird in der Open-Source-Community als Abweichung von der einfacheren Apache-2.0-Praxis früherer Qwen-Veröffentlichungen diskutiert.

Verwandte Begriffe

Quellenangaben

  1. Razzaq, Asif, 2026a. Alibaba Qwen Releases Qwen3.8-Max: A 2.4 Trillion Parameter MoE Model and the Most Capable One in the Qwen Family to Date. MarkTechPost, 3. August 2026. https://www.marktechpost.com/2026/08/03/alibaba-qwen-releases-qwen3-8-max/
  2. Razzaq, Asif, 2026b. Alibaba Previews Qwen3.8-Max, a 2.4 Trillion-Parameter Multimodal Model, Days After Moonshot’s Kimi K3 Open-Weight Launch. MarkTechPost, 19. Juli 2026. https://www.marktechpost.com/2026/07/19/alibaba-previews-qwen3-8-max-a-2-4-trillion-parameter-multimodal-model-days-after-moonshots-kimi-k3-open-weight-launch/
  3. Alibaba Cloud, 2026. Alibaba Unveils Qwen3.8-Max: Its Largest and Most Capable Flagship Model to Date. Alibaba Cloud Press Room, August 2026. https://www.alibabacloud.com/en/press-room/alibaba-unveils-qwen3-8-max
  4. Yotta Labs, 2026. Qwen 3.8-Max: Specs, Pricing, Benchmark Status, and How to Access It. yottalabs.ai, 2026.
  5. Hugging Face, 2026. Qwen/Qwen3.8-2.4T-A95B. huggingface.co, 12. August 2026.

← Zurück zur Lexikon-Übersicht