Zum Inhalt springen
AI NEWS pro

Qwen 3.8 Max: Alibabas Flaggschiff im Billionen-Maßstab

Qwen 3.8 Max im Datenblatt: Alibabas Mixture-of-Experts-Flaggschiff mit multimodaler Eingabe und einem Kontext nahe der Million Token.

Sebastian Fiebiger4Min. Lesezeit
Schriftzug "Alibaba Cloud Qwen 3.8 Max" in Weiß und Hellblau vor dunkelblauem Grund mit feinem Wellenlinienmuster, darunter ein gelbes Banner mit der Aufschrift "Spitzenklasse"

Qwen 3.8 Max ist das neue Spitzenmodell von Alibaba Cloud - ein Mixture-of-Experts-System im Billionen-Parameter-Segment, das neben Text auch Bilder, Videos und Dokumente als Eingabe verarbeitet. Vorgestellt hat der Konzern das Modell am 19. Juli 2026 auf der World AI Conference in Shanghai, zunächst unter dem Namen "Qwen3.8-Max-Preview". Nach Anbieterangaben ist es das bislang leistungsfähigste Modell des Unternehmens.

Qwen 3.8 Max - Überblick und technische Daten

AnbieterAlibaba Cloud
FamilieQwen 3.8
Erschienen19. Juli 2026Vorgestellt am 19. Juli 2026 auf der World AI Conference in Shanghai, zunächst als Qwen3.8-Max-Preview. Ein Datum für die allgemeine Freigabe ohne Preview-Kennzeichnung ist nicht belegt.
LizenzQwen3.8-Max License (eigene Anbieterlizenz)
Gewichteoffen seit 12. August 2026, Selbstbetrieb möglichAm 12. August 2026 als Qwen3.8-2.4T-A95B auf Hugging Face erschienen (BF16 und FP8). Offen ist das Basismodell, nicht die Max-Ausbaustufe: nur Text, nur Thinking-Modus, nativ 262.144 Token Kontext (erweiterbar bis 1.010.000). Bildeingabe, Standard-1M-Kontext und Non-Thinking-Betrieb bleiben laut Modellkarte der Cloud-Version Qwen 3.8 Max vorbehalten.
Nutzbar überAlibaba Cloud
Preis ab2,00 USD je Mio. Input-Token
ArchitekturMixture of Experts
Parameter gesamt2,4 Billionen
Parameter aktiv95 Milliarden
Kontextfenster983.616 TokenDer Anbieter bewirbt "1 Mio. Token". Die Metadaten der Qwen-Cloud nennen 983.616 Token.
Maximaler Output131.072 Token
InputText, Bild, Video, Dokument
OutputText
Kennungqwen3.8-max, qwen3.8-max-preview

Preise

API-Preise: Qwen 3.8 Max im Vergleich API-Preise: Qwen 3.8 Max im Vergleich Dollar je eine Million Token. Je kürzer der Balken, desto günstiger. Input Output GPT-5.6 Luna 0,20 Dollar 1,20 Dollar Grok 4.5 2,00 Dollar 6,00 Dollar Qwen 3.8 Max 2,00 Dollar 6,00 Dollar GPT-5.6 Terra 2,00 Dollar 12,00 Dollar Claude Sonnet 5 3,00 Dollar 15,00 Dollar Quelle: Anbieter-Preislisten, Stand: 4. August 2026 · Grafik: AI NEWS pro
StufeInputOutputCache (Lesen)Stand
standardAlibaba Cloud2,006,000,254. August 2026

Beträge in US-Dollar je einer Million Token, nach Anbieterangabe.

standard: Der Cache-Preis gilt für wiederverwendete Eingaben über den impliziten Cache von Alibaba Cloud.

Benchmarks

Coding-Benchmarks: Qwen 3.8 Max im Vergleich Coding-Benchmarks: Qwen 3.8 Max im Vergleich Anteil gelöster Aufgaben in Prozent. Je länger der Balken, desto besser. Qwen 3.8 Max Claude Fable 5 Terminal-Bench 2.1 86,6 % 84,6 % SWE-bench Pro 67,7 % 80 % FrontierSWE 73,5 % 88,8 % Quelle: Alibaba (Herstellerangabe), Stand: 3. August 2026 · Grafik: AI NEWS pro
SuiteWertGemessen vonBedingungenStand
GPQA DiamondFassung diamond92,6 %Anbieter (Alibaba Cloud)Bedingungen nicht angegeben4. August 2026
SWE-bench ProFassung pro67,7 %Anbieter (Alibaba Cloud)Bedingungen nicht angegeben4. August 2026

Stand der Daten: 21. August 2026

Alibaba führt Qwen 3.8 Max als Flaggschiff seiner Modellfamilie Qwen 3.8. Der Konzern sucht damit den Anschluss an die internationale Spitzenklasse. Es ist das Aushängeschild einer Modell-Reihe, die in der Entwicklergemeinde seit Jahren sehr populär ist.

Technisch ist es ein Mixture-of-Experts-Modell. Vom gesamten Parameterbestand rechnet bei jeder Anfrage nur ein kleiner Teil, rund vier Prozent. Dieses Bauprinzip trennt die Kosten einer einzelnen Anfrage von der Gesamtgröße: Der Rechenaufwand richtet sich nach den aktiven Parametern, während der volle Bestand die Breite des Gelernten trägt. Ein Modell dieser Größenklasse bleibt dadurch überhaupt erst zu marktüblichen Preisen betreibbar.

Auf der Eingabeseite nimmt Qwen 3.8 Max Text, Bilder, Videos und Dokumente entgegen, ausgegeben wird ausschließlich Text. Das Kontextfenster umfasst fast eine Million Token. Dabei gehen Werbung und Technik allerdings auseinander. Der Anbieter bewirbt eine Million Token, die Metadaten der Qwen-Cloud weisen etwas weniger aus - den belegten Wert zeigt die Datentabelle weiter unten.

Offen ist der formale Status des Modells. Die Schnittstelle führt inzwischen zwei Kennungen, eine mit und eine ohne den Zusatz Preview. Ein greifbares Datum, ab dem das Modell den Preview-Zusatz vollständig abgelegt hat, gibt es aber nicht.

Am 12. August 2026 hat Alibaba die Open Weights auf Hugging Face bereitgestellt, unter dem technischen Namen Qwen3.8-2.4T-A95B und in zwei Formaten (BF16 und FP8). Es ist das erste Mal, dass der Konzern ein Modell seiner Max-Klasse offenlegt.

Das offene Modell ist allerdings nicht die Cloud-Fassung. Es versteht nur Text und arbeitet ausschließlich im Thinking-Modus. Sein Kontextfenster umfasst standardmäßig 262.144 Token, erweiterbar auf rund eine Million. Bildeingabe, den großen Kontext ab Werk und den Betrieb ohne Thinking behält der Anbieter der Cloud-Version vor, die er als ausgebaute Fassung desselben Basismodells führt.

Auch die Lizenz hat Limitierungen. Der Grundtext ähnelt einer MIT-Lizenz, doch zwei Schwellen schränken ihn ein. Wer mehr als 100 Millionen monatlich aktive Nutzer oder 20 Millionen US-Dollar Monatsumsatz erreicht, muss den Modellnamen sichtbar in der Oberfläche nennen. Und wer das Modell als Dienst oder als KI-Assistenten vermarktet und dabei auf mehr als 50 Millionen US-Dollar Umsatz in zwölf Monaten kommt, braucht eine separate kommerzielle Lizenz. Eine lupenreine Open-Source-Lizenz ist das also nicht.

Die Auslegung des Modells zielt auf große, gemischte Materialmengen. Wer umfangreiche Dokumentbestände, Bildstrecken oder Videomaterial in einem Durchgang verarbeiten will, findet hier die passenden Eingabekanäle und ein Kontextfenster, das solche Mengen aufnimmt.

Auffällig ist der Preis. Das nächstliegende Vergleichsmodell - das offene Kimi K3 von Moonshot AI, ebenfalls ein Mixture-of-Experts-System im Billionen-Parameter-Segment - verlangt für Ausgabe-Token das Zweieinhalbfache.

Die Preisangaben zu Qwen 3.8 Max stammen bislang allerdings aus einer aggregierenden Übersicht, die Prüfung gegen die Preisseite von Alibaba Cloud selbst steht noch aus.

Alibaba meldet Ergebnisse für GPQA Diamond, einen Wissenstest mit naturwissenschaftlichen Fragen auf Promotionsniveau, und für SWE-bench Pro, eine Suite mit schweren, mehrdateiigen Programmieraufgaben aus echten Repositories. In beiden Fällen fehlen jedoch die Messbedingungen. Werte ohne Bedingungen sind nicht vergleichbar - offen bleibt, in wie vielen Anläufen, mit welchen Hilfsmitteln und mit welchem Rechenaufwand sie entstanden sind.

Artificial Analysis führt Qwen 3.8 Max mit einem Intelligence Index von 58, deutlich über dem Median vergleichbarer Modelle von 35. Derselbe Dienst hält zwei Eigenheiten fest, die in Alibabas Zahlen nicht vorkommen. Das Modell antwortet mit rund 45 Token pro Sekunde auffällig langsam, und es schreibt sehr viel: In der Index-Messung hat es etwa doppelt so viele Token erzeugt wie der Median der Vergleichsmodelle. Wer nach Ausgabe-Token zahlt, bezahlt diese Ausführlichkeit mit.

Bei LMArena, wo Nutzer Modellantworten im Blindvergleich bewerten, zeigt sich ein geteiltes Bild. In der Code-Rangliste steht Qwen 3.8 Max auf Platz 3, in der allgemeinen Text-Rangliste auf Platz 17. Die Stärke liegt nach diesen Daten beim Programmieren, nicht in der Breite.

Einen direkten Vorgänger, den Qwen 3.8 Max ablöst, gibt es nicht. Der nächste Verwandte außerhalb des eigenen Hauses ist Kimi K3 von Moonshot AI - wie Qwen 3.8 Max ein Mixture-of-Experts-Modell im Billionen-Parameter-Bereich mit einem Kontextfenster in der Millionenklasse. Moonshot hat seine Gewichte Ende Juli 2026 freigegeben, ebenfalls unter einer eigenen Anbieterlizenz mit Umsatzschranke, die keine anerkannte Open-Source-Lizenz ist. Beide Unternehmen sind damit denselben Weg gegangen - Flaggschiff-Gewichte offen, aber zu eigenen Bedingungen.

DeepSeek V4 Flash 0731 spielt dagegen in einer anderen Gewichtsklasse: ein deutlich kompakteres Mixture-of-Experts-Modell aus China, MIT-lizenziert, selbst hostbar und im Niedrigpreissegment angesiedelt.

Im proprietären Spitzenfeld trifft Qwen 3.8 Max auf die GPT-5.6-Familie von OpenAI, auf die Claude-Reihe von Anthropic um Opus 5 und auf Grok 4.5 von xAI. Für die Rangfolge zwischen all diesen Modellen gibt es inzwischen zumindest eine gemeinsame Messlatte. Im Intelligence Index von Artificial Analysis stand Qwen 3.8 Max beim Abruf am 21. August 2026 auf Platz 11 von 182 gelisteten Modellen und damit in Reichweite der proprietären Spitze.

Quellen