Alle Anleitungen
Ratgeber10 Min. Lesezeit · aktualisiert 8. September 2026

Qwen3.8-Max, erklärt: fünf Modelle mit irgendeiner Version von „Qwen3 Max" im Namen seit 2025 – und welches gerade gemeint ist

Wer heute „qwen3 max" bei Google eingibt, bekommt Ergebnisse zu einem Modell, das Alibaba vor einem Jahr eingestellt hat, gemischt mit Ergebnissen zu dem Modell, das diesen Monat erschienen ist – ohne erkennbares Signal, welches welches ist. Ein unabhängiger Tracker benchmarkt weiterhin das alte Modell. Wir haben die tatsächliche Zeitleiste zusammengestellt, geprüft, welche Versionen offene Gewichte haben und welche nicht (die Antwort ist komplizierter als ein einfaches Ja oder Nein), und den aktuellen Preis direkt aus einer Live-API-Auflistung entnommen.

Kurze Antwort

Das aktuelle Flaggschiff ist Qwen3.8-Max, genauer das „-0902"-Refresh, das Alibaba am 2. September 2026 veröffentlicht hat: 2,4 Billionen Parameter insgesamt, ein spärliches Mixture-of-Experts-Design, ein Kontextfenster von 1 Million Tokens und 2,00 $ pro Million Input-Tokens / 6,00 $ pro Million Output-Tokens auf OpenRouter.

Es ist geschlossen, nur über API. Alibaba hat die Gewichte von Qwen3.8-Max nicht veröffentlicht. Was unter derselben „3.8"-Namensgebung separat veröffentlicht wurde, war ein reduzierter, reiner Text-Checkpoint (unter einer restriktiven eigenen Lizenz, nicht Apache) und ein unabhängiges, dichtes 27B-Modell (kostenlos, Apache 2.0): drei verschiedene Produkte, ein verwirrend gemeinsamer Name.

„Qwen3-Max" (ohne „.8", ohne Punkt-Version) ist ein anderes, älteres, eingestelltes Modell aus dem September 2025 mit über 1 Billion Parametern, das Alibabas eigener Nachfolger überflüssig macht. Mindestens ein unabhängiger Benchmark-Tracker führt es weiterhin als aktiven Vergleichspunkt, und genau so hält sich die Verwechslung.

Die eine Zahl zu aktiven Parametern, die überall auftaucht („~95 Mrd. aktiv"), ist keine von Alibaba bestätigte Angabe. Es handelt sich um eine vielfach wiederholte Schätzung aus Sekundärquellen. Alibaba hat die 2,4 Billionen insgesamt offengelegt, aber nicht die Zahl der aktiven Parameter.

Die Zeitleiste, denn so hat sie noch niemand aufgeschrieben

Alibabas Qwen-Team hat im vergangenen Jahr fünf unterschiedlich benannte Dinge veröffentlicht, die in irgendeiner Kombination „Qwen3" und „Max" im Namen tragen. Von links nach rechts gelesen wirkt die Namensgebung inkrementell. Das ist sie nicht: Es handelt sich um verschiedene Modelle mit unterschiedlichen Fähigkeiten, unterschiedlichen Lizenzen und in zwei Fällen um Preisseiten verschiedener Anbieter, die sich nicht einig sind, was dasselbe Modell kostet.

Date              Release                        What it is
------------------------------------------------------------------------
Sept 2025         Qwen3-Max-Preview, then         >1T params, MoE, closed,
                   Qwen3-Max (stable, Sept 23-24)   API/Qwen Chat only.
                                                     Now discontinued.
Jan 2026           Qwen3-Max-Thinking              Reasoning-mode variant
                                                     of the same Max line,
                                                     not a separate model
                                                     family. Closed.
Jul 19, 2026       Qwen3.8-Max (preview)           2.4T params announced
                                                     at WAIC Shanghai.
Aug 3, 2026        Qwen3.8-Max (GA)                Full release: 1M
                                                     context, $2/$6 per
                                                     1M tokens. Closed.
Aug 12-13, 2026    Qwen3.8-2.4T-A95B               Same base architecture,
                                                     text-only, reduced.
                                                     Open weights, but
                                                     restrictive custom
                                                     license (not Apache).
Aug 13-14, 2026    Qwen3.8-27B                     Unrelated dense model,
                                                     27B params, genuinely
                                                     open, Apache 2.0,
                                                     runs on one GPU.
Sept 2, 2026       Qwen3.8-Max-0902                Post-training refresh
                                                     of the Aug 3 build.
                                                     Same price/specs,
                                                     stronger coding and
                                                     agent benchmarks.

Das Modell, das heute so gut wie sicher gemeint ist, wenn man „qwen3 max" sucht, ist die letzte Zeile: Qwen3.8-Max-0902, seit dem 3. September 2026 live auf OpenRouter. Alles darüber in der Tabelle ist entweder eingestellt, ein Modus statt eines eigenständigen Modells, oder ein völlig anderes Produkt, das zufällig denselben Namen trägt.

Warum die Verwechslung real ist, nicht bloß nachlässig geschrieben

Wir haben Artificial Analysis geprüft, einen der meistzitierten unabhängigen Benchmark-Tracker, und dessen „Qwen3 Max"-Modellseite bezieht sich auf das ursprüngliche Modell aus dem September 2025, nicht auf Qwen3.8-Max. Die Seite gibt an, dass Alibaba für dieses Modell nie eine Parameterzahl offengelegt hat, markiert es als veraltet mit eingestelltem Benchmarking außer bei einer Eingabelänge von 10.000 Tokens, und listet einen Preis von 1,20 $ pro Million Input-Tokens und 6,00 $ pro Million Output-Tokens. OpenRouters eigene Auflistung desselben nominellen Modells zeigt stattdessen 0,78 $ für Input und 3,90 $ für Output, ein realer, ungelöster Widerspruch zwischen zwei aktiven Quellen über den Preis des Modells, das nach übereinstimmender Meinung inzwischen veraltet ist. Zum Zeitpunkt dieses Textes hatte Artificial Analysis noch keinen eigenen, unabhängigen Wert für Qwen3.8-Max selbst veröffentlicht, das heißt, die meisten kursierenden Benchmark-Zahlen für das aktuelle Modell gehen auf Alibabas eigene veröffentlichte Tabellen zurück, nicht auf eine unabhängige Überprüfung.

Diese Lücke wurde binnen Stunden nach dem Ranking-Update eines Aggregators öffentlich sichtbar. Ein Hacker-News-Thread, der darüber diskutiert, dass Qwen3.8-Max als „bestes Gesamtmodell nach agentischem Index" eingestuft wurde, deckte auf, dass der zugrunde liegende Benchmark-Anbieter mitten im Zyklus sein Bewertungsmodell austauschte, wodurch Qwens Wert von 55,4 auf 58,4 sprang und ein konkurrierendes Modell (Claude Opus) es innerhalb desselben Nachrichtenzyklus wieder überholte. Kommentatoren wiesen direkt auf diese Volatilität hin: eine Ranglistenposition, die sich „in wenigen Sekunden" spürbar verändert, obwohl darunter dieselbe Benchmark-Beschreibung steht. Wer ein Modell anhand eines einzelnen Ranglisten-Screenshots auswählt, findet in diesem Thread eine nützliche Erinnerung daran, dass der Screenshot veraltet sein kann, noch bevor man ihn zu Ende gelesen hat.

Was Qwen3.8-Max tatsächlich ist

Das aktuelle Flaggschiff ist ein spärliches Mixture-of-Experts-Modell mit 2,4 Billionen Parametern insgesamt. Die häufig zitierte Zahl von „~95 Milliarden aktiven Parametern" taucht in fast jeder Sekundärquelle zu diesem Modell auf, ist aber keine Zahl, die Alibaba in seiner eigenen Ankündigung bestätigt hat; sie sollte als vielfach wiederholte Schätzung behandelt werden, nicht als Spezifikation. Das Modell ist multimodal, verarbeitet Text-, Bild- und Video-Eingaben, und Alibaba positioniert es rund um Coding, Full-Stack-Entwicklung, Datenanalyse und allgemeine Büroarbeit, mit dem Anspruch, gegenüber der vorherigen Qwen3.7-Max-Generation bei genau diesen Aufgaben Fortschritte gemacht zu haben.

Das Kontextfenster reicht bis zu 1 Million Tokens (rund 991.000 nutzbar für die Eingabe, wenn man das Output-Budget berücksichtigt), mit bis zu 131.072 Tokens für eine einzelne Vervollständigung. Auf OpenRouters Live-Auflistung kostet es 2,00 $ pro Million Input-Tokens und 6,00 $ pro Million Output-Tokens, mit Cache-Preisen von 0,25 $ pro Million für einen Cache-Read und 2,50 $ pro Million für einen 5-Minuten-Cache-Write. Erreichbar ist es über Alibabas eigene Qwen-Chat-Oberfläche, die DashScope-API, OpenRouter und die Qoder-IDE-Integration. Es gibt eine separate, unabhängige Behauptung, die sich nur in einer einzigen Quelle findet und anderswo nicht bestätigt wird, wonach das Modell nativ 262.144 Tokens Kontext unterstütze, erweiterbar auf 1.010.000; diese konkrete Darstellung lässt sich nicht bestätigen, weshalb die einfachere Angabe „bis zu 1M" die sicherere Formulierung ist.

Offene Gewichte oder nicht? Kommt darauf an, welches „Qwen3.8" gemeint ist

Das ist der folgenreichste Punkt der Verwechslung, denn die ehrliche Antwort teilt sich in drei Richtungen auf, je nachdem, um welches Produkt es genau geht:

  • Qwen3.8-Max selbst, das vollständige multimodale Flaggschiff mit dem 1M-Kontextfenster, das man über Qwen Chat, die API oder OpenRouter erreicht, ist geschlossen. Alibaba hat seine Gewichte nicht veröffentlicht, und die Berichterstattung zur Preview-Ankündigung vom Juli 2026 beschrieb es unmissverständlich als proprietär, nur über API zugänglich, ohne geplante herunterladbare Veröffentlichung.
  • Qwen3.8-2.4T-A95B, separat veröffentlicht um den 12./13. August 2026, teilt sich dieselbe Basisarchitektur, ist aber reiner Text, verzichtet auf den nativen 1M-Kontext und Bild-Eingaben, und Alibaba hat dessen Gewichte tatsächlich veröffentlicht, allerdings unter einer eigenen Lizenz, nicht unter Apache 2.0 oder einer anderen OSI-anerkannten Lizenz. Diese Lizenz verlangt Berichten zufolge eine kostenpflichtige kommerzielle Vereinbarung, sobald ein Einsatz bestimmte Umsatz- oder Nutzerschwellen überschreitet (genannte Zahlen sind 50 Mio. $/Jahr MaaS-Umsatz oder 100 Millionen monatlich aktive Nutzer / 20 Mio. $ Monatsumsatz). Nach der Veröffentlichung kursierte ein Gerücht, die Lizenz enthalte zudem territoriale Download-Beschränkungen für die USA, die EU, Großbritannien und Südkorea; der veröffentlichte Lizenztext auf Hugging Face enthält keine solche territoriale Klausel, diese konkrete Behauptung sollte also als widerlegt gelten und nicht als Tatsache wiederholt werden. Das ist nicht dasselbe Produkt wie Qwen3.8-Max, auch wenn sich der Name fast vollständig überschneidet.
  • Qwen3.8-27B, veröffentlicht in derselben Woche (13./14. August 2026), ist ein deutlich kleineres dichtes Modell mit 27 Milliarden Parametern, wirklich offen unter Apache 2.0 und klein genug, um auf einer einzigen Consumer-GPU zu laufen. Es ist eine völlig eigenständige Modellreihe, getrennt von der Max-Familie; die einzige Gemeinsamkeit mit dem Flaggschiff ist die „3.8" im Namen. Unser eigener Qwen3.8-27B-Ratgeber erklärt, was es kann und was nicht, wenn lokale, selbst gehostete Inferenz das eigentliche Ziel ist.

Ganz klar gesagt: Wer „ist Qwen3.8-Max Open Source" gesucht hat, in der Hoffnung, das Flaggschiff lokal zu betreiben, bekommt die Antwort nein. Wenn eine Schlagzeile behauptet hat, Qwen habe die Gewichte für „Qwen3.8" veröffentlicht, war damit sehr wahrscheinlich der kleinere 2.4T-A95B-Checkpoint oder das unabhängige 27B-Modell gemeint, nicht das vollständige Max-Produkt, das die meisten mit „Qwen3.8-Max" meinen. Unsere Berichterstattung zu Qwen3.8-Flash-Next behandelt eine dritte, separate Open-Weight-Veröffentlichung aus derselben Familie mit eigenem 1M-Kontext und einer nicht-parametrischen Embedding-Architektur, ein wirklich anderes Design als sowohl die Max-Reihe als auch das 27B-Modell, trotz des überschneidenden Generationsnamens.

Wie es im Vergleich abschneidet, mit dem Vorbehalt, dass das meiste davon selbst berichtet ist

Unabhängiges Drittanbieter-Benchmarking speziell zu Qwen3.8-Max ist derzeit dünn gesät. Die meisten kursierenden Vergleichszahlen, einschließlich Alibabas eigener Behauptung, GPT-5.6 Sol Max und Claude Fable 5 bei agentischen Computer-Use-Aufgaben zu schlagen, gehen auf Alibabas eigene veröffentlichte Tabellen zurück und nicht auf einen neutralen Dritten, der denselben Test bei jedem Modell durchführt. Ein nützlicher, wenn auch begrenzter Datenpunkt: Eine Hacker-News-Diskussion zitierte unabhängige Kosten-pro-Aufgabe-Zahlen, die Qwen bei rund 1,13 $ pro Aufgabe gegenüber Claude Opus bei rund 1,80 $ für vergleichbare agentische Arbeit ansetzen, eine echte Effizienzlücke, sollte sie sich bestätigen, aber aus der Methodik einer einzigen Quelle stammend, nicht aus breitem Konsens. Während Geminis Benchmark-Zahlen von mindestens einem Tracker als unabhängig geprüft beschrieben werden, werden Qwens Zahlen in derselben Quelle als selbst berichtet bezeichnet. Diese Asymmetrie ist relevant, wenn eine Kaufentscheidung auf einem Vergleichsdiagramm beruht: Es lohnt sich zu prüfen, ob die Qwen-Zahlen im Diagramm von Alibaba stammen oder von demselben Labor, das jedes andere Modell in der Zeile getestet hat.

Wo das hinpasst, wenn man sich nicht tief mit Modell-Benchmarks beschäftigt

Wenn der eigentliche Anwendungsfall darin besteht, bereits vorhandene Dokumente zusammenzufassen oder mit ihnen zu chatten, statt ein Frontier-Coding-Modell auszuwählen, spielt Qwen3.8-Max in dieser Kategorie eigentlich keine Rolle: Es gibt kein darum gebautes Dokumenten-Grounding-Produkt wie bei Gemini Notebook oder ChatPDF, und der 1M-Token-Kontext ist eine reine Kapazitätszahl, kein Zitier- und Retrieval-System. Wer es bewertet, weil er zwischen gehosteten Frontier-Modellen für Coding oder agentische Arbeit wählt, sollte praktisch Folgendes prüfen: sicherstellen, dass man den Preis des „-0902"-Refresh vergleicht und nicht des veralteten ursprünglichen Qwen3-Max (die beiden haben bei mindestens einem Tracker unterschiedliche Preise), klären, ob man wirklich das geschlossene API-Flaggschiff braucht oder eigentlich mit dem Open-Weight-27B-Modell besser bedient wäre, und die aktuellen Preise direkt gegen Alibabas eigene DashScope-Seite oder eine Live-Auflistung bei OpenRouter gegenprüfen statt gegen einen statischen Blogbeitrag, da diese Modellfamilie Namen und Preis in unter zwölf Monaten schon zweimal geändert hat.

Auch der Zugang folgt derselben Aufteilung wie die Lizenzierung. Qwen3.8-Max über Alibabas Qwen-Chat-App oder die DashScope-API zu erreichen, erfordert ein Alibaba-Cloud-Konto und für die API eine Abrechnung nach den oben genannten Preisen pro Token. OpenRouter ist der einfachere Weg, wenn man es bereits für andere Modelle nutzt: Dort wird Qwen3.8-Max als Modell mit nur einem Anbieter geführt (ausschließlich Alibaba Cloud International, kein Fallback-Routing), sodass ein Ausfall oder Rate-Limit auf Alibabas Seite nirgendwo anders hin ausweichen kann, anders als bei manchen Multi-Provider-Einträgen auf derselben Plattform. Wer tatsächlich selbst etwas betreiben möchte, statt eine API aufzurufen, sollte bedenken, dass Qwen3.8-Max dafür keine Option ist: Die Open-Weight-Wege in dieser Familie sind der restriktiv lizenzierte Qwen3.8-2.4T-A95B-Checkpoint oder das wirklich offene Qwen3.8-27B, und nur das 27B-Modell passt realistisch auf Hardware, die die meisten Einzelpersonen oder kleinen Teams besitzen.

Häufige Fragen

Was ist Qwen3.8-Max?

Alibabas aktuelles KI-Flaggschiff: ein spärliches Mixture-of-Experts-Modell mit 2,4 Billionen Parametern und einem Kontextfenster von 1 Million Tokens, veröffentlicht am 3. August 2026 und am 2. September 2026 als „Qwen3.8-Max-0902" aufgefrischt. Es ist geschlossen und nur über API nutzbar, mit einem Preis von 2,00 $ pro Million Input-Tokens und 6,00 $ pro Million Output-Tokens auf OpenRouter.

Ist Qwen3.8-Max dasselbe wie Qwen3-Max?

Nein. Qwen3-Max (ohne „.8") ist ein älteres, eingestelltes Modell aus dem September 2025 mit über 1 Billion Parametern. Qwen3.8-Max ist sein Nachfolger von 2026 mit mehr als der doppelten Parameterzahl und einem deutlich größeren Kontextfenster. Mindestens ein Benchmark-Tracker führt das alte Modell weiterhin separat, was eine häufige Quelle der Verwechslung ist.

Ist Qwen3.8-Max Open Source?

Das vollständige Qwen3.8-Max-Flaggschiff hat keine offenen Gewichte; es ist geschlossen und nur über Alibabas API, Qwen Chat und Drittplattformen wie OpenRouter verfügbar. Ein verwandter, aber anderer, reduzierter reiner Text-Checkpoint (Qwen3.8-2.4T-A95B) wurde mit offenen Gewichten unter einer restriktiven eigenen Lizenz veröffentlicht, und ein separates, kleineres 27B-Modell (Qwen3.8-27B) wurde unter einer wirklich offenen Apache-2.0-Lizenz veröffentlicht. Das sind drei verschiedene Produkte trotz der gemeinsamen „3.8"-Namensgebung.

Wie viel kostet Qwen3.8-Max?

2,00 $ pro Million Input-Tokens und 6,00 $ pro Million Output-Tokens, laut OpenRouters Live-Auflistung für die aktuelle „-0902"-Version, Stand September 2026. Das ältere, eingestellte Qwen3-Max hatte andere, uneinheitlich berichtete Preise, ein für dieses Modell gefundener Preis sollte also nicht übernommen werden.

Was ist Qwen3-Max-Thinking?

Eine auf Reasoning ausgelegte Variante der ursprünglichen Qwen3-Max-Reihe, veröffentlicht etwa im Januar 2026. Die Hinweise deuten darauf hin, dass es sich eher um einen Modus oder Checkpoint innerhalb derselben Max-Linie handelt (aktivierbar über einen API-Parameter) als um eine völlig eigenständige Modellarchitektur, auch wenn die Berichterstattung dazu nicht ganz einheitlich ist. Es bleibt geschlossen, nur über API und Qwen Chat.

Weiterlesen