Alle Modelle

Qwen 3.8 Max

Qwen 3.8 Max ist die oberste Stufe der Modellreihe Qwen 3.8. Entwickelt hat sie Qwen, der KI-Bereich des chinesischen Konzerns Alibaba. Es ist ein Textmodell: es liest Text und schreibt Text. Die Besonderheit gegenüber den meisten anderen Modellen im Katalog: Es denkt vor jeder Antwort erst schriftlich nach, und dieser Schritt lässt sich nicht abschalten.

Bei lowcloud ist Qwen 3.8 Max eines von 14 Modellen, die auf Servern in der EU laufen. Du wählst es im Chat für eine einzelne Nachricht, fest für einen Agenten oder für einen einzelnen Schritt eines Ablaufs. Die Verarbeitung geht nicht an Alibaba, sondern über die Melious AI GmbH in Saarbrücken an Rechenzentren in der EU. Die Modellwahl gehört zum kostenlosen Konto. Ohne Konto baut agent.lowcloud.de zwar einen Ablauf, wählt das Modell dabei aber selbst.

Hersteller
Qwen, China
Kontextfenster
256k Token
Bilder lesen
nein
Lizenz
Qwen3.8-Max-Lizenz
Verarbeitung
EU-Server über Melious

Woher Qwen 3.8 Max kommt

Hersteller ist Qwen, der KI-Bereich von Alibaba, Sitz in China. Das Modell gehört zur Reihe Qwen 3.8, die im August 2026 erschien. Ein eigenes Veröffentlichungsdatum nur für die Max-Stufe nennt Qwen nicht. Die Dokumentation von Alibaba dazu wurde zuletzt am 2. September 2026 aktualisiert und führt dort eine überarbeitete Fassung mit dem Namen qwen3.8-max-0902. Die Gewichte von Qwen 3.8 Max sind nicht veröffentlicht. Gewichte sind die trainierten Zahlen, aus denen ein Modell besteht; ohne sie kann niemand das Modell selbst aufsetzen. Nutzbar ist Qwen 3.8 Max nur über eine Schnittstelle bei einem Anbieter, der es betreibt. Öffentlich steht ein verwandtes Modell mit dem Namen Qwen3.8-2.4T-A95B. Qwen beschreibt Qwen 3.8 Max als die betreute Fassung davon. Dieses offene Modell hat 2,4 Billionen Parameter, von denen pro Anfrage 95 Milliarden aktiv sind. Die Bauweise heißt Mixture of Experts, kurz MoE: das Netz besteht aus vielen Teilnetzen, und pro Anfrage schaltet es nur einen kleinen Teil davon ein. Eine eigene Parameterzahl für die Max-Stufe veröffentlicht Qwen nicht. Die Lizenz des offenen Modells ist weder MIT noch Apache 2.0. Sie heißt Qwen3.8-Max License, stammt von Qwen selbst und enthält Auflagen: Produkte mit mehr als 100 Millionen aktiven Nutzern pro Monat oder mehr als 20 Millionen US-Dollar Monatsumsatz müssen den Modellnamen sichtbar in ihrer Oberfläche nennen. Wer Modellzugang weiterverkauft und dabei über 50 Millionen US-Dollar Jahresumsatz liegt, braucht eine gesonderte Erlaubnis von Qwen. Übersichtsseiten, die hier pauschal "Open Source" schreiben, sind ungenau. Stand 7. September 2026 ist Qwen 3.8 Max nicht abgelöst. Ein Nachfolger auf der Max-Stufe ist nicht auffindbar; die neueren Veröffentlichungen von Qwen liegen unterhalb davon.

Was "auf EU-Servern" hier konkret heißt

Die Kette hat drei Stationen. Du arbeitest in lowcloud. lowcloud, das ist die lowcloud UG in Bielefeld, gibt die Anfrage an die Melious AI GmbH in Saarbrücken weiter. Melious führt sie in Rechenzentren in der EU aus. Die Anfrage geht nicht an Alibaba. Der Hersteller des Modells ist an der Ausführung nicht beteiligt. Eines weiß lowcloud nicht und sagt das auch so: Melious betreibt keine eigenen Rechenzentren, sondern verteilt die Last auf europäische Betreiber. Welcher Betreiber ein bestimmtes Modell bedient, veröffentlicht Melious nicht. Wenn dein Kunde nach dem konkreten Betreiber fragt, ist die belastbare Antwort: EU, über einen benannten deutschen Vermittler, Betreiber nicht offengelegt.

Was lowcloud selbst an der Schnittstelle geprüft hat

Drei Angaben in diesem Text stammen aus eigenen Versuchen gegen die Schnittstelle, nicht aus der Herstellerdokumentation. Alle drei weichen von ihr ab. Erstens Bilder: Über den EU-Weg nimmt Qwen 3.8 Max keine Bilder an. Die Dokumentation von Alibaba führt für ihre eigene betreute Fassung Bild- und Videoeingaben auf. Zweitens feste JSON-Schemas: Ein JSON-Schema ist eine Feldvorgabe, die der Anbieter erzwingt, damit eine Antwort garantiert genau die vorgegebenen Felder enthält. Über den EU-Weg lehnt der Anbieter solche Schemas mit einer Fehlermeldung ab. Alibaba führt strukturierte Ausgaben für die eigene Fassung als unterstützt auf. Drittens das Kontextfenster, also wie viel Text das Modell in einer Anfrage auf einmal verarbeiten kann. Gemessen wird das in Token; ein Token ist ein Textstück von etwa einem halben bis einem ganzen Wort. Der Katalog von lowcloud nennt 256k Token, also rund 256.000. Alibaba nennt für die eigene betreute Fassung 1 Million. Alle drei Abweichungen passen zu dem offen veröffentlichten Modell Qwen3.8-2.4T-A95B: Es verarbeitet nur Text, sein natives Kontextfenster liegt bei 262.144 Token, und sein Nachdenken lässt sich laut Modellkarte nicht abschalten. Dass über den EU-Weg genau dieses Modell antwortet, ist damit nicht bewiesen, nur naheliegend. Plane mit dem, was gemessen ist: keine Bilder, keine festen JSON-Schemas, 256k Kontext.

Wofür das Modell taugt

Für Schritte, in denen etwas abgewogen werden muss. Das Modell arbeitet vor der Antwort erst schriftlich durch, was zu beachten ist. Dieser Schritt heißt Reasoning und ist hier immer an. Bei Aufgaben mit mehreren Regeln, Ausnahmen oder widersprüchlichen Angaben im Ausgangstext ist das der Unterschied zu einem Modell, das sofort losschreibt. Konkrete Stellen in Abläufen: eine Reklamation gegen die eigenen Kulanzregeln prüfen und die Entscheidung begründen. Aus einem langen Vertrag die Punkte ziehen, die von der eigenen Vorlage abweichen. Zwei Angebote nebeneinanderlegen und benennen, worin sie sich unterscheiden. Eine unklar formulierte Kundenanfrage lesen und entscheiden, welcher der vorhandenen Abläufe zuständig ist. 256k Kontext reichen für lange Einzeldokumente und für Abläufe, die viele Zwischenergebnisse mitschleppen. Am sinnvollsten setzt du das Modell punktuell ein. In lowcloud lässt sich das Modell pro Schritt festlegen: der eine Schritt, der abwägen muss, läuft auf Qwen 3.8 Max, die einfachen Schritte davor und danach auf einem schnelleren Modell. Das begrenzt gleichzeitig Laufzeit und Kosten.

Wofür es nicht taugt

Keine Bilder. Wenn ein Schritt einen Screenshot, ein Foto oder eine eingescannte Rechnung lesen soll, scheidet Qwen 3.8 Max aus. Bilder lesen können im EU-Katalog: Kimi K3, Kimi K2.7 Code, Kimi K2.6, GLM 5.3 Flash, Qwen 3.8 27B und Mistral Small 4. Keine festen JSON-Schemas. Wenn die Antwort eines Schritts garantiert bestimmte Felder enthalten muss, weil ein anderes System damit weiterarbeitet, nimm ein Modell, das Schemas annimmt: Kimi K2.6, GLM 5.1, GLM 5, Qwen 3.5 397B oder DeepSeek V4 Flash. Qwen 3.5 397B ist dabei die nächstliegende Wahl aus derselben Reihe. Nicht für viele kleine Schritte. Einsortieren, kurze Standardantworten, Felder aus einer Mail ziehen: dafür ist das ständige Nachdenken zu langsam und erzeugt bei jeder einzelnen Antwort zusätzliche Ausgabe-Token, die bezahlt werden. Nicht für Textmengen jenseits von 256k. Mit 1 Million Kontext stehen im EU-Katalog Kimi K3, GLM 5.3, GLM 5.3 Flash, GLM 5.2 und DeepSeek V4 Pro.

Was es kostet

Eine Zahl steht hier nicht. Auf den Einkaufspreis kommt ein Aufschlag, eine veröffentlichte Zahl wäre also falsch. Was du stattdessen bekommst: Jeder Lauf zeigt in der App, was er in Euro gekostet hat. Zur Einordnung innerhalb des EU-Katalogs: Qwen 3.8 Max liegt preislich in der oberen Mitte. Es gibt günstigere und es gibt teurere Modelle. Wichtiger als diese Position ist das dauernde Nachdenken. Es erzeugt bei jeder Antwort zusätzliche Ausgabe-Token, und Ausgabe-Token werden abgerechnet, auch wenn der Nutzer sie am Ende nicht zu sehen bekommt. Ein Lauf mit Qwen 3.8 Max fällt deshalb in der Praxis teurer aus, als seine Position in der Liste vermuten lässt. Dazu kommt die längere Laufzeit. Der belastbare Vergleich läuft über den eigenen Ablauf: einmal mit Qwen 3.8 Max ausführen, einmal mit einem schnelleren Modell, und die beiden Eurobeträge nebeneinanderlegen. Das ist auch die Zahl, die du deinem Kunden zeigen kannst.

Qwen 3.8 Max ausprobieren

Für die Modellwahl brauchst du ein kostenloses Konto. Danach wählst du Qwen 3.8 Max im Chat, pro Agent oder pro Schritt.

Häufige Fragen

Was ist Qwen 3.8 Max?

Die oberste Stufe der Modellreihe Qwen 3.8, entwickelt von Qwen, dem KI-Bereich des chinesischen Konzerns Alibaba. Die Reihe erschien im August 2026. Es ist ein Textmodell: es liest Text und schreibt Text. Über den EU-Weg von lowcloud nimmt es keine Bilder an. Vor jeder Antwort denkt es schriftlich nach, und dieser Schritt lässt sich nicht abschalten.

Gehen meine Daten nach China, wenn ich Qwen 3.8 Max nutze?

Nein. Entwickelt wurde das Modell in China, ausgeführt wird es bei lowcloud auf Servern in der EU. Die Kette: lowcloud UG in Bielefeld gibt die Anfrage an die Melious AI GmbH in Saarbrücken, die sie in europäischen Rechenzentren ausführt. Alibaba bekommt die Anfrage nicht. Zwei Dinge solltest du im Kundengespräch offen sagen: Wer ein Modell gebaut hat, ist eine andere Frage als, wo es läuft. Und welcher europäische Betreiber dieses Modell konkret bedient, veröffentlicht Melious nicht, also weiß lowcloud es auch nicht.

Ist Qwen 3.8 Max Open Source?

Nein. Die Gewichte von Qwen 3.8 Max sind nicht veröffentlicht, das Modell ist nur über eine Schnittstelle nutzbar. Öffentlich steht ein verwandtes Modell namens Qwen3.8-2.4T-A95B, und auch das nicht unter MIT oder Apache 2.0, sondern unter einer eigenen Lizenz von Qwen. Die verlangt bei großen Produkten eine sichtbare Nennung des Modellnamens und beim Weiterverkauf von Modellzugang oberhalb einer Umsatzschwelle eine gesonderte Erlaubnis. Übersichtsseiten, die hier "Open Source" schreiben, verkürzen das.

Kann Qwen 3.8 Max Bilder lesen?

Über lowcloud nicht. Der Versuch gegen die Schnittstelle scheitert; das hat lowcloud selbst geprüft. Die Dokumentation von Alibaba führt für ihre eigene betreute Fassung Bilder und Videos auf, über den EU-Weg trifft das nicht zu. Wenn ein Schritt ein Bild lesen soll, nimm aus dem EU-Katalog Kimi K3, Kimi K2.7 Code, Kimi K2.6, GLM 5.3 Flash, Qwen 3.8 27B oder Mistral Small 4.

Warum nennt Alibaba 1 Million Token Kontext und lowcloud 256k?

Weil das, was über den EU-Weg antwortet, sich nicht so verhält wie Alibabas eigene betreute Fassung. 256k ist die Zahl aus dem Katalog von lowcloud, und mit der solltest du planen. Sie entspricht dem nativen Kontextfenster des offen veröffentlichten Modells Qwen3.8-2.4T-A95B, nämlich 262.144 Token. Ob genau dieses Modell dahintersteht, ist nicht bestätigt. Wenn du mehr Kontext brauchst: Kimi K3, GLM 5.3, GLM 5.3 Flash, GLM 5.2 und DeepSeek V4 Pro stehen mit 1 Million im Katalog.

Was kostet Qwen 3.8 Max bei lowcloud?

Den genauen Betrag zeigt die App an jedem Lauf, in Euro. Eine Zahl auf dieser Seite gibt es nicht, weil auf den Einkaufspreis ein Aufschlag kommt und die veröffentlichte Zahl damit falsch wäre. Zur Einordnung: Im EU-Katalog liegt das Modell preislich in der oberen Mitte. Weil es bei jeder Antwort zusätzliche Ausgabe-Token für das Nachdenken erzeugt, fällt ein Lauf teurer aus, als diese Position vermuten lässt.

Qwen 3.8 Max ist ein Produktname von Qwen. Zwischen lowcloud und Qwen besteht keine Geschäftsbeziehung; wir betreiben das offen verfügbare Modell über einen europäischen Anbieter. Stand: 7. September 2026.