Alle Modelle

GLM 5.3: was das Modell ist und wie lowcloud es auf EU-Servern betreibt

GLM 5.3 ist ein Sprachmodell des chinesischen Anbieters Z.ai. Die Gewichte liegen seit dem 25. August 2026 öffentlich auf Hugging Face, das Modell hat 753 Milliarden Parameter, verarbeitet nur Text und fasst rund 1 Million Token Kontext. Token sind die Textbausteine, in die ein Modell eine Eingabe zerlegt; ein Token entspricht grob einem halben bis einem ganzen Wort.

Bei lowcloud wählst du GLM 5.3 als Modell hinter einem Agenten, für eine einzelne Nachricht im Chat oder für einen einzelnen Schritt eines Ablaufs. Die Anfrage geht dann nicht an Z.ai, sondern über die Melious AI GmbH in Saarbrücken an Rechenzentren in der EU.

Hersteller
Z.ai, China
Kontextfenster
1 Mio. Token
Bilder lesen
nein
Lizenz
GLM-5.3-Lizenz
Verarbeitung
EU-Server über Melious

Woher das Modell kommt

Hersteller ist Z.ai, ein Anbieter aus China. Das Modell-Repository zai-org/GLM-5.3 auf Hugging Face wurde am 25. August 2026 angelegt. Jeder kann die Gewichte herunterladen und das Modell selbst betreiben. GLM 5.3 ist ein MoE-Modell. MoE steht für Mixture of Experts: das Modell besteht aus vielen Teilnetzen, und pro Token rechnet nur ein kleiner Teil davon. Die Konfigurationsdatei im Repository nennt 78 Schichten, 256 wählbare Experten plus einen fest genutzten, davon 8 pro Token. Wie viele der 753 Milliarden Parameter dadurch je Token tatsächlich aktiv sind, veröffentlicht Z.ai nicht. GLM 5.3 nutzt laut Modellkarte dasselbe Basismodell wie GLM 5.2. Der Unterschied entsteht im Nachtraining. Z.ai gibt dort eine Verbesserung von 50 Prozent gegenüber GLM 5.2 auf einem hauseigenen Code-Testsatz an. Das ist eine Herstellerangabe aus der Modellkarte vom 25. August 2026, keine unabhängige Messung. Einen Nachfolger gibt es nicht. Stand 7. September 2026 ist GLM 5.3 das neueste Modell der Reihe; daneben steht GLM 5.3 Flash, ein kleineres Modell mit eigenem Zuschnitt.

Die Lizenz ist nicht MIT

Viele Übersichtsseiten führen GLM 5.3 unter „Open Source". Das ist ungenau. Hugging Face weist als Lizenz „other" mit dem Namen „glm-5.3" aus. Es gilt eine eigene Lizenz von Z.ai, nicht MIT und nicht Apache 2.0. Inhaltlich ist sie MIT-nah: der Urheberrechtshinweis muss bei Weitergabe mitlaufen, die Nutzung muss geltendem Recht entsprechen, Gewährleistung gibt es keine. Dazu kommt eine Auflage, die MIT nicht hat. Wer das Modell als Dienst anbietet und mit verbundenen Unternehmen in zwölf zusammenhängenden Monaten mehr als 10 Milliarden US-Dollar Umsatz macht, muss vorher eine Sicherheitsprüfung von Z.ai bestehen. Die Lizenz nimmt davon zwei Fälle ausdrücklich aus: Produkte, die Modellfähigkeiten nur eingebettet nutzen, und das reine Weiterleiten von Anfragen an fremd gehostete Modelle. Für dich und für lowcloud hat diese Schwelle keine praktische Folge. Wenn dein Kunde nach der Lizenz fragt, lautet die richtige Antwort trotzdem „offene Gewichte unter einer eigenen Z.ai-Lizenz", nicht „Open Source".

Was „auf EU-Servern" konkret heißt

Die Kette ist kurz und benennbar: dein Kunde, die lowcloud UG in Bielefeld, die Melious AI GmbH in Saarbrücken, Rechenzentren in der EU. Z.ai kommt darin nicht vor. Der Hersteller stellt die Gewichte bereit und sieht deine Anfragen nicht. Melious betreibt keine eigenen Rechenzentren, sondern verteilt auf europäische Betreiber und sagt zu, dass die Verarbeitung in der EU bleibt. Was lowcloud nicht weiß: welcher Betreiber GLM 5.3 im Einzelfall bedient. Melious veröffentlicht das nicht. Wir geben die Zusage weiter, die wir haben, und nicht mehr. Der Unterschied zu den anderen Wegen: wer direkt bei Z.ai bucht, lässt in China verarbeiten. Wer über einen Weitervermittler wie OpenRouter geht, landet je nach Auslastung bei wechselnden Anbietern, meist außerhalb der EU; eine feste Zuständigkeit pro Modell ist dort nicht Teil des Angebots. Bevor du GLM 5.3 mit Daten eines Kunden einsetzt, klären wir die vertragliche Seite mit dir: Auftragsverarbeitung nach Art. 28 DSGVO und die Nennung der Unterauftragsverarbeiter. Das gehört ins Gespräch, nicht auf eine Webseite.

Wofür GLM 5.3 taugt

Lange Eingaben. Rund 1 Million Token Kontext reichen für einen Stapel Verträge, ein Jahr Ticketverlauf oder eine komplette Dokumentation, ohne das Material vorher zu zerteilen. Die Z.ai-Dokumentation nennt eine maximale Ausgabelänge von 128.000 Token, das Modell kann also auch lange Ergebnisse in einem Stück schreiben. Abläufe mit vielen Schritten. Z.ai richtet das Nachtraining von GLM 5.3 auf Agentenarbeit aus: mehrere Schritte hintereinander, dazwischen Aufrufe von Werkzeugen wie Suche, Postfach oder CRM. Das ist der Fall, für den ein Baukasten wie lowcloud gebaut ist. Text- und Codearbeit ohne Bildanteil. Zusammenfassen, Vergleichen, Umschreiben, Auswerten von Textdaten. Fälle, in denen du deinem Kunden den Verarbeitungsort nennen musst.

Wofür GLM 5.3 nicht taugt

Bilder. GLM 5.3 verarbeitet nur Text; die Z.ai-Dokumentation sagt das ausdrücklich, und lowcloud hat es gegen die API bestätigt. Ein angehängtes Foto oder ein Scan wird abgelegt und weitergereicht, aber nicht gelesen. Wenn ein Agent Bilder auswerten soll, nimm GLM 5.3 Flash, Kimi K2.6 oder Mistral Small 4. Alle drei laufen ebenfalls auf EU-Servern. Feste JSON-Schemas. Das ist ein Punkt, an dem lowclouds eigene Messung der Herstellerangabe widerspricht. Die Z.ai-Dokumentation führt „Structured Output" als unterstützt (abgerufen am 7. September 2026). Über den EU-Weg lehnt der Anbieter eine Anfrage mit festem JSON-Schema mit einem Fehler ab. Das ist eine eigene Beobachtung von lowcloud aus dem Test gegen die API, nicht abgeschrieben. Ob die Ursache bei Melious oder bei Z.ai liegt, ist ungeklärt. lowcloud fängt das ab und fordert die gewünschte Struktur im Prompt an, statt sie erzwingen zu lassen. Für einen Schritt, dessen Ausgabe exakt einem Schema folgen muss, weil ein anderes System sie direkt weiterverarbeitet, ist ein Modell mit Schema-Unterstützung die sicherere Wahl: Kimi K2.6, GLM 5.1, Qwen 3.5 397B oder DeepSeek V4 Flash, alle auf EU-Servern.

Was es kostet

Diese Seite nennt keinen Preis. Was ein einzelner Lauf gekostet hat, steht in Euro an jedem Lauf in der App. Das ist die Zahl, mit der du beim Kunden rechnest. Zur Einordnung: GLM 5.3 liegt im Mittelfeld der vierzehn EU-Modelle. Es ist weder das günstigste noch das teuerste. Du musst dich nicht auf ein Modell festlegen. Die Wahl gilt pro Nachricht im Chat, fest pro Agent oder pro einzelnem Schritt eines Ablaufs. Ein teures Modell lässt sich damit auf die zwei Schritte begrenzen, die es wirklich brauchen.

GLM 5.3 ausprobieren

Für die Modellwahl brauchst du ein kostenloses Konto. Danach wählst du GLM 5.3 im Chat, pro Agent oder pro Schritt.

Häufige Fragen

Gehen meine Daten nach China, wenn ich GLM 5.3 nutze?

Nein. Die Anfrage geht von lowcloud in Bielefeld an die Melious AI GmbH in Saarbrücken und wird in Rechenzentren in der EU verarbeitet. Z.ai stellt nur die öffentlich verfügbaren Modellgewichte bereit und sieht deine Anfragen nicht. Welcher europäische Betreiber das Modell im Einzelfall bedient, veröffentlicht Melious nicht.

Ist GLM 5.3 Open Source?

Die Gewichte sind öffentlich und frei herunterladbar, die Lizenz ist aber weder MIT noch Apache. Es gilt eine eigene Z.ai-Lizenz. Sie verlangt den Urheberrechtshinweis bei Weitergabe und, für Anbieter mit mehr als 10 Milliarden US-Dollar Umsatz in zwölf Monaten, eine vorherige Sicherheitsprüfung durch Z.ai. Für deinen Einsatz hat das keine Folge.

Kann GLM 5.3 Bilder lesen?

Nein, das Modell verarbeitet nur Text. Für Fotos, Scans oder Screenshots nimm GLM 5.3 Flash, Kimi K2.6 oder Mistral Small 4. Alle drei werden ebenfalls auf EU-Servern verarbeitet.

Wie groß ist GLM 5.3?

753 Milliarden Parameter insgesamt. Es ist ein MoE-Modell, es rechnet also pro Token nur mit einem Teil davon: 8 von 256 wählbaren Experten plus einem fest genutzten, über 78 Schichten. Wie viele Parameter das je Token ergibt, nennt Z.ai nicht.

Was ist der Unterschied zwischen GLM 5.3 und GLM 5.3 Flash?

Beide haben rund 1 Million Token Kontext, aber GLM 5.3 Flash liest zusätzlich Bilder und ist das günstigere der beiden. GLM 5.3 ist das größere Modell und auf lange Abläufe mit vielen Werkzeugaufrufen ausgerichtet. Beide sind bei lowcloud auf EU-Servern verfügbar.

Was brauche ich, um GLM 5.3 bei lowcloud zu nutzen?

Ein kostenloses Konto. Ohne Konto kannst du dir auf agent.lowcloud.de einen Ablauf bauen lassen, dabei wählt lowcloud das Modell aus. Die eigene Modellwahl kommt mit dem Konto.

GLM 5.3 ist ein Produktname von Z.ai. Zwischen lowcloud und Z.ai besteht keine Geschäftsbeziehung; wir betreiben das offen verfügbare Modell über einen europäischen Anbieter. Stand: 7. September 2026.