DeepSeek V4 Flash
DeepSeek V4 Flash ist ein Sprachmodell der chinesischen Firma DeepSeek. Die aktuelle Fassung heißt DeepSeek-V4-Flash-0731, die vier Ziffern sind das Datum: 31. Juli 2026. Die Gewichte, also die trainierte Datei des Modells, liegen seit dem 1. August 2026 offen auf Hugging Face, unter MIT-Lizenz. Es ist ein MoE-Modell mit rund 304 Milliarden Parametern.
Bei lowcloud läuft DeepSeek V4 Flash über die Melious AI GmbH in Saarbrücken auf Servern in der EU. Die Anfrage geht nicht an DeepSeek in China. Dazu kommt der wichtigste Betriebsfakt: V4 Flash ist die Voreinstellung. Ein Arbeitsbereich, in dem niemand ein Modell ausgewählt hat, arbeitet mit diesem Modell. Wer bei lowcloud etwas baut und nichts umstellt, hat also DeepSeek V4 Flash im Einsatz.
- Hersteller
- DeepSeek, China
- Kontextfenster
- —
- Bilder lesen
- nein
- Lizenz
- MIT
- Verarbeitung
- EU-Server über Melious
Hersteller, Lizenz, Fassung
DeepSeek ist ein KI-Unternehmen aus China. Die Reihe V4 Flash ist seit Juni 2026 öffentlich, das Basismodell seit April 2026. Die hier beschriebene Fassung 0731 ist seit dem 1. August 2026 auf Hugging Face abrufbar. Die Lizenz ist MIT. Das ist eine einfache Open-Source-Lizenz ohne Auflagen zur Nutzung: Die Gewichte darf jeder laden, betreiben, verändern und kommerziell einsetzen. Bei chinesischen Modellen ist das nicht selbstverständlich, manche stehen unter einer eigenen Lizenz mit Einschränkungen, und Übersichtsseiten schreiben trotzdem "Open Source". Bei DeepSeek V4 Flash stimmt die Angabe. Technisch ist V4 Flash ein MoE-Modell. MoE steht für Mixture of Experts: Das Modell besteht aus vielen Teilnetzen, und pro Token rechnet nur ein kleiner Teil davon mit. Ein Token ist ein Textbaustein, ungefähr eine halbe bis eine ganze Silbe. Die Konfigurationsdatei nennt 256 solcher Experten, von denen sechs pro Token aktiv sind. Wie viele Parameter damit pro Token tatsächlich rechnen, veröffentlicht DeepSeek nicht. Einen Nachfolger dieser Fassung gibt es nicht. Anfang September 2026 hat DeepSeek eine Variante mit Bildeingabe nachgelegt (DeepSeek-V4-Flash-Vision-Exp), sie ist als experimentell gekennzeichnet und steht nicht im EU-Katalog von lowcloud. Das größere Schwestermodell DeepSeek V4 Pro ist kein Nachfolger, sondern eine eigene Größe.
Die Voreinstellung bei lowcloud
Wer kein Modell auswählt, arbeitet mit DeepSeek V4 Flash. Das gilt für jeden Arbeitsbereich, in dem die Modellwahl nicht angefasst wurde. Intern heißt diese Einstellung EU_AUTO_MODEL. Ändern lässt sich die Wahl an drei Stellen: im Chat pro Nachricht, fest für einen Agenten, oder für einen einzelnen Schritt eines Ablaufs. Ein Agent kann also für die einfachen Schritte auf V4 Flash bleiben und nur für den einen schwierigen Schritt ein anderes Modell nehmen. Auf agent.lowcloud.de kannst du ohne Konto einen Ablauf bauen lassen. Dabei wählt lowcloud das Modell. Die eigene Modellwahl kommt mit dem kostenlosen Konto.
Was "auf EU-Servern" konkret heißt
Die Kette ist: Kunde, dann lowcloud UG in Bielefeld, dann Melious AI GmbH in Saarbrücken, dann Rechenzentren in der EU. DeepSeek als Unternehmen ist an dieser Kette nicht beteiligt und bekommt weder Anfrage noch Antwort zu sehen. Möglich ist das, weil die Gewichte offen sind und jeder Betreiber sie selbst laufen lassen kann. Melious betreibt keine eigenen Rechenzentren, sondern verteilt die Anfragen auf europäische Betreiber. Welcher Betreiber ein bestimmtes Modell bedient, veröffentlicht Melious nicht. Damit ist auch gesagt, was lowcloud nicht weiß: den konkreten Standort und den Namen des Rechenzentrums hinter einer einzelnen Anfrage. Wenn ein Kunde danach fragt, ist das die ehrliche Antwort. Zusichern lässt sich die Verarbeitung in der EU, nicht der einzelne Betreiber.
Wofür das Modell taugt
V4 Flash ist die günstigste Stufe im EU-Katalog. Das macht es zum sinnvollen Standard für Abläufe, die oft laufen oder aus vielen Schritten bestehen: Eingänge sortieren, Texte zusammenfassen, Felder aus Dokumenten ziehen, Antwortentwürfe schreiben, Aufgaben an den nächsten Schritt weiterreichen. Feste JSON-Schemas nimmt das Modell an. JSON ist ein Datenformat mit festen Feldern. Ein festes Schema heißt: Du gibst vor, welche Felder die Antwort haben muss, und das Modell hält sich daran. Für einen Ablauf ist das der entscheidende Punkt, weil der nächste Schritt sonst nicht weiß, wo Rechnungsnummer, Datum und Betrag stehen. Diese Angabe hat lowcloud selbst gegen die Schnittstelle geprobt, sie ist nicht von der Herstellerseite abgeschrieben. DeepSeek dokumentiert die JSON-Ausgabe in seinen Anleitungen nur am größeren Modell V4 Pro. Das Kontextfenster steht im lowcloud-Katalog nicht. Das Kontextfenster ist die Textmenge, die ein Modell in einem Lauf gleichzeitig lesen kann. In der offenen Konfigurationsdatei des Modells stehen 1.048.576 Token, also rund eine Million. Ob die EU-Server diese volle Länge anbieten, ist nicht geprüft.
Wofür es nicht taugt
Bilder liest das Modell nicht. Rechnungen als Foto, Screenshots, Scans oder Ausweisdokumente kann es nicht auswerten. Für solche Schritte stellst du im EU-Katalog auf ein Modell um, das Bilder lesen kann: Kimi K3, Kimi K2.7 Code, Kimi K2.6, GLM 5.3 Flash, Qwen 3.8 27B oder Mistral Small 4. Wenn sehr lange Dokumente in einem Stück verarbeitet werden sollen, ist ein Modell mit angegebener Länge die sichere Wahl, etwa Kimi K3, GLM 5.3 oder DeepSeek V4 Pro mit je einer Million Token im Katalog. Die günstigste Stufe ist nicht automatisch die richtige für die schwierigste Entscheidung im Ablauf. Wenn ein Schritt regelmäßig daneben liegt, stell genau diesen Schritt auf ein größeres Modell um und lass den Rest auf V4 Flash. Leistungszahlen nennt diese Seite nicht. Herstellereigene Benchmarkwerte sagen wenig darüber, wie ein Modell in deinem konkreten Ablauf entscheidet. Belastbar ist nur der Vergleich: denselben Ablauf mit zwei Modellen laufen lassen und die Ergebnisse nebeneinander legen.
Was es kostet
Preise stehen hier nicht. Auf den Einkaufspreis kommt ein Aufschlag, eine hier veröffentlichte Zahl wäre also falsch. Die Einordnung lässt sich sagen: DeepSeek V4 Flash ist die günstigste Stufe der 14 EU-Modelle bei lowcloud. Alle anderen Modelle im EU-Katalog kosten mehr. Die tatsächlichen Kosten in Euro stehen an jedem einzelnen Lauf in der App. Damit siehst du vor dem Ausrollen beim Kunden, was ein Durchgang kostet, und kannst einzelne Schritte gezielt auf ein teureres Modell heben, ohne den ganzen Ablauf teurer zu machen.
DeepSeek V4 Flash ausprobieren
Für die Modellwahl brauchst du ein kostenloses Konto. Danach wählst du DeepSeek V4 Flash im Chat, pro Agent oder pro Schritt.
Häufige Fragen
Gehen meine Daten nach China?
Nein. Die Anfrage geht nicht an DeepSeek, sondern über die lowcloud UG in Bielefeld an die Melious AI GmbH in Saarbrücken und von dort in Rechenzentren in der EU. Das Modell ist eine offen veröffentlichte Datei, die europäische Betreiber auf eigenen Servern laufen lassen. Der Hersteller in China sieht weder die Anfrage noch die Antwort. Das gilt für den Modellaufruf. Ruft dein Agent zusätzlich andere Dienste auf, haben die ihre eigenen Wege.
Welches Modell nutzt lowcloud, wenn ich keins auswähle?
DeepSeek V4 Flash in der Fassung 0731. Das ist die Voreinstellung für jeden Arbeitsbereich ohne eigene Modellwahl. Ändern kannst du sie pro Nachricht im Chat, fest pro Agent oder pro einzelnem Schritt eines Ablaufs.
Ist DeepSeek V4 Flash Open Source?
Ja. Die Gewichte stehen unter MIT-Lizenz auf Hugging Face und dürfen ohne Auflagen kommerziell genutzt werden. Das ist bei chinesischen Modellen nicht immer so, manche stehen unter einer eigenen Lizenz mit Einschränkungen. Hier nicht.
Kann DeepSeek V4 Flash Bilder lesen?
Nein. lowcloud hat das selbst gegen die Schnittstelle geprüft. DeepSeek hat im September 2026 eine experimentelle Variante mit Bildeingabe veröffentlicht, die steht nicht im EU-Katalog. Für Bilder nimmst du dort Kimi K3, Kimi K2.7 Code, Kimi K2.6, GLM 5.3 Flash, Qwen 3.8 27B oder Mistral Small 4.
Wie groß ist das Kontextfenster von DeepSeek V4 Flash?
Der lowcloud-Katalog nennt keine Zahl. In der offenen Konfigurationsdatei des Modells stehen 1.048.576 Token, also rund eine Million. Ob die EU-Server diese Länge vollständig anbieten, ist nicht geprüft. Wenn es auf die Länge ankommt, nimm ein Modell, für das der Katalog eine Zahl nennt.
Was kostet ein Lauf mit DeepSeek V4 Flash?
Feste Zahlen veröffentlicht lowcloud nicht, weil auf den Einkaufspreis ein Aufschlag kommt. Im EU-Katalog ist V4 Flash die günstigste Stufe. Die tatsächlichen Kosten in Euro stehen an jedem einzelnen Lauf in der App.
DeepSeek V4 Flash ist ein Produktname von DeepSeek. Zwischen lowcloud und DeepSeek besteht keine Geschäftsbeziehung; wir betreiben das offen verfügbare Modell über einen europäischen Anbieter. Stand: 7. September 2026.