DeepSeek-V4-Flash (0731)
Souveränität und Hosting
Dieses Modell ist als Referenz katalogisiert. Es wird noch nicht bei LLM EU gehostet, und kein Endpunkt aus erster Hand bedient es hier. Anfragen dazu gehen direkt an den Anbieter, zu dessen eigenen Bedingungen.
Zusammenfassung
DeepSeek-V4-Flash ist ein Mixture-of-Experts-Modell mit 304B Parametern insgesamt, veröffentlicht unter der MIT-Lizenz mit einem Kontextfenster von 1.048.576 Token in der Konfiguration. Es bietet drei Stufen für den Reasoning-Aufwand; der Anbieter empfiehlt bei den Stufen high und max bis zu 384K Ausgabe-Token. DeepSeek gibt an, dass es die eigene Vorschau DeepSeek-V4-Pro auf den in der Modellkarte genannten Benchmarks übertrifft; diese Werte sind selbst gemeldet.
Technische Daten
- Anbieter
- DeepSeek (CN)
- Kontextfenster
- 1.0M
- Modellparameter
- 304.18B
- Modalitäten
- text
- Lizenz
- mit · licence
- Offene Gewichte
- yes
- Veröffentlichungsdatum
- 31. Juli 2026
- Aufgaben
- reasoning, coding, summarization, rag
Sprachen
Stark: en, zh
Ausreichend: de, fr, es, it, pt, ru, ja, ko, ar
Sprachen
Stark
- en
- zh
Ausreichend
- de
- fr
- es
- it
- pt
- ru
- ja
- ko
- ar
Nicht verifiziert: Der Anbieter hat diese Angabe nicht belegt. — a language is listed as strong only where a source claims it; the card links the evidence where one exists.
Wann einsetzen
Stärken
- MIT licence with no user threshold or field-of-use restriction
- 1M-token context window
- three reasoning-effort levels for latency control
- vendor reports it beats its own larger preview model on published benchmarks
Grenzen
- 304B parameters require a multi-GPU node even at reduced precision
- all benchmark claims are self-reported by DeepSeek
- no evaluation has been run by LLM EU