DeepSeek-V4-Flash (0731)

DeepSeek

Nur im Katalog Offene Gewichte

Souveränität und Hosting

Nur im Katalog

Dieses Modell ist als Referenz katalogisiert. Es wird noch nicht bei LLM EU gehostet, und kein Endpunkt aus erster Hand bedient es hier. Anfragen dazu gehen direkt an den Anbieter, zu dessen eigenen Bedingungen.

Zusammenfassung

DeepSeek-V4-Flash ist ein Mixture-of-Experts-Modell mit 304B Parametern insgesamt, veröffentlicht unter der MIT-Lizenz mit einem Kontextfenster von 1.048.576 Token in der Konfiguration. Es bietet drei Stufen für den Reasoning-Aufwand; der Anbieter empfiehlt bei den Stufen high und max bis zu 384K Ausgabe-Token. DeepSeek gibt an, dass es die eigene Vorschau DeepSeek-V4-Pro auf den in der Modellkarte genannten Benchmarks übertrifft; diese Werte sind selbst gemeldet.

Technische Daten

Anbieter
DeepSeek (CN)
Kontextfenster
1.0M
Modellparameter
304.18B
Modalitäten
text
Lizenz
mit · licence
Offene Gewichte
yes
Veröffentlichungsdatum
31. Juli 2026
Aufgaben
reasoning, coding, summarization, rag

Sprachen

Stark: en, zh

Ausreichend: de, fr, es, it, pt, ru, ja, ko, ar

Sprachen

Stark

  • en
  • zh

Ausreichend

  • de
  • fr
  • es
  • it
  • pt
  • ru
  • ja
  • ko
  • ar

Nicht verifiziert: Der Anbieter hat diese Angabe nicht belegt. — a language is listed as strong only where a source claims it; the card links the evidence where one exists.

Wann einsetzen

Stärken

  • MIT licence with no user threshold or field-of-use restriction
  • 1M-token context window
  • three reasoning-effort levels for latency control
  • vendor reports it beats its own larger preview model on published benchmarks

Grenzen

  • 304B parameters require a multi-GPU node even at reduced precision
  • all benchmark claims are self-reported by DeepSeek
  • no evaluation has been run by LLM EU