DeepSeek-V3.2

DeepSeek

Nur im Katalog Offene Gewichte

Souveränität und Hosting

Nur im Katalog

Dieses Modell ist als Referenz katalogisiert. Es wird noch nicht bei LLM EU gehostet, und kein Endpunkt aus erster Hand bedient es hier. Anfragen dazu gehen direkt an den Anbieter, zu dessen eigenen Bedingungen.

Zusammenfassung

DeepSeek-V3.2 ist ein Mixture-of-Experts-Modell mit 685B Parametern unter der MIT-Lizenz und einer Konfigurationsgrenze von 163.840 Token. Die wichtigste architektonische Änderung ist DeepSeek Sparse Attention, die laut Anbieter die Rechenkosten für Long-Context-Inferenz senkt. Es ist ein reines Textmodell und benötigt in voller Präzision eine Multi-Node-Bereitstellung.

Technische Daten

Anbieter
DeepSeek (CN)
Kontextfenster
164k
Modellparameter
685.36B
Modalitäten
text
Lizenz
mit · licence
Offene Gewichte
yes
Veröffentlichungsdatum
01. Dez. 2025
Aufgaben
reasoning, coding, summarization, rag

Sprachen

Stark: en, zh

Ausreichend: de, fr, es, it, pt, ru, ja, ko, ar

Sprachen

Stark

  • en
  • zh

Ausreichend

  • de
  • fr
  • es
  • it
  • pt
  • ru
  • ja
  • ko
  • ar

Nicht verifiziert: Der Anbieter hat diese Angabe nicht belegt. — a language is listed as strong only where a source claims it; the card links the evidence where one exists.

Wann einsetzen

Stärken

  • MIT licence
  • sparse attention aimed at lower long-context inference cost
  • 163,840-token configuration maximum

Grenzen

  • 685B parameters: full-precision serving needs several nodes
  • vendor efficiency claims are not independently reproduced here
  • no evaluation has been run by LLM EU