DeepSeek-V3.2
Souveränität und Hosting
Dieses Modell ist als Referenz katalogisiert. Es wird noch nicht bei LLM EU gehostet, und kein Endpunkt aus erster Hand bedient es hier. Anfragen dazu gehen direkt an den Anbieter, zu dessen eigenen Bedingungen.
Zusammenfassung
DeepSeek-V3.2 ist ein Mixture-of-Experts-Modell mit 685B Parametern unter der MIT-Lizenz und einer Konfigurationsgrenze von 163.840 Token. Die wichtigste architektonische Änderung ist DeepSeek Sparse Attention, die laut Anbieter die Rechenkosten für Long-Context-Inferenz senkt. Es ist ein reines Textmodell und benötigt in voller Präzision eine Multi-Node-Bereitstellung.
Technische Daten
- Anbieter
- DeepSeek (CN)
- Kontextfenster
- 164k
- Modellparameter
- 685.36B
- Modalitäten
- text
- Lizenz
- mit · licence
- Offene Gewichte
- yes
- Veröffentlichungsdatum
- 01. Dez. 2025
- Aufgaben
- reasoning, coding, summarization, rag
Sprachen
Stark: en, zh
Ausreichend: de, fr, es, it, pt, ru, ja, ko, ar
Sprachen
Stark
- en
- zh
Ausreichend
- de
- fr
- es
- it
- pt
- ru
- ja
- ko
- ar
Nicht verifiziert: Der Anbieter hat diese Angabe nicht belegt. — a language is listed as strong only where a source claims it; the card links the evidence where one exists.
Wann einsetzen
Stärken
- MIT licence
- sparse attention aimed at lower long-context inference cost
- 163,840-token configuration maximum
Grenzen
- 685B parameters: full-precision serving needs several nodes
- vendor efficiency claims are not independently reproduced here
- no evaluation has been run by LLM EU