Qwen3-8B

Alibaba Qwen

Nur im Katalog Offene Gewichte

Souveränität und Hosting

Nur im Katalog

Dieses Modell ist als Referenz katalogisiert. Es wird noch nicht bei LLM EU gehostet, und kein Endpunkt aus erster Hand bedient es hier. Anfragen dazu gehen direkt an den Anbieter, zu dessen eigenen Bedingungen.

Zusammenfassung

Qwen3-8B ist ein dichtes Textmodell, das einen Thinking- und einen Non-Thinking-Modus in einem Checkpoint vereint. Es verarbeitet nativ 32.768 Token; laut Modellkarte erweitert YaRN-Skalierung dies auf 131.072 Token. Es erscheint unter Apache-2.0 und gehört weiterhin zu den am häufigsten heruntergeladenen offenen Textmodellen seiner Größenklasse.

Technische Daten

Anbieter
Alibaba Qwen (CN)
Kontextfenster
33k
Modellparameter
8.19B
Modalitäten
text
Lizenz
apache-2.0 · licence
Offene Gewichte
yes
Veröffentlichungsdatum
27. Apr. 2025
Aufgaben
cheap, reasoning, multilingual-support, summarization

Sprachen

Stark: en, zh

Ausreichend: de, fr, es, it, pt, ru, ja, ko, ar, nl, pl, tr, vi, hi

Sprachen

Stark

  • en
  • zh

Ausreichend

  • de
  • fr
  • es
  • it
  • pt
  • ru
  • ja
  • ko
  • ar
  • nl
  • pl
  • tr
  • vi
  • hi

Nicht verifiziert: Der Anbieter hat diese Angabe nicht belegt. — a language is listed as strong only where a source claims it; the card links the evidence where one exists.

Wann einsetzen

Stärken

  • hybrid thinking and non-thinking modes
  • Apache-2.0 licence
  • runs on a single mid-range GPU

Grenzen

  • 32,768-token native context; longer inputs need YaRN configuration
  • behind Qwen3.5 and Qwen3.8 releases on reasoning
  • no evaluation has been run by LLM EU