Qwen3-8B

Alibaba Qwen

Μόνο στον κατάλογο Ανοιχτά βάρη

Κυριαρχία και φιλοξενία

Μόνο στον κατάλογο

Αυτό το μοντέλο είναι καταγεγραμμένο για αναφορά. Δεν φιλοξενείται ακόμη στο LLM EU και κανένα δικό μας τελικό σημείο δεν το εξυπηρετεί εδώ. Τα αιτήματα προς αυτό πηγαίνουν απευθείας στον πάροχο, υπό τους δικούς του όρους.

Σύνοψη

Qwen3-8B is a dense text model that supports both a thinking and a non-thinking mode in one checkpoint. It handles 32,768 tokens natively, and the model card states that YaRN scaling extends it to 131,072 tokens. It is published under Apache-2.0 and remains one of the most downloaded open text models in its size class.

Προδιαγραφές

Πάροχος
Alibaba Qwen (CN)
Παράθυρο πλαισίου
33k
Παράμετροι
8.19B
Τροπικότητες
text
Άδεια
apache-2.0 · licence
Ανοιχτά βάρη
yes
Ημερομηνία κυκλοφορίας
27 Απρ 2025
Εργασίες
cheap, reasoning, multilingual-support, summarization

Γλώσσες

Ισχυρή: en, zh

Επαρκής: de, fr, es, it, pt, ru, ja, ko, ar, nl, pl, tr, vi, hi

Γλώσσες

Ισχυρή

  • en
  • zh

Επαρκής

  • de
  • fr
  • es
  • it
  • pt
  • ru
  • ja
  • ko
  • ar
  • nl
  • pl
  • tr
  • vi
  • hi

Μη επαληθευμένο: ο πάροχος δεν έχει τεκμηριώσει αυτόν τον ισχυρισμό. — a language is listed as strong only where a source claims it; the card links the evidence where one exists.

Πότε να το χρησιμοποιήσετε

Πλεονεκτήματα

  • hybrid thinking and non-thinking modes
  • Apache-2.0 licence
  • runs on a single mid-range GPU

Περιορισμοί

  • 32,768-token native context; longer inputs need YaRN configuration
  • behind Qwen3.5 and Qwen3.8 releases on reasoning
  • no evaluation has been run by LLM EU