gte-multilingual-reranker-base

Alibaba Qwen

Alleen catalogus Open gewichten

Soevereiniteit en hosting

Alleen catalogus

Dit model is opgenomen in de catalogus ter referentie. Het wordt nog niet gehost op LLM EU, en geen enkel first-party endpoint bedient het hier. Verzoeken eraan gaan rechtstreeks naar de aanbieder, onder de eigen voorwaarden van die aanbieder.

Samenvatting

gte-multilingual-reranker-base is a cross-encoder reranker for multilingual retrieval, with 305M parameters and support for inputs up to 8192 tokens. It is published under Apache-2.0 and covers 75 languages in its declared language list. In a retrieval pipeline it belongs after a first-stage vector search, not as a standalone embedding model.

Specificaties

Aanbieder
Alibaba Qwen (CN)
Contextvenster
8.2k
Parameters
0.31B
Modaliteiten
embedding
Licentie
apache-2.0 · licence
Open gewichten
yes
Releasedatum
20 jul 2024
Taken
rag, multilingual-support, private, cheap

Talen

Sterk: en, de, fr, es, it, pt, nl, pl

Voldoende: ru, uk, ar, zh, ja, ko, hi, tr, sv, da, fi, cs, ro, el

Talen

Sterk

  • en
  • de
  • fr
  • es
  • it
  • pt
  • nl
  • pl

Voldoende

  • ru
  • uk
  • ar
  • zh
  • ja
  • ko
  • hi
  • tr
  • sv
  • da
  • fi
  • cs
  • ro
  • el

Niet geverifieerd: de aanbieder heeft deze claim niet gedocumenteerd. — a language is listed as strong only where a source claims it; the card links the evidence where one exists.

Wanneer te gebruiken

Sterke punten

  • 8192-token input limit, long for a reranker
  • 75 declared languages including all large EU languages
  • small enough to run next to the embedding model
  • Apache-2.0 licence

Beperkingen

  • a reranker only: it cannot generate text or embeddings for indexing
  • the model card examples truncate inputs at 512 tokens unless configured otherwise
  • no evaluation has been run by LLM EU