Teuken 7B Instruct v0.6

OpenGPT-X (Teuken) · Aanbieders EU

Alleen catalogus Open gewichten Europese aanbieder

Soevereiniteit en hosting

Alleen catalogus

Dit model is opgenomen in de catalogus ter referentie. Het wordt nog niet gehost op LLM EU, en geen enkel first-party endpoint bedient het hier. Verzoeken eraan gaan rechtstreeks naar de aanbieder, onder de eigen voorwaarden van die aanbieder.

Samenvatting

Teuken 7B Instruct v0.6 is a German publicly funded model trained on all 24 official EU languages, developed by Fraunhofer, Forschungszentrum Jülich, TU Dresden and DFKI. It is published under CC-BY-NC-4.0, so the weights are downloadable but may only be used for private, non-commercial, research and educational purposes. On the project’s own EU21 evaluation it averages 0.57, ahead of Llama 3.1 8B Instruct at 0.563 and Mistral 7B Instruct v0.3 at 0.527 on the same test set.

Specificaties

Aanbieder
OpenGPT-X (Teuken) (DE)
Contextvenster
4.1k
Parameters
7.45B
Modaliteiten
text
Licentie
cc-by-nc-4.0 · licence
Open gewichten
yes
Releasedatum
28 jul 2025
Taken
german, multilingual-support, translation, summarization, customer-support

Talen

Sterk: de, en, fr, es, it, nl, pl, pt, sv, cs, da, fi, el, ro

Voldoende: bg, et, ga, hr, hu, lt, lv, mt, sk, sl

Talen

Sterk

  • de
  • en
  • fr
  • es
  • it
  • nl
  • pl
  • pt
  • sv
  • cs
  • da
  • fi
  • el
  • ro

Voldoende

  • bg
  • et
  • ga
  • hr
  • hu
  • lt
  • lv
  • mt
  • sk
  • sl

Niet geverifieerd: de aanbieder heeft deze claim niet gedocumenteerd. — a language is listed as strong only where a source claims it; the card links the evidence where one exists.

Wanneer te gebruiken

Sterke punten

  • trained on all 24 official EU languages rather than English-first data
  • published EU21 evaluation against Llama 3.1 8B and Mistral 7B
  • small enough to run on one mid-range accelerator
  • German public funding, with evaluation code and data documentation

Beperkingen

  • CC-BY-NC-4.0 forbids commercial use of the released checkpoint
  • 4096-token context window
  • a 7B model, so reasoning and coding lag larger releases