Codestral 25.08
Codestral ist Mistrals Modell für Code-Vervollständigung; es wird über die Mistral-API bereitgestellt und nicht als Gewichte veröffentlicht. Es unters…
Modelle europäischer Anbieter, Modelle mit Hosting in der EU und Modelle von anderswo, die europäische Teams hier betreiben können. Jede Karte sagt, was dokumentiert ist und was nicht.
Diese Seite ist eine statische Kopie: Die URL kann nicht ändern, was hier ausgeliefert wird, deshalb gibt es hier kein Filterformular. Unten stehen alle 53 Modelle; die Konsole bietet denselben Katalog mit Filtern.
API-SchlüsselGefundene Modelle: 53
Codestral ist Mistrals Modell für Code-Vervollständigung; es wird über die Mistral-API bereitgestellt und nicht als Gewichte veröffentlicht. Es unters…
Devstral Small 2 ist ein 24B-Modell unter Apache-2.0, das gemeinsam mit All Hands AI für Software-Engineering-Agenten feinabgestimmt wurde. Die Modell…
EuroLLM-1.7B-Instruct ist das kleinste Modell der EuroLLM-Familie und wurde auf 4 Billionen Token in denselben 35 Sprachen wie die größeren Varianten …
EuroLLM-22B-Instruct (2512) ist das größte veröffentlichte EuroLLM-Modell und deckt dieselbe europäische Sprachmenge ab wie die 9B-Version. Die Modell…
EuroLLM-9B-Instruct (2512) ist die Long-Context-Version des EuroLLM-9B-Instruct-Modells und wurde für die 24 Amtssprachen der EU sowie Katalanisch, Ga…
LLMEU V2 ist das Modell, das LLM EU auf europäischer Infrastruktur trainieren und betreiben will — für genau die Lücke, die die aktuelle Generation of…
Magistral Small 1.2 ist ein 24B-Reasoning-Modell unter Apache-2.0, das von Mistral Small 3.2 abstammt, einen Vision-Encoder und eigene Think-Token für…
Ministral 3 8B ist ein kleines Instruct-Modell unter Apache-2.0 mit Vision-Eingabe und einem Kontextfenster von 256k Token. Mistral positioniert es fü…
Mistral 7B Instruct v0.3 ist die Version mit erweitertem Vokabular von Mistrals ursprünglichem 7B-Instruct-Modell, mit einem Kontextfenster von 32k To…
Mistral Large 3 ist das größte veröffentlichte Mistral-Modell: ein fein granuliertes Mixture-of-Experts-Modell mit 675B Parametern insgesamt und 41B a…
Mistral NeMo ist ein gemeinsam mit NVIDIA entwickeltes 12B-Modell unter Apache-2.0 mit einem Kontextfenster von 128k Token und dem Tekken-Tokenizer. D…
Mistral Small 4 ist ein Mixture-of-Experts-Modell unter Apache-2.0 mit 119B Parametern insgesamt und 6,5B aktivierten Parametern pro Token. Es nimmt T…
Dies ist ein Platzhalter für die abschließende Modellveröffentlichung von OpenEuroLLM, die im Projektplan zusammen mit dem Trainings- und dem Evaluati…
Dies ist ein Platzhalter für die erste Modellveröffentlichung von OpenEuroLLM, die das Projekt als Lieferung mit Fälligkeit am 31. Dezember 2026 führt…
Pharia-1-Embedding-4608-control ist ein Embedding-Modell, das Aleph Alpha auf Basis von Pharia-1-LLM-7B-control entwickelt und unter derselben Open Al…
Pharia-1-LLM-7B-control-aligned ist das 7B-Control-Modell von Aleph Alpha, veröffentlicht auf Hugging Face unter der Open Aleph License, die die Nutzu…
Pixtral 12B ist Mistrals erstes Vision-Sprachmodell und wurde unter Apache-2.0 als offene Gewichte veröffentlicht. Die Konfigurationsdatei deklariert …
Teuken 7B Instruct v0.6 ist ein öffentlich gefördertes deutsches Modell, das auf allen 24 Amtssprachen der EU trainiert wurde und von Fraunhofer, dem …
Voxtral Small ist ein Modell mit Audio-Eingabe unter Apache-2.0, das Sprache transkribiert und darüber reasoning betreibt; der Anbieter ordnet das 32k…
Aya 23 8B ist die 8B-Variante der Aya-23-Veröffentlichung von Cohere Labs, die 23 Sprachen unter CC-BY-NC-4.0 mit einer Kontextlänge von 8192 Token ab…
Aya Expanse 8B ist das mehrsprachige Instruktionsmodell von Cohere Labs für 23 Sprachen, veröffentlicht unter CC-BY-NC-4.0. Die Metadaten nennen 23 Sp…
Command A+ ist Coheres Flaggschiff mit 219B Parametern, das als offene Gewichte unter Apache-2.0 erscheint, Bildeingabe verarbeitet und laut Modellkar…
Command R (08-2024) ist ein 32B-Modell für Retrieval-Augmented Generation mit einem Kontextfenster von 128K Token, veröffentlicht unter CC-BY-NC-4.0. …
DeepSeek-R1 ist das Reasoning-Modell, das offenes Training mit Gedankenketten breit reproduzierbar gemacht hat; es hat 671B Parameter insgesamt, 37B a…
Diese vier Bezeichnungen ersetzen das bloße Wort souverän, das wir nicht allein verwenden. Ein Modell heißt bei uns nur dann souverän, wenn Klasse und Region daneben stehen, denn Eigentum, Betrieb und Jurisdiktion sind drei verschiedene Tatsachen.