Datenresidenz für LLM-APIs
Jedes Modell im Katalog mit der Region, in der seine Inferenz läuft, und der Aufbewahrung, die sein Endpunkt angibt — gelesen aus den Endpunkt-Zeilen, nach denen der Router selbst filtert, nicht von einer Marketingseite. Ein Modell ohne aktiven Endpunkt steht unten als reiner Katalogeintrag, weil es genau das ist.
Diese Bereitstellung hat kein produktives Inferenz-Backend. Jede Anfrage beantwortet das eingebaute Mock-Backend in der Region dev-mock; es wird also nichts in den Regionen verarbeitet, die die Endpunkt-Zeilen angeben. Die Inferenzregion steht deshalb unten als dev-mock, und für ein Modell ohne Laufzeitumgebung wird keine Hosting-Klasse behauptet.
Diese Seite ist Dokumentation, keine Zertifizierung. Sie hält fest, was jeder Endpunkt zu Region, Aufbewahrung und Hosting-Klasse angibt, und nennt die Quelle. Sie ist kein Rechtsgutachten, keine Konformitätsbewertung und keine Zusage über einen Anbieter.
| Modell | Anbieter | Inferenzregion | Aufbewahrung | Hosting-Klasse | Lizenz |
|---|---|---|---|---|---|
| Devstral Small 2 (24B) | Mistral AI | dev-mock | zero | keine Laufzeit hier | apache-2.0 |
| EuroLLM-1.7B-Instruct | EuroLLM (utter-project) | dev-mock | zero | keine Laufzeit hier | apache-2.0 |
| EuroLLM-22B-Instruct (2512) | EuroLLM (utter-project) | dev-mock | zero | keine Laufzeit hier | apache-2.0 |
| EuroLLM-9B-Instruct (2512) | EuroLLM (utter-project) | dev-mock | zero | keine Laufzeit hier | apache-2.0 |
| Mistral Small 4 (119B-A6B) | Mistral AI | dev-mock | zero | keine Laufzeit hier | apache-2.0 |
| Whisper large-v3 | OpenAI | dev-mock | zero | keine Laufzeit hier | apache-2.0 |
Nur Katalog — noch kein Endpunkt
Diese Modelle sind im Katalog dokumentiert, haben aber keinen Endpunkt, der eine Anfrage beantworten könnte; es gibt daher keine Region und keine Aufbewahrung anzugeben. Eine Anfrage führt zu einem Fehler, statt an eine andere Stelle zu routen.
- Aya 23 8B — Cohere
- Aya Expanse 8B — Cohere
- Codestral 25.08 — Mistral AI
- Command A+ (05-2026) — Cohere
- Command R (08-2024) — Cohere
- DeepSeek-R1 — DeepSeek
- DeepSeek-R1-Distill-Qwen-32B — DeepSeek
- DeepSeek-V3.2 — DeepSeek
- DeepSeek-V4-Flash (0731) — DeepSeek
- EmbeddingGemma 300M — Google DeepMind
- GLM-4.7-Flash — Z.ai (Zhipu AI)
- GLM-5.3 — Z.ai (Zhipu AI)
- GLM-OCR — Z.ai (Zhipu AI)
- Gemma 4 26B A4B IT — Google DeepMind
- Gemma 4 31B IT — Google DeepMind
- Gemma 4 E4B IT — Google DeepMind
- LLMEU V2 (announced) — LLM EU
- Llama 3.1 8B Instruct — Meta
- Llama 3.3 70B Instruct — Meta
- Llama 4 Maverick 17B-128E Instruct — Meta
- Llama 4 Scout 17B-16E Instruct — Meta
- Llama Nemotron Rerank 1B v2 — NVIDIA
- Magistral Small 1.2 — Mistral AI
- Ministral 3 8B — Mistral AI
- Mistral 7B Instruct v0.3 — Mistral AI
- Mistral Large 3 (675B) — Mistral AI
- Mistral NeMo 12B Instruct — Mistral AI
- NVIDIA Nemotron 3 Nano 4B — NVIDIA
- NVIDIA Nemotron 3 Super 120B-A12B — NVIDIA
- OpenEuroLLM final models (planned) — OpenEuroLLM
- OpenEuroLLM initial model release (planned) — OpenEuroLLM
- Pharia-1-Embedding-4608-control — Aleph Alpha
- Pharia-1-LLM-7B-control-aligned — Aleph Alpha
- Phi-4 — Microsoft
- Phi-4-multimodal-instruct — Microsoft
- Pixtral 12B — Mistral AI
- Qwen3-8B — Alibaba Qwen
- Qwen3-Coder-30B-A3B-Instruct — Alibaba Qwen
- Qwen3-VL-8B-Instruct — Alibaba Qwen
- Qwen3.8-27B — Alibaba Qwen
- Teuken 7B Instruct v0.6 — OpenGPT-X (Teuken)
- Voxtral Small 24B — Mistral AI
- Whisper large-v3-turbo — OpenAI
- gpt-oss-120b — OpenAI
- gpt-oss-20b — OpenAI
- gte-multilingual-reranker-base — Alibaba Qwen
- multilingual-e5-large — Microsoft
Siehe auch: EU-Hosting · Dokumentation · Verifiziert