Gegevensresidentie voor LLM-API's
Elk model in de catalogus met de regio waarin zijn inferentie draait en de retentie die zijn endpoint registreert, gelezen uit de endpointrijen waarop de router zelf filtert, niet van een marketingpagina. Een model zonder live endpoint staat hieronder als alleen catalogus, omdat dat is wat het is.
Deze deployment heeft geen productie-inferentiebackend. Elk verzoek wordt beantwoord door de ingebouwde mockbackend in regio dev-mock, dus er wordt niets verwerkt in de regio's die de endpointrijen registreren. De inferentieregio wordt hieronder daarom als dev-mock getoond, en er wordt geen hostingklasse geclaimd voor een model dat hier geen runtime heeft.
Deze pagina is documentatie, geen certificering. Hij registreert wat elk endpoint verklaart over zijn regio, zijn retentie en zijn hostingklasse, en noemt de bron. Het is geen juridisch advies, geen conformiteitsbeoordeling en geen garantie over welke aanbieder dan ook.
| Model | Aanbieder | Inferentieregio | Retentie | Hostingklasse | Licentie |
|---|---|---|---|---|---|
| Devstral Small 2 (24B) | Mistral AI | dev-mock | zero | geen runtime hier | apache-2.0 |
| EuroLLM-1.7B-Instruct | EuroLLM (utter-project) | dev-mock | zero | geen runtime hier | apache-2.0 |
| EuroLLM-22B-Instruct (2512) | EuroLLM (utter-project) | dev-mock | zero | geen runtime hier | apache-2.0 |
| EuroLLM-9B-Instruct (2512) | EuroLLM (utter-project) | dev-mock | zero | geen runtime hier | apache-2.0 |
| Mistral Small 4 (119B-A6B) | Mistral AI | dev-mock | zero | geen runtime hier | apache-2.0 |
| Whisper large-v3 | OpenAI | dev-mock | zero | geen runtime hier | apache-2.0 |
Alleen catalogus — nog geen endpoint
Deze modellen staan in de catalogus gedocumenteerd, maar hebben geen endpoint dat een verzoek kan beantwoorden, dus er is geen regio en geen retentie om voor hen te rapporteren. Erom vragen retourneert een fout in plaats van ergens anders naartoe te routeren.
- Aya 23 8B — Cohere
- Aya Expanse 8B — Cohere
- Codestral 25.08 — Mistral AI
- Command A+ (05-2026) — Cohere
- Command R (08-2024) — Cohere
- DeepSeek-R1 — DeepSeek
- DeepSeek-R1-Distill-Qwen-32B — DeepSeek
- DeepSeek-V3.2 — DeepSeek
- DeepSeek-V4-Flash (0731) — DeepSeek
- EmbeddingGemma 300M — Google DeepMind
- GLM-4.7-Flash — Z.ai (Zhipu AI)
- GLM-5.3 — Z.ai (Zhipu AI)
- GLM-OCR — Z.ai (Zhipu AI)
- Gemma 4 26B A4B IT — Google DeepMind
- Gemma 4 31B IT — Google DeepMind
- Gemma 4 E4B IT — Google DeepMind
- LLMEU V2 (announced) — LLM EU
- Llama 3.1 8B Instruct — Meta
- Llama 3.3 70B Instruct — Meta
- Llama 4 Maverick 17B-128E Instruct — Meta
- Llama 4 Scout 17B-16E Instruct — Meta
- Llama Nemotron Rerank 1B v2 — NVIDIA
- Magistral Small 1.2 — Mistral AI
- Ministral 3 8B — Mistral AI
- Mistral 7B Instruct v0.3 — Mistral AI
- Mistral Large 3 (675B) — Mistral AI
- Mistral NeMo 12B Instruct — Mistral AI
- NVIDIA Nemotron 3 Nano 4B — NVIDIA
- NVIDIA Nemotron 3 Super 120B-A12B — NVIDIA
- OpenEuroLLM final models (planned) — OpenEuroLLM
- OpenEuroLLM initial model release (planned) — OpenEuroLLM
- Pharia-1-Embedding-4608-control — Aleph Alpha
- Pharia-1-LLM-7B-control-aligned — Aleph Alpha
- Phi-4 — Microsoft
- Phi-4-multimodal-instruct — Microsoft
- Pixtral 12B — Mistral AI
- Qwen3-8B — Alibaba Qwen
- Qwen3-Coder-30B-A3B-Instruct — Alibaba Qwen
- Qwen3-VL-8B-Instruct — Alibaba Qwen
- Qwen3.8-27B — Alibaba Qwen
- Teuken 7B Instruct v0.6 — OpenGPT-X (Teuken)
- Voxtral Small 24B — Mistral AI
- Whisper large-v3-turbo — OpenAI
- gpt-oss-120b — OpenAI
- gpt-oss-20b — OpenAI
- gte-multilingual-reranker-base — Alibaba Qwen
- multilingual-e5-large — Microsoft
Zie ook: Hosting · Documentatie · Geverifieerd