Dataplacering för LLM-API:er
Varje modell i katalogen med regionen där dess inferens körs och den lagringstid dess endpoint anger, läst från de endpoint-rader som routern själv filtrerar på i stället för från en marknadsföringssida. En modell utan en aktiv endpoint listas nedan som endast katalog, eftersom det är vad den är.
Den här distributionen har ingen produktionsbackend för inferens. Varje begäran besvaras av den inbyggda mock-backenden i regionen dev-mock, så ingenting bearbetas i de regioner som endpoint-raderna anger. Inferensregionen visas nedan som dev-mock av den anledningen, och ingen hostingklass anges för en modell som inte har någon körtid här.
Den här sidan är dokumentation, inte en certifiering. Den registrerar vad varje endpoint uppger om sin region, sin lagringstid och sin hostingklass, och namnger källan. Den är inte ett juridiskt utlåtande, inte en bedömning av överensstämmelse och inte en garanti för någon leverantör.
| Modell | Leverantör | Inferensregion | Lagringstid | Hostingklass | Licens |
|---|---|---|---|---|---|
| Devstral Small 2 (24B) | Mistral AI | dev-mock | zero | ingen körtid här | apache-2.0 |
| EuroLLM-1.7B-Instruct | EuroLLM (utter-project) | dev-mock | zero | ingen körtid här | apache-2.0 |
| EuroLLM-22B-Instruct (2512) | EuroLLM (utter-project) | dev-mock | zero | ingen körtid här | apache-2.0 |
| EuroLLM-9B-Instruct (2512) | EuroLLM (utter-project) | dev-mock | zero | ingen körtid här | apache-2.0 |
| Mistral Small 4 (119B-A6B) | Mistral AI | dev-mock | zero | ingen körtid här | apache-2.0 |
| Whisper large-v3 | OpenAI | dev-mock | zero | ingen körtid här | apache-2.0 |
Endast katalog – ingen endpoint ännu
Dessa modeller finns dokumenterade i katalogen men har ingen endpoint som kan besvara en begäran, så det finns ingen region och ingen lagringstid att rapportera för dem. Att begära en returnerar ett fel i stället för att routa någon annanstans.
- Aya 23 8B — Cohere
- Aya Expanse 8B — Cohere
- Codestral 25.08 — Mistral AI
- Command A+ (05-2026) — Cohere
- Command R (08-2024) — Cohere
- DeepSeek-R1 — DeepSeek
- DeepSeek-R1-Distill-Qwen-32B — DeepSeek
- DeepSeek-V3.2 — DeepSeek
- DeepSeek-V4-Flash (0731) — DeepSeek
- EmbeddingGemma 300M — Google DeepMind
- GLM-4.7-Flash — Z.ai (Zhipu AI)
- GLM-5.3 — Z.ai (Zhipu AI)
- GLM-OCR — Z.ai (Zhipu AI)
- Gemma 4 26B A4B IT — Google DeepMind
- Gemma 4 31B IT — Google DeepMind
- Gemma 4 E4B IT — Google DeepMind
- LLMEU V2 (announced) — LLM EU
- Llama 3.1 8B Instruct — Meta
- Llama 3.3 70B Instruct — Meta
- Llama 4 Maverick 17B-128E Instruct — Meta
- Llama 4 Scout 17B-16E Instruct — Meta
- Llama Nemotron Rerank 1B v2 — NVIDIA
- Magistral Small 1.2 — Mistral AI
- Ministral 3 8B — Mistral AI
- Mistral 7B Instruct v0.3 — Mistral AI
- Mistral Large 3 (675B) — Mistral AI
- Mistral NeMo 12B Instruct — Mistral AI
- NVIDIA Nemotron 3 Nano 4B — NVIDIA
- NVIDIA Nemotron 3 Super 120B-A12B — NVIDIA
- OpenEuroLLM final models (planned) — OpenEuroLLM
- OpenEuroLLM initial model release (planned) — OpenEuroLLM
- Pharia-1-Embedding-4608-control — Aleph Alpha
- Pharia-1-LLM-7B-control-aligned — Aleph Alpha
- Phi-4 — Microsoft
- Phi-4-multimodal-instruct — Microsoft
- Pixtral 12B — Mistral AI
- Qwen3-8B — Alibaba Qwen
- Qwen3-Coder-30B-A3B-Instruct — Alibaba Qwen
- Qwen3-VL-8B-Instruct — Alibaba Qwen
- Qwen3.8-27B — Alibaba Qwen
- Teuken 7B Instruct v0.6 — OpenGPT-X (Teuken)
- Voxtral Small 24B — Mistral AI
- Whisper large-v3-turbo — OpenAI
- gpt-oss-120b — OpenAI
- gpt-oss-20b — OpenAI
- gte-multilingual-reranker-base — Alibaba Qwen
- multilingual-e5-large — Microsoft
Se även: Hosting · Dokument · Verifierat