Rezidencia dát pre LLM API
Každý model v katalógu s regiónom, v ktorom beží jeho inferencia, a uchovávaním, ktoré zaznamenáva jeho koncový bod, prečítané z riadkov koncových bodov, podľa ktorých samotný router filtruje, a nie z marketingovej stránky. Model bez živého koncového bodu je nižšie uvedený iba ako katalóg, pretože to je to, čím je.
Toto nasadenie nemá produkčný backend inferencie. Každú požiadavku odpovedá vstavaný simulovaný backend v regióne dev-mock, takže sa nič nespracúva v regiónoch, ktoré zaznamenávajú riadky koncových bodov. Región inferencie je preto nižšie zobrazený ako dev-mock a pre model, ktorý tu nemá runtime, sa neuvádza žiadna trieda hostingu.
Táto stránka je dokumentácia, nie certifikácia. Zaznamenáva, čo každý koncový bod uvádza o svojom regióne, uchovávaní a triede hostingu, a uvádza zdroj. Nie je právnym názorom, nie je posúdením zhody a nie je zárukou o žiadnom poskytovateľovi.
| Model | Poskytovateľ | Región inferencie | Uchovávanie | Trieda hostingu | Licencia |
|---|---|---|---|---|---|
| Devstral Small 2 (24B) | Mistral AI | dev-mock | zero | žiadny runtime tu | apache-2.0 |
| EuroLLM-1.7B-Instruct | EuroLLM (utter-project) | dev-mock | zero | žiadny runtime tu | apache-2.0 |
| EuroLLM-22B-Instruct (2512) | EuroLLM (utter-project) | dev-mock | zero | žiadny runtime tu | apache-2.0 |
| EuroLLM-9B-Instruct (2512) | EuroLLM (utter-project) | dev-mock | zero | žiadny runtime tu | apache-2.0 |
| Mistral Small 4 (119B-A6B) | Mistral AI | dev-mock | zero | žiadny runtime tu | apache-2.0 |
| Whisper large-v3 | OpenAI | dev-mock | zero | žiadny runtime tu | apache-2.0 |
Iba katalóg — zatiaľ žiadny koncový bod
Tieto modely sú zdokumentované v katalógu, ale nemajú žiadny koncový bod, ktorý by mohol odpovedať na požiadavku, takže pre ne nie je uvedený žiadny región ani uchovávanie. Požiadanie o jeden vráti chybu namiesto presmerovania niekam inam.
- Aya 23 8B — Cohere
- Aya Expanse 8B — Cohere
- Codestral 25.08 — Mistral AI
- Command A+ (05-2026) — Cohere
- Command R (08-2024) — Cohere
- DeepSeek-R1 — DeepSeek
- DeepSeek-R1-Distill-Qwen-32B — DeepSeek
- DeepSeek-V3.2 — DeepSeek
- DeepSeek-V4-Flash (0731) — DeepSeek
- EmbeddingGemma 300M — Google DeepMind
- GLM-4.7-Flash — Z.ai (Zhipu AI)
- GLM-5.3 — Z.ai (Zhipu AI)
- GLM-OCR — Z.ai (Zhipu AI)
- Gemma 4 26B A4B IT — Google DeepMind
- Gemma 4 31B IT — Google DeepMind
- Gemma 4 E4B IT — Google DeepMind
- LLMEU V2 (announced) — LLM EU
- Llama 3.1 8B Instruct — Meta
- Llama 3.3 70B Instruct — Meta
- Llama 4 Maverick 17B-128E Instruct — Meta
- Llama 4 Scout 17B-16E Instruct — Meta
- Llama Nemotron Rerank 1B v2 — NVIDIA
- Magistral Small 1.2 — Mistral AI
- Ministral 3 8B — Mistral AI
- Mistral 7B Instruct v0.3 — Mistral AI
- Mistral Large 3 (675B) — Mistral AI
- Mistral NeMo 12B Instruct — Mistral AI
- NVIDIA Nemotron 3 Nano 4B — NVIDIA
- NVIDIA Nemotron 3 Super 120B-A12B — NVIDIA
- OpenEuroLLM final models (planned) — OpenEuroLLM
- OpenEuroLLM initial model release (planned) — OpenEuroLLM
- Pharia-1-Embedding-4608-control — Aleph Alpha
- Pharia-1-LLM-7B-control-aligned — Aleph Alpha
- Phi-4 — Microsoft
- Phi-4-multimodal-instruct — Microsoft
- Pixtral 12B — Mistral AI
- Qwen3-8B — Alibaba Qwen
- Qwen3-Coder-30B-A3B-Instruct — Alibaba Qwen
- Qwen3-VL-8B-Instruct — Alibaba Qwen
- Qwen3.8-27B — Alibaba Qwen
- Teuken 7B Instruct v0.6 — OpenGPT-X (Teuken)
- Voxtral Small 24B — Mistral AI
- Whisper large-v3-turbo — OpenAI
- gpt-oss-120b — OpenAI
- gpt-oss-20b — OpenAI
- gte-multilingual-reranker-base — Alibaba Qwen
- multilingual-e5-large — Microsoft