Rezidența datelor pentru API-uri LLM
Fiecare model din catalog, cu regiunea în care rulează inferența sa și retenția pe care o înregistrează endpoint-ul său, citite din rândurile de endpoint pe care routerul însuși filtrează, nu dintr-o pagină de marketing. Un model fără endpoint activ este listat mai jos doar în catalog, pentru că asta este.
Această implementare nu are backend de inferență de producție. Fiecare cerere primește răspuns de la backend-ul mock integrat în regiunea dev-mock, așa că nimic nu este procesat în regiunile pe care le înregistrează rândurile de endpoint. Regiunea de inferență este afișată mai jos ca dev-mock din acest motiv, iar nicio clasă de găzduire nu este revendicată pentru un model care nu are runtime aici.
Această pagină este documentație, nu o certificare. Înregistrează ce declară fiecare endpoint despre regiunea sa, retenția sa și clasa sa de găzduire și numește sursa. Nu este o opinie juridică, nu este o evaluare a conformității și nu este o garanție despre vreun furnizor.
| Model | Furnizor | Regiune de inferență | Retenție | Clasă de găzduire | Licență |
|---|---|---|---|---|---|
| Devstral Small 2 (24B) | Mistral AI | dev-mock | zero | fără runtime aici | apache-2.0 |
| EuroLLM-1.7B-Instruct | EuroLLM (utter-project) | dev-mock | zero | fără runtime aici | apache-2.0 |
| EuroLLM-22B-Instruct (2512) | EuroLLM (utter-project) | dev-mock | zero | fără runtime aici | apache-2.0 |
| EuroLLM-9B-Instruct (2512) | EuroLLM (utter-project) | dev-mock | zero | fără runtime aici | apache-2.0 |
| Mistral Small 4 (119B-A6B) | Mistral AI | dev-mock | zero | fără runtime aici | apache-2.0 |
| Whisper large-v3 | OpenAI | dev-mock | zero | fără runtime aici | apache-2.0 |
Doar în catalog — încă fără endpoint
Aceste modele sunt documentate în catalog, dar nu au niciun endpoint care poate răspunde unei cereri, așa că nu există regiune și retenție de raportat pentru ele. Cererea unuia returnează o eroare în loc să fie direcționată în altă parte.
- Aya 23 8B — Cohere
- Aya Expanse 8B — Cohere
- Codestral 25.08 — Mistral AI
- Command A+ (05-2026) — Cohere
- Command R (08-2024) — Cohere
- DeepSeek-R1 — DeepSeek
- DeepSeek-R1-Distill-Qwen-32B — DeepSeek
- DeepSeek-V3.2 — DeepSeek
- DeepSeek-V4-Flash (0731) — DeepSeek
- EmbeddingGemma 300M — Google DeepMind
- GLM-4.7-Flash — Z.ai (Zhipu AI)
- GLM-5.3 — Z.ai (Zhipu AI)
- GLM-OCR — Z.ai (Zhipu AI)
- Gemma 4 26B A4B IT — Google DeepMind
- Gemma 4 31B IT — Google DeepMind
- Gemma 4 E4B IT — Google DeepMind
- LLMEU V2 (announced) — LLM EU
- Llama 3.1 8B Instruct — Meta
- Llama 3.3 70B Instruct — Meta
- Llama 4 Maverick 17B-128E Instruct — Meta
- Llama 4 Scout 17B-16E Instruct — Meta
- Llama Nemotron Rerank 1B v2 — NVIDIA
- Magistral Small 1.2 — Mistral AI
- Ministral 3 8B — Mistral AI
- Mistral 7B Instruct v0.3 — Mistral AI
- Mistral Large 3 (675B) — Mistral AI
- Mistral NeMo 12B Instruct — Mistral AI
- NVIDIA Nemotron 3 Nano 4B — NVIDIA
- NVIDIA Nemotron 3 Super 120B-A12B — NVIDIA
- OpenEuroLLM final models (planned) — OpenEuroLLM
- OpenEuroLLM initial model release (planned) — OpenEuroLLM
- Pharia-1-Embedding-4608-control — Aleph Alpha
- Pharia-1-LLM-7B-control-aligned — Aleph Alpha
- Phi-4 — Microsoft
- Phi-4-multimodal-instruct — Microsoft
- Pixtral 12B — Mistral AI
- Qwen3-8B — Alibaba Qwen
- Qwen3-Coder-30B-A3B-Instruct — Alibaba Qwen
- Qwen3-VL-8B-Instruct — Alibaba Qwen
- Qwen3.8-27B — Alibaba Qwen
- Teuken 7B Instruct v0.6 — OpenGPT-X (Teuken)
- Voxtral Small 24B — Mistral AI
- Whisper large-v3-turbo — OpenAI
- gpt-oss-120b — OpenAI
- gpt-oss-20b — OpenAI
- gte-multilingual-reranker-base — Alibaba Qwen
- multilingual-e5-large — Microsoft
Vezi și: Găzduire · Documentație · Verificat