Rezidence dat pro LLM API
Každý model v katalogu s regionem, ve kterém běží jeho inference, a s retencí, kterou zaznamenává jeho koncový bod, přečteno z řádků koncových bodů, podle kterých router sám filtruje, nikoli z marketingové stránky. Model bez živého koncového bodu je níže uveden pouze jako katalogový, protože tím je.
Toto nasazení nemá produkční inferenční backend. Každý požadavek odpovídá vestavěný mock backend v regionu dev-mock, takže se nic nezpracovává v regionech, které zaznamenávají řádky koncových bodů. Z tohoto důvodu je níže uveden region inference jako dev-mock a u modelu, který zde nemá runtime, není uváděna žádná třída hostingu.
Tato stránka je dokumentace, nikoli certifikace. Zaznamenává, co každý koncový bod uvádí o svém regionu, své retenci a své třídě hostingu, a uvádí zdroj. Není právním posudkem, posouzením shody ani zárukou o jakémkoli poskytovateli.
| Model | Poskytovatel | Region inference | Retence | Třída hostingu | Licence |
|---|---|---|---|---|---|
| Devstral Small 2 (24B) | Mistral AI | dev-mock | zero | zde žádný runtime | apache-2.0 |
| EuroLLM-1.7B-Instruct | EuroLLM (utter-project) | dev-mock | zero | zde žádný runtime | apache-2.0 |
| EuroLLM-22B-Instruct (2512) | EuroLLM (utter-project) | dev-mock | zero | zde žádný runtime | apache-2.0 |
| EuroLLM-9B-Instruct (2512) | EuroLLM (utter-project) | dev-mock | zero | zde žádný runtime | apache-2.0 |
| Mistral Small 4 (119B-A6B) | Mistral AI | dev-mock | zero | zde žádný runtime | apache-2.0 |
| Whisper large-v3 | OpenAI | dev-mock | zero | zde žádný runtime | apache-2.0 |
Pouze katalog – zatím žádný koncový bod
Tyto modely jsou v katalogu zdokumentovány, ale nemají žádný koncový bod, který by mohl odpovědět na požadavek, takže pro ně není uveden žádný region ani retence. Vyžádání jednoho vrátí chybu, místo aby se směrovalo jinam.
- Aya 23 8B — Cohere
- Aya Expanse 8B — Cohere
- Codestral 25.08 — Mistral AI
- Command A+ (05-2026) — Cohere
- Command R (08-2024) — Cohere
- DeepSeek-R1 — DeepSeek
- DeepSeek-R1-Distill-Qwen-32B — DeepSeek
- DeepSeek-V3.2 — DeepSeek
- DeepSeek-V4-Flash (0731) — DeepSeek
- EmbeddingGemma 300M — Google DeepMind
- GLM-4.7-Flash — Z.ai (Zhipu AI)
- GLM-5.3 — Z.ai (Zhipu AI)
- GLM-OCR — Z.ai (Zhipu AI)
- Gemma 4 26B A4B IT — Google DeepMind
- Gemma 4 31B IT — Google DeepMind
- Gemma 4 E4B IT — Google DeepMind
- LLMEU V2 (announced) — LLM EU
- Llama 3.1 8B Instruct — Meta
- Llama 3.3 70B Instruct — Meta
- Llama 4 Maverick 17B-128E Instruct — Meta
- Llama 4 Scout 17B-16E Instruct — Meta
- Llama Nemotron Rerank 1B v2 — NVIDIA
- Magistral Small 1.2 — Mistral AI
- Ministral 3 8B — Mistral AI
- Mistral 7B Instruct v0.3 — Mistral AI
- Mistral Large 3 (675B) — Mistral AI
- Mistral NeMo 12B Instruct — Mistral AI
- NVIDIA Nemotron 3 Nano 4B — NVIDIA
- NVIDIA Nemotron 3 Super 120B-A12B — NVIDIA
- OpenEuroLLM final models (planned) — OpenEuroLLM
- OpenEuroLLM initial model release (planned) — OpenEuroLLM
- Pharia-1-Embedding-4608-control — Aleph Alpha
- Pharia-1-LLM-7B-control-aligned — Aleph Alpha
- Phi-4 — Microsoft
- Phi-4-multimodal-instruct — Microsoft
- Pixtral 12B — Mistral AI
- Qwen3-8B — Alibaba Qwen
- Qwen3-Coder-30B-A3B-Instruct — Alibaba Qwen
- Qwen3-VL-8B-Instruct — Alibaba Qwen
- Qwen3.8-27B — Alibaba Qwen
- Teuken 7B Instruct v0.6 — OpenGPT-X (Teuken)
- Voxtral Small 24B — Mistral AI
- Whisper large-v3-turbo — OpenAI
- gpt-oss-120b — OpenAI
- gpt-oss-20b — OpenAI
- gte-multilingual-reranker-base — Alibaba Qwen
- multilingual-e5-large — Microsoft
Viz také: Hosting · Dokumentace · Ověřeno