Rezydencja danych dla API LLM
Każdy model w katalogu z regionem, w którym działa jego wnioskowanie, i przechowywaniem rejestrowanym przez jego endpoint, odczytane z wierszy endpointów, na których filtruje sam router, a nie ze strony marketingowej. Model bez aktywnego endpointu jest wymieniony poniżej jako tylko katalogowy, bo właśnie tym jest.
To wdrożenie nie ma produkcyjnego backendu wnioskowania. Każde żądanie obsługuje wbudowany backend mock w regionie dev-mock, więc nic nie jest przetwarzane w regionach rejestrowanych przez wiersze endpointów. Z tego powodu region wnioskowania pokazano poniżej jako dev-mock i nie przypisuje się żadnej klasy hostingu modelowi, który nie ma tutaj środowiska uruchomieniowego.
Ta strona jest dokumentacją, a nie certyfikacją. Rejestruje to, co każdy endpoint podaje o swoim regionie, swoim przechowywaniu i swojej klasie hostingu, oraz wskazuje źródło. Nie jest opinią prawną, nie jest oceną zgodności i nie jest gwarancją dotyczącą jakiegokolwiek dostawcy.
| Model | Dostawca | Region wnioskowania | Przechowywanie | Klasa hostingu | Licencja |
|---|---|---|---|---|---|
| Devstral Small 2 (24B) | Mistral AI | dev-mock | zero | brak środowiska uruchomieniowego | apache-2.0 |
| EuroLLM-1.7B-Instruct | EuroLLM (utter-project) | dev-mock | zero | brak środowiska uruchomieniowego | apache-2.0 |
| EuroLLM-22B-Instruct (2512) | EuroLLM (utter-project) | dev-mock | zero | brak środowiska uruchomieniowego | apache-2.0 |
| EuroLLM-9B-Instruct (2512) | EuroLLM (utter-project) | dev-mock | zero | brak środowiska uruchomieniowego | apache-2.0 |
| Mistral Small 4 (119B-A6B) | Mistral AI | dev-mock | zero | brak środowiska uruchomieniowego | apache-2.0 |
| Whisper large-v3 | OpenAI | dev-mock | zero | brak środowiska uruchomieniowego | apache-2.0 |
Tylko katalog — brak endpointu
Te modele są udokumentowane w katalogu, ale nie mają endpointu, który mógłby odpowiedzieć na żądanie, więc nie ma dla nich regionu ani przechowywania do zgłoszenia. Zapytanie o taki model zwraca błąd, zamiast kierować gdzie indziej.
- Aya 23 8B — Cohere
- Aya Expanse 8B — Cohere
- Codestral 25.08 — Mistral AI
- Command A+ (05-2026) — Cohere
- Command R (08-2024) — Cohere
- DeepSeek-R1 — DeepSeek
- DeepSeek-R1-Distill-Qwen-32B — DeepSeek
- DeepSeek-V3.2 — DeepSeek
- DeepSeek-V4-Flash (0731) — DeepSeek
- EmbeddingGemma 300M — Google DeepMind
- GLM-4.7-Flash — Z.ai (Zhipu AI)
- GLM-5.3 — Z.ai (Zhipu AI)
- GLM-OCR — Z.ai (Zhipu AI)
- Gemma 4 26B A4B IT — Google DeepMind
- Gemma 4 31B IT — Google DeepMind
- Gemma 4 E4B IT — Google DeepMind
- LLMEU V2 (announced) — LLM EU
- Llama 3.1 8B Instruct — Meta
- Llama 3.3 70B Instruct — Meta
- Llama 4 Maverick 17B-128E Instruct — Meta
- Llama 4 Scout 17B-16E Instruct — Meta
- Llama Nemotron Rerank 1B v2 — NVIDIA
- Magistral Small 1.2 — Mistral AI
- Ministral 3 8B — Mistral AI
- Mistral 7B Instruct v0.3 — Mistral AI
- Mistral Large 3 (675B) — Mistral AI
- Mistral NeMo 12B Instruct — Mistral AI
- NVIDIA Nemotron 3 Nano 4B — NVIDIA
- NVIDIA Nemotron 3 Super 120B-A12B — NVIDIA
- OpenEuroLLM final models (planned) — OpenEuroLLM
- OpenEuroLLM initial model release (planned) — OpenEuroLLM
- Pharia-1-Embedding-4608-control — Aleph Alpha
- Pharia-1-LLM-7B-control-aligned — Aleph Alpha
- Phi-4 — Microsoft
- Phi-4-multimodal-instruct — Microsoft
- Pixtral 12B — Mistral AI
- Qwen3-8B — Alibaba Qwen
- Qwen3-Coder-30B-A3B-Instruct — Alibaba Qwen
- Qwen3-VL-8B-Instruct — Alibaba Qwen
- Qwen3.8-27B — Alibaba Qwen
- Teuken 7B Instruct v0.6 — OpenGPT-X (Teuken)
- Voxtral Small 24B — Mistral AI
- Whisper large-v3-turbo — OpenAI
- gpt-oss-120b — OpenAI
- gpt-oss-20b — OpenAI
- gte-multilingual-reranker-base — Alibaba Qwen
- multilingual-e5-large — Microsoft
Zobacz także: Hosting · Dokumentacja · Zweryfikowane