Duomenų rezidencija LLM API
Kiekvienas katalogo modelis su regionu, kuriame veikia jo inferencija, ir saugojimu, kurį įrašo jo galutinis taškas, perskaityta iš galutinių taškų eilučių, pagal kurias filtruoja pats maršrutizatorius, o ne iš rinkodaros puslapio. Modelis be veikiančio galutinio taško žemiau nurodytas tik kaip katalogo įrašas, nes toks jis ir yra.
Šis diegimas neturi produkcinio inferencijos vidinio serverio. Į kiekvieną užklausą atsako įtaisytasis imitavimo vidinis serveris regione dev-mock, todėl nieko neapdorojama regionuose, kuriuos įrašo galutinių taškų eilutės. Inferencijos regionas žemiau rodomas kaip dev-mock dėl šios priežasties, ir jokia talpinimo klasė nenurodoma modeliui, kuris čia neturi vykdymo aplinkos.
Šis puslapis yra dokumentacija, o ne sertifikatas. Jis įrašo, ką kiekvienas galutinis taškas nurodo apie savo regioną, saugojimą ir talpinimo klasę, ir nurodo šaltinį. Tai nėra teisinė nuomonė, nėra atitikties vertinimas ir nėra garantija dėl jokio tiekėjo.
| Modelis | Tiekėjas | Inferencijos regionas | Saugojimas | Talpinimo klasė | Licencija |
|---|---|---|---|---|---|
| Devstral Small 2 (24B) | Mistral AI | dev-mock | zero | nėra vykdymo aplinkos čia | apache-2.0 |
| EuroLLM-1.7B-Instruct | EuroLLM (utter-project) | dev-mock | zero | nėra vykdymo aplinkos čia | apache-2.0 |
| EuroLLM-22B-Instruct (2512) | EuroLLM (utter-project) | dev-mock | zero | nėra vykdymo aplinkos čia | apache-2.0 |
| EuroLLM-9B-Instruct (2512) | EuroLLM (utter-project) | dev-mock | zero | nėra vykdymo aplinkos čia | apache-2.0 |
| Mistral Small 4 (119B-A6B) | Mistral AI | dev-mock | zero | nėra vykdymo aplinkos čia | apache-2.0 |
| Whisper large-v3 | OpenAI | dev-mock | zero | nėra vykdymo aplinkos čia | apache-2.0 |
Tik katalogas — dar nėra galutinio taško
Šie modeliai aprašyti kataloge, bet neturi galutinio taško, galinčio atsakyti į užklausą, todėl nėra regiono ir saugojimo, ką apie juos pranešti. Paprašius vieno grąžinama klaida, o ne nukreipiama kur nors kitur.
- Aya 23 8B — Cohere
- Aya Expanse 8B — Cohere
- Codestral 25.08 — Mistral AI
- Command A+ (05-2026) — Cohere
- Command R (08-2024) — Cohere
- DeepSeek-R1 — DeepSeek
- DeepSeek-R1-Distill-Qwen-32B — DeepSeek
- DeepSeek-V3.2 — DeepSeek
- DeepSeek-V4-Flash (0731) — DeepSeek
- EmbeddingGemma 300M — Google DeepMind
- GLM-4.7-Flash — Z.ai (Zhipu AI)
- GLM-5.3 — Z.ai (Zhipu AI)
- GLM-OCR — Z.ai (Zhipu AI)
- Gemma 4 26B A4B IT — Google DeepMind
- Gemma 4 31B IT — Google DeepMind
- Gemma 4 E4B IT — Google DeepMind
- LLMEU V2 (announced) — LLM EU
- Llama 3.1 8B Instruct — Meta
- Llama 3.3 70B Instruct — Meta
- Llama 4 Maverick 17B-128E Instruct — Meta
- Llama 4 Scout 17B-16E Instruct — Meta
- Llama Nemotron Rerank 1B v2 — NVIDIA
- Magistral Small 1.2 — Mistral AI
- Ministral 3 8B — Mistral AI
- Mistral 7B Instruct v0.3 — Mistral AI
- Mistral Large 3 (675B) — Mistral AI
- Mistral NeMo 12B Instruct — Mistral AI
- NVIDIA Nemotron 3 Nano 4B — NVIDIA
- NVIDIA Nemotron 3 Super 120B-A12B — NVIDIA
- OpenEuroLLM final models (planned) — OpenEuroLLM
- OpenEuroLLM initial model release (planned) — OpenEuroLLM
- Pharia-1-Embedding-4608-control — Aleph Alpha
- Pharia-1-LLM-7B-control-aligned — Aleph Alpha
- Phi-4 — Microsoft
- Phi-4-multimodal-instruct — Microsoft
- Pixtral 12B — Mistral AI
- Qwen3-8B — Alibaba Qwen
- Qwen3-Coder-30B-A3B-Instruct — Alibaba Qwen
- Qwen3-VL-8B-Instruct — Alibaba Qwen
- Qwen3.8-27B — Alibaba Qwen
- Teuken 7B Instruct v0.6 — OpenGPT-X (Teuken)
- Voxtral Small 24B — Mistral AI
- Whisper large-v3-turbo — OpenAI
- gpt-oss-120b — OpenAI
- gpt-oss-20b — OpenAI
- gte-multilingual-reranker-base — Alibaba Qwen
- multilingual-e5-large — Microsoft
Taip pat žr.: Hostingas · Dokumentai · Patikrinta