Résidence des données pour les API LLM
Chaque modèle du catalogue avec la région où son inférence s’exécute et la conservation que son point de terminaison enregistre, lues depuis les lignes de point de terminaison sur lesquelles le routeur filtre lui-même, plutôt que depuis une page marketing. Un modèle sans point de terminaison actif est listé ci-dessous comme catalogue uniquement, parce que c’est ce qu’il est.
Ce déploiement n’a pas de backend d’inférence de production. Chaque requête est traitée par le backend simulé intégré dans la région dev-mock, donc rien n’est traité dans les régions que les lignes de point de terminaison enregistrent. La région d’inférence est indiquée ci-dessous comme dev-mock pour cette raison, et aucune classe d’hébergement n’est revendiquée pour un modèle qui n’a pas de runtime ici.
Cette page est de la documentation, pas une certification. Elle enregistre ce que chaque point de terminaison déclare sur sa région, sa conservation et sa classe d’hébergement, et nomme la source. Ce n’est pas un avis juridique, ni une évaluation de conformité, ni une garantie concernant un fournisseur.
| Modèle | Fournisseur | Région d’inférence | Conservation | Classe d’hébergement | Licence |
|---|---|---|---|---|---|
| Devstral Small 2 (24B) | Mistral AI | dev-mock | zero | aucun runtime ici | apache-2.0 |
| EuroLLM-1.7B-Instruct | EuroLLM (utter-project) | dev-mock | zero | aucun runtime ici | apache-2.0 |
| EuroLLM-22B-Instruct (2512) | EuroLLM (utter-project) | dev-mock | zero | aucun runtime ici | apache-2.0 |
| EuroLLM-9B-Instruct (2512) | EuroLLM (utter-project) | dev-mock | zero | aucun runtime ici | apache-2.0 |
| Mistral Small 4 (119B-A6B) | Mistral AI | dev-mock | zero | aucun runtime ici | apache-2.0 |
| Whisper large-v3 | OpenAI | dev-mock | zero | aucun runtime ici | apache-2.0 |
Catalogue uniquement — aucun point de terminaison pour l’instant
Ces modèles sont documentés dans le catalogue mais n’ont aucun point de terminaison qui puisse répondre à une requête ; il n’y a donc ni région ni conservation à signaler pour eux. Demander l’un de ces modèles renvoie une erreur plutôt que de router ailleurs.
- Aya 23 8B — Cohere
- Aya Expanse 8B — Cohere
- Codestral 25.08 — Mistral AI
- Command A+ (05-2026) — Cohere
- Command R (08-2024) — Cohere
- DeepSeek-R1 — DeepSeek
- DeepSeek-R1-Distill-Qwen-32B — DeepSeek
- DeepSeek-V3.2 — DeepSeek
- DeepSeek-V4-Flash (0731) — DeepSeek
- EmbeddingGemma 300M — Google DeepMind
- GLM-4.7-Flash — Z.ai (Zhipu AI)
- GLM-5.3 — Z.ai (Zhipu AI)
- GLM-OCR — Z.ai (Zhipu AI)
- Gemma 4 26B A4B IT — Google DeepMind
- Gemma 4 31B IT — Google DeepMind
- Gemma 4 E4B IT — Google DeepMind
- LLMEU V2 (announced) — LLM EU
- Llama 3.1 8B Instruct — Meta
- Llama 3.3 70B Instruct — Meta
- Llama 4 Maverick 17B-128E Instruct — Meta
- Llama 4 Scout 17B-16E Instruct — Meta
- Llama Nemotron Rerank 1B v2 — NVIDIA
- Magistral Small 1.2 — Mistral AI
- Ministral 3 8B — Mistral AI
- Mistral 7B Instruct v0.3 — Mistral AI
- Mistral Large 3 (675B) — Mistral AI
- Mistral NeMo 12B Instruct — Mistral AI
- NVIDIA Nemotron 3 Nano 4B — NVIDIA
- NVIDIA Nemotron 3 Super 120B-A12B — NVIDIA
- OpenEuroLLM final models (planned) — OpenEuroLLM
- OpenEuroLLM initial model release (planned) — OpenEuroLLM
- Pharia-1-Embedding-4608-control — Aleph Alpha
- Pharia-1-LLM-7B-control-aligned — Aleph Alpha
- Phi-4 — Microsoft
- Phi-4-multimodal-instruct — Microsoft
- Pixtral 12B — Mistral AI
- Qwen3-8B — Alibaba Qwen
- Qwen3-Coder-30B-A3B-Instruct — Alibaba Qwen
- Qwen3-VL-8B-Instruct — Alibaba Qwen
- Qwen3.8-27B — Alibaba Qwen
- Teuken 7B Instruct v0.6 — OpenGPT-X (Teuken)
- Voxtral Small 24B — Mistral AI
- Whisper large-v3-turbo — OpenAI
- gpt-oss-120b — OpenAI
- gpt-oss-20b — OpenAI
- gte-multilingual-reranker-base — Alibaba Qwen
- multilingual-e5-large — Microsoft
Voir aussi : Hébergement · Docs · Vérifié