Residencia de datos para las API de LLM
Todos los modelos del catálogo con la región en la que se ejecuta su inferencia y la retención que registra su endpoint, leídos de las filas de endpoint por las que el propio enrutador filtra y no de una página de marketing. Un modelo sin endpoint activo se lista a continuación como solo catálogo, porque eso es lo que es.
Este despliegue no tiene backend de inferencia de producción. Todas las solicitudes las responde el backend mock integrado en la región dev-mock, así que no se procesa nada en las regiones que registran las filas de endpoint. Por eso la región de inferencia se muestra a continuación como dev-mock, y no se declara ninguna clase de alojamiento para un modelo que no tiene runtime aquí.
Esta página es documentación, no una certificación. Registra lo que cada endpoint declara sobre su región, su retención y su clase de alojamiento, y nombra la fuente. No es una opinión jurídica, ni una evaluación de conformidad, ni una garantía sobre ningún proveedor.
| Modelo | Proveedor | Región de inferencia | Retención | Clase de alojamiento | Licencia |
|---|---|---|---|---|---|
| Devstral Small 2 (24B) | Mistral AI | dev-mock | zero | sin runtime aquí | apache-2.0 |
| EuroLLM-1.7B-Instruct | EuroLLM (utter-project) | dev-mock | zero | sin runtime aquí | apache-2.0 |
| EuroLLM-22B-Instruct (2512) | EuroLLM (utter-project) | dev-mock | zero | sin runtime aquí | apache-2.0 |
| EuroLLM-9B-Instruct (2512) | EuroLLM (utter-project) | dev-mock | zero | sin runtime aquí | apache-2.0 |
| Mistral Small 4 (119B-A6B) | Mistral AI | dev-mock | zero | sin runtime aquí | apache-2.0 |
| Whisper large-v3 | OpenAI | dev-mock | zero | sin runtime aquí | apache-2.0 |
Solo catálogo — aún sin endpoint
Estos modelos están documentados en el catálogo pero no tienen ningún endpoint que pueda responder a una solicitud, por lo que no hay región ni retención que informar sobre ellos. Pedir uno devuelve un error en lugar de enrutar a otro sitio.
- Aya 23 8B — Cohere
- Aya Expanse 8B — Cohere
- Codestral 25.08 — Mistral AI
- Command A+ (05-2026) — Cohere
- Command R (08-2024) — Cohere
- DeepSeek-R1 — DeepSeek
- DeepSeek-R1-Distill-Qwen-32B — DeepSeek
- DeepSeek-V3.2 — DeepSeek
- DeepSeek-V4-Flash (0731) — DeepSeek
- EmbeddingGemma 300M — Google DeepMind
- GLM-4.7-Flash — Z.ai (Zhipu AI)
- GLM-5.3 — Z.ai (Zhipu AI)
- GLM-OCR — Z.ai (Zhipu AI)
- Gemma 4 26B A4B IT — Google DeepMind
- Gemma 4 31B IT — Google DeepMind
- Gemma 4 E4B IT — Google DeepMind
- LLMEU V2 (announced) — LLM EU
- Llama 3.1 8B Instruct — Meta
- Llama 3.3 70B Instruct — Meta
- Llama 4 Maverick 17B-128E Instruct — Meta
- Llama 4 Scout 17B-16E Instruct — Meta
- Llama Nemotron Rerank 1B v2 — NVIDIA
- Magistral Small 1.2 — Mistral AI
- Ministral 3 8B — Mistral AI
- Mistral 7B Instruct v0.3 — Mistral AI
- Mistral Large 3 (675B) — Mistral AI
- Mistral NeMo 12B Instruct — Mistral AI
- NVIDIA Nemotron 3 Nano 4B — NVIDIA
- NVIDIA Nemotron 3 Super 120B-A12B — NVIDIA
- OpenEuroLLM final models (planned) — OpenEuroLLM
- OpenEuroLLM initial model release (planned) — OpenEuroLLM
- Pharia-1-Embedding-4608-control — Aleph Alpha
- Pharia-1-LLM-7B-control-aligned — Aleph Alpha
- Phi-4 — Microsoft
- Phi-4-multimodal-instruct — Microsoft
- Pixtral 12B — Mistral AI
- Qwen3-8B — Alibaba Qwen
- Qwen3-Coder-30B-A3B-Instruct — Alibaba Qwen
- Qwen3-VL-8B-Instruct — Alibaba Qwen
- Qwen3.8-27B — Alibaba Qwen
- Teuken 7B Instruct v0.6 — OpenGPT-X (Teuken)
- Voxtral Small 24B — Mistral AI
- Whisper large-v3-turbo — OpenAI
- gpt-oss-120b — OpenAI
- gpt-oss-20b — OpenAI
- gte-multilingual-reranker-base — Alibaba Qwen
- multilingual-e5-large — Microsoft
Véase también: Alojamiento · Documentación · Verificado