Estado de la plataforma

Las regiones de endpoint describen configuración, no geolocalización independiente. La inferencia simulada no ejecuta pesos de modelo e informa dev-mock. La inferencia real requiere un backend configurado para la región del endpoint; ubicación europea y propiedad europea son distintas.

de-ber

ModelosRuntimeEstado de la plataformauptime
measured over the last 1 hour · 12 checks
p50 latency
Devstral Small 2 (24B) mock Operativo 100% 0 ms
EuroLLM-22B-Instruct (2512) mock Operativo 100% 0 ms

de-fra

ModelosRuntimeEstado de la plataformauptime
measured over the last 1 hour · 12 checks
p50 latency
EuroLLM-1.7B-Instruct mock Operativo 100% 0 ms
EuroLLM-9B-Instruct (2512) mock Operativo 100% 0 ms
Whisper large-v3 mock Operativo 100% 0 ms

fr-par

ModelosRuntimeEstado de la plataformauptime
measured over the last 1 hour · 12 checks
p50 latency
Mistral Small 4 (119B-A6B) mock Operativo 100% 0 ms

Feature flags

FlagStateMeaning
gpu_enabled off First-party GPU inference is available (VLLM_BASE_URL set)
partner_endpoints off Partner endpoints may be routed to
public_playground on The public playground is rate limited and open
public_signup on Anyone may create an account
stripe_enabled off Card payments are enabled on this deployment

Este despliegue puede ejecutar inferencia simulada: una respuesta puede provenir de un modelo sustituto en lugar del modelo nombrado en la solicitud. Cuando el modo simulado está activado, la consola y la traza lo indican, y no se cobra ningún cargo por tokens.