Stato della piattaforma

Le regioni degli endpoint descrivono la configurazione, non la geolocalizzazione indipendente. L'inferenza mock non esegue pesi del modello e riporta dev-mock. L'inferenza reale richiede un backend configurato per la regione dell'endpoint; posizione europea e proprietà europea sono distinte.

de-ber

ModelliRuntimeStato della piattaformauptime
measured over the last 1 hour · 12 checks
p50 latency
Devstral Small 2 (24B) mock Operativo 100% 0 ms
EuroLLM-22B-Instruct (2512) mock Operativo 100% 0 ms

de-fra

ModelliRuntimeStato della piattaformauptime
measured over the last 1 hour · 12 checks
p50 latency
EuroLLM-1.7B-Instruct mock Operativo 100% 0 ms
EuroLLM-9B-Instruct (2512) mock Operativo 100% 0 ms
Whisper large-v3 mock Operativo 100% 0 ms

fr-par

ModelliRuntimeStato della piattaformauptime
measured over the last 1 hour · 12 checks
p50 latency
Mistral Small 4 (119B-A6B) mock Operativo 100% 0 ms

Feature flags

FlagStateMeaning
gpu_enabled off First-party GPU inference is available (VLLM_BASE_URL set)
partner_endpoints off Partner endpoints may be routed to
public_playground on The public playground is rate limited and open
public_signup on Anyone may create an account
stripe_enabled off Card payments are enabled on this deployment

Questa implementazione può eseguire inferenza mock: una risposta può provenire da un modello sostitutivo invece che dal modello indicato nella richiesta. Quando la modalità mock è attiva, la console e la traccia lo dicono, e non viene addebitato alcun costo per token.