Platformstatus

Endpointregio's beschrijven configuratie, geen onafhankelijke geolocatie. Mock-inferentie draait geen modelgewichten en rapporteert dev-mock. Echte inferentie vereist een backend die is geconfigureerd voor de endpointregio; Europese locatie en Europees eigendom zijn verschillend.

de-ber

ModellenRuntimePlatformstatusuptime
measured over the last 1 hour · 12 checks
p50 latency
Devstral Small 2 (24B) mock Operationeel 100% 0 ms
EuroLLM-22B-Instruct (2512) mock Operationeel 100% 0 ms

de-fra

ModellenRuntimePlatformstatusuptime
measured over the last 1 hour · 12 checks
p50 latency
EuroLLM-1.7B-Instruct mock Operationeel 100% 0 ms
EuroLLM-9B-Instruct (2512) mock Operationeel 100% 0 ms
Whisper large-v3 mock Operationeel 100% 0 ms

fr-par

ModellenRuntimePlatformstatusuptime
measured over the last 1 hour · 12 checks
p50 latency
Mistral Small 4 (119B-A6B) mock Operationeel 100% 0 ms

Feature flags

FlagStateMeaning
gpu_enabled off First-party GPU inference is available (VLLM_BASE_URL set)
partner_endpoints off Partner endpoints may be routed to
public_playground on The public playground is rate limited and open
public_signup on Anyone may create an account
stripe_enabled off Card payments are enabled on this deployment

Deze deployment kan mock-inferentie uitvoeren: een antwoord kan van een plaatsvervangend model komen in plaats van het model dat in het verzoek wordt genoemd. Wanneer de mockmodus aan staat, vermelden de console en de trace dat, en worden er geen tokenkosten in rekening gebracht.