Stav platformy

Regiony endpointů popisují konfiguraci, nikoli nezávislou geolokaci. Mock inference nespouští žádné váhy modelu a hlásí dev-mock. Skutečná inference vyžaduje backend nakonfigurovaný pro region endpointu; evropské umístění a evropské vlastnictví jsou odlišné.

de-ber

ModelyRuntimeStav platformyuptime
measured over the last 1 hour · 12 checks
p50 latency
Devstral Small 2 (24B) mock V provozu 100% 0 ms
EuroLLM-22B-Instruct (2512) mock V provozu 100% 0 ms

de-fra

ModelyRuntimeStav platformyuptime
measured over the last 1 hour · 12 checks
p50 latency
EuroLLM-1.7B-Instruct mock V provozu 100% 0 ms
EuroLLM-9B-Instruct (2512) mock V provozu 100% 0 ms
Whisper large-v3 mock V provozu 100% 0 ms

fr-par

ModelyRuntimeStav platformyuptime
measured over the last 1 hour · 12 checks
p50 latency
Mistral Small 4 (119B-A6B) mock V provozu 100% 0 ms

Feature flags

FlagStateMeaning
gpu_enabled off First-party GPU inference is available (VLLM_BASE_URL set)
partner_endpoints off Partner endpoints may be routed to
public_playground on The public playground is rate limited and open
public_signup on Anyone may create an account
stripe_enabled off Card payments are enabled on this deployment

Toto nasazení může spouštět mock inference: odpověď může pocházet z náhradního modelu, nikoli z modelu uvedeného v požadavku. Když je mock režim zapnutý, konzole a stopa to uvedou a žádný poplatek za tokeny se neúčtuje.