Plattformstatus

Endpunktregionen beschreiben die Konfiguration, keine unabhängige Geolokalisierung. Mock-Inferenz führt keine Modellgewichte aus und meldet dev-mock. Echte Inferenz benötigt ein Backend für die Endpunktregion; europäischer Standort und europäisches Eigentum sind zu unterscheiden.

de-ber

ModelleRuntimePlattformstatusVerfügbarkeit
gemessen über die letzten 1 Stunden · 12 Prüfungen
p50 Latenz
Devstral Small 2 (24B) mock Betriebsbereit 100% 0 ms
EuroLLM-22B-Instruct (2512) mock Betriebsbereit 100% 0 ms

de-fra

ModelleRuntimePlattformstatusVerfügbarkeit
gemessen über die letzten 1 Stunden · 12 Prüfungen
p50 Latenz
EuroLLM-1.7B-Instruct mock Betriebsbereit 100% 0 ms
EuroLLM-9B-Instruct (2512) mock Betriebsbereit 100% 0 ms
Whisper large-v3 mock Betriebsbereit 100% 0 ms

fr-par

ModelleRuntimePlattformstatusVerfügbarkeit
gemessen über die letzten 1 Stunden · 12 Prüfungen
p50 Latenz
Mistral Small 4 (119B-A6B) mock Betriebsbereit 100% 0 ms

Feature flags

FlagStateMeaning
gpu_enabled off First-party GPU inference is available (VLLM_BASE_URL set)
partner_endpoints off Partner endpoints may be routed to
public_playground on The public playground is rate limited and open
public_signup on Anyone may create an account
stripe_enabled off Card payments are enabled on this deployment

Diese Installation kann mit Mock-Inferenz laufen: Eine Antwort kann von einem Ersatzmodell stammen und nicht vom angefragten Modell. Ist der Mock-Modus aktiv, sagen Konsole und Protokoll das, und es wird kein Token-Preis berechnet.