Estado da plataforma

As regiões dos endpoints descrevem configuração, não geolocalização independente. A inferência simulada não executa pesos de modelo e reporta dev-mock. A inferência real exige um backend configurado para a região do endpoint; localização europeia e propriedade europeia são distintas.

de-ber

ModelosRuntimeEstado da plataformauptime
measured over the last 1 hour · 12 checks
p50 latency
Devstral Small 2 (24B) mock Operacional 100% 0 ms
EuroLLM-22B-Instruct (2512) mock Operacional 100% 0 ms

de-fra

ModelosRuntimeEstado da plataformauptime
measured over the last 1 hour · 12 checks
p50 latency
EuroLLM-1.7B-Instruct mock Operacional 100% 0 ms
EuroLLM-9B-Instruct (2512) mock Operacional 100% 0 ms
Whisper large-v3 mock Operacional 100% 0 ms

fr-par

ModelosRuntimeEstado da plataformauptime
measured over the last 1 hour · 12 checks
p50 latency
Mistral Small 4 (119B-A6B) mock Operacional 100% 0 ms

Feature flags

FlagStateMeaning
gpu_enabled off First-party GPU inference is available (VLLM_BASE_URL set)
partner_endpoints off Partner endpoints may be routed to
public_playground on The public playground is rate limited and open
public_signup on Anyone may create an account
stripe_enabled off Card payments are enabled on this deployment

Esta implementação pode executar inferência simulada: uma resposta pode vir de um modelo substituto em vez do modelo indicado no pedido. Quando o modo simulado está ativo, a consola e o trace indicam-no, e não é cobrada qualquer taxa por tokens.