Residência de dados para APIs de LLM

Cada modelo no catálogo com a região onde a sua inferência é executada e a retenção que o seu endpoint regista, lidos a partir das linhas de endpoint sobre as quais o próprio router filtra, em vez de uma página de marketing. Um modelo sem endpoint ativo é listado abaixo apenas como catálogo, porque é isso que é.

Esta implementação não tem backend de inferência de produção. Todos os pedidos são respondidos pelo backend mock incorporado na região dev-mock, pelo que nada é processado nas regiões que as linhas de endpoint registam. A região de inferência é mostrada abaixo como dev-mock por essa razão, e nenhuma classe de alojamento é reivindicada para um modelo que não tem runtime aqui.

Esta página é documentação, não uma certificação. Regista o que cada endpoint afirma sobre a sua região, a sua retenção e a sua classe de alojamento, e nomeia a fonte. Não é uma opinião legal, nem uma avaliação de conformidade, nem uma garantia sobre qualquer fornecedor.

0 de 53 modelos do catálogo têm um endpoint ativo que não é o backend mock.
Modelo Fornecedor Região de inferência Retenção Classe de alojamento Licença
Devstral Small 2 (24B) Mistral AI dev-mock zero sem runtime aqui apache-2.0
EuroLLM-1.7B-Instruct EuroLLM (utter-project) dev-mock zero sem runtime aqui apache-2.0
EuroLLM-22B-Instruct (2512) EuroLLM (utter-project) dev-mock zero sem runtime aqui apache-2.0
EuroLLM-9B-Instruct (2512) EuroLLM (utter-project) dev-mock zero sem runtime aqui apache-2.0
Mistral Small 4 (119B-A6B) Mistral AI dev-mock zero sem runtime aqui apache-2.0
Whisper large-v3 OpenAI dev-mock zero sem runtime aqui apache-2.0

Apenas catálogo — ainda sem endpoint

Estes modelos estão documentados no catálogo mas não têm endpoint que possa responder a um pedido, pelo que não há região nem retenção a reportar para eles. Pedir um devolve um erro em vez de encaminhar para outro local.

Ver também: Alojamento · Documentação · Verificado