Points de terminaison
Chaque route montée par cette API, ce dont elle a besoin, et celles que l'on attend mais qui sont volontairement absentes.
URL de base dans ce déploiement : https://api.llmeu.com
| Méthode | Chemin | Justificatif d'accès | Remarques |
|---|---|---|---|
| GET | /healthz | aucun | Liveness. Ne lit rien. |
| GET | /readyz | aucun | Readiness : base de données, points de terminaison propriétaires, environnements d'exécution gérés. Répond 503 pendant qu'un GPU charge encore les poids. |
| GET | /v1/models | clé · inférence | Uniquement les modèles que cette clé peut réellement appeler selon la politique par défaut de son organisation. |
| GET | /v1/models/{id} | clé · inférence | Un modèle, avec sa licence et l'indication qu'il est hébergé ici ou non. |
| POST | /v1/chat/completions | clé · inférence | Le point de terminaison de chat compatible OpenAI, avec ou sans streaming. |
| POST | /v1/completions | aucun | Non proposé. Répond 501 not_implemented et indique le point de terminaison à utiliser à la place. |
| POST | /v1/embeddings | clé · inférence | Embeddings produits par un modèle d'embedding. Ce déploiement les sert depuis son backend local déterministe, et la réponse l'indique : llmeu.mock vaut true dans le corps. |
| POST | /v1/playground | aucun | Anonyme, backend simulé uniquement, et limité par adresse IP. |
| GET | /platform/v1/me | clé · platform_read | L'organisation à laquelle ce justificatif d'accès appartient. |
| GET | /platform/v1/api-keys | clé · platform_read | Les clés de l'organisation, sans les secrets. |
| POST | /platform/v1/api-keys | clé · platform_write | Crée une clé. Le secret apparaît dans cette réponse et plus jamais ensuite. |
| DELETE | /platform/v1/api-keys/{id} | clé · platform_write | Révoque une clé. Effectif à la prochaine requête. |
| GET | /platform/v1/traces | clé · platform_read | Métadonnées enregistrées pour les appels passés. Aucun corps de prompt ou de complétion : la rétention est de zéro. |
| GET | /platform/v1/traces/{id} | clé · platform_read | Une trace, y compris la décision de routage. |
| GET | /platform/v1/usage | clé · platform_read | Utilisation agrégée par jour et par modèle. |
| GET | /platform/v1/policies | clé · platform_read | Les politiques de l'organisation. |
| GET | /platform/v1/policies/{id} | clé · platform_read | Une politique. |
| POST | /platform/v1/policies | clé · platform_write | Crée une politique. |
| PUT | /platform/v1/policies/{id} | clé · platform_write | Modifie une politique. S'applique à la prochaine requête, pas à une requête déjà en cours. |
| GET | /platform/v1/status | aucun | État du déploiement. Il ne demande aucun justificatif d'accès, considérez-le donc comme non confidentiel. |
Ce qui n'est pas ici
Il n'y a pas de /v1/files, /v1/batches, /v1/assistants, /v1/fine_tuning, /v1/images, /v1/audio ni de /v1/moderations. Ils ne sont pas montés, ils répondent donc 404 unknown_route plutôt qu'un 501 qui laisserait entendre qu'ils arrivent. Il n'y a ni webhooks ni SDK : tout client compatible OpenAI fait office de SDK.
État sans clé
Ce point de terminaison ne demande aucun justificatif d'accès, ce qui rend public l'état du déploiement lui-même. C'est écrit ici plutôt que découvert plus tard, car c'est une décision de produit : si votre politique exige une sonde d'état authentifiée, modifiez-la délibérément. La réponse ne contient jamais de données d'organisation.