Points de terminaison

Chaque route montée par cette API, ce dont elle a besoin, et celles que l'on attend mais qui sont volontairement absentes.

URL de base dans ce déploiement : https://api.llmeu.com

Méthode Chemin Justificatif d'accès Remarques
GET /healthz aucun Liveness. Ne lit rien.
GET /readyz aucun Readiness : base de données, points de terminaison propriétaires, environnements d'exécution gérés. Répond 503 pendant qu'un GPU charge encore les poids.
GET /v1/models clé · inférence Uniquement les modèles que cette clé peut réellement appeler selon la politique par défaut de son organisation.
GET /v1/models/{id} clé · inférence Un modèle, avec sa licence et l'indication qu'il est hébergé ici ou non.
POST /v1/chat/completions clé · inférence Le point de terminaison de chat compatible OpenAI, avec ou sans streaming.
POST /v1/completions aucun Non proposé. Répond 501 not_implemented et indique le point de terminaison à utiliser à la place.
POST /v1/embeddings clé · inférence Embeddings produits par un modèle d'embedding. Ce déploiement les sert depuis son backend local déterministe, et la réponse l'indique : llmeu.mock vaut true dans le corps.
POST /v1/playground aucun Anonyme, backend simulé uniquement, et limité par adresse IP.
GET /platform/v1/me clé · platform_read L'organisation à laquelle ce justificatif d'accès appartient.
GET /platform/v1/api-keys clé · platform_read Les clés de l'organisation, sans les secrets.
POST /platform/v1/api-keys clé · platform_write Crée une clé. Le secret apparaît dans cette réponse et plus jamais ensuite.
DELETE /platform/v1/api-keys/{id} clé · platform_write Révoque une clé. Effectif à la prochaine requête.
GET /platform/v1/traces clé · platform_read Métadonnées enregistrées pour les appels passés. Aucun corps de prompt ou de complétion : la rétention est de zéro.
GET /platform/v1/traces/{id} clé · platform_read Une trace, y compris la décision de routage.
GET /platform/v1/usage clé · platform_read Utilisation agrégée par jour et par modèle.
GET /platform/v1/policies clé · platform_read Les politiques de l'organisation.
GET /platform/v1/policies/{id} clé · platform_read Une politique.
POST /platform/v1/policies clé · platform_write Crée une politique.
PUT /platform/v1/policies/{id} clé · platform_write Modifie une politique. S'applique à la prochaine requête, pas à une requête déjà en cours.
GET /platform/v1/status aucun État du déploiement. Il ne demande aucun justificatif d'accès, considérez-le donc comme non confidentiel.

Ce qui n'est pas ici

Il n'y a pas de /v1/files, /v1/batches, /v1/assistants, /v1/fine_tuning, /v1/images, /v1/audio ni de /v1/moderations. Ils ne sont pas montés, ils répondent donc 404 unknown_route plutôt qu'un 501 qui laisserait entendre qu'ils arrivent. Il n'y a ni webhooks ni SDK : tout client compatible OpenAI fait office de SDK.

État sans clé

Ce point de terminaison ne demande aucun justificatif d'accès, ce qui rend public l'état du déploiement lui-même. C'est écrit ici plutôt que découvert plus tard, car c'est une décision de produit : si votre politique exige une sonde d'état authentifiée, modifiez-la délibérément. La réponse ne contient jamais de données d'organisation.