Tarification
Vous payez le prix des tokens du modèle que vous appelez, plus une redevance de plateforme visible. Rien n'est ajouté au tarif du fournisseur en secret.
Les paiements par carte ne sont pas activés sur ce déploiement, et rien n'ajoute de crédit automatiquement : il n'y a pas encore de traitement de facturation ni de voie d'ajout de crédit par un opérateur. La console affiche ce que vous avez dépensé et ce qu'il reste.
Ce déploiement peut exécuter de l'inférence simulée : une réponse peut provenir d'un modèle de substitution plutôt que du modèle nommé dans la requête. Quand le mode simulé est activé, la console et la trace le disent, et aucun frais de token n'est facturé.
Modèles
| Modèles | Région | in par million de tokens | out par million de tokens |
|---|---|---|---|
| Whisper large-v3 | de-fra | 0,0736 € | 0,22 € |
| Mistral Small 4 (119B-A6B) | fr-par | 0,0920 € | 0,28 € |
| EuroLLM-1.7B-Instruct | de-fra | 0,0920 € | 0,28 € |
| EuroLLM-22B-Instruct (2512) | de-ber | 0,11 € | 0,33 € |
| Devstral Small 2 (24B) | de-ber | 0,32 € | 0,97 € |
| EuroLLM-9B-Instruct (2512) | de-fra | 0,32 € | 0,97 € |
6 endpoint(s) currently priceable. Si un modèle coûte plus cher via LLM EU que directement chez son fournisseur, la fiche le dit et de combien. Il n'y a pas de marge cachée.
Ce que finance la redevance de plateforme
Le routeur et son moteur de politique, l'hôte UE et ses opérations, les traces que vous lisez dans la console, et le travail de documentation des fiches. Elle est facturée une fois par requête, affichée sur chaque ligne de facture, et jamais intégrée à un prix de token.
Si un modèle coûte plus cher via LLM EU que directement chez son fournisseur, la fiche le dit et de combien. Il n'y a pas de marge cachée.
Entreprise
Pour les équipes qui évaluent une inférence contrôlée par politique et des métadonnées de requête auditables. Examinez les contrôles mis en œuvre, les limitations actuelles et les documents contractuels inachevés avant d'envisager un usage en production.