Skip to main content
Estimez le coût avant un appel de modèle en combinant le prix du répertoire des modèles avec les unités facturées par le point de terminaison : tokens, images, durée audio ou tâches vidéo. Considérez l’estimation comme une protection budgétaire, puis utilisez les données d’utilisation et de facturation réelles une fois la requête terminée.

Estimer les appels basés sur les tokens

L’exemple Python suivant estime le coût d’une requête basée sur des tokens à partir des valeurs de tarification configurées :
Le résultat est une estimation avant l’appel :

Définir un budget de sortie maximal

La requête suivante plafonne la sortie générée afin que l’estimation ait une borne supérieure :
La réponse inclut l’utilisation réelle après l’appel du modèle :

Estimer les appels basés sur des tâches

L’exemple JavaScript suivant estime un flux de travail basé sur des tâches, comme la génération d’images ou de vidéos :
Le résultat correspond au budget de la tâche :

Erreurs courantes

Liens associés

Dernière modification le 23 juin 2026