Calculateur de coût d'une fonctionnalité IA
Ce que coûtent vos appels à un modèle chaque mois, et quelle part de votre abonnement ils mangent.
Gratuit · sans carte bancaire · résultat immédiatVoir les données
| Où va la facture, et ce qu'il reste | |
|---|---|
| Entrée | 180 € |
| Sortie | 270 € |
| Marge | 9 050 € |
- Requêtes par mois
- 30 000
- Coût par requête
- 0,015 €
- Coût par utilisateur
- 0,90 €
- Part de l'abonnement
- 4,7 %
- Marge restante par utilisateur
- 18,10 €
- Requêtes avant d'y perdre
- 1 266 par utilisateur
30 000 requêtes par mois vous coûtent 450 €, soit 0,015 € par requête et 1 € par utilisateur.
Elle mange 4,7 % de l'abonnement à 19 €, et il vous reste 18 € par utilisateur pour tout le reste : hébergement, support, salaires, marge.
Un utilisateur peut faire 1 266 requêtes avant de coûter son abonnement entier. C'est le plafond à connaître avant d'annoncer un usage illimité — quelques utilisateurs intensifs suffisent à emporter la marge de tous les autres.
La sortie pèse 60 % de la facture, l'entrée 40 %. Votre coût vient surtout de ce que le modèle écrit : demander des réponses plus courtes agit directement sur la facture.
Comment ce calcul est fait
Le coût unitaire ne dit rien, sa part de l'abonnement dit tout
Un dixième de centime par requête paraît gratuit — jusqu'à ce qu'un utilisateur en fasse deux cents par mois sur un abonnement à dix-neuf euros. C'est le pourcentage de l'abonnement mangé par l'IA qui décide d'un modèle économique, et c'est celui que personne ne calcule avant de lancer.
Aucun tarif de modèle n'est écrit dans cet outil
Ils changent tous les trimestres, et un calculateur qui les porterait en dur serait faux six mois plus tard sans que personne s'en aperçoive. Les deux prix se saisissent, tels que votre fournisseur les affiche : par million de jetons, entrée et sortie séparées.
L'entrée et la sortie ne coûtent pas pareil
La sortie vaut trois à cinq fois l'entrée chez la plupart des fournisseurs. Selon celle qui domine votre facture, le levier n'est pas le même : raccourcir le contexte envoyé, ou demander des réponses plus courtes. La mise en cache des invites, elle, divise le coût d'entrée par cinq à dix — c'est le premier réglage à activer sur un produit qui renvoie le même contexte à chaque appel.
Ce que le calcul ne fait pas
Il suppose un usage moyen. Or il n'existe pas d'utilisateur moyen : quelques utilisateurs intensifs suffisent à emporter la marge de tous les autres, et c'est pour cela que le nombre de requêtes avant perte est affiché. Il ignore aussi les reprises après erreur et les appels de vérification, qui ajoutent dix à trente pour cent en pratique.
Questions fréquentes
Qu'est-ce qu'un jeton ?
L'unité de découpage du texte par le modèle. Mille jetons valent environ 750 mots en français, un peu moins qu'en anglais. Les fournisseurs facturent par million de jetons, séparément pour ce que vous envoyez et ce que le modèle rend.
Comment réduire la facture d'une fonctionnalité IA ?
Dans l'ordre du plus efficace : activer la mise en cache des invites, raccourcir le contexte envoyé, demander des réponses plus courtes, et n'employer le gros modèle que là où il change quelque chose. Un modèle rapide sur quatre-vingts pour cent des requêtes divise souvent la facture par trois.
Faut-il facturer l'IA à l'usage ou l'inclure dans l'abonnement ?
L'inclure tant que la part de l'abonnement reste sous vingt pour cent, avec un plafond d'usage annoncé. Au-delà, les utilisateurs intensifs coûtent plus qu'ils ne rapportent, et un forfait illimité devient une promesse qu'on ne tient qu'en la retirant.
Pourquoi mon coût réel dépasse-t-il cette estimation ?
Trois causes habituelles : les reprises après erreur, les appels de vérification qu'on oublie de compter, et un contexte qui grossit avec l'historique de conversation. Prenez ce résultat comme un plancher, et ajoutez-y une marge de vingt à trente pour cent.