Un token est la plus petite unité dans laquelle un modèle d’IA lit, écrit et facture le texte. Ce n’est ni un mot ni une lettre : c’est un fragment. En français et en anglais, un token équivaut en moyenne à environ 4 caractères, soit à peu près 0,75 mot. Tout ce que vous payez sur une API d’IA se mesure en tokens, en entrée et en sortie.

En un coup d’œil

Ce que c’estL’unité dans laquelle le modèle découpe le texte
Taille moyenne~4 caractères · ~0,75 mot
Repère rapide1 000 tokens ≈ 750 mots ≈ 1,5 page
Comment c’est facturéPar tokens d’entrée et de sortie, à des prix différents

Comment le texte est découpé

Le modèle ne voit pas des mots, il voit des tokens. Les mots courants font en général un seul token ; les mots rares, les noms propres, les longs nombres ou les mots dans d’autres langues se coupent en plusieurs. C’est pourquoi le même texte traduit peut coûter plus ou moins selon la langue : le contenu ne change pas, le nombre de morceaux si.

Entrée et sortie sont facturées différemment

Chaque requête paie deux choses : les tokens que vous envoyez (entrée : votre prompt, les instructions, le contexte) et ceux que le modèle renvoie (sortie : sa réponse). La sortie coûte nettement plus cher par token que l’entrée, donc une réponse longue pèse plus sur la facture qu’il n’y paraît.

Pourquoi cela décide de votre facture

Votre coût ne dépend pas du nombre de requêtes, mais du nombre de tokens que vous déplacez. Un prompt avec un document entier collé dedans peut coûter plus cher que cent questions courtes. La formule est toujours la même : tokens × prix par token × volume de requêtes. C’est de là que vient le coût par tâche, la métrique qui compte vraiment.

Comptez les vôtres

Entrez vos tokens d’entrée et de sortie et votre volume mensuel dans le calculateur de coût des tokens et comparez entre modèles : vous verrez en une minute d’où vient votre dépense. Si le chiffre vous surprend, commencez par les 7 leviers pour réduire la facture.

Questions fréquentes

Combien de mots font 1 000 tokens ? Environ 750 mots, soit à peu près 1,5 page de texte suivi. C’est une moyenne : les nombres, les noms propres et les langues moins courantes consomment plus de tokens par mot.

L’entrée et la sortie sont-elles facturées pareil ? Non. La sortie coûte plusieurs fois plus cher par token que l’entrée, c’est pourquoi limiter la longueur des réponses est l’un des leviers d’économie les plus rapides.

Le system prompt compte-t-il ? Oui. Tout ce que vous envoyez compte comme entrée à chaque requête, y compris les instructions fixes, sauf si vous utilisez le prompt caching pour ne pas les payer à chaque fois.


Chez e-ficient, nous mesurons le coût par tâche d’entreprises qui exploitent déjà l’IA en production et vous disons combien vous économiseriez avec chaque levier à votre volume réel. Le premier audit est gratuit si vous souscrivez un forfait avec un engagement de trois mois et rend un diagnostic sous 72 heures.