← Retour au blog

Qu'est-ce qu'un token en IA ? Le guide simple pour comprendre

Un token est l'unité de texte que traite un modèle d'IA. Ce que c'est, comment le compter et son impact sur vos coûts, expliqué simplement pour une TPE.

July 25, 2026

7 min

Terence Acher

📌 Résumé de l’article

Un token est l'unité de texte que traite un modèle d'IA. Ce que c'est, comment le compter et son impact sur vos coûts, expliqué simplement pour une TPE.

En bref : un token est la plus petite unité de texte qu'un modèle d'intelligence artificielle lit et produit. Ce n'est pas tout à fait un mot : selon les cas, un token peut être un mot court, un fragment de mot, un signe de ponctuation ou même une espace. Les modèles comme ChatGPT ou Claude ne raisonnent pas en phrases, ils découpent tout en tokens, puis prédisent le token suivant, encore et encore. Comprendre cette unité change deux choses très concrètes pour une entreprise : ce que vous payez, et la quantité d'information qu'un modèle peut traiter d'un coup. Cet article explique le quoi et le pourquoi, sans jargon.

Qu'est-ce qu'un token, concrètement

Quand vous envoyez une phrase à un modèle d'IA, il ne la lit pas lettre par lettre ni mot par mot. Il la transforme d'abord en une suite de tokens, des petits morceaux de texte tirés d'un vocabulaire fixe appris pendant l'entraînement. Le mot "bonjour" peut tenir en un seul token, alors qu'un mot rare ou technique sera coupé en plusieurs morceaux. La ponctuation et les espaces comptent aussi comme des tokens. C'est cette suite de tokens, et rien d'autre, que le modèle manipule pour comprendre votre demande et rédiger sa réponse.

Pourquoi ce découpage plutôt que des mots entiers ? Parce qu'il rend le modèle plus efficace et plus universel. Avec quelques dizaines de milliers de tokens, il peut représenter n'importe quel texte, dans n'importe quelle langue, y compris des mots qu'il n'a jamais vus, en les assemblant à partir de fragments connus. Le mot compte pour un humain, le token compte pour la machine.

Comment un texte devient des tokens

La transformation d'un texte en tokens s'appelle la tokenisation, et elle est réalisée par un composant dédié, le tokenizer. Chaque famille de modèles a le sien, ce qui explique qu'un même texte ne donne pas exactement le même nombre de tokens chez OpenAI, Anthropic ou Mistral. La règle reste stable dans les grandes lignes : en anglais, un token représente en moyenne environ quatre caractères, soit à peu près trois quarts d'un mot. En français, le découpage est un peu plus fin, car nos mots sont souvent plus longs et les accents fragmentent davantage. Pour donner un ordre de grandeur, une page d'environ 500 mots pèse en général entre 650 et 900 tokens.

Le plus simple pour saisir le principe reste de l'essayer. Collez une phrase dans le Tokenizer d'OpenAI : l'outil colore chaque token et affiche le compte total. Vous verrez tout de suite que "l'automatisation" ne fait pas un token, que les chiffres et les emojis se comportent différemment, et que le français consomme légèrement plus de tokens que l'anglais pour dire la même chose.

Pourquoi les tokens comptent pour votre entreprise

Tant que l'IA reste un gadget occasionnel, le sujet des tokens paraît théorique. Dès que vous l'intégrez à un usage régulier (traitement d'emails, résumés, assistant interne), il devient très concret, pour deux raisons.

D'abord, le prix. Les modèles ne se facturent pas au mois ni au document, mais au token. Chaque appel additionne les tokens que vous envoyez (l'entrée : votre consigne et le contexte fourni) et les tokens que le modèle génère (la sortie : sa réponse). Les deux sont comptés, et la sortie est généralement plus chère que l'entrée. Un prompt à rallonge répété mille fois par jour n'a pas le même coût qu'une consigne resserrée.

Ensuite, la fenêtre de contexte. Un modèle ne peut pas lire une quantité illimitée de texte d'un coup. Il a une limite, exprimée en tokens, qui englobe à la fois votre demande et sa réponse. Si vous lui soumettez un document trop long, il faut le découper ou le résumer, sinon la partie qui dépasse est ignorée. Comprendre cette limite évite bien des surprises quand on veut faire analyser un gros rapport.

Ce que vous avez en têteCe que le modèle compte réellement
L'unité, c'est le motL'unité, c'est le token, souvent un fragment de mot
Les espaces et la ponctuation ne comptent pasIls comptent comme des tokens
Seule ma question est facturéeL'entrée et la sortie sont additionnées
La langue n'a pas d'impactLe français consomme un peu plus que l'anglais
Je peux envoyer un document de n'importe quelle tailleLa fenêtre de contexte plafonne le volume traité

Réduire sa consommation de tokens sans perdre en qualité

Maîtriser les tokens ne veut pas dire rogner sur tout. Il s'agit d'éviter le gaspillage, là où il ne sert à rien. Trois réflexes simples suffisent à faire une vraie différence sur la facture.

  • Aller à l'essentiel dans vos consignes. Un prompt clair et concis coûte moins cher et donne souvent de meilleures réponses qu'un pavé confus. Inutile de répéter dix fois le contexte : donnez-le une fois, proprement.
  • Ne fournir que le contexte utile. Coller un rapport de trente pages quand trois paragraphes suffisent gonfle l'entrée pour rien. Extrayez la partie pertinente, ou résumez en amont.
  • Cadrer la longueur des réponses. Demander explicitement une réponse courte, une liste ou un tableau limite les tokens de sortie, les plus coûteux. Vous gardez la main sur le format, donc sur le coût.

Pour un usage à plus grande échelle, d'autres leviers existent (mise en cache d'un contexte réutilisé, choix d'un modèle plus léger pour les tâches simples), mais ces trois habitudes couvrent déjà l'essentiel des cas d'une TPE. Si vous débutez avec des outils comme ChatGPT en entreprise ou Claude, prendre ce réflexe dès le départ vous évitera de mauvaises surprises.

Questions fréquentes

Un token, c'est la même chose qu'un mot ?

Non. Un mot peut correspondre à un seul token, mais aussi à plusieurs, et un token peut ne représenter qu'un fragment de mot, une ponctuation ou une espace. En moyenne, en anglais, un token vaut environ trois quarts d'un mot. En français, comptez un peu plus de tokens pour un même nombre de mots.

Comment compter les tokens d'un texte ?

Le plus fiable est d'utiliser un tokenizer en ligne. En collant votre texte dans le Tokenizer d'OpenAI, vous obtenez le nombre exact de tokens et voyez comment le texte est découpé. C'est le meilleur moyen d'estimer un coût avant de lancer un traitement en volume.

Pourquoi l'IA facture-t-elle au token et pas au mot ?

Parce que le token est l'unité que le modèle traite réellement. Facturer au token reflète le vrai travail effectué, quelle que soit la langue ou le type de contenu. C'est aussi ce qui permet une tarification homogène entre un texte en français, un extrait de code ou une liste de chiffres.

Le français consomme-t-il plus de tokens que l'anglais ?

Oui, légèrement. Les mots français sont en moyenne plus longs, et les accents comme certaines constructions fragmentent davantage le texte. À contenu équivalent, un texte français mobilise donc un peu plus de tokens, et coûte un peu plus, que son équivalent anglais.

Qu'est-ce que la fenêtre de contexte ?

C'est la quantité maximale de tokens qu'un modèle peut prendre en compte en une seule fois, en additionnant votre demande et sa réponse. Au-delà de cette limite, le texte qui dépasse est ignoré. Pour traiter un document plus grand que la fenêtre, il faut le découper ou le résumer par étapes.

Combien de tokens dans une page de texte ?

De l'ordre de 650 à 900 tokens pour une page d'environ 500 mots en français, à titre indicatif. Le chiffre exact dépend du modèle et du contenu. Pour une estimation précise, passez votre texte dans un tokenizer plutôt que de vous fier à une moyenne.


Aller plus loin

Comprendre les tokens, c'est poser la première brique pour utiliser l'IA de façon maîtrisée, sans surprise de coût ni blocage technique. Si vous voulez aller du concept à la pratique et intégrer ces outils au quotidien de votre activité, notre formation Améliorer l'efficacité de sa TPE à l'aide de l'IA vous accompagne pas à pas, avec des cas concrets adaptés à votre métier.

Automation

Terence

Automation

Formateur et consultant Growth & IA. Intervenant en école supérieure.

Acquisition
IA & Automation

Vous voulez vous former ?

Formations certifiantes éligibles CPF. Réponse sous 24h.

Financement

Faites financer votre formation

CPF, OPCO, plan de développement des compétences… selon votre situation, votre formation peut être prise en charge jusqu'à 100 %. Un conseiller monte votre dossier avec vous.

Nous contacter ↗