L'unité que l'IA lit
Une IA ne lit pas des mots, mais des tokens : des morceaux de mots. Un mot court peut tenir en un seul token, un mot long en compte plusieurs. En anglais, un token représente en moyenne quatre caractères ; le français en consomme un peu plus pour le même texte.
Tout se compte en tokens : ce que vous envoyez, ce que l'IA répond, et tout ce qu'elle garde de la conversation. Cette mémoire de travail a une taille maximale, la fenêtre de contexte. Quand elle est pleine, l'assistant doit résumer ou oublier le début. Les limites d'usage et les tarifs se calculent eux aussi en tokens.
Pourquoi un PDF coûte cher
Quand vous déposez un PDF dans Claude, chaque page est traitée deux fois : son texte est extrait, et la page est aussi convertie en image. Vous payez les deux. Selon la documentation d'Anthropic, le texte seul représente déjà 1 500 à 3 000 tokens par page, auxquels s'ajoute l'image.
Trois réflexes simples économisent beaucoup : convertir un document en Markdown avant de le déposer, n'envoyer que la partie utile, et ouvrir une nouvelle conversation quand on change de sujet. Vous gardez ainsi de la place pour ce qui compte, et l'essentiel ne se perd pas dans la masse.
Chaque token inutile prend la place d'une information utile.
Source : Anthropic, documentation « PDF support », platform.claude.com.
Économe ou gourmand ?
Glissez chaque carte dans la bonne zone : ce geste économise des tokens, ou en consomme inutilement ?
Félicitations, formation terminée
Vous savez ce qu'est un token, à quoi sert la fenêtre de contexte et pourquoi un PDF consomme autant. Prochaine étape : convertir vos documents avec le Convertisseur Markdown.