Qu’est-ce qu’un token ?
Le token est l’unité économique de base des modèles de langage (Claude, ChatGPT, Gemini…). Ce n’est pas un mot : c’est un fragment de mot, découpé de façon arbitraire par le modèle.
Exemples : – « de » = 1 token – « WordPress » = 2 à 3 tokens (les mots longs et techniques sont davantage découpés) – Les espaces comptent aussi comme tokens
Tokens en entrée = tout ce que vous envoyez à Claude (prompt, fichiers, contexte)
Tokens en sortie = tout ce que Claude génère en réponse
Les deux comptent dans votre consommation.
Leviers pour réduire la consommation
- Demander des réponses plus courtes et plus concises
- Fournir moins de contexte inutile en entrée
- Choisir le bon format de fichier quand vous uploadez quelque chose
- Démarrer une nouvelle conversation plutôt que de prolonger une conversation longue
Comparaison des formats : impact sur les tokens
Test réalisé avec la même page web (copilots.com, générée avec un page builder) :
| Format | Tokens estimés |
|---|---|
| HTML page builder | ~525 000 |
| PDF (8 pages) | > HTML page builder (chaque page = image + texte) |
| HTML propre (site codé) | Bien moins que page builder |
| Markdown | ~15 000 |
Le Markdown est de loin le format le plus économique. Réduction d’un facteur 35 par rapport au HTML d’un page builder.
Pourquoi le HTML page builder est si lourd ?
Un site Divi, Elementor, etc. génère un HTML très chargé : conteneurs imbriqués, styles inline, scripts de fonctionnement du page builder… C’est du bruit pour l’IA, qui n’a besoin que du contenu textuel et de sa hiérarchie.
Pourquoi le PDF est lourd ?
L’IA extrait le texte et prend une capture d’image de chaque page. Double consommation.
Le Markdown : format natif de l’IA
Le Markdown (extension .md) est du texte quasi brut avec un léger formatage :
# Titre (H1)
## Sous-titre (H2)
- Liste à puce
Il conserve la hiérarchie de l’information sans le balisage HTML superflu.
Outil recommandé : extension Chrome Webpage to Markdown — convertit n’importe quelle page web en Markdown en un clic. Indispensable pour alimenter Claude avec du contenu web de façon économique.
La longueur de conversation compte aussi
Plus une conversation est longue, plus elle accumule du contexte — et plus elle consomme. Même avec le système de cache de Claude, démarrer une nouvelle conversation dès que possible est l’un des meilleurs réflexes pour faire des économies.
Règle générale
Privilégiez toujours le format le plus proche du texte brut. Le Markdown est le format natif de l’IA. Plus vous uploadez des images et des PDF, plus vous consommez.