Calcul des tokens
Les tokens sont l’unité de mesure de Claude (et de tous les LLM). Environ 4 caractères de texte anglais — et à peu près ce que vous payez.
Ordre de grandeur
- 1 token ≈ 4 caractères anglais ≈ 0,75 mot.
- Une page de texte (~500 mots) représente ~670 tokens.
- Le code source, les alphabets non latins et les émojis se découpent en tokens plus denses — comptez 1,2 à 2× le ratio anglais. Le français est légèrement plus dense que l’anglais.
- Une fenêtre de contexte de 200k tokens représente environ 150k mots anglais — environ 300 pages.
Quatre types de tokens sur votre facture
| Type | De quoi il s’agit | Facturation |
|---|---|---|
| Entrée | Chaque token que le modèle lit : prompt système, tours précédents, message actuel, schéma des outils, images. | Tarif d’entrée plein. |
| Sortie | Chaque token que le modèle écrit : texte de réponse, appels d’outils, réflexion (si activée). | Tarif de sortie plein (en général 5× l’entrée). |
| Lecture cache | Tokens d’entrée servis depuis le point de cache d’une requête précédente. | 10 % du tarif d’entrée. |
| Écriture cache | La première requête sur un point de cache — elle crée le cache pour les lectures suivantes. | 125 % du tarif d’entrée. |
Chaque réponse contient ces décomptes dans le champ usage — voir Consommation et facturation.
Estimer avant d’envoyer
Les SDK Anthropic proposent un utilitaire de comptage de tokens utilisable localement :
from anthropic import Anthropic
client = Anthropic(base_url="https://api-ai.fr")
count = client.messages.count_tokens(
model="claude-sonnet-5-5",
messages=[{"role": "user", "content": "Your long prompt here"}],
)
print(count.input_tokens)Ce décompte est une borne basse — il n’inclut pas la sortie que le modèle va produire. Pour budgéter, fixez un plafond max_tokens et prenez le pire cas.
Estimer les économies du cache
Il n’existe pas de multiplicateur universel entre modèles. Pour le modèle équilibré actuel claude-sonnet-5-5 comme pour les autres, utilisez ses valeurs Lecture cache et Écriture cache dans le tableau des tarifs. Comparez-les à son tarif d’entrée et au nombre de lectures répétées attendu.