Présentation de la facturation
Qu'est-ce qu'un token ?
Un token est l'unité de base utilisée par les modèles pour traiter le texte. À titre indicatif :
- 1 mot anglais correspond environ à 1 à 2 tokens
- 1 caractère chinois correspond environ à 1,5 à 2 tokens
Comment la facturation est-elle calculée ?
La consommation de tokens des modèles Claude se divise en quatre catégories :
| Type de token | Description |
|---|---|
| Tokens d'entrée | Le contenu que vous envoyez au modèle, comme les prompts, le code et le contexte |
| Tokens de sortie | Le contenu de réponse généré par le modèle |
| Tokens d'écriture en cache | Le contenu d'entrée mis en cache pour la première fois. C'est plus cher que l'entrée standard, mais les réutilisations suivantes peuvent réduire fortement les coûts. |
| Tokens de lecture du cache | Le contenu d'entrée retrouvé dans le cache. Son prix est bien inférieur à celui d'une entrée standard. |
Formule complète de facturation :
Coût = tokens d'entrée × prix d'entrée
+ tokens de sortie × prix de sortie
+ tokens d'écriture en cache × prix d'écriture en cache
+ tokens de lecture du cache × prix de lecture du cache
À propos du cache Dans des outils comme Claude Code, le système gère automatiquement le cache de contexte. Lorsque vous poursuivez une conversation dans une même session, une grande partie du contenu d'entrée est mise en cache, et les tokens de lecture du cache des requêtes suivantes coûtent bien moins cher qu'une entrée ordinaire. Cela peut réduire nettement les coûts. C'est aussi pourquoi nous recommandons d'utiliser le groupe correspondant dans chaque outil : les accès au cache sont plus faciles à obtenir.
