logo

Recharge et tarification

Présentation de la facturation

Qu'est-ce qu'un token ?

Un token est l'unité de base utilisée par les modèles pour traiter le texte. À titre indicatif :

  • 1 mot anglais correspond environ à 1 à 2 tokens
  • 1 caractère chinois correspond environ à 1,5 à 2 tokens

Comment la facturation est-elle calculée ?

La consommation de tokens des modèles Claude se divise en quatre catégories :

Type de tokenDescription
Tokens d'entréeLe contenu que vous envoyez au modèle, comme les prompts, le code et le contexte
Tokens de sortieLe contenu de réponse généré par le modèle
Tokens d'écriture en cacheLe contenu d'entrée mis en cache pour la première fois. C'est plus cher que l'entrée standard, mais les réutilisations suivantes peuvent réduire fortement les coûts.
Tokens de lecture du cacheLe contenu d'entrée retrouvé dans le cache. Son prix est bien inférieur à celui d'une entrée standard.

Formule complète de facturation :

Coût = tokens d'entrée × prix d'entrée
+ tokens de sortie × prix de sortie
+ tokens d'écriture en cache × prix d'écriture en cache
+ tokens de lecture du cache × prix de lecture du cache

À propos du cache Dans des outils comme Claude Code, le système gère automatiquement le cache de contexte. Lorsque vous poursuivez une conversation dans une même session, une grande partie du contenu d'entrée est mise en cache, et les tokens de lecture du cache des requêtes suivantes coûtent bien moins cher qu'une entrée ordinaire. Cela peut réduire nettement les coûts. C'est aussi pourquoi nous recommandons d'utiliser le groupe correspondant dans chaque outil : les accès au cache sont plus faciles à obtenir.