Aller au contenu principal

Quatre types de tokens

Comprendre la facturation par token

L’API Grok ne facture pas toutes les données de la même manière. Il existe quatre types de tokens distincts, chacun avec son propre tarif et ses propres règles de comptage. Maîtriser cette distinction est indispensable pour estimer vos coûts et optimiser vos dépenses en production.

4
Types de tokens
90 %
Réduction tokens cachés
1 792
Tokens max par image
2M
Contexte maximum

Tokens texte

Les tokens texte sont les plus courants. Ils représentent les fragments de texte envoyés en entrée (votre prompt, le système prompt, l’historique de conversation) et générés en sortie (la réponse du modèle).

Pour grok-4.20, les tarifs sont :

  • Entrée : $2.00 par million de tokens
  • Sortie : $6.00 par million de tokens

Pour grok-4-1-fast, les tarifs sont nettement inférieurs :

  • Entrée : $0.20 par million de tokens
  • Sortie : $0.50 par million de tokens

La différence de prix entre entrée et sortie (facteur 3x pour grok-4.20) s’explique par le coût computationnel plus élevé de la génération de texte par rapport à l’analyse du contexte.

Tokens image

Lorsque vous envoyez une image à l’API, elle est convertie en tokens image. Le nombre de tokens dépend de la taille et du niveau de détail de l’image :

  • Minimum : 256 tokens pour une image de petite taille ou basse résolution
  • Maximum : 1 792 tokens pour une image en haute résolution

Les images sont acceptées aux formats JPG et PNG uniquement, avec une taille maximale de 20 MiB. Les tokens image sont facturés au même tarif que les tokens texte en entrée.

Optimiser le coût des images

Pour réduire le nombre de tokens image consommés :

  • Redimensionnez vos images à la résolution minimale nécessaire pour votre cas d’usage
  • Utilisez une compression JPEG appropriée avant l’envoi
  • Évitez d’envoyer des images haute résolution si une résolution standard suffit

Tokens cachés (cached)

Les tokens cachés sont des tokens d’entrée qui ont été mémorisés par le système de cache automatique de l’API. Ils bénéficient d’une réduction tarifaire considérable :

  • grok-4.20 : $0.20 par million de tokens cachés (au lieu de $2.00, soit 90 % de réduction)
  • grok-4-1-fast : $0.05 par million de tokens cachés (au lieu de $0.20, soit 75 % de réduction)

Nous détaillerons le mécanisme de cache dans la section suivante du cours. Retenez pour l’instant que les tokens cachés apparaissent dans l’objet usage de chaque réponse sous le champ cached_tokens.

Tokens de raisonnement (reasoning)

Les tokens de raisonnement sont spécifiques aux modèles utilisant le mode reasoning (grok-4.20-0309-reasoning). Ils représentent la “réflexion interne” du modèle avant de produire sa réponse finale.

Un point important : les tokens de raisonnement sont facturés au tarif de sortie, pas au tarif d’entrée. Pour grok-4.20, cela signifie $6.00 par million de tokens de raisonnement. Ce coût peut être significatif car le modèle peut générer des milliers de tokens de raisonnement avant de répondre.

À noter que grok-4.20 ne retourne pas le contenu de raisonnement (reasoning_content) en clair dans la réponse API. Vous êtes facturé pour ces tokens sans pouvoir lire la chaîne de pensée.

Points clés à retenir

  • Quatre types de tokens existent : texte, image, cached (tarif réduit) et reasoning (facturés en sortie)
  • Les tokens image varient de 256 à 1 792 selon la taille et le détail de l’image
  • Les tokens cachés offrent jusqu’à 90 % de réduction sur grok-4.20
  • Les tokens de raisonnement sont facturés au tarif de sortie, ce qui peut représenter un coût important
  • Choisissez le bon modèle selon votre besoin : grok-4-1-fast est 10x moins cher que grok-4.20