Aller au contenu principal

Tarification détaillée des modèles

Choisir le bon modèle pour votre budget

L’API Grok propose plusieurs modèles avec des tarifs très différents. Le choix du modèle est la décision qui a le plus d’impact sur votre facture mensuelle. Un mauvais choix peut multiplier vos coûts par 10 sans amélioration notable de la qualité pour votre cas d’usage.

Modèles texte et multimodaux

Les deux familles principales de modèles texte sont grok-4.20 (premium) et grok-4-1-fast (économique).

grok-4.20

Le modèle phare de xAI, avec une fenêtre de contexte de 2 millions de tokens :

  • Entrée standard : $2.00 / million de tokens
  • Entrée cachée : $0.20 / million de tokens (90 % de réduction)
  • Sortie : $6.00 / million de tokens
  • Disponible en versions reasoning et non-reasoning

grok-4-1-fast

Le modèle rapide et économique, également avec 2 millions de tokens de contexte :

  • Entrée standard : $0.20 / million de tokens
  • Entrée cachée : $0.05 / million de tokens (75 % de réduction)
  • Sortie : $0.50 / million de tokens
  • Disponible en versions reasoning et non-reasoning

grok-4.20-multi-agent

Conçu pour l’orchestration multi-agents, mêmes tarifs que grok-4.20 :

  • Entrée : $2.00 / million de tokens
  • Sortie : $6.00 / million de tokens

Modèles de génération visuelle

Pour la génération d’images et de vidéos, la facturation est à l’unité :

  • grok-imagine-image-pro : $0.07 par image (qualité supérieure, 30 RPM)
  • grok-imagine-image : $0.02 par image (qualité standard, 300 RPM)
  • grok-imagine-video : $0.05 par seconde de vidéo (60 RPM)

Voice et Text-to-Speech

Les services vocaux utilisent une facturation spécifique :

  • Voice Agent API : $0.05 par minute ($3.00 par heure), jusqu’à 100 sessions concurrentes, maximum 30 minutes par session
  • Text-to-Speech : $4.20 par million de caractères, jusqu’à 100 requêtes concurrentes

Batch API : 50 % de réduction

Pour les traitements non urgents, la Batch API offre une réduction de 50 % sur les tarifs standard des tokens. Les images et vidéos restent au tarif normal. C’est l’option idéale pour :

  • Le traitement nocturne de grands volumes de données
  • L’analyse de corpus documentaires
  • La génération de contenu en masse

Avec la Batch API, grok-4.20 descend à $1.00 en entrée et $3.00 en sortie par million de tokens, ce qui le rend compétitif avec grok-4-1-fast en temps réel.

Frais de violation d’usage

Un point souvent ignoré : xAI facture $0.05 par requête qui viole les conditions d’utilisation. Implémentez un filtrage côté client pour éviter d’envoyer involontairement du contenu problématique.

Estimer votre facture mensuelle

Pour une estimation réaliste, considérez ce scénario d’application de service client :

  • 10 000 requêtes par jour
  • Prompt moyen : 2 000 tokens en entrée
  • Réponse moyenne : 500 tokens en sortie
  • Modèle : grok-4-1-fast
  • Taux de cache : 60 %

Calcul mensuel (30 jours) :

  • Tokens en entrée : 10 000 x 2 000 x 30 = 600M tokens
  • Dont cachés (60 %) : 360M x $0.05/M = $18
  • Dont non-cachés (40 %) : 240M x $0.20/M = $48
  • Tokens en sortie : 10 000 x 500 x 30 = 150M x $0.50/M = $75
  • Total estimé : ~$141/mois

Le même scénario avec grok-4.20 coûterait environ $1 332/mois. Le choix du modèle est déterminant.

Points clés à retenir

  • grok-4-1-fast est 10x moins cher que grok-4.20 en entrée et 12x en sortie
  • La Batch API offre 50 % de réduction sur les tokens
  • Les frais de violation d’usage ($0.05/requête) justifient un filtrage côté client
  • Estimez votre facture en combinant volume, taux de cache et choix de modèle
  • Pour la plupart des cas d’usage, commencez par grok-4-1-fast puis migrez vers grok-4.20 si la qualité est insuffisante