Tarification détaillée des modèles
Choisir le bon modèle pour votre budget
L’API Grok propose plusieurs modèles avec des tarifs très différents. Le choix du modèle est la décision qui a le plus d’impact sur votre facture mensuelle. Un mauvais choix peut multiplier vos coûts par 10 sans amélioration notable de la qualité pour votre cas d’usage.
Modèles texte et multimodaux
Les deux familles principales de modèles texte sont grok-4.20 (premium) et grok-4-1-fast (économique).
grok-4.20
Le modèle phare de xAI, avec une fenêtre de contexte de 2 millions de tokens :
- Entrée standard : $2.00 / million de tokens
- Entrée cachée : $0.20 / million de tokens (90 % de réduction)
- Sortie : $6.00 / million de tokens
- Disponible en versions reasoning et non-reasoning
grok-4-1-fast
Le modèle rapide et économique, également avec 2 millions de tokens de contexte :
- Entrée standard : $0.20 / million de tokens
- Entrée cachée : $0.05 / million de tokens (75 % de réduction)
- Sortie : $0.50 / million de tokens
- Disponible en versions reasoning et non-reasoning
grok-4.20-multi-agent
Conçu pour l’orchestration multi-agents, mêmes tarifs que grok-4.20 :
- Entrée : $2.00 / million de tokens
- Sortie : $6.00 / million de tokens
Modèles de génération visuelle
Pour la génération d’images et de vidéos, la facturation est à l’unité :
- grok-imagine-image-pro : $0.07 par image (qualité supérieure, 30 RPM)
- grok-imagine-image : $0.02 par image (qualité standard, 300 RPM)
- grok-imagine-video : $0.05 par seconde de vidéo (60 RPM)
Voice et Text-to-Speech
Les services vocaux utilisent une facturation spécifique :
- Voice Agent API : $0.05 par minute ($3.00 par heure), jusqu’à 100 sessions concurrentes, maximum 30 minutes par session
- Text-to-Speech : $4.20 par million de caractères, jusqu’à 100 requêtes concurrentes
Batch API : 50 % de réduction
Pour les traitements non urgents, la Batch API offre une réduction de 50 % sur les tarifs standard des tokens. Les images et vidéos restent au tarif normal. C’est l’option idéale pour :
- Le traitement nocturne de grands volumes de données
- L’analyse de corpus documentaires
- La génération de contenu en masse
Avec la Batch API, grok-4.20 descend à $1.00 en entrée et $3.00 en sortie par million de tokens, ce qui le rend compétitif avec grok-4-1-fast en temps réel.
Frais de violation d’usage
Un point souvent ignoré : xAI facture $0.05 par requête qui viole les conditions d’utilisation. Implémentez un filtrage côté client pour éviter d’envoyer involontairement du contenu problématique.
Estimer votre facture mensuelle
Pour une estimation réaliste, considérez ce scénario d’application de service client :
- 10 000 requêtes par jour
- Prompt moyen : 2 000 tokens en entrée
- Réponse moyenne : 500 tokens en sortie
- Modèle : grok-4-1-fast
- Taux de cache : 60 %
Calcul mensuel (30 jours) :
- Tokens en entrée : 10 000 x 2 000 x 30 = 600M tokens
- Dont cachés (60 %) : 360M x $0.05/M = $18
- Dont non-cachés (40 %) : 240M x $0.20/M = $48
- Tokens en sortie : 10 000 x 500 x 30 = 150M x $0.50/M = $75
- Total estimé : ~$141/mois
Le même scénario avec grok-4.20 coûterait environ $1 332/mois. Le choix du modèle est déterminant.
Points clés à retenir
- grok-4-1-fast est 10x moins cher que grok-4.20 en entrée et 12x en sortie
- La Batch API offre 50 % de réduction sur les tokens
- Les frais de violation d’usage ($0.05/requête) justifient un filtrage côté client
- Estimez votre facture en combinant volume, taux de cache et choix de modèle
- Pour la plupart des cas d’usage, commencez par grok-4-1-fast puis migrez vers grok-4.20 si la qualité est insuffisante