Endpoints supportés dans les batchs
Mis à jour le 30 juillet 2026
Six endpoints, un seul workflow
La Batch API n’est pas limitée à la génération de texte. Elle prend en charge six endpoints différents, couvrant le texte, les images et les vidéos. Vous pouvez mixer ces endpoints dans un même batch, ce qui permet de créer des pipelines multimodaux complets en une seule opération.
Endpoints texte
Les deux endpoints texte sont les plus fréquemment utilisés en mode batch :
/v1/chat/completions — L’endpoint classique de complétion. Vous envoyez une conversation (messages system, user, assistant) et recevez une réponse. C’est l’endpoint compatible avec le format OpenAI, utilisé par la plupart des frameworks et SDKs existants.
/v1/responses — L’API Responses, endpoint principal de xAI. Elle offre des fonctionnalités supplémentaires par rapport à Chat Completions : outils intégrés (recherche web, exécution de code, MCP), gestion d’état, et instructions système enrichies.
Ces deux endpoints bénéficient de la réduction de 50 % sur les tokens texte en mode batch. Pour un traitement de masse purement textuel, le gain économique est maximal.
Endpoints images
La Batch API supporte également la génération et l’édition d’images :
/v1/images/generations — Génération d’images à partir d’un prompt texte. Vous décrivez l’image souhaitée et Grok la génère. En mode batch, vous pouvez soumettre des centaines de prompts de génération dans un seul lot.
/v1/images/edits — Édition d’images existantes. Vous fournissez une image source et des instructions de modification. Utile pour des transformations en série sur un catalogue visuel.
Les images sont facturées au tarif standard, sans réduction batch. Cependant, la commodité de soumettre toutes les générations en un seul appel reste un avantage opérationnel.
Endpoints vidéos
Les deux derniers endpoints concernent la vidéo :
/v1/videos/generations — Génération de vidéos à partir d’un prompt. Les vidéos générées sont accessibles via des URLs signées temporaires.
/v1/videos/edits — Édition de vidéos existantes avec des instructions texte.
Comme pour les images, les tarifs vidéos restent standard en mode batch. L’intérêt réside dans la capacité à soumettre un grand nombre de générations dans une seule opération.
Mixer les endpoints dans un batch
Un batch unique peut contenir des requêtes ciblant différents endpoints. Chaque requête du fichier JSONL spécifie son endpoint cible dans le champ url :
{"custom_id": "text-1", "method": "POST", "url": "/v1/chat/completions", "body": {"model": "grok-4.5", "messages": [{"role": "user", "content": "Résume cet article"}]}}
{"custom_id": "img-1", "method": "POST", "url": "/v1/images/generations", "body": {"model": "grok-imagine-image", "prompt": "Logo minimaliste"}}
Cette flexibilité permet de construire des pipelines complets. Par exemple, vous pourriez générer des descriptions de produits (texte) et leurs visuels (images) dans le même batch.
Choisir le bon endpoint
Le choix entre Chat Completions et Responses API dépend de votre cas d’usage :
- Chat Completions : compatibilité maximale avec les SDKs tiers, migration simple depuis d’autres fournisseurs, cas d’usage purement textuels
- Responses API : accès aux outils intégrés (recherche web, code), fonctionnalités avancées, cas d’usage complexes
Pour un traitement batch standard (classification, résumé, extraction), Chat Completions suffit généralement. Si vos requêtes nécessitent l’accès à des outils serveur, l’API Responses est le bon choix.
Points clés à retenir
- Six endpoints sont supportés : deux texte, deux images, deux vidéos
- Seuls les tokens texte bénéficient de la réduction de 50 %
- Vous pouvez mixer différents endpoints dans un même batch
- Le champ
urldans le JSONL détermine l’endpoint cible de chaque requête - Chat Completions convient aux cas simples, Responses API aux cas avec outils