Aller au contenu principal

Endpoints supportes dans les batchs

Six endpoints, un seul workflow

La Batch API n’est pas limitee a la generation de texte. Elle prend en charge six endpoints differents, couvrant le texte, les images et les videos. Vous pouvez mixer ces endpoints dans un meme batch, ce qui permet de creer des pipelines multimodaux complets en une seule operation.

Endpoints texte

Les deux endpoints texte sont les plus frequemment utilises en mode batch :

/v1/chat/completions — L’endpoint classique de completion. Vous envoyez une conversation (messages system, user, assistant) et recevez une reponse. C’est l’endpoint compatible avec le format OpenAI, utilise par la plupart des frameworks et SDKs existants.

/v1/responses — L’API Responses, endpoint principal de xAI. Elle offre des fonctionnalites supplementaires par rapport a Chat Completions : outils integres (recherche web, execution de code, MCP), gestion d’etat, et instructions systeme enrichies.

Ces deux endpoints beneficient de la reduction de 50 % sur les tokens texte en mode batch. Pour un traitement de masse purement textuel, le gain economique est maximal.

Endpoints images

La Batch API supporte egalement la generation et l’edition d’images :

/v1/images/generations — Generation d’images a partir d’un prompt texte. Vous decrivez l’image souhaitee et Grok la genere. En mode batch, vous pouvez soumettre des centaines de prompts de generation dans un seul lot.

/v1/images/edits — Edition d’images existantes. Vous fournissez une image source et des instructions de modification. Utile pour des transformations en serie sur un catalogue visuel.

Les images sont facturees au tarif standard, sans reduction batch. Cependant, la commodite de soumettre toutes les generations en un seul appel reste un avantage operationnel.

Endpoints videos

Les deux derniers endpoints concernent la video :

/v1/videos/generations — Generation de videos a partir d’un prompt. Les videos generees sont accessibles via des URLs signees temporaires.

/v1/videos/edits — Edition de videos existantes avec des instructions texte.

Comme pour les images, les tarifs videos restent standard en mode batch. L’interet reside dans la capacite a soumettre un grand nombre de generations dans une seule operation.

Mixer les endpoints dans un batch

Un batch unique peut contenir des requetes ciblant differents endpoints. Chaque requete du fichier JSONL specifie son endpoint cible dans le champ url :

{"custom_id": "text-1", "method": "POST", "url": "/v1/chat/completions", "body": {"model": "grok-3", "messages": [{"role": "user", "content": "Resume cet article"}]}}
{"custom_id": "img-1", "method": "POST", "url": "/v1/images/generations", "body": {"model": "grok-2-image", "prompt": "Logo minimaliste"}}

Cette flexibilite permet de construire des pipelines complets. Par exemple, vous pourriez generer des descriptions de produits (texte) et leurs visuels (images) dans le meme batch.

Choisir le bon endpoint

Le choix entre Chat Completions et Responses API depend de votre cas d’usage :

  • Chat Completions : compatibilite maximale avec les SDKs tiers, migration simple depuis d’autres fournisseurs, cas d’usage purement textuels
  • Responses API : acces aux outils integres (recherche web, code), fonctionnalites avancees, cas d’usage complexes

Pour un traitement batch standard (classification, resume, extraction), Chat Completions suffit generalement. Si vos requetes necessitent l’acces a des outils serveur, l’API Responses est le bon choix.

Points cles a retenir

  • Six endpoints sont supportes : deux texte, deux images, deux videos
  • Seuls les tokens texte beneficient de la reduction de 50 %
  • Vous pouvez mixer differents endpoints dans un meme batch
  • Le champ url dans le JSONL determine l’endpoint cible de chaque requete
  • Chat Completions convient aux cas simples, Responses API aux cas avec outils