Aller au contenu principal

Cycle de vie des modèles

Anticiper les changements de modèles

En production, votre application dépend d’un modèle spécifique de l’API Grok. Les modèles évoluent : de nouvelles versions sortent, les anciennes sont dépréciées puis supprimées. Comprendre ce cycle de vie est essentiel pour maintenir la continuité de service de vos applications.

1

Actif

Le modèle est disponible et recommandé pour une utilisation en production. Il reçoit des optimisations et corrections.

2

Déprécié

Le modèle fonctionne encore mais sera supprimé. Planifiez votre migration vers le successeur dès cette annonce.

3

Obsolète (supprimé)

Le modèle est supprimé de l'API. Toute requête utilisant cet identifiant échouera avec une erreur.

Les trois états d’un modèle

Chaque modèle de l’API Grok traverse trois états au cours de sa vie :

Actif

Un modèle actif est pleinement opérationnel et recommandé pour la production. C’est l’état dans lequel vous devez utiliser vos modèles. xAI peut appliquer des optimisations mineures sans changer l’identifiant du modèle.

Déprécié

Lorsqu’un modèle est déprécié, il continue de fonctionner normalement mais xAI annonce sa suppression future. C’est votre signal pour planifier la migration. Le délai entre la dépréciation et la suppression varie, mais il est généralement de plusieurs semaines.

Obsolète (supprimé)

Un modèle obsolète est retiré de l’API. Les requêtes envoyées avec cet identifiant de modèle échouent avec une erreur. Si votre application utilise un modèle qui passe en obsolète sans que vous ayez migré, elle cessera de fonctionner.

Endpoints et leur statut

L’API Grok expose plusieurs endpoints, chacun avec son propre statut :

  • /v1/responses : endpoint principal, recommandé pour tous les nouveaux projets
  • /v1/chat/completions : endpoint legacy, maintenu pour la compatibilité
  • /v1/images/generations : actif pour la génération d’images
  • /v1/tokenize-text : actif pour le comptage de tokens

L’endpoint /v1/chat/completions est compatible avec le format OpenAI, ce qui facilite la migration depuis d’autres fournisseurs. Cependant, il ne reçoit plus de nouvelles fonctionnalités. Les développements futurs de l’API se concentrent sur /v1/responses.

Impact sur votre code

Pour préparer les migrations futures, isolez la référence au modèle dans un fichier de configuration :

# config.py
GROK_MODEL = "grok-4.20-0309"  # Version figee pour la production
GROK_MODEL_FAST = "grok-4-1-fast-non-reasoning"

# Facilite la migration : un seul endroit a modifier

Ne dispersez jamais le nom du modèle en dur dans votre code. Un fichier de configuration centralisé vous permettra de migrer en quelques minutes le jour où une nouvelle version sera disponible.

Processus de migration

Lorsqu’une migration est nécessaire, suivez ces étapes :

  1. Mettre à jour le champ model dans votre configuration
  2. Tester vos prompts existants avec le nouveau modèle en environnement de staging
  3. Ajuster si nécessaire : les modèles plus récents peuvent répondre différemment, avec des variations de ton, de longueur ou de format
  4. Déployer progressivement : commencez par un pourcentage du trafic avant de basculer complètement

Points clés à retenir

  • Les modèles passent par trois états : Actif, Déprécié, puis Obsolète (supprimé)
  • L’endpoint /v1/responses est le principal ; /v1/chat/completions est legacy et ne reçoit plus de nouvelles fonctionnalités
  • Centralisez le nom du modèle dans un fichier de configuration pour faciliter les migrations
  • Testez toujours vos prompts avec le nouveau modèle avant de migrer en production
  • Surveillez les annonces de dépréciation pour planifier vos migrations à l’avance