Production, Évals et Optimisation
Latence, prompt caching, Batch API, Evals, compaction et architecture de production complète.
Objectifs pédagogiques
À l'issue de cette formation, vous serez capable de :
- Mesurer la latence bout-en-bout d'un appel et identifier les leviers d'optimisation prioritaires
- Réduire les coûts à l'échelle avec le prompt caching, les Predicted Outputs et la Batch API
- Concevoir une architecture asynchrone à base de files d'attente, de parallélisme et de background mode
- Maîtriser les conversations longues par compaction, comptage de tokens et budgétisation
- Automatiser des évaluations avec le framework Evals et les intégrer à une chaîne CI/CD
Fiche pédagogique
- Public visé
- Développeurs, ingénieurs et intégrateurs souhaitant exploiter ChatGPT par API dans leurs applications.
- Prérequis
- Expérience confirmée du développement d'applications et de leur mise en production.
- Durée
- 2h — 20 leçons
- Modalités
- Formation 100 % en ligne, en autonomie, accessible 24h/24 depuis un navigateur. Progression enregistrée, reprise possible à tout moment. Durée estimée : 2h.
- Évaluation
- Auto-évaluation à partir des « Points clés à retenir » qui concluent chaque leçon, et mise en pratique directe des exemples sur vos propres cas. Un quiz final de 5 questions corrigées, en fin de dernière leçon, permet de valider les acquis.
- Accessibilité
- Formation accessible aux personnes en situation de handicap : contenus textuels compatibles avec les lecteurs d'écran, navigation au clavier et contrastes conformes. Pour tout besoin d'adaptation, écrivez à [email protected].
- Tarif
- Gratuit — accès immédiat après inscription