Voxtral Audio — Transcription et Speech-to-Text
Transcription audio offline et temps réel avec Voxtral : diarisation, context biasing, microphone streaming et optimisation de la latence.
Objectifs pédagogiques
À l'issue de cette formation, vous serez capable de :
- Transcrire un fichier audio avec l'API offline en récupérant timestamps et segmentation temporelle
- Activer la diarisation pour attribuer chaque segment transcrit au bon locuteur
- Améliorer la précision sur un vocabulaire métier grâce au context biasing
- Implémenter en Python une transcription temps réel alimentée par le microphone via PyAudio
- Arbitrer entre transcription offline et temps réel selon la latence et le volume à traiter
Fiche pédagogique
- Public visé
- Développeurs, ingénieurs et intégrateurs souhaitant exploiter Mistral AI par API dans leurs applications.
- Prérequis
- Aucun prérequis technique. Un ordinateur, une connexion internet et un compte sur la plateforme concernée suffisent.
- Durée
- 1h45 — 16 leçons
- Modalités
- Formation 100 % en ligne, en autonomie, accessible 24h/24 depuis un navigateur. Progression enregistrée, reprise possible à tout moment. Durée estimée : 1h45.
- Évaluation
- Exercices d'application proposés au fil des leçons. Chaque leçon se termine par ses points clés, support de l'auto-évaluation. Un quiz final de 5 questions corrigées, en fin de dernière leçon, permet de valider les acquis.
- Accessibilité
- Formation accessible aux personnes en situation de handicap : contenus textuels compatibles avec les lecteurs d'écran, navigation au clavier et contrastes conformes. Pour tout besoin d'adaptation, écrivez à [email protected].
- Tarif
- Gratuit — accès immédiat après inscription