Aller au contenu principal

Voxtral Audio — Transcription et Speech-to-Text

Transcription audio offline et temps réel avec Voxtral : diarisation, context biasing, microphone streaming et optimisation de la latence.

16 leçons ~1h45 Développeur Certification officielle →

Objectifs pédagogiques

À l'issue de cette formation, vous serez capable de :

  • Transcrire un fichier audio avec l'API offline en récupérant timestamps et segmentation temporelle
  • Activer la diarisation pour attribuer chaque segment transcrit au bon locuteur
  • Améliorer la précision sur un vocabulaire métier grâce au context biasing
  • Implémenter en Python une transcription temps réel alimentée par le microphone via PyAudio
  • Arbitrer entre transcription offline et temps réel selon la latence et le volume à traiter

Fiche pédagogique

Public visé
Développeurs, ingénieurs et intégrateurs souhaitant exploiter Mistral AI par API dans leurs applications.
Prérequis
Aucun prérequis technique. Un ordinateur, une connexion internet et un compte sur la plateforme concernée suffisent.
Durée
1h45 — 16 leçons
Modalités
Formation 100 % en ligne, en autonomie, accessible 24h/24 depuis un navigateur. Progression enregistrée, reprise possible à tout moment. Durée estimée : 1h45.
Évaluation
Exercices d'application proposés au fil des leçons. Chaque leçon se termine par ses points clés, support de l'auto-évaluation. Un quiz final de 5 questions corrigées, en fin de dernière leçon, permet de valider les acquis.
Accessibilité
Formation accessible aux personnes en situation de handicap : contenus textuels compatibles avec les lecteurs d'écran, navigation au clavier et contrastes conformes. Pour tout besoin d'adaptation, écrivez à [email protected].
Tarif
Gratuit — accès immédiat après inscription

Programme