Analyser des Images dans Le Chat
Votre première analyse d’image
Le Chat de Mistral vous permet d’analyser n’importe quelle image en quelques secondes. L’opération est aussi simple que d’envoyer un message : vous uploadez votre fichier, vous posez votre question, et le modèle multimodal fait le reste. Cette leçon vous montre concrètement comment procéder et quels types d’analyses sont possibles.
Comment uploader une image
Pour soumettre une image à l’analyse dans Le Chat, trois méthodes s’offrent à vous :
- Glisser-déposer : faites glisser votre fichier image directement dans la zone de conversation. C’est la méthode la plus rapide.
- Bouton d’upload : cliquez sur l’icône de pièce jointe (trombone) à côté de la zone de saisie, puis sélectionnez votre fichier.
- Copier-coller : copiez une image depuis votre presse-papier (capture d’écran, par exemple) et collez-la directement dans Le Chat avec Ctrl+V (ou Cmd+V sur Mac).
Les formats acceptés incluent les images courantes : JPEG, PNG, WebP et GIF. La taille maximale dépend du modèle utilisé, mais en pratique, les photos prises avec un smartphone ou les captures d’écran passent sans problème.
Types d’analyses possibles
Une fois votre image uploadée, le modèle peut répondre à une grande variété de questions. Voici les principaux types d’analyses :
Description générale
Demandez simplement « Que vois-tu sur cette image ? » ou « Décris cette photo ». Le modèle identifie les éléments principaux : objets, personnes, paysages, couleurs, texte visible. C’est utile pour obtenir une description accessible d’une image ou pour vérifier rapidement son contenu.
Identification et classification
Vous pouvez demander au modèle d’identifier des éléments spécifiques :
- « Quel est ce monument ? »
- « De quel type de plante s’agit-il ? »
- « Quelle marque est visible sur ce produit ? »
Le modèle utilise ses connaissances pour tenter une identification. Il n’est pas infaillible, mais les résultats sont souvent surprenants de précision sur les objets courants.
Lecture de texte (OCR basique)
Si votre image contient du texte — panneau, carte de visite, affiche, capture d’écran — le modèle peut le lire et le retranscrire. Demandez par exemple :
- « Lis le texte sur cette photo »
- « Quel est le numéro de téléphone sur cette carte de visite ? »
- « Retranscris le contenu de cette capture d’écran »
Interprétation contextuelle
Le modèle ne se contente pas de décrire ce qu’il voit — il peut aussi interpréter. Quelques exemples :
- « Cette tenue est-elle adaptée pour un entretien d’embauche ? »
- « Est-ce que ce plat a l’air équilibré nutritionnellement ? »
- « Quel est le message principal de cette publicité ? »
Formuler de bonnes questions
La qualité de l’analyse dépend beaucoup de la façon dont vous formulez votre demande. Voici quelques bonnes pratiques :
- Soyez spécifique : au lieu de « Analyse cette image », demandez « Quels sont les chiffres de vente affichés dans ce graphique ? »
- Donnez du contexte : « Voici la photo d’un plat que j’ai préparé. Estime les calories approximatives. »
- Demandez un format : « Liste les éléments visibles sous forme de puces » ou « Résume en une phrase ce que montre cette image »
Limites à connaître
Le modèle de vision est puissant, mais il a ses limites :
- Texte très petit ou flou : si la résolution est trop basse ou le texte trop petit, le modèle peut mal lire ou inventer des caractères
- Images ambiguës : une photo sombre, surexposée ou très abstraite donnera des résultats moins fiables
- Informations personnelles : le modèle peut lire des données visibles sur l’image — soyez prudent avec les documents sensibles
- Pas de mémoire visuelle : chaque image est analysée indépendamment, sauf si vous envoyez plusieurs images dans la même conversation
Mise en pratique
Essayez ces exercices dans Le Chat :
- Prenez une photo d’un objet sur votre bureau et demandez au modèle de le décrire
- Faites une capture d’écran d’un article de presse et demandez un résumé du titre et du chapeau
- Photographiez un reçu ou un ticket et demandez d’en extraire le montant total
Points clés à retenir
- Trois méthodes pour uploader : glisser-déposer, bouton trombone, copier-coller
- Le modèle peut décrire, identifier, lire du texte et interpréter le contexte d’une image
- Des questions spécifiques donnent de meilleurs résultats que des demandes vagues
- Attention aux images de mauvaise qualité et aux documents sensibles