Aller au contenu principal

Enterprise Search

Interroger l’ensemble de vos données internes

La connaissance d’une organisation est dispersée : documents sur le cloud, fils de discussion dans les outils collaboratifs, bases de connaissances internes, wikis, CRM, tickets de support. Trouver la bonne information au bon moment est un défi quotidien pour les collaborateurs.

Enterprise Search de Mistral AI répond à ce problème en proposant une recherche unifiée alimentée par l’IA, directement intégrée à Le Chat Enterprise. Au lieu de chercher manuellement dans chaque outil, vos équipes posent une question en langage naturel et obtiennent une réponse synthétisée à partir de l’ensemble des sources connectées.

Le principe de la recherche unifiée

Au-delà de la recherche par mots-clés

Les moteurs de recherche internes traditionnels fonctionnent par correspondance de mots-clés. Si vous cherchez “procédure d’onboarding nouveau collaborateur” mais que le document s’intitule “Guide d’intégration des recrues”, la recherche classique passe à côté.

Enterprise Search utilise la compréhension sémantique des modèles Mistral pour interpréter l’intention derrière votre question et retrouver les documents pertinents, même si le vocabulaire diffère. Le système comprend les synonymes, les formulations alternatives et le contexte métier de votre organisation.

Comment fonctionne l’indexation

Le processus d’indexation se déroule en plusieurs étapes :

  • Connexion aux sources : Enterprise Search se connecte à vos outils via des connecteurs dédiés
  • Extraction du contenu : les documents, messages et données sont extraits et normalisés
  • Vectorisation : chaque contenu est transformé en vecteur sémantique par les modèles d’embedding Mistral
  • Indexation incrémentale : les mises à jour sont détectées et indexées automatiquement

L’indexation est incrémentale : seuls les contenus nouveaux ou modifiés sont traités, ce qui garantit une mise à jour rapide sans retraiter l’ensemble du corpus.

Les connecteurs disponibles

Enterprise Search propose des connecteurs natifs pour les principales plateformes utilisées en entreprise :

Stockage et documents

  • Google Drive : documents, feuilles de calcul, présentations, fichiers partagés
  • Microsoft SharePoint : sites, bibliothèques de documents, listes
  • OneDrive : fichiers personnels et partagés
  • Dropbox Business : dossiers d’équipe et documents partagés
  • Notion : pages, bases de données, wikis d’équipe

Communication et collaboration

  • Slack : messages publics et canaux autorisés
  • Microsoft Teams : conversations de canaux et fichiers partagés
  • Confluence : espaces, pages et articles de blog

Développement et technique

  • GitHub : issues, pull requests, documentation, wikis
  • GitLab : issues, merge requests, wikis
  • Jira : tickets, épiques, sprints

Bases de données et CRM

  • Salesforce : comptes, contacts, opportunités, articles de connaissance
  • Zendesk : tickets, articles du centre d’aide
  • HubSpot : contacts, entreprises, deals

Architecture de la recherche

Le flux de recherche suit un parcours en trois étapes :

Étape 1 — Compréhension de la requête

Lorsqu’un utilisateur pose une question, le modèle analyse l’intention, identifie les entités clés et reformule éventuellement la requête pour maximiser la pertinence des résultats.

Étape 2 — Recherche hybride

Enterprise Search combine deux approches complémentaires :

  • Recherche sémantique : les vecteurs de la requête sont comparés aux vecteurs des documents indexés pour trouver les contenus sémantiquement proches
  • Recherche lexicale : une recherche classique par mots-clés complète les résultats pour garantir la couverture des termes spécifiques (noms de projets, codes internes, acronymes)

Cette approche hybride garantit à la fois la pertinence sémantique et la précision factuelle.

Étape 3 — Synthèse et citation

Le modèle synthétise les informations trouvées en une réponse claire, avec des citations précises renvoyant aux documents sources. Chaque affirmation est traçable jusqu’à sa source d’origine, permettant à l’utilisateur de vérifier et d’approfondir.

Respect des permissions

Un aspect fondamental d’Enterprise Search est le respect des permissions existantes. Le système ne donne jamais accès à des documents que l’utilisateur ne pourrait pas consulter normalement :

  • Les permissions sont héritées des systèmes sources (Google Drive, SharePoint, etc.)
  • Un utilisateur ne voit dans les résultats que les documents auxquels il a accès
  • Les permissions sont synchronisées régulièrement avec les systèmes sources
  • Les changements de permissions sont reflétés dans les résultats de recherche

Points clés à retenir

  • Enterprise Search offre une recherche unifiée en langage naturel sur l’ensemble des données internes
  • L’indexation sémantique va au-delà des mots-clés pour comprendre l’intention de la requête
  • Des connecteurs natifs couvrent les principales plateformes (Google, Microsoft, Slack, Confluence, GitHub, etc.)
  • La recherche hybride combine sémantique et lexicale pour une couverture optimale
  • Les permissions existantes sont respectées : chaque utilisateur ne voit que ce qu’il est autorisé à consulter