Aller au contenu principal

Connecter ses Données

Mettre en place Enterprise Search dans votre organisation

La puissance d’Enterprise Search dépend directement de la qualité et de l’étendue des sources connectées. Dans cette leçon, vous apprendrez à configurer les connecteurs, gérer les sources de données et optimiser l’indexation pour obtenir les meilleurs résultats.

Préparer la connexion des sources

Inventaire des sources de données

Avant de connecter vos outils, réalisez un inventaire structuré :

  • Quels outils sont utilisés par vos équipes au quotidien ?
  • Où se trouve la connaissance critique : documentation technique, procédures, politiques internes ?
  • Quels contenus sont les plus recherchés par les collaborateurs ?
  • Quelles données sont sensibles et nécessitent des restrictions d’accès ?

Cet inventaire vous permet de prioriser les connexions : commencez par les sources qui contiennent la connaissance la plus recherchée et la plus à jour.

Prérequis techniques

Pour chaque connecteur, vous aurez besoin de :

  • Droits d’administration sur la plateforme source (Google Workspace Admin, SharePoint Admin, etc.)
  • Un compte de service ou une application OAuth dédiée à Enterprise Search
  • Les permissions de lecture sur les espaces et documents à indexer
  • L’approbation de votre équipe sécurité pour l’accès aux données

Configurer les connecteurs principaux

Google Drive

La connexion Google Drive se fait via OAuth 2.0 avec un compte de service Google Workspace :

  • Créez un compte de service dans la console Google Cloud
  • Activez l’API Google Drive pour ce compte
  • Autorisez la délégation de domaine dans Google Workspace Admin
  • Configurez les portées (scopes) de lecture nécessaires
  • Renseignez les identifiants dans la console Enterprise Search

Le connecteur indexe les fichiers Google Docs, Sheets, Slides, PDF et autres formats stockés dans Drive. Les permissions de partage Google sont automatiquement respectées.

Microsoft SharePoint et OneDrive

Pour les environnements Microsoft 365 :

  • Enregistrez une application dans Azure Active Directory
  • Accordez les permissions Microsoft Graph (Sites.Read.All, Files.Read.All)
  • Obtenez le consentement de l’administrateur
  • Configurez le connecteur avec les identifiants de l’application

Le connecteur indexe les sites SharePoint, les bibliothèques de documents et les fichiers OneDrive. Les permissions SharePoint sont héritées fidèlement.

Confluence

Pour connecter votre base de connaissances Confluence :

  • Créez un token API Atlassian avec les permissions de lecture
  • Spécifiez les espaces à indexer (ou indexez tout le site)
  • Configurez la fréquence de synchronisation

Confluence est souvent la source la plus riche en documentation technique et en procédures internes. Priorisez cette connexion si votre organisation utilise Confluence comme wiki principal.

Slack

La connexion Slack nécessite une application Slack avec les permissions appropriées :

  • Créez une application Slack dans l’espace de travail
  • Ajoutez les scopes OAuth nécessaires (channels:history, channels:read)
  • Installez l’application dans l’espace de travail
  • Sélectionnez les canaux à indexer

Il est recommandé de ne pas indexer tous les canaux. Concentrez-vous sur les canaux de projets, de support et de documentation, en excluant les canaux informels.

Gérer l’indexation

Synchronisation initiale

La première indexation peut prendre plusieurs heures selon le volume de données. Planifiez-la en dehors des heures de pointe pour minimiser l’impact sur vos systèmes sources.

Synchronisation incrémentale

Après l’indexation initiale, Enterprise Search détecte automatiquement les modifications :

  • Nouveaux documents : indexés dans les minutes suivant leur création
  • Documents modifiés : réindexés automatiquement
  • Documents supprimés : retirés de l’index lors de la prochaine synchronisation
  • Changements de permissions : reflétés dans les résultats de recherche

La fréquence de synchronisation est configurable par connecteur : temps réel (webhooks), toutes les 15 minutes, toutes les heures ou quotidiennement.

Filtrage et exclusions

Vous pouvez affiner l’indexation avec des règles de filtrage :

  • Inclure/exclure des dossiers : n’indexer que les espaces pertinents
  • Filtrer par type de fichier : exclure les images, vidéos ou fichiers volumineux non pertinents
  • Filtrer par ancienneté : n’indexer que les documents des 2 dernières années, par exemple
  • Exclure des patterns : ignorer les fichiers temporaires, brouillons ou archives

Optimiser la qualité des résultats

Enrichir les métadonnées

Enterprise Search exploite les métadonnées des documents pour améliorer la pertinence :

  • Titres descriptifs : un document bien nommé sera mieux retrouvé
  • Tags et labels : les catégories existantes enrichissent l’indexation
  • Descriptions : les résumés de pages Confluence ou de fichiers Drive sont utilisés
  • Auteurs : l’information d’auteur permet de pondérer la fiabilité

Former les utilisateurs

La qualité des résultats dépend aussi de la façon dont les utilisateurs formulent leurs questions :

  • Encouragez les questions complètes plutôt que les mots-clés isolés
  • Suggérez de préciser le contexte : “Quelle est la procédure d’onboarding pour les développeurs back-end ?” plutôt que “onboarding”
  • Proposez des exemples de requêtes efficaces dans votre communication interne

Monitoring et maintenance

Tableau de bord d’indexation

La console d’administration fournit des indicateurs sur l’état de l’indexation :

  • Nombre de documents indexés par source
  • Date de dernière synchronisation
  • Erreurs d’indexation et documents en échec
  • Volume de recherches et taux de satisfaction

Actions de maintenance

  • Vérifiez régulièrement que les connecteurs sont actifs et synchronisés
  • Investiguez les erreurs d’indexation (permissions révoquées, fichiers corrompus)
  • Ajustez les filtres selon les retours des utilisateurs
  • Ajoutez de nouvelles sources au fur et à mesure de l’adoption

Points clés à retenir

  • Commencez par un inventaire des sources de données et priorisez les plus recherchées
  • Chaque connecteur nécessite un compte de service avec des permissions de lecture
  • L’indexation incrémentale maintient les résultats à jour automatiquement
  • Le filtrage et les exclusions permettent d’affiner la pertinence
  • Le monitoring continu garantit la qualité et la fraîcheur des résultats