Connecter ses Données
Mettre en place Enterprise Search dans votre organisation
La puissance d’Enterprise Search dépend directement de la qualité et de l’étendue des sources connectées. Dans cette leçon, vous apprendrez à configurer les connecteurs, gérer les sources de données et optimiser l’indexation pour obtenir les meilleurs résultats.
Préparer la connexion des sources
Inventaire des sources de données
Avant de connecter vos outils, réalisez un inventaire structuré :
- Quels outils sont utilisés par vos équipes au quotidien ?
- Où se trouve la connaissance critique : documentation technique, procédures, politiques internes ?
- Quels contenus sont les plus recherchés par les collaborateurs ?
- Quelles données sont sensibles et nécessitent des restrictions d’accès ?
Cet inventaire vous permet de prioriser les connexions : commencez par les sources qui contiennent la connaissance la plus recherchée et la plus à jour.
Prérequis techniques
Pour chaque connecteur, vous aurez besoin de :
- Droits d’administration sur la plateforme source (Google Workspace Admin, SharePoint Admin, etc.)
- Un compte de service ou une application OAuth dédiée à Enterprise Search
- Les permissions de lecture sur les espaces et documents à indexer
- L’approbation de votre équipe sécurité pour l’accès aux données
Configurer les connecteurs principaux
Google Drive
La connexion Google Drive se fait via OAuth 2.0 avec un compte de service Google Workspace :
- Créez un compte de service dans la console Google Cloud
- Activez l’API Google Drive pour ce compte
- Autorisez la délégation de domaine dans Google Workspace Admin
- Configurez les portées (scopes) de lecture nécessaires
- Renseignez les identifiants dans la console Enterprise Search
Le connecteur indexe les fichiers Google Docs, Sheets, Slides, PDF et autres formats stockés dans Drive. Les permissions de partage Google sont automatiquement respectées.
Microsoft SharePoint et OneDrive
Pour les environnements Microsoft 365 :
- Enregistrez une application dans Azure Active Directory
- Accordez les permissions Microsoft Graph (Sites.Read.All, Files.Read.All)
- Obtenez le consentement de l’administrateur
- Configurez le connecteur avec les identifiants de l’application
Le connecteur indexe les sites SharePoint, les bibliothèques de documents et les fichiers OneDrive. Les permissions SharePoint sont héritées fidèlement.
Confluence
Pour connecter votre base de connaissances Confluence :
- Créez un token API Atlassian avec les permissions de lecture
- Spécifiez les espaces à indexer (ou indexez tout le site)
- Configurez la fréquence de synchronisation
Confluence est souvent la source la plus riche en documentation technique et en procédures internes. Priorisez cette connexion si votre organisation utilise Confluence comme wiki principal.
Slack
La connexion Slack nécessite une application Slack avec les permissions appropriées :
- Créez une application Slack dans l’espace de travail
- Ajoutez les scopes OAuth nécessaires (channels:history, channels:read)
- Installez l’application dans l’espace de travail
- Sélectionnez les canaux à indexer
Il est recommandé de ne pas indexer tous les canaux. Concentrez-vous sur les canaux de projets, de support et de documentation, en excluant les canaux informels.
Gérer l’indexation
Synchronisation initiale
La première indexation peut prendre plusieurs heures selon le volume de données. Planifiez-la en dehors des heures de pointe pour minimiser l’impact sur vos systèmes sources.
Synchronisation incrémentale
Après l’indexation initiale, Enterprise Search détecte automatiquement les modifications :
- Nouveaux documents : indexés dans les minutes suivant leur création
- Documents modifiés : réindexés automatiquement
- Documents supprimés : retirés de l’index lors de la prochaine synchronisation
- Changements de permissions : reflétés dans les résultats de recherche
La fréquence de synchronisation est configurable par connecteur : temps réel (webhooks), toutes les 15 minutes, toutes les heures ou quotidiennement.
Filtrage et exclusions
Vous pouvez affiner l’indexation avec des règles de filtrage :
- Inclure/exclure des dossiers : n’indexer que les espaces pertinents
- Filtrer par type de fichier : exclure les images, vidéos ou fichiers volumineux non pertinents
- Filtrer par ancienneté : n’indexer que les documents des 2 dernières années, par exemple
- Exclure des patterns : ignorer les fichiers temporaires, brouillons ou archives
Optimiser la qualité des résultats
Enrichir les métadonnées
Enterprise Search exploite les métadonnées des documents pour améliorer la pertinence :
- Titres descriptifs : un document bien nommé sera mieux retrouvé
- Tags et labels : les catégories existantes enrichissent l’indexation
- Descriptions : les résumés de pages Confluence ou de fichiers Drive sont utilisés
- Auteurs : l’information d’auteur permet de pondérer la fiabilité
Former les utilisateurs
La qualité des résultats dépend aussi de la façon dont les utilisateurs formulent leurs questions :
- Encouragez les questions complètes plutôt que les mots-clés isolés
- Suggérez de préciser le contexte : “Quelle est la procédure d’onboarding pour les développeurs back-end ?” plutôt que “onboarding”
- Proposez des exemples de requêtes efficaces dans votre communication interne
Monitoring et maintenance
Tableau de bord d’indexation
La console d’administration fournit des indicateurs sur l’état de l’indexation :
- Nombre de documents indexés par source
- Date de dernière synchronisation
- Erreurs d’indexation et documents en échec
- Volume de recherches et taux de satisfaction
Actions de maintenance
- Vérifiez régulièrement que les connecteurs sont actifs et synchronisés
- Investiguez les erreurs d’indexation (permissions révoquées, fichiers corrompus)
- Ajustez les filtres selon les retours des utilisateurs
- Ajoutez de nouvelles sources au fur et à mesure de l’adoption
Points clés à retenir
- Commencez par un inventaire des sources de données et priorisez les plus recherchées
- Chaque connecteur nécessite un compte de service avec des permissions de lecture
- L’indexation incrémentale maintient les résultats à jour automatiquement
- Le filtrage et les exclusions permettent d’affiner la pertinence
- Le monitoring continu garantit la qualité et la fraîcheur des résultats