Tutoriel pas à pas Base de connaissances

Sources de données WebChatAgent : chaque commande expliquée

Comprenez l'espace de travail complet Data Sources et maintenez une base de connaissances de chatbot fiable et sans approximations.

Débutant27 min de lecture16 juillet 2026
Sources de données WebChatAgent : chaque commande expliquée

Les sources de données WebChatAgent contrôlent quels sites Web, documents et espaces de travail connectés peuvent alimenter les réponses d'un assistant.

L'onglet Data Sources est l'endroit où vous définissez les faits qu'un assistant peut récupérer. Les sites Web, les fichiers, le texte direct, Confluence et Notion partagent un même espace, mais ils diffèrent par leur responsabilité éditoriale, leur mode d'actualisation et les commandes disponibles après l'indexation.

Ce guide s'appuie sur un véritable assistant de test Premium nommé Source Control Center. Son site Web et son fichier PDF sont indexés, et une conversation réelle renvoie le fait unique du PDF NORDSTERN-42. Cette vérification finale est essentielle : un statut vert prouve que l'indexation s'est terminée, tandis que le test de réponse démontre que l'information peut réellement être récupérée.

Lecteur vidéo respectueux de la vie privée (en deux clics)

Tutoriel sources de données WebChatAgent : chaque commande expliquée

Gérez les sources de données WebChatAgent : états d'indexation, recherche, filtres, métadonnées, réindexation et suppression sécurisée.

YouTube · 5:35 · Anglais

Le lecteur YouTube reste bloqué jusqu'à ce que vous cliquiez sur Lecture. Son chargement connecte votre navigateur à YouTube et peut transmettre des données techniques à Google.

Ouvrir directement sur YouTube

Ce que vous maîtriserez à la fin

  • Le bon type de source pour chaque responsable de contenu et cycle de mise à jour
  • Un examen méthodique du statut d'indexation, de la consommation de caractères et des filtres
  • Des procédures sûres d'édition, de recherche de contenu, de réindexation et de suppression
  • Un véritable test de non-régression à réponse connue

Avant de commencer

  • Un chatbot dont vous pouvez gérer les sources
  • Au moins une petite source de test approuvée
  • Une question exacte dont la réponse se trouve uniquement dans cette source

Cycle de vie d'une source, de l'importation à la récupération

L'ajout d'une source lance l'extraction et l'indexation. Les passages générés sont décomptés du quota de caractères du forfait et deviennent disponibles uniquement après un statut réussi.

Modifier la portée ou changer de fournisseur peut nécessiter une nouvelle indexation. La suppression d'une source retire ses connaissances des futures recherches.

Ajouter une sourceIndexer et surveillerActualiser ou supprimer

01–10

Configuration pas à pas

1

Ouvrir l'assistant concerné et l'onglet Data Sources

Confirmez le nom de l'assistant avant de modifier ses connaissances.

Sélectionnez Source Control Center dans la barre latérale gauche et ouvrez Data Sources dans la navigation de l'assistant. L'en-tête de la page, la sélection de la barre latérale et la liste des sources doivent appartenir au même assistant.

Lisez le bandeau d'information avant d'ajouter du contenu : les sources sont découpées en passages interrogeables et sont décomptées du quota de caractères du forfait. Les modifications apportées ici influent sur les réponses futures, ne travaillez donc jamais depuis un onglet de navigateur ambigu.

Confirmez le nom de l'assistant avant de modifier ses connaissances.
2

Comparer toutes les options de Add Data Source

Choisissez en fonction de la responsabilité du contenu et du mode de mise à jour, pas seulement du nom de fichier.

Ouvrez Add Data Source. Website explore les pages publiques autorisées ; Documents permet de téléverser des fichiers PDF, TXT, Markdown, Word ou Excel ; Text Input enregistre directement une information courte et suivie. Confluence et Notion connectent les contenus approuvés d'un espace de travail.

Par exemple, utilisez Website pour un centre d'aide public, Documents pour un PDF de politique validé, Text Input pour un avis de service temporaire, et un connecteur lorsque le responsable maintient déjà la source dans cet espace de travail. Fermez la boîte de dialogue sans créer de doublons.

Choisissez en fonction de la responsabilité du contenu et du mode de mise à jour, pas seulement du nom de fichier.
3

Lire le statut, l'utilisation des caractères et le nombre de sources

Une source finalisée est exploitable ; une source inachevée n'est pas prête pour les tests de réponse.

La carte d'utilisation compare les caractères indexés avec la limite du forfait. Les compteurs de sources séparent les sites Web, les documents, le texte et les connecteurs, tandis que le tableau affiche le statut d'indexation de chaque élément.

Considérez Pending ou Processing comme un état d'attente. Failed ou Error nécessite des détails et une correction. Re-index required signifie que les vecteurs actuels sont indisponibles ou obsolètes, souvent après un changement de fournisseur. Completed ou Indexed signifie que le traitement est terminé, mais vous devez tout de même effectuer le test de réponse à l'étape dix.

Une source finalisée est exploitable ; une source inachevée n'est pas prête pour les tests de réponse.
4

Trouver une source grâce à la recherche, aux filtres et aux catégories

Des catégories stables rendent compréhensible un inventaire volumineux de sources.

Le champ de recherche accepte un nom de source ou une URL de site Web. Utilisez le filtre par type pour isoler les sites, les fichiers, le texte ou les connecteurs, et le filtre de catégorie pour cibler un responsable ou un sujet. Réinitialisez les deux filtres avant de conclure qu'une source est manquante.

Source Control Center utilise la catégorie Support pour le PDF Northstar. En production, privilégiez des étiquettes durables telles que Support, Products ou Legal. N'encodez pas d'états temporaires comme nouveau ou à vérifier dans une catégorie ; le statut et la responsabilité éditoriale doivent rester distincts.

Des catégories stables rendent compréhensible un inventaire volumineux de sources.
5

Inspecter la portée d'un site Web avant de réindexer

L'URL, la profondeur d'exploration, les exclusions et la planification déterminent ce qui entre dans l'index.

Ouvrez l'action d'édition sur la ligne du site Web. Vérifiez l'URL de départ canonique, la profondeur d'exploration et l'intervalle de réindexation automatique. Déployez Advanced uniquement si des sélecteurs ou des règles d'exclusion sont nécessaires.

Une profondeur de zéro indexe uniquement la page saisie ; une profondeur supérieure suit les liens. Excluez les chemins de paiement, de compte et de langues en double avant d'augmenter la profondeur. Enregistrez uniquement les modifications délibérées, puis attendez la fin de la nouvelle tâche d'indexation au lieu de tester immédiatement.

L'URL, la profondeur d'exploration, les exclusions et la planification déterminent ce qui entre dans l'index.
6

Examiner les pages d'une source de type site Web

Une source peut afficher un statut vert alors qu'une page indésirable consomme inutilement du quota.

Ouvrez Indexed URLs pour le site Web. Parcourez la liste des pages, comparez le nombre de caractères et utilisez View Content pour repérer le bruit de navigation, les bandeaux de cookies ou les pages dupliquées.

L'option Delete supprime uniquement la page indexée sélectionnée jusqu'à ce que la prochaine exploration la découvre à nouveau. Exclude ajoute une règle d'exclusion durable pour les explorations futures. Utilisez la boîte de dialogue de confirmation, puis vérifiez que le total de caractères a évolué comme prévu.

Une source peut afficher un statut vert alors qu'une page indésirable consomme inutilement du quota.
7

Modifier le texte extrait, les métadonnées et la Search Priority

Vérifiez exactement ce que le chatbot peut extraire de ce document.

Ouvrez Edit sur Northstar Knowledge Base. L'éditeur affiche le texte extrait utilisé pour l'indexation, ainsi que Document Name, Category et Search Priority. Ne corrigez une petite erreur d'extraction que si vous pouvez la comparer avec l'original approuvé.

La Search Priority influence le classement par rapport aux autres sources ; il ne s'agit pas d'un score de qualité. Laissez la valeur à zéro sauf si des questions répétables justifient un boost. Pour une politique modifiée ou une révision majeure, téléversez le nouveau fichier approuvé, vérifiez-le, puis supprimez la source obsolète au lieu de maintenir une version divergente masquée dans le texte extrait.

Vérifiez exactement ce que le chatbot peut extraire de ce document.
9

Utiliser la réindexation et la suppression sans perdre les connaissances requises

La réindexation actualise une source ; la suppression la retire des futures recherches.

Utilisez l'action de ligne pour réindexer une seule source, ou Re-index All uniquement après un changement de fournisseur ou une actualisation coordonnée. Les tâches en bloc volumineuses prennent du temps et peuvent compliquer le diagnostic ; notez d'abord ce qui a changé.

Avant d'utiliser Delete, identifiez chaque fait unique qui ne figure que dans cette source. Le message de confirmation avertit que la suppression affecte les réponses futures. Annulez pendant une vérification, ou supprimez uniquement après qu'une source de remplacement a été finalisée et que ses questions de non-régression ont été validées.

La réindexation actualise une source ; la suppression la retire des futures recherches.
10

Vérifier la source avec une question exacte posée au chatbot

La réponse observée doit concorder avec le fait présent dans le document indexé.

Ouvrez Conversations et sélectionnez la session de test Source Control Center. Saisie exacte : “What is the unique verification code in the uploaded tutorial PDF?” Résultat attendu : la réponse cite NORDSTERN-42 sans inventer un autre code.

Résultat observé : l'assistant réel a répondu : “The unique verification code is NORDSTERN-42.” Cet exemple est vérifié de bout en bout. Conservez une question à réponse connue par source critique et rejouez-la après un remplacement de fichier, une réindexation, un changement de modèle ou la suppression d'une source.

La réponse observée doit concorder avec le fait présent dans le document indexé.

Exemple et résultat

Découvrez le test pratique et son résultat

Chaque tutoriel présente une saisie précise, le résultat attendu et le récapitulatif transparent des vérifications effectuées localement.

Exemple pratique : sources de données WebChatAgent expliquées, chaque commande avec des exemples

Ce cas d'usage exact a été exécuté sur un compte de démonstration temporaire.

Vérifié de bout en bout

Données de test exactes

Ask: “What is the unique verification code in the uploaded tutorial PDF?”

Résultat attendu

L'assistant renvoie NORDSTERN-42 depuis le PDF indexé au lieu de deviner.

Ce qui a été réellement vérifié

Une fois que le site Web et le PDF ont tous deux affiché le statut Completed, le test visiteur réel a répondu avec NORDSTERN-42 en référençant les connaissances indexées du tutoriel.

Une fois que le site Web et le PDF ont tous deux affiché le statut Completed, le test visiteur réel a répondu avec NORDSTERN-42 en référençant les connaissances indexées du tutoriel.

Conseils et astuces

Rendre la configuration fiable et pérenne

Testez toujours avec des cas réalistes, documentez votre état de référence et n'appliquez qu'un changement à la fois. C'est la seule façon de mesurer de réels progrès.

Supprimer les doublons avant d'acheter du quota supplémentaire

Les copies de navigation, les pages d'impression et les doublons traduits peuvent consommer des caractères et créer des passages en concurrence. Nettoyez le périmètre des sources avant de mettre à niveau le forfait.

Attribuer un responsable à chaque source

Définir la responsabilité éditoriale permet de détecter et de supprimer plus facilement les politiques obsolètes et les connecteurs abandonnés.

Modifier une seule variable de récupération à la fois

Gardez le modèle, l'ensemble de sources et les questions de test stables lorsque vous comparez la Search Priority, la catégorie ou le périmètre d'exploration. Sinon, vous ne pourrez pas expliquer pourquoi un résultat a changé.

Utiliser un modèle rapide pour les vérifications de routine des sources

Un modèle rapide et économique suffit généralement pour les tests déterministes à réponse connue. Ne comparez avec un modèle plus puissant que si le passage indexé est bien présent mais que les questions fixes échouent toujours.

Que faire en cas de problème ?

Dépannage

Vérifiez méthodiquement l'état du service, les autorisations d'accès et les données de test avant de modifier le modèle ou le prompt.

La source est finalisée, mais la réponse omet son information

Recherchez l'expression exacte avec Content Search. Si elle est absente, corrigez l'extraction ou le périmètre puis réindexez. Si elle est présente, testez la question exacte, éliminez les doublons concurrents et comparez la Search Priority ou le modèle en n'effectuant qu'une seule modification à la fois.

Un site Web continue d'ajouter des pages indésirables

Utilisez Exclude plutôt que simplement Delete, ou ajoutez un motif de chemin dans les paramètres de la source de site Web. Réindexez ensuite et vérifiez la liste des URL indexées ainsi que le total des caractères.

Re-index required apparaît après un changement de fournisseur

Lancez la réindexation pour les sources concernées, attendez que chaque tâche soit terminée et rejouez les questions fixes connues et inconnues avant de publier la modification.

Prêt pour un test en conditions réelles ?

Créez un inventaire trimestriel des sources avec le responsable, la catégorie, la méthode d'actualisation, la date de dernière vérification et une question fixe pour chaque source critique.

Ressources complémentaires