Sources de données WebChatAgent : chaque commande expliquée
Comprenez l'espace de travail complet Data Sources et maintenez une base de connaissances de chatbot fiable et sans approximations.

Les sources de données WebChatAgent contrôlent quels sites Web, documents et espaces de travail connectés peuvent alimenter les réponses d'un assistant.
L'onglet Data Sources est l'endroit où vous définissez les faits qu'un assistant peut récupérer. Les sites Web, les fichiers, le texte direct, Confluence et Notion partagent un même espace, mais ils diffèrent par leur responsabilité éditoriale, leur mode d'actualisation et les commandes disponibles après l'indexation.
Ce guide s'appuie sur un véritable assistant de test Premium nommé Source Control Center. Son site Web et son fichier PDF sont indexés, et une conversation réelle renvoie le fait unique du PDF NORDSTERN-42. Cette vérification finale est essentielle : un statut vert prouve que l'indexation s'est terminée, tandis que le test de réponse démontre que l'information peut réellement être récupérée.
Lecteur vidéo respectueux de la vie privée (en deux clics)
Tutoriel sources de données WebChatAgent : chaque commande expliquée
Gérez les sources de données WebChatAgent : états d'indexation, recherche, filtres, métadonnées, réindexation et suppression sécurisée.
Le lecteur YouTube reste bloqué jusqu'à ce que vous cliquiez sur Lecture. Son chargement connecte votre navigateur à YouTube et peut transmettre des données techniques à Google.
Ouvrir directement sur YouTubeCe que vous maîtriserez à la fin
- Le bon type de source pour chaque responsable de contenu et cycle de mise à jour
- Un examen méthodique du statut d'indexation, de la consommation de caractères et des filtres
- Des procédures sûres d'édition, de recherche de contenu, de réindexation et de suppression
- Un véritable test de non-régression à réponse connue
Avant de commencer
- Un chatbot dont vous pouvez gérer les sources
- Au moins une petite source de test approuvée
- Une question exacte dont la réponse se trouve uniquement dans cette source
Cycle de vie d'une source, de l'importation à la récupération
L'ajout d'une source lance l'extraction et l'indexation. Les passages générés sont décomptés du quota de caractères du forfait et deviennent disponibles uniquement après un statut réussi.
Modifier la portée ou changer de fournisseur peut nécessiter une nouvelle indexation. La suppression d'une source retire ses connaissances des futures recherches.
01–10
Configuration pas à pas
Ouvrir l'assistant concerné et l'onglet Data Sources
Confirmez le nom de l'assistant avant de modifier ses connaissances.
Sélectionnez Source Control Center dans la barre latérale gauche et ouvrez Data Sources dans la navigation de l'assistant. L'en-tête de la page, la sélection de la barre latérale et la liste des sources doivent appartenir au même assistant.
Lisez le bandeau d'information avant d'ajouter du contenu : les sources sont découpées en passages interrogeables et sont décomptées du quota de caractères du forfait. Les modifications apportées ici influent sur les réponses futures, ne travaillez donc jamais depuis un onglet de navigateur ambigu.
Comparer toutes les options de Add Data Source
Choisissez en fonction de la responsabilité du contenu et du mode de mise à jour, pas seulement du nom de fichier.
Ouvrez Add Data Source. Website explore les pages publiques autorisées ; Documents permet de téléverser des fichiers PDF, TXT, Markdown, Word ou Excel ; Text Input enregistre directement une information courte et suivie. Confluence et Notion connectent les contenus approuvés d'un espace de travail.
Par exemple, utilisez Website pour un centre d'aide public, Documents pour un PDF de politique validé, Text Input pour un avis de service temporaire, et un connecteur lorsque le responsable maintient déjà la source dans cet espace de travail. Fermez la boîte de dialogue sans créer de doublons.
Lire le statut, l'utilisation des caractères et le nombre de sources
Une source finalisée est exploitable ; une source inachevée n'est pas prête pour les tests de réponse.
La carte d'utilisation compare les caractères indexés avec la limite du forfait. Les compteurs de sources séparent les sites Web, les documents, le texte et les connecteurs, tandis que le tableau affiche le statut d'indexation de chaque élément.
Considérez Pending ou Processing comme un état d'attente. Failed ou Error nécessite des détails et une correction. Re-index required signifie que les vecteurs actuels sont indisponibles ou obsolètes, souvent après un changement de fournisseur. Completed ou Indexed signifie que le traitement est terminé, mais vous devez tout de même effectuer le test de réponse à l'étape dix.
Trouver une source grâce à la recherche, aux filtres et aux catégories
Des catégories stables rendent compréhensible un inventaire volumineux de sources.
Le champ de recherche accepte un nom de source ou une URL de site Web. Utilisez le filtre par type pour isoler les sites, les fichiers, le texte ou les connecteurs, et le filtre de catégorie pour cibler un responsable ou un sujet. Réinitialisez les deux filtres avant de conclure qu'une source est manquante.
Source Control Center utilise la catégorie Support pour le PDF Northstar. En production, privilégiez des étiquettes durables telles que Support, Products ou Legal. N'encodez pas d'états temporaires comme nouveau ou à vérifier dans une catégorie ; le statut et la responsabilité éditoriale doivent rester distincts.
Inspecter la portée d'un site Web avant de réindexer
L'URL, la profondeur d'exploration, les exclusions et la planification déterminent ce qui entre dans l'index.
Ouvrez l'action d'édition sur la ligne du site Web. Vérifiez l'URL de départ canonique, la profondeur d'exploration et l'intervalle de réindexation automatique. Déployez Advanced uniquement si des sélecteurs ou des règles d'exclusion sont nécessaires.
Une profondeur de zéro indexe uniquement la page saisie ; une profondeur supérieure suit les liens. Excluez les chemins de paiement, de compte et de langues en double avant d'augmenter la profondeur. Enregistrez uniquement les modifications délibérées, puis attendez la fin de la nouvelle tâche d'indexation au lieu de tester immédiatement.
Examiner les pages d'une source de type site Web
Une source peut afficher un statut vert alors qu'une page indésirable consomme inutilement du quota.
Ouvrez Indexed URLs pour le site Web. Parcourez la liste des pages, comparez le nombre de caractères et utilisez View Content pour repérer le bruit de navigation, les bandeaux de cookies ou les pages dupliquées.
L'option Delete supprime uniquement la page indexée sélectionnée jusqu'à ce que la prochaine exploration la découvre à nouveau. Exclude ajoute une règle d'exclusion durable pour les explorations futures. Utilisez la boîte de dialogue de confirmation, puis vérifiez que le total de caractères a évolué comme prévu.
Modifier le texte extrait, les métadonnées et la Search Priority
Vérifiez exactement ce que le chatbot peut extraire de ce document.
Ouvrez Edit sur Northstar Knowledge Base. L'éditeur affiche le texte extrait utilisé pour l'indexation, ainsi que Document Name, Category et Search Priority. Ne corrigez une petite erreur d'extraction que si vous pouvez la comparer avec l'original approuvé.
La Search Priority influence le classement par rapport aux autres sources ; il ne s'agit pas d'un score de qualité. Laissez la valeur à zéro sauf si des questions répétables justifient un boost. Pour une politique modifiée ou une révision majeure, téléversez le nouveau fichier approuvé, vérifiez-le, puis supprimez la source obsolète au lieu de maintenir une version divergente masquée dans le texte extrait.
Rechercher au sein du contenu indexé
Content Search vérifie les passages enregistrés, et pas seulement les titres des sources.
Ouvrez Content Search et saisissez la valeur unique NORDSTERN-42. Le résultat doit pointer vers Northstar Knowledge Base et afficher le passage indexé correspondant.
C'est le moyen le plus rapide de distinguer un problème de source d'un problème de génération de réponse. L'absence de résultat signifie que le fait ne figure pas dans l'index actuel. Un résultat concordant accompagné d'une mauvaise réponse du chatbot indique qu'il faut examiner la formulation de la question, le chevauchement des sources, la Search Priority et le comportement du modèle.
Utiliser la réindexation et la suppression sans perdre les connaissances requises
La réindexation actualise une source ; la suppression la retire des futures recherches.
Utilisez l'action de ligne pour réindexer une seule source, ou Re-index All uniquement après un changement de fournisseur ou une actualisation coordonnée. Les tâches en bloc volumineuses prennent du temps et peuvent compliquer le diagnostic ; notez d'abord ce qui a changé.
Avant d'utiliser Delete, identifiez chaque fait unique qui ne figure que dans cette source. Le message de confirmation avertit que la suppression affecte les réponses futures. Annulez pendant une vérification, ou supprimez uniquement après qu'une source de remplacement a été finalisée et que ses questions de non-régression ont été validées.
Vérifier la source avec une question exacte posée au chatbot
La réponse observée doit concorder avec le fait présent dans le document indexé.
Ouvrez Conversations et sélectionnez la session de test Source Control Center. Saisie exacte : “What is the unique verification code in the uploaded tutorial PDF?” Résultat attendu : la réponse cite NORDSTERN-42 sans inventer un autre code.
Résultat observé : l'assistant réel a répondu : “The unique verification code is NORDSTERN-42.” Cet exemple est vérifié de bout en bout. Conservez une question à réponse connue par source critique et rejouez-la après un remplacement de fichier, une réindexation, un changement de modèle ou la suppression d'une source.
Exemple et résultat
Découvrez le test pratique et son résultat
Chaque tutoriel présente une saisie précise, le résultat attendu et le récapitulatif transparent des vérifications effectuées localement.
Exemple pratique : sources de données WebChatAgent expliquées, chaque commande avec des exemples
Ce cas d'usage exact a été exécuté sur un compte de démonstration temporaire.
Données de test exactes
Ask: “What is the unique verification code in the uploaded tutorial PDF?”
Résultat attendu
L'assistant renvoie NORDSTERN-42 depuis le PDF indexé au lieu de deviner.
Ce qui a été réellement vérifié
Une fois que le site Web et le PDF ont tous deux affiché le statut Completed, le test visiteur réel a répondu avec NORDSTERN-42 en référençant les connaissances indexées du tutoriel.
Conseils et astuces
Rendre la configuration fiable et pérenne
Testez toujours avec des cas réalistes, documentez votre état de référence et n'appliquez qu'un changement à la fois. C'est la seule façon de mesurer de réels progrès.
Supprimer les doublons avant d'acheter du quota supplémentaire
Les copies de navigation, les pages d'impression et les doublons traduits peuvent consommer des caractères et créer des passages en concurrence. Nettoyez le périmètre des sources avant de mettre à niveau le forfait.
Attribuer un responsable à chaque source
Définir la responsabilité éditoriale permet de détecter et de supprimer plus facilement les politiques obsolètes et les connecteurs abandonnés.
Modifier une seule variable de récupération à la fois
Gardez le modèle, l'ensemble de sources et les questions de test stables lorsque vous comparez la Search Priority, la catégorie ou le périmètre d'exploration. Sinon, vous ne pourrez pas expliquer pourquoi un résultat a changé.
Utiliser un modèle rapide pour les vérifications de routine des sources
Un modèle rapide et économique suffit généralement pour les tests déterministes à réponse connue. Ne comparez avec un modèle plus puissant que si le passage indexé est bien présent mais que les questions fixes échouent toujours.
Que faire en cas de problème ?
Dépannage
Vérifiez méthodiquement l'état du service, les autorisations d'accès et les données de test avant de modifier le modèle ou le prompt.
La source est finalisée, mais la réponse omet son information
Recherchez l'expression exacte avec Content Search. Si elle est absente, corrigez l'extraction ou le périmètre puis réindexez. Si elle est présente, testez la question exacte, éliminez les doublons concurrents et comparez la Search Priority ou le modèle en n'effectuant qu'une seule modification à la fois.
Un site Web continue d'ajouter des pages indésirables
Utilisez Exclude plutôt que simplement Delete, ou ajoutez un motif de chemin dans les paramètres de la source de site Web. Réindexez ensuite et vérifiez la liste des URL indexées ainsi que le total des caractères.
Re-index required apparaît après un changement de fournisseur
Lancez la réindexation pour les sources concernées, attendez que chaque tâche soit terminée et rejouez les questions fixes connues et inconnues avant de publier la modification.
Prêt pour un test en conditions réelles ?
Créez un inventaire trimestriel des sources avec le responsable, la catégorie, la méthode d'actualisation, la date de dernière vérification et une question fixe pour chaque source critique.
