WebChatAgent-Datenquellen: alle Funktionen erklärt
Verstehe den vollständigen Datenquellen-Bereich und pflege eine verlässliche Chatbot-Wissensbasis ohne Rätselraten.

WebChatAgent-Datenquellen bestimmen, welche Websites, Dokumente und verbundenen Arbeitsbereiche eine Antwort belegen können.
Unter Datenquellen entscheidest du, welche Fakten ein Assistent abrufen darf. Websites, Dateien, direkter Text, Confluence und Notion teilen sich einen Bereich, unterscheiden sich aber bei Verantwortlichkeit, Aktualisierung und den späteren Verwaltungsfunktionen.
Diese Anleitung verwendet den echten Premium-Testassistenten Source Control Center. Website und PDF sind indexiert; in einer echten Konversation liefert der Assistent den eindeutigen PDF-Wert NORDSTERN-42. Diese Abschlussprüfung ist wichtig: Ein grüner Status belegt die Indexierung, der Antworttest den tatsächlichen Abruf.
Datenschutzfreundlicher Zwei-Klick-Player
WebChatAgent Datenquellen: Alle Funktionen
Verstehe WebChatAgent-Datenquellen, Indexierungsstatus, Suche, Filter, Metadaten, Reindexierung und sicheres Löschen anhand echter Beispiele.
Der YouTube-Player bleibt bis zu deinem Klick gesperrt. Beim Laden verbindet sich dein Browser mit YouTube; dabei können technische Daten an Google übertragen werden.
Direkt auf YouTube öffnenDas hast du am Ende eingerichtet
- Der richtige Quellentyp für Verantwortliche und Aktualisierungszyklus
- Eine wiederholbare Prüfung von Indexstatus, Zeichennutzung und Filtern
- Sichere Abläufe für Bearbeiten, Inhaltssuche, Neuindexieren und Löschen
- Ein echter Regressionstest mit bekannter Antwort
Das brauchst du
- Ein Chatbot, dessen Quellen du verwalten darfst
- Mindestens eine kleine freigegebene Testquelle
- Eine exakte Frage, deren Antwort nur in dieser Quelle steht
Quellenlebenszyklus von Eingabe bis Abruf
Das Hinzufügen startet Extraktion und Indexierung. Die resultierenden Inhalte zählen zur zeichenbasierten Inhaltsquota und sind erst nach erfolgreichem Status nutzbar.
Änderungen am Umfang oder Anbieterwechsel können eine Neuindexierung erfordern. Das Löschen entfernt das Wissen aus künftigen Abrufen.
01–10
Schritt für Schritt einrichten
Richtigen Assistenten und Datenquellen-Tab öffnen
Prüfe vor Wissensänderungen den Namen des Assistenten.
Wähle Source Control Center in der linken Seitenleiste und öffne im Assistenten die Datenquellen. Seitenüberschrift, markierter Assistent und Quellenliste müssen zusammenpassen.
Lies vor dem Hinzufügen den Hinweis: Quellen werden in durchsuchbare Abschnitte geteilt und auf das Zeichenkontingent des Tarifs angerechnet. Änderungen wirken auf künftige Antworten; arbeite deshalb nie in einem unklaren Browser-Tab.
Alle Optionen unter Add Data Source vergleichen
Wähle nach Verantwortlichkeit und Aktualisierung, nicht nur nach Dateiname.
Öffne Add Data Source. Website crawlt freigegebene öffentliche Seiten; Documents lädt PDF, TXT, Markdown, Word oder Excel; Text Input speichert einen kurzen gepflegten Fakt direkt. Confluence und Notion verbinden freigegebene Workspace-Inhalte.
Beispiel: Website für ein öffentliches Helpcenter, Documents für eine freigegebene Richtlinien-PDF, Text Input für einen vorübergehenden Servicehinweis und einen Connector, wenn die Quelle bereits im jeweiligen Workspace gepflegt wird. Schließe den Dialog ohne Duplikate.
Status, Zeichennutzung und Quellenanzahl lesen
Eine abgeschlossene Quelle ist nutzbar; eine unfertige noch nicht testbereit.
Die Nutzungsanzeige vergleicht indexierte Zeichen mit dem Tariflimit. Quellzähler trennen Websites, Dokumente, Text und Connectoren; die Tabelle zeigt den Indexstatus jedes Eintrags.
Pending oder Processing bedeutet warten. Failed oder Error erfordert Details und Korrektur. Re-index required weist auf fehlende oder veraltete Vektoren hin, oft nach einem Anbieterwechsel. Completed oder Indexed belegt den fertigen Job, aber noch nicht die richtige Antwort; dafür folgt Schritt zehn.
Quelle mit Suche, Filtern und Kategorien finden
Stabile Kategorien machen eine große Quellenliste verständlich.
Die Suche akzeptiert Quellenname oder Website-URL. Mit dem Typfilter grenzt du Websites, Dateien, Text oder Connectoren ein; der Kategoriefilter reduziert nach Verantwortlichkeit oder Thema. Setze beide Filter zurück, bevor du eine Quelle als fehlend einstufst.
Source Control Center nutzt die Kategorie Support für die Northstar-PDF. In Produktion eignen sich dauerhafte Kategorien wie Support, Products oder Legal. Schreibe keinen vorübergehenden Status wie neu oder prüfen in die Kategorie; Status und Verantwortung bleiben getrennt.
Website-Umfang vor Neuindexierung prüfen
URL, Crawltiefe, Ausschlüsse und Zeitplan bestimmen den Indexinhalt.
Öffne die Bearbeiten-Aktion der Website-Zeile. Prüfe kanonische Start-URL, Crawltiefe und automatisches Neuindexierungsintervall. Advanced brauchst du nur für Selektoren oder Ausschlussmuster.
Tiefe null indexiert nur die eingetragene Seite; größere Werte folgen Links. Schließe Checkout, Konto und doppelte Sprachpfade vor einer Erhöhung aus. Speichere nur beabsichtigte Änderungen und warte danach auf den neuen Indexlauf.
Indexierte Seiten einer Website prüfen
Eine Quelle kann grün sein, obwohl eine unerwünschte Seite Quote verbraucht.
Öffne Indexed URLs der Website. Durchsuche die Seitenliste, vergleiche Zeichenzahlen und erkenne mit View Content Navigationsrauschen, Cookie-Text oder Duplikate.
Delete entfernt nur die gewählte indexierte Seite; der nächste Crawl kann sie erneut finden. Exclude hinterlegt einen dauerhaften Ausschluss für künftige Crawls. Nutze den Bestätigungsdialog und prüfe danach die geänderte Zeichensumme.
Extrahierten Text, Metadaten und Search Priority bearbeiten
Prüfe genau den Dokumenttext, den der Chatbot abrufen kann.
Öffne Edit bei Northstar Knowledge Base. Der Editor zeigt den für die Indexierung verwendeten extrahierten Text sowie Document Name, Category und Search Priority. Korrigiere kleine Extraktionsfehler nur im Vergleich mit dem freigegebenen Original.
Search Priority beeinflusst das Ranking gegenüber anderen Quellen; es ist keine Qualitätsnote. Belasse den Wert ohne reproduzierbaren Grund auf null. Bei geänderter Richtlinie oder größerer Revision lädst du die freigegebene neue Datei hoch, prüfst sie und entfernst danach die veraltete Quelle.
Innerhalb indexierter Inhalte suchen
Content Search prüft gespeicherte Abschnitte statt nur Quellentitel.
Öffne Content Search und suche den eindeutigen Wert NORDSTERN-42. Das Ergebnis sollte auf Northstar Knowledge Base zeigen und den passenden indexierten Abschnitt enthalten.
So trennst du ein Quellenproblem schnell von einem Problem bei der Antworterzeugung. Kein Treffer bedeutet: Der Fakt ist nicht im aktuellen Index. Ein Treffer bei schlechter Chatbot-Antwort lenkt die Prüfung auf Fragestellung, Quellenüberschneidung, Search Priority und Modellverhalten.
Neuindexieren und Löschen ohne Wissensverlust
Neuindexieren aktualisiert eine Quelle; Löschen entfernt sie aus künftigem Abruf.
Nutze die Zeilenaktion für eine einzelne Quelle. Re-index All ist für einen Anbieterwechsel oder bewusst koordinierten Komplettlauf gedacht. Große Sammeljobs kosten Zeit und erschweren die Fehlersuche; dokumentiere vorher jede Änderung.
Ermittle vor Delete alle eindeutigen Fakten, die nur in dieser Quelle liegen. Der Bestätigungsdialog warnt vor Auswirkungen auf künftige Antworten. Brich bei einer reinen Prüfung ab oder lösche erst nach fertig indexiertem Ersatz und erfolgreichen Regressionstests.
Quelle mit einer exakten Chatbot-Frage prüfen
Die beobachtete Antwort muss dem Fakt im indexierten Dokument entsprechen.
Öffne Conversations und wähle die Source-Control-Center-Testsitzung. Exakte Eingabe: „What is the unique verification code in the uploaded tutorial PDF?“ Erwartetes Ergebnis: Die Antwort nennt NORDSTERN-42 und erfindet keinen anderen Code.
Beobachtetes Ergebnis: Der echte Assistent antwortete „The unique verification code is NORDSTERN-42.“ Dieses Beispiel ist End-to-End verifiziert. Halte pro kritischer Quelle eine bekannte Testfrage fest und wiederhole sie nach Dateiaustausch, Neuindexierung, Modellwechsel oder Löschung.
Beispiel & Ergebnis
So sieht der echte Praxistest aus
Jedes Tutorial nennt eine feste Eingabe, das erwartete Ergebnis und transparent, was im lokalen Test tatsächlich verifiziert wurde.
Praxisbeispiel: WebChatAgent-Datenquellen erklärt: alle Funktionen mit Beispielen
Dieses konkrete Szenario wurde mit dem temporären Tutorial-Konto vollständig ausgeführt.
Konkrete Testeingabe
Frage: „What is the unique verification code in the uploaded tutorial PDF?“
Erwartetes Ergebnis
Der Assistent liefert NORDSTERN-42 aus dem indexierten PDF statt zu raten.
Tatsächlich geprüft
Nachdem Website und PDF „Completed“ zeigten, antwortete der echte Besuchertest mit NORDSTERN-42 aus dem indexierten Tutorialwissen.
Tipps & Tricks
So wird die Einrichtung zuverlässig
Teste mit realistischen Beispielen, dokumentiere deine Ausgangswerte und ändere jeweils nur eine Einstellung. So erkennst du, was die Qualität tatsächlich verbessert.
Entferne Duplikate vor mehr Quote
Navigationskopien, Druckseiten und übersetzte Duplikate verbrauchen Zeichen und erzeugen konkurrierende Abschnitte. Bereinige zuerst den Quellenumfang, bevor du den Tarif erhöhst.
Gib jeder Quelle einen Verantwortlichen
Verantwortlichkeit macht veraltete Richtlinien und aufgegebene Connectoren schneller sichtbar.
Ändere nur eine Abrufvariable gleichzeitig
Halte Modell, Quellenset und Testfragen stabil, während du Search Priority, Kategorie oder Crawl-Umfang vergleichst. Sonst bleibt unklar, warum sich ein Ergebnis geändert hat.
Nutze ein schnelles Modell für Quellenprüfungen
Für deterministische Tests mit bekannter Antwort reicht meist ein schnelles wirtschaftliches Modell. Vergleiche ein stärkeres Modell erst, wenn der Indexabschnitt vorhanden ist und feste Fragen weiterhin scheitern.
Wenn etwas nicht klappt
Fehlerbehebung
Prüfe Status, Berechtigungen und Testdaten systematisch, bevor du Modell oder Prompt wechselst.
Quelle ist abgeschlossen, aber die Antwort verfehlt den Fakt
Suche die exakte Formulierung mit Content Search. Fehlt sie, korrigiere Extraktion oder Umfang und indexiere neu. Ist sie vorhanden, teste die exakte Frage, entferne konkurrierende Duplikate und vergleiche Search Priority oder Modell jeweils einzeln.
Website nimmt unerwünschte Seiten erneut auf
Nutze Exclude statt nur Delete oder ergänze ein Pfadmuster in den Website-Einstellungen. Indexiere danach neu und prüfe URL-Liste sowie Zeichensumme.
Re-index required erscheint nach Anbieterwechsel
Starte die Neuindexierung der betroffenen Quellen, warte auf alle abgeschlossenen Jobs und wiederhole vor Veröffentlichung die festen bekannten und unbekannten Testfragen.
Bereit für den Praxistest
Erstelle quartalsweise ein Quelleninventar mit Verantwortlichem, Kategorie, Aktualisierungsmethode, letztem Prüfdatum und einer festen Frage je kritischer Quelle.
