Schritt-für-Schritt-Tutorial Wissensbasis

WebChatAgent-Datenquellen: alle Funktionen erklärt

Verstehe den vollständigen Datenquellen-Bereich und pflege eine verlässliche Chatbot-Wissensbasis ohne Rätselraten.

Einsteiger27 Min. Lesezeit16. Juli 2026
WebChatAgent-Datenquellen: alle Funktionen erklärt

WebChatAgent-Datenquellen bestimmen, welche Websites, Dokumente und verbundenen Arbeitsbereiche eine Antwort belegen können.

Unter Datenquellen entscheidest du, welche Fakten ein Assistent abrufen darf. Websites, Dateien, direkter Text, Confluence und Notion teilen sich einen Bereich, unterscheiden sich aber bei Verantwortlichkeit, Aktualisierung und den späteren Verwaltungsfunktionen.

Diese Anleitung verwendet den echten Premium-Testassistenten Source Control Center. Website und PDF sind indexiert; in einer echten Konversation liefert der Assistent den eindeutigen PDF-Wert NORDSTERN-42. Diese Abschlussprüfung ist wichtig: Ein grüner Status belegt die Indexierung, der Antworttest den tatsächlichen Abruf.

Datenschutzfreundlicher Zwei-Klick-Player

WebChatAgent Datenquellen: Alle Funktionen

Verstehe WebChatAgent-Datenquellen, Indexierungsstatus, Suche, Filter, Metadaten, Reindexierung und sicheres Löschen anhand echter Beispiele.

YouTube · 5:35 · Englisch

Der YouTube-Player bleibt bis zu deinem Klick gesperrt. Beim Laden verbindet sich dein Browser mit YouTube; dabei können technische Daten an Google übertragen werden.

Direkt auf YouTube öffnen

Das hast du am Ende eingerichtet

  • Der richtige Quellentyp für Verantwortliche und Aktualisierungszyklus
  • Eine wiederholbare Prüfung von Indexstatus, Zeichennutzung und Filtern
  • Sichere Abläufe für Bearbeiten, Inhaltssuche, Neuindexieren und Löschen
  • Ein echter Regressionstest mit bekannter Antwort

Das brauchst du

  • Ein Chatbot, dessen Quellen du verwalten darfst
  • Mindestens eine kleine freigegebene Testquelle
  • Eine exakte Frage, deren Antwort nur in dieser Quelle steht

Quellenlebenszyklus von Eingabe bis Abruf

Das Hinzufügen startet Extraktion und Indexierung. Die resultierenden Inhalte zählen zur zeichenbasierten Inhaltsquota und sind erst nach erfolgreichem Status nutzbar.

Änderungen am Umfang oder Anbieterwechsel können eine Neuindexierung erfordern. Das Löschen entfernt das Wissen aus künftigen Abrufen.

Quelle hinzufügenIndexieren und prüfenAktualisieren oder entfernen

01–10

Schritt für Schritt einrichten

1

Richtigen Assistenten und Datenquellen-Tab öffnen

Prüfe vor Wissensänderungen den Namen des Assistenten.

Wähle Source Control Center in der linken Seitenleiste und öffne im Assistenten die Datenquellen. Seitenüberschrift, markierter Assistent und Quellenliste müssen zusammenpassen.

Lies vor dem Hinzufügen den Hinweis: Quellen werden in durchsuchbare Abschnitte geteilt und auf das Zeichenkontingent des Tarifs angerechnet. Änderungen wirken auf künftige Antworten; arbeite deshalb nie in einem unklaren Browser-Tab.

Prüfe vor Wissensänderungen den Namen des Assistenten.
2

Alle Optionen unter Add Data Source vergleichen

Wähle nach Verantwortlichkeit und Aktualisierung, nicht nur nach Dateiname.

Öffne Add Data Source. Website crawlt freigegebene öffentliche Seiten; Documents lädt PDF, TXT, Markdown, Word oder Excel; Text Input speichert einen kurzen gepflegten Fakt direkt. Confluence und Notion verbinden freigegebene Workspace-Inhalte.

Beispiel: Website für ein öffentliches Helpcenter, Documents für eine freigegebene Richtlinien-PDF, Text Input für einen vorübergehenden Servicehinweis und einen Connector, wenn die Quelle bereits im jeweiligen Workspace gepflegt wird. Schließe den Dialog ohne Duplikate.

Wähle nach Verantwortlichkeit und Aktualisierung, nicht nur nach Dateiname.
3

Status, Zeichennutzung und Quellenanzahl lesen

Eine abgeschlossene Quelle ist nutzbar; eine unfertige noch nicht testbereit.

Die Nutzungsanzeige vergleicht indexierte Zeichen mit dem Tariflimit. Quellzähler trennen Websites, Dokumente, Text und Connectoren; die Tabelle zeigt den Indexstatus jedes Eintrags.

Pending oder Processing bedeutet warten. Failed oder Error erfordert Details und Korrektur. Re-index required weist auf fehlende oder veraltete Vektoren hin, oft nach einem Anbieterwechsel. Completed oder Indexed belegt den fertigen Job, aber noch nicht die richtige Antwort; dafür folgt Schritt zehn.

Eine abgeschlossene Quelle ist nutzbar; eine unfertige noch nicht testbereit.
4

Quelle mit Suche, Filtern und Kategorien finden

Stabile Kategorien machen eine große Quellenliste verständlich.

Die Suche akzeptiert Quellenname oder Website-URL. Mit dem Typfilter grenzt du Websites, Dateien, Text oder Connectoren ein; der Kategoriefilter reduziert nach Verantwortlichkeit oder Thema. Setze beide Filter zurück, bevor du eine Quelle als fehlend einstufst.

Source Control Center nutzt die Kategorie Support für die Northstar-PDF. In Produktion eignen sich dauerhafte Kategorien wie Support, Products oder Legal. Schreibe keinen vorübergehenden Status wie neu oder prüfen in die Kategorie; Status und Verantwortung bleiben getrennt.

Stabile Kategorien machen eine große Quellenliste verständlich.
5

Website-Umfang vor Neuindexierung prüfen

URL, Crawltiefe, Ausschlüsse und Zeitplan bestimmen den Indexinhalt.

Öffne die Bearbeiten-Aktion der Website-Zeile. Prüfe kanonische Start-URL, Crawltiefe und automatisches Neuindexierungsintervall. Advanced brauchst du nur für Selektoren oder Ausschlussmuster.

Tiefe null indexiert nur die eingetragene Seite; größere Werte folgen Links. Schließe Checkout, Konto und doppelte Sprachpfade vor einer Erhöhung aus. Speichere nur beabsichtigte Änderungen und warte danach auf den neuen Indexlauf.

URL, Crawltiefe, Ausschlüsse und Zeitplan bestimmen den Indexinhalt.
6

Indexierte Seiten einer Website prüfen

Eine Quelle kann grün sein, obwohl eine unerwünschte Seite Quote verbraucht.

Öffne Indexed URLs der Website. Durchsuche die Seitenliste, vergleiche Zeichenzahlen und erkenne mit View Content Navigationsrauschen, Cookie-Text oder Duplikate.

Delete entfernt nur die gewählte indexierte Seite; der nächste Crawl kann sie erneut finden. Exclude hinterlegt einen dauerhaften Ausschluss für künftige Crawls. Nutze den Bestätigungsdialog und prüfe danach die geänderte Zeichensumme.

Eine Quelle kann grün sein, obwohl eine unerwünschte Seite Quote verbraucht.
7

Extrahierten Text, Metadaten und Search Priority bearbeiten

Prüfe genau den Dokumenttext, den der Chatbot abrufen kann.

Öffne Edit bei Northstar Knowledge Base. Der Editor zeigt den für die Indexierung verwendeten extrahierten Text sowie Document Name, Category und Search Priority. Korrigiere kleine Extraktionsfehler nur im Vergleich mit dem freigegebenen Original.

Search Priority beeinflusst das Ranking gegenüber anderen Quellen; es ist keine Qualitätsnote. Belasse den Wert ohne reproduzierbaren Grund auf null. Bei geänderter Richtlinie oder größerer Revision lädst du die freigegebene neue Datei hoch, prüfst sie und entfernst danach die veraltete Quelle.

Prüfe genau den Dokumenttext, den der Chatbot abrufen kann.
9

Neuindexieren und Löschen ohne Wissensverlust

Neuindexieren aktualisiert eine Quelle; Löschen entfernt sie aus künftigem Abruf.

Nutze die Zeilenaktion für eine einzelne Quelle. Re-index All ist für einen Anbieterwechsel oder bewusst koordinierten Komplettlauf gedacht. Große Sammeljobs kosten Zeit und erschweren die Fehlersuche; dokumentiere vorher jede Änderung.

Ermittle vor Delete alle eindeutigen Fakten, die nur in dieser Quelle liegen. Der Bestätigungsdialog warnt vor Auswirkungen auf künftige Antworten. Brich bei einer reinen Prüfung ab oder lösche erst nach fertig indexiertem Ersatz und erfolgreichen Regressionstests.

Neuindexieren aktualisiert eine Quelle; Löschen entfernt sie aus künftigem Abruf.
10

Quelle mit einer exakten Chatbot-Frage prüfen

Die beobachtete Antwort muss dem Fakt im indexierten Dokument entsprechen.

Öffne Conversations und wähle die Source-Control-Center-Testsitzung. Exakte Eingabe: „What is the unique verification code in the uploaded tutorial PDF?“ Erwartetes Ergebnis: Die Antwort nennt NORDSTERN-42 und erfindet keinen anderen Code.

Beobachtetes Ergebnis: Der echte Assistent antwortete „The unique verification code is NORDSTERN-42.“ Dieses Beispiel ist End-to-End verifiziert. Halte pro kritischer Quelle eine bekannte Testfrage fest und wiederhole sie nach Dateiaustausch, Neuindexierung, Modellwechsel oder Löschung.

Die beobachtete Antwort muss dem Fakt im indexierten Dokument entsprechen.

Beispiel & Ergebnis

So sieht der echte Praxistest aus

Jedes Tutorial nennt eine feste Eingabe, das erwartete Ergebnis und transparent, was im lokalen Test tatsächlich verifiziert wurde.

Praxisbeispiel: WebChatAgent-Datenquellen erklärt: alle Funktionen mit Beispielen

Dieses konkrete Szenario wurde mit dem temporären Tutorial-Konto vollständig ausgeführt.

End-to-End geprüft

Konkrete Testeingabe

Frage: „What is the unique verification code in the uploaded tutorial PDF?“

Erwartetes Ergebnis

Der Assistent liefert NORDSTERN-42 aus dem indexierten PDF statt zu raten.

Tatsächlich geprüft

Nachdem Website und PDF „Completed“ zeigten, antwortete der echte Besuchertest mit NORDSTERN-42 aus dem indexierten Tutorialwissen.

Nachdem Website und PDF „Completed“ zeigten, antwortete der echte Besuchertest mit NORDSTERN-42 aus dem indexierten Tutorialwissen.

Tipps & Tricks

So wird die Einrichtung zuverlässig

Teste mit realistischen Beispielen, dokumentiere deine Ausgangswerte und ändere jeweils nur eine Einstellung. So erkennst du, was die Qualität tatsächlich verbessert.

Entferne Duplikate vor mehr Quote

Navigationskopien, Druckseiten und übersetzte Duplikate verbrauchen Zeichen und erzeugen konkurrierende Abschnitte. Bereinige zuerst den Quellenumfang, bevor du den Tarif erhöhst.

Gib jeder Quelle einen Verantwortlichen

Verantwortlichkeit macht veraltete Richtlinien und aufgegebene Connectoren schneller sichtbar.

Ändere nur eine Abrufvariable gleichzeitig

Halte Modell, Quellenset und Testfragen stabil, während du Search Priority, Kategorie oder Crawl-Umfang vergleichst. Sonst bleibt unklar, warum sich ein Ergebnis geändert hat.

Nutze ein schnelles Modell für Quellenprüfungen

Für deterministische Tests mit bekannter Antwort reicht meist ein schnelles wirtschaftliches Modell. Vergleiche ein stärkeres Modell erst, wenn der Indexabschnitt vorhanden ist und feste Fragen weiterhin scheitern.

Wenn etwas nicht klappt

Fehlerbehebung

Prüfe Status, Berechtigungen und Testdaten systematisch, bevor du Modell oder Prompt wechselst.

Quelle ist abgeschlossen, aber die Antwort verfehlt den Fakt

Suche die exakte Formulierung mit Content Search. Fehlt sie, korrigiere Extraktion oder Umfang und indexiere neu. Ist sie vorhanden, teste die exakte Frage, entferne konkurrierende Duplikate und vergleiche Search Priority oder Modell jeweils einzeln.

Website nimmt unerwünschte Seiten erneut auf

Nutze Exclude statt nur Delete oder ergänze ein Pfadmuster in den Website-Einstellungen. Indexiere danach neu und prüfe URL-Liste sowie Zeichensumme.

Re-index required erscheint nach Anbieterwechsel

Starte die Neuindexierung der betroffenen Quellen, warte auf alle abgeschlossenen Jobs und wiederhole vor Veröffentlichung die festen bekannten und unbekannten Testfragen.

Bereit für den Praxistest

Erstelle quartalsweise ein Quelleninventar mit Verantwortlichem, Kategorie, Aktualisierungsmethode, letztem Prüfdatum und einer festen Frage je kritischer Quelle.

Weiterführende Ressourcen