WebChatAgent databronnen: elke functie uitgelegd
Begrijp de complete Data Sources-omgeving en onderhoud zonder giswerk een betrouwbare chatbot-kennisbank.

WebChatAgent databronnen bepalen welke websites, documenten en gekoppelde werkruimtes een antwoord van de assistent kunnen ondersteunen.
In Data Sources bepaalt u welke feiten een assistent mag ophalen. Websites, bestanden, directe tekst, Confluence en Notion delen één werkruimte, maar verschillen in eigenaarschap, verversingsgedrag en de beschikbare instellingen na het indexeren.
Deze handleiding gebruikt een echte Premium-testassistent genaamd Source Control Center. De bijbehorende website en PDF zijn geïndexeerd, en een echt gesprek retourneert het unieke PDF-feit NORDSTERN-42. Die laatste controle is belangrijk: een groene status bewijst dat het indexeren is voltooid, terwijl de antwoordtest bewijst dat de informatie daadwerkelijk kan worden opgehaald.
Privacyvriendelijke speler met tweestapsactivering
WebChatAgent Data Sources-handleiding: elk bedieningselement uitgelegd
Begrijp WebChatAgent databronnen, indexeerstatussen, zoekfunctionaliteit, filters, metadata, herindexeren en veilig verwijderen met echte interfacevoorbeelden.
De YouTube-speler blijft geblokkeerd totdat u op Afspelen klikt. Door het laden maakt uw browser verbinding met YouTube en kunnen technische gegevens naar Google worden verzonden.
Rechtstreeks openen op YouTubeWat u aan het einde heeft bereikt
- Het juiste brontype voor elke inhoudseigenaar en updatecyclus
- Een herhaalbare controle van indexeerstatus, tekenverbruik en filters
- Veilige procedures voor bewerken, inhoud zoeken, herindexeren en verwijderen
- Een echte regressietest met een bekend antwoord
Voordat u begint
- Een chatbot waarvoor u bronnen kunt beheren
- Minstens één kleine goedgekeurde testbron
- Eén exacte vraag waarvan het antwoord alleen in die bron voorkomt
Levenscyclus van een bron van invoer tot retrieval
Het toevoegen van een bron start de extractie en indexering. De resulterende passages tellen mee voor het tekengebaseerde inhoudsquota en worden pas beschikbaar na een succesvolle status.
Het aanpassen van het bereik of het wijzigen van de provider kan een nieuwe index vereisen. Het verwijderen van een bron wist de bijbehorende kennis voor toekomstige retrieval.
01–10
Stap voor stap instellen
Open de juiste assistent en het tabblad Data Sources
Controleer de naam van de assistent voordat u de bijbehorende kennis wijzigt.
Selecteer Source Control Center in de linkerzijbalk en open Data Sources in de navigatie van de assistent. De paginatitel, de selectie in de zijbalk en de bronnenlijst moeten bij dezelfde assistent horen.
Lees de informatiebanner voordat u inhoud toevoegt: bronnen worden opgesplitst in doorzoekbare passages en tellen mee voor de tekenlimiet van het abonnement. Wijzigingen hier zijn van invloed op toekomstige antwoorden, dus werk nooit vanuit een onduidelijk browsertabblad.
Vergelijk elke optie onder Add Data Source
Kies op basis van eigenaarschap en updatemethode, niet alleen op basis van de bestandsnaam.
Open Add Data Source. Website crawlt goedgekeurde openbare pagina's; Documents uploadt PDF, TXT, Markdown, Word of Excel; Text Input slaat een kort onderhouden feit direct op. Confluence en Notion koppelen goedgekeurde werkruimte-inhoud.
Gebruik bijvoorbeeld Website voor een openbaar helpcentrum, Documents voor een ondertekende beleids-PDF, Text Input voor één tijdelijke servicemelding en een connector wanneer de inhoudseigenaar de bron al in die werkruimte beheert. Sluit het dialoogvenster zonder dubbele bronnen aan te maken.
Lees status, tekenverbruik en bronaantallen af
Een voltooide bron is bruikbaar; een niet-afgeronde bron is nog niet klaar voor het testen van antwoorden.
De gebruikskaart vergelijkt geïndexeerde tekens met de limiet van het abonnement. Brontellers splitsen websites, documenten, tekst en connectors uit, terwijl de tabel de indexeerstatus van elk item toont.
Beschouw Pending of Processing als een wachtstatus. Failed of Error vereist details en een correctie. Re-index required betekent dat de huidige vectoren niet beschikbaar of verouderd zijn, vaak na een providerwijziging. Completed of Indexed betekent dat de taak is voltooid, maar u moet nog steeds de antwoordtest in stap tien uitvoeren.
Vind een bron met zoeken, filters en categorieën
Stabiele categorieën houden een grote bronneninventaris overzichtelijk.
Search accepteert een bronnaam of website-URL. Gebruik het typefilter om websites, bestanden, tekst of connectors te isoleren, en het categoriefilter om eigenaarschap of onderwerp te verfijnen. Reset beide filters voordat u concludeert dat een bron ontbreekt.
Source Control Center gebruikt de categorie Support voor de Northstar-PDF. Geef in productie de voorkeur aan duurzame labels zoals Support, Products of Legal. Verwerk geen tijdelijke statussen zoals new of needs review in een categorie; status en eigenaarschap moeten gescheiden blijven.
Controleer het websitebereik vóór het herindexeren
URL, crawldiepte, uitsluitingen en planning bepalen wat er in de index terechtkomt.
Open de bewerkingsactie in de rij van de website. Controleer de canonieke start-URL, de crawldiepte en het automatische herindexeerinterval. Vouw Advanced alleen uit wanneer selectors of uitsluitingspatronen noodzakelijk zijn.
Een diepte van nul indexeert alleen de ingevoerde pagina; een grotere diepte volgt links. Sluit afreken-, account- en dubbele taalpaden uit voordat u de diepte vergroot. Sla alleen bewuste wijzigingen op en wacht vervolgens op de nieuwe indexeertaak in plaats van direct te testen.
Bekijk de pagina's binnen een websitebron
Een bron kan groen zijn terwijl één ongewenste pagina toch quota verbruikt.
Open Indexed URLs voor de website. Doorzoek de paginalijst, vergelijk tekensaantallen en gebruik View Content om navigatieruis, cookieteksten of dubbele pagina's te ontdekken.
Delete verwijdert alleen de geselecteerde geïndexeerde pagina totdat een volgende crawl deze mogelijk opnieuw ontdekt. Exclude voegt een blijvende uitsluiting toe voor toekomstige crawls. Gebruik het bevestigingsvenster en controleer vervolgens of het totale aantal tekens naar verwachting is gewijzigd.
Bewerk geëxtraheerde tekst, metadata en Search Priority
Controleer exact wat de chatbot uit dit document kan ophalen.
Open Edit bij Northstar Knowledge Base. De editor toont de geëxtraheerde tekst die voor de indexering wordt gebruikt, plus Document Name, Category en Search Priority. Corrigeer een kleine extractiefout alleen wanneer u deze kunt vergelijken met het goedgekeurde origineel.
Search Priority beïnvloedt de rangschikking ten opzichte van andere bronnen; het is geen kwaliteitsscore. Laat dit op nul staan, tenzij herhaalbare vragen een verhoging rechtvaardigen. Upload bij een gewijzigd beleid of grotere herziening het goedgekeurde nieuwe bestand, controleer het en verwijder vervolgens de verouderde bron in plaats van een verborgen afwijking in de geëxtraheerde tekst te onderhouden.
Zoek binnen de geïndexeerde inhoud
Content Search controleert de opgeslagen passages, niet alleen de brontitels.
Open Content Search en voer de unieke waarde NORDSTERN-42 in. Het resultaat moet verwijzen naar Northstar Knowledge Base en de overeenkomende geïndexeerde passage tonen.
Dit is de snelste manier om een bronprobleem te scheiden van een probleem met het genereren van antwoorden. Geen resultaat betekent dat het feit niet in de huidige index staat. Een overeenkomend resultaat met een slecht chatbot-antwoord betekent dat u de vraagformulering, bronomvang, Search Priority en het modelgedrag moet inspecteren.
Gebruik herindexeren en verwijderen zonder benodigde kennis te verliezen
Herindexeren vernieuwt een bron; verwijderen wist deze voor toekomstige retrieval.
Gebruik de rij-actie om één bron te herindexeren, of Re-index All alleen na een providerwijziging of een doelbewust gecoördineerde vernieuwing. Grote bulkopdrachten kosten tijd en kunnen probleemoplossing bemoeilijken, dus leg eerst vast wat er is gewijzigd.
Identificeer vóór Delete elk uniek feit dat uitsluitend in die bron voorkomt. De bevestiging waarschuwt dat verwijdering invloed heeft op toekomstige antwoorden. Annuleer tijdens een controle, of verwijder pas nadat een vervanging is voltooid en de vaste regressievragen slagen.
Verifieer de bron met een exacte chatbot-vraag
Het waargenomen antwoord moet overeenkomen met het feit in het geïndexeerde document.
Open Conversations en selecteer de testsessie van Source Control Center. Exacte invoer: “What is the unique verification code in the uploaded tutorial PDF?” Verwacht resultaat: het antwoord noemt NORDSTERN-42 en verzint geen andere code.
Waargenomen resultaat: de echte assistent antwoordde: “The unique verification code is NORDSTERN-42.” Dit voorbeeld is end-to-end geverifieerd. Houd één vraag met een bekend antwoord aan per kritieke bron en herhaal deze na bestandsvervanging, herindexering, modelwijzigingen of bronverwijdering.
Voorbeeld en resultaat
Bekijk de praktijktest en het resultaat
Elke tutorial bevat een vaste invoer, het verwachte resultaat en een transparant overzicht van wat daadwerkelijk lokaal is geverifieerd.
Praktijkvoorbeeld: WebChatAgent Data Sources uitgelegd: elk bedieningselement met voorbeelden
Dit exacte scenario is doorlopen met het tijdelijke tutorial-account.
Exacte testinvoer
Ask: “What is the unique verification code in the uploaded tutorial PDF?”
Verwacht resultaat
De assistent retourneert NORDSTERN-42 uit de geïndexeerde PDF in plaats van te gissen.
Wat er daadwerkelijk is geverifieerd
Nadat zowel de website als de PDF Completed toonden, antwoordde de echte bezoekerstest met NORDSTERN-42 en verwees naar de geïndexeerde tutorialkennis.
Tips en trucs
Maak de inrichting betrouwbaar
Test met realistische voorbeelden, leg uw startpunt vast en wijzig één instelling tegelijk. Zo worden echte verbeteringen zichtbaar.
Verwijder duplicaten voordat u meer quota aanschaft
Navigatiekopieën, printpagina's en vertaalde duplicaten kunnen tekens verbruiken en concurrerende passages creëren. Schoon het bronbereik op voordat u het abonnement upgradet.
Wijs een eigenaar toe aan elke bron
Eigenaarschap maakt het eenvoudiger om verouderd beleid en verlaten connectors te detecteren en te verwijderen.
Wijzig één retrieval-variabele tegelijk
Houd het model, de bronnenset en testvragen gelijk terwijl u Search Priority, categorie of crawlbereik vergelijkt. Anders kunt u niet verklaren waarom een resultaat is veranderd.
Gebruik een snel model voor routinematige broncontroles
Een snel, economisch model is meestal voldoende voor deterministische tests met bekende antwoorden. Vergelijk een krachtiger model pas wanneer de geïndexeerde passage aanwezig is en de vaste vragen toch mislukken.
Wanneer iets niet werkt
Problemen oplossen
Controleer status, machtigingen en testgegevens systematisch voordat u het model of de prompt aanpast.
De bron is voltooid, maar het antwoord mist het bijbehorende feit
Zoek de exacte zin met Content Search. Als deze ontbreekt, herstel dan de extractie of het bereik en herindexeer. Als deze aanwezig is, test dan de exacte vraag, verwijder concurrerende duplicaten en vergelijk Search Priority of het model met slechts één wijziging tegelijk.
Een website blijft ongewenste pagina's toevoegen
Gebruik Exclude in plaats van alleen Delete, of voeg een padpatroon toe in de instellingen van de websitebron. Herindexeer vervolgens en controleer de lijst met geïndexeerde URL's en het totale aantal tekens.
Re-index required verschijnt na een providerwijziging
Start de herindexering voor de betreffende bronnen, wacht tot elke taak is voltooid en voer de vaste bekende en onbekende vragen opnieuw uit voordat u de wijziging publiceert.
Klaar voor een test op productieniveau
Stel een driemaandelijkse bronneninventaris op met eigenaar, categorie, verversingsmethode, laatste verificatiedatum en één vaste vraag voor elke kritieke bron.
