Fuentes de datos en WebChatAgent: todos los controles explicados
Comprende el espacio de trabajo completo de Data Sources y mantén una base de conocimiento fiable para tu chatbot sin suposiciones.

Las fuentes de datos de WebChatAgent controlan qué sitios web, documentos y espacios de trabajo conectados pueden respaldar la respuesta de un asistente.
En Data Sources es donde decides qué datos puede recuperar un asistente. Los sitios web, archivos, texto directo, Confluence y Notion comparten un mismo espacio de trabajo, pero difieren en su propiedad, comportamiento de actualización y los controles disponibles tras la indexación.
Esta guía utiliza un asistente de prueba Premium real llamado Source Control Center. Su sitio web y PDF están indexados, y una conversación real devuelve el dato único del PDF NORDSTERN-42. Esta comprobación final es importante: el estado verde demuestra que la indexación finalizó, mientras que la prueba de respuesta demuestra que la información realmente se puede recuperar.
Reproductor en dos clics que protege la privacidad
Tutorial de Data Sources en WebChatAgent: todos los controles explicados
Descubre las fuentes de datos en WebChatAgent, estados de indexación, filtros, metadatos, reindexación y borrado seguro con casos reales.
El reproductor de YouTube permanece bloqueado hasta que pulsa Reproducir. Al cargarlo, su navegador se conecta a YouTube y puede transmitir datos técnicos a Google.
Abrir directamente en YouTubeQué obtendrá al final
- El tipo de fuente adecuado para cada responsable de contenido y ciclo de actualización
- Una revisión reproducible del estado de indexación, uso de caracteres y filtros
- Procedimientos seguros de edición, búsqueda de contenido, reindexación y eliminación
- Una prueba de regresión real con respuesta conocida
Antes de empezar
- Un chatbot en el que puedas gestionar fuentes
- Al menos una fuente de prueba pequeña y aprobada
- Una pregunta exacta cuya respuesta aparezca únicamente en esa fuente
Ciclo de vida de la fuente desde la entrada hasta la recuperación
Añadir una fuente inicia la extracción y la indexación. Los fragmentos resultantes cuentan para la cuota de contenido basada en caracteres y solo están disponibles tras un estado correcto.
Editar el alcance o cambiar de proveedor puede requerir un nuevo índice. Eliminar una fuente retira su conocimiento de futuras recuperaciones.
01–10
Configuración paso a paso
Abre el asistente correcto y la pestaña Data Sources
Confirma el nombre del asistente antes de modificar su conocimiento.
Selecciona Source Control Center en la barra lateral izquierda y abre Data Sources en la navegación del asistente. El encabezado de la página, la selección de la barra lateral y la lista de fuentes deben pertenecer al mismo asistente.
Lee el banner informativo antes de añadir contenido: las fuentes se dividen en fragmentos indexables y cuentan para el límite de caracteres de contenido del plan. Los cambios aquí afectan a respuestas futuras, así que nunca trabajes desde una pestaña del navegador ambigua.
Compara cada opción de Add Data Source
Elige según la propiedad y el método de actualización, no solo por el nombre del archivo.
Abre Add Data Source. Website rastrea páginas públicas aprobadas; Documents sube PDF, TXT, Markdown, Word o Excel; Text Input almacena un dato breve y mantenido directamente. Confluence y Notion conectan contenido de espacios de trabajo aprobados.
Por ejemplo, usa Website para un centro de ayuda público, Documents para un PDF de políticas firmado, Text Input para un aviso temporal de servicio y un conector cuando el responsable del contenido ya mantenga la fuente en ese espacio de trabajo. Cierra el cuadro de diálogo sin crear duplicados.
Interpreta el estado, uso de caracteres y recuentos de fuentes
Una fuente completada es utilizable; una inacabada no está lista para pruebas de respuesta.
La tarjeta de uso compara los caracteres indexados con el límite del plan. Los contadores de fuentes separan sitios web, documentos, texto y conectores, mientras que la tabla muestra el estado de indexación de cada elemento.
Trata Pending o Processing como un estado de espera. Failed o Error necesita detalles y una corrección. Re-index required significa que los vectores actuales no están disponibles o están desactualizados, a menudo tras cambiar de proveedor. Completed o Indexed significa que la tarea finalizó, pero aún necesitas la prueba de respuesta del paso diez.
Encuentra una fuente con búsqueda, filtros y categorías
Las categorías estables hacen que un inventario grande de fuentes sea comprensible.
Search acepta el nombre de una fuente o la URL de un sitio web. Usa el filtro de tipo para aislar sitios web, archivos, texto o conectores, y el filtro de categoría para acotar por responsable o tema. Restablece ambos filtros antes de concluir que falta una fuente.
Source Control Center usa la categoría Support para el PDF de Northstar. En producción, prefiere etiquetas duraderas como Support, Products o Legal. No codifiques estados temporales como nuevo o necesita revisión en una categoría; el estado y la propiedad deben mantenerse separados.
Inspecciona el alcance del sitio web antes de reindexar
La URL, la profundidad de rastreo, las exclusiones y la programación deciden qué entra en el índice.
Abre la acción de edición en la fila del sitio web. Verifica la URL inicial canónica, la profundidad de rastreo y el intervalo de reindexación automática. Despliega Advanced solo cuando sean necesarios selectores o patrones de exclusión.
Una profundidad de cero indexa únicamente la página introducida; una profundidad mayor sigue los enlaces. Excluye rutas de pago, cuentas y duplicados por idioma antes de aumentar la profundidad. Guarda únicamente cambios intencionados y luego espera a la nueva tarea de indexación en lugar de probar de inmediato.
Revisa las páginas dentro de una fuente de sitio web
Una fuente puede estar en verde mientras una página no deseada sigue consumiendo cuota.
Abre Indexed URLs para el sitio web. Busca en la lista de páginas, compara el recuento de caracteres y usa View Content para detectar ruido de navegación, textos de cookies o páginas duplicadas.
Delete elimina únicamente la página indexada seleccionada hasta que el próximo rastreo pueda descubrirla de nuevo. Exclude añade una exclusión duradera para futuros rastreos. Usa el cuadro de diálogo de confirmación y luego comprueba que el recuento total de caracteres cambió como se esperaba.
Edita el texto extraído, los metadatos y Search Priority
Revisa exactamente qué puede recuperar el chatbot de este documento.
Abre Edit en Northstar Knowledge Base. El editor muestra el texto extraído utilizado para la indexación, además de Document Name, Category y Search Priority. Corrige un pequeño error de extracción solo cuando puedas compararlo con el original aprobado.
Search Priority influye en el posicionamiento respecto a otras fuentes; no es una puntuación de calidad. Mantenlo en cero a menos que preguntas recurrentes justifiquen un aumento. Para una política modificada o una revisión mayor, sube el nuevo archivo aprobado, verifícalo y luego elimina la fuente obsoleta en lugar de mantener una bifurcación oculta en el texto extraído.
Busca dentro del contenido indexado
Content Search comprueba los fragmentos almacenados, no solo los títulos de las fuentes.
Abre Content Search e introduce el valor único NORDSTERN-42. El resultado debería apuntar a Northstar Knowledge Base y mostrar el fragmento indexado coincidente.
Esta es la forma más rápida de separar un problema en la fuente de un problema en la generación de la respuesta. Ningún resultado significa que el dato no está en el índice actual. Un resultado coincidente con una respuesta deficiente del chatbot significa que debes inspeccionar la redacción de la pregunta, el solapamiento de fuentes, Search Priority y el comportamiento del modelo.
Usa la reindexación y la eliminación sin perder conocimiento necesario
Re-index actualiza una fuente; Delete la elimina de futuras recuperaciones.
Usa la acción de fila para reindexar una sola fuente, o Re-index All únicamente tras un cambio de proveedor o una actualización deliberadamente coordinada. Las tareas masivas grandes consumen tiempo y pueden dificultar la resolución de problemas, así que registra qué cambió primero.
Antes de Delete, identifica cada dato único que exista solo en esa fuente. La confirmación advierte que la eliminación afecta a respuestas futuras. Cancela durante una revisión o elimina solo después de que un reemplazo esté completado y supere sus preguntas fijas de regresión.
Verifica la fuente con una pregunta exacta al chatbot
La respuesta observada debe coincidir con el dato en el documento indexado.
Abre Conversations y selecciona la sesión de prueba de Source Control Center. Entrada exacta: “What is the unique verification code in the uploaded tutorial PDF?” Resultado esperado: la respuesta menciona NORDSTERN-42 y no inventa un código diferente.
Resultado observado: el asistente real respondió, “The unique verification code is NORDSTERN-42.” Este ejemplo está verificado de extremo a extremo. Mantén una pregunta de respuesta conocida por cada fuente crítica y repítela tras reemplazos de archivos, reindexaciones, cambios de modelo o eliminaciones de fuentes.
Ejemplo y resultado
Vea la prueba práctica y su resultado
Cada tutorial incluye un caso de entrada definido, el resultado previsto y un registro transparente de las comprobaciones realizadas.
Ejemplo práctico: Fuentes de datos de WebChatAgent explicadas: cada control con ejemplos
Este escenario exacto se completó con la cuenta temporal del tutorial.
Entrada exacta de la prueba
Ask: “What is the unique verification code in the uploaded tutorial PDF?”
Resultado previsto
El asistente devuelve NORDSTERN-42 a partir del PDF indexado en lugar de adivinar.
Qué se comprobó realmente
Después de que tanto el sitio web como el PDF mostraran Completed, la prueba con un visitante real respondió con NORDSTERN-42 e hizo referencia al conocimiento indexado del tutorial.
Consejos útiles
Consiga una configuración fiable
Pruebe con ejemplos realistas, guarde su punto de partida y modifique un solo ajuste cada vez para evaluar las mejoras con claridad.
Elimina duplicados antes de comprar más cuota
Copias de navegación, páginas de impresión y duplicados traducidos pueden consumir caracteres y crear fragmentos que compiten entre sí. Limpia el alcance de la fuente antes de ampliar el plan.
Asigna un responsable a cada fuente
Tener un responsable facilita la detección y eliminación de políticas obsoletas y conectores abandonados.
Cambia una variable de recuperación a la vez
Mantén estables el modelo, el conjunto de fuentes y las preguntas de prueba mientras comparas Search Priority, la categoría o el alcance del rastreo. De lo contrario, no podrás explicar por qué cambió un resultado.
Usa un modelo rápido para comprobaciones rutinarias de fuentes
Un modelo rápido y económico suele ser suficiente para pruebas deterministas de respuesta conocida. Compara con un modelo más potente solo cuando el fragmento indexado esté presente y las preguntas fijas sigan fallando.
Si algo no funciona
Resolución de problemas
Revise el estado, los permisos y los datos de prueba de forma sistemática antes de cambiar el modelo o la instrucción.
La fuente está completada, pero la respuesta omite su dato
Encuentra la frase exacta con Content Search. Si no está presente, corrige la extracción o el alcance y reindexa. Si está presente, prueba la pregunta exacta, elimina duplicados que compitan y compara Search Priority o el modelo realizando solo un cambio a la vez.
Un sitio web sigue añadiendo páginas no deseadas
Usa Exclude en lugar de solo Delete, o añade un patrón de ruta en la configuración de la fuente del sitio web. Luego reindexa y verifica la lista de URL indexadas y el total de caracteres.
Aparece Re-index required tras un cambio de proveedor
Inicia la reindexación de las fuentes afectadas, espera a que finalicen todas las tareas y vuelve a ejecutar las preguntas fijas conocidas y no conocidas antes de publicar el cambio.
Listo para una prueba tipo producción
Crea un inventario trimestral de fuentes con responsable, categoría, método de actualización, fecha de última verificación y una pregunta fija para cada fuente crítica.
