Si deseas agregar contenido del sitio web a Intercom y ponerlo a disposición de Fin AI Agent y Copilot, puedes hacerlo sincronizando la URL pública de tu sitio. También puedes entrenar a Fin y Copilot con contenido de entradas de blog, registros de cambios, actualizaciones de noticias o cualquier otra página web con fechas. Esto garantiza que Fin y Copilot siempre usen la información más actualizada y relevante de estas fuentes.
Nota: Esta función funciona solo con URL públicas. Si el contenido que quieres usar está detrás de un inicio de sesión, Fin no podrá acceder ni importarlo.
Sincronizar contenido del sitio web con Fin y Copilot
Ve a Fin AI Agent > Train > Content, luego selecciona Website sync en “Add content.”
Ahora ingresa la URL de tu contenido de soporte externo (top-level domain) y haz clic en Siguiente:
Esto obtendrá todas las páginas desde la URL del sitio web que proporciones y leerá todas las páginas de sub domain.
Consejo: Los dominios de nivel superior ofrecen los mejores resultados (p. ej., usa la URL de la página principal de tu external help center https://myhelpcenter.com en lugar de subpáginas https://myhelpcenter.com/articles).
Nota: La sincronización de sitios web tiene un máximo de 100 sitios web.
Revisar páginas para sincronizar
Una vez que ingreses tu URL, verificaremos que sea válida y accesible. Luego tendrás que revisar las páginas para sincronizar. Todas las subpáginas vinculadas en cada sección seleccionada se sincronizarán. Selecciona solo contenido relevante y actualizado.
Consejos:
Selecciona páginas y secciones que contengan contenido de soporte como artículos de ayuda, guías o FAQS.
Evita seleccionar páginas de marketing, listados de productos o páginas con diseños complejos.
Todas las subpáginas vinculadas dentro de las secciones seleccionadas se incluirán automáticamente.
Siempre puedes actualizar tu selección más adelante en la configuración avanzada.
Configuración avanzada [optional]
Selecciona el Advanced settings dropdown para configurar URLs adicionales, excluir URLs, selectores CSS para excluir y más.
URLs adicionales
Las estructuras de los sitios web pueden variar. Para asegurarnos de sincronizar tu contenido más relevante, recomendamos que agregues URLs adicionales para esas subpáginas específicas.
Por ejemplo, si ingresas https://myhelpcenter.com/help como la URL principal arriba, también podrías querer agregar la URL específica como https://myhelpcenter.com/help/index.html
URLs para excluir
Para excluir ciertas páginas de las que no deseas sincronizar contenido, puedes agregar una lista de URL globs.
¿Qué es un URL glob?
Un glob es una cadena de caracteres literales y/o comodines usada para coincidir rutas de archivos o URLs. Globbing es el acto de localizar archivos en un sistema de archivos usando uno o más globs. Usar URL globs también ayuda a obtener un rango de URLs que son mayormente iguales, con solo una pequeña porción que cambia entre las solicitudes.
Por ejemplo, este URL glob https://{store,docs}.example.com/** permite que el rastreador acceda a todas las URLs que comienzan con https://store.example.com/ o https://docs.example.com/ y https://example.com/**/*\?*foo=*
Consejo: ¿No estás seguro de si tu patrón glob coincidirá con las URLs que deseas excluir? Puedes usar DigitalOcean's Glob Tool para probar patrones contra URLs de ejemplo antes de aplicarlos. (Esta es una herramienta de terceros que no es mantenida por Intercom.)
Selectores CSS para excluir
Para excluir ciertos elementos de la página, puedes usar selectores CSS de esas secciones o elementos específicos que deseas excluir.
Esto es útil para omitir contenido irrelevante de la página. El valor debe ser un selector CSS válido aceptado por la función document.querySelectorAll(). Por defecto, ya eliminamos elementos comunes de navegación, encabezados, pies de página, modales, scripts e imágenes en línea.
Selector CSS clicable
Esto permite que los elementos DOM identificados por el selector CSS sean clicados durante el proceso de sincronización web.
Esto es útil para expandir secciones colapsadas, con el fin de capturar su contenido de texto. El valor debe ser un selector CSS válido aceptado por la función document.querySelectorAll().
Los ejemplos son "[aria-expanded=\"false\"]", #expand_section
También se pueden describir condiciones complejas con un selector CSS. En CSS, encadenar selectores sin espacios crea una condición similar a AND; por ejemplo .button.blue.small coincidirá solo con elementos que tengan las tres clases.
Usar coma (,) como separador funciona como OR; por ejemplo .button, .blue, h1 apunta a todos los elementos con clase button, o clase blue, o encabezados de primer nivel.
Esperar a cargar selector CSS
Para dirigir contenido que pueda tardar en aparecer en la página, puedes agregar un selector CSS que haga que el rastreador web espere antes de raspar el contenido.
Esto es útil para páginas en las que el reconocimiento predeterminado de carga de contenido por inactividad de la red falla. Establecer esta opción desactiva por completo el comportamiento predeterminado, y la página se procesará solo si aparece el elemento especificado por este selector.
Nota: El valor debe ser un selector CSS válido aceptado por la función document.querySelectorAll().
XML Sitemap
Habilita XML Sitemap para una sincronización web más sólida en sitios compatibles con sitemap, permitiendo el acceso a páginas que podrían no ser alcanzables desde las URLs iniciales.
Si esta opción está habilitada, el rastreador web buscará Sitemaps en los dominios de la URL de origen proporcionada y encolará URLs coincidentes de manera similar a los enlaces encontrados en las páginas rastreadas. También puedes hacer referencia directamente a un archivo sitemap.xml agregándolo como otra URL de inicio, p. ej. https://www.example.com/sitemap.xml.
Región del proxy
Puedes seleccionar un proxy para que el rastreador lo use si necesitas que tu sitio web sea rastreado con un proxy configurado en una región o país específico.
Actualmente admitimos los siguientes proxies:
Rotating: United States, Germany, France, United Kingdom, Czechia, Hungary
Static:
United States - 119.13.211.225, 161.123.167.215, 94.176.49.232, 185.223.56.90, 154.17.143.135
Europa - 178.171.116.231, 206.232.77.243, 206.232.90.11, 209.20.175.180, 45.94.247.149
Australia - 154.220.151.84, 173.254.193.121, 160.224.101.213, 160.224.100.176, 212.70.22.41
Tipo de rastreador
Elija con qué exhaustividad el rastreador renderiza cada página mientras sincroniza este sitio web.
Páginas que se sincronizan vacías o truncadas suelen significar renderizado por JavaScript. Cambie a Full y vuelva a sincronizar.
Full es más pesado, por lo que es más probable que ponga una fuente grande en un horario reducido.
Puede cambiar esto en una fuente existente y volver a sincronizar para comparar.
Opción | Qué hace | Úselo cuando |
Rápido | Lee HTML sin ejecutar JavaScript. | El contenido está en el HTML inicial — la mayoría de blogs, documentación, help center. |
Auto (predeterminado) | Nosotros elegimos, y cambiamos a Full si el sitio necesita JavaScript. | No está seguro. Adecuado para casi todos. |
Full | Carga cada página en un navegador y ejecuta JavaScript. Más lento. | El contenido solo aparece después de que se ejecutan los scripts, aplicaciones de una sola página páginas pesadas en JavaScript. |
Ignorar URLs canónicas
Cuando está activado, el scraper web ignora las etiquetas de enlace canonical (rel="canonical") y trata cada URL como una página distinta. Esta opción está desactivada por defecto.
Esto es útil cuando un sitio apunta muchas páginas a una URL canonical y como resultado se pierde contenido.
Exclusión de parámetros de consulta y respeto a robots.txt
Hay dos alternancias más bajo Advanced settings. Ambas están desactivadas por defecto.
Respect robots.txt: hace que el rastreador obedezca las reglas de disallow en el robots.txt de su sitio. Actívelo para mantener la sincronización consistente con lo que permite que otros rastreadores alcancen. Si robots.txt prohíbe rutas que contienen contenido que desea en Fin, esto reducirá lo que se sincroniza.
Exclude query parameters: omite cualquier URL con una cadena de consulta (?). Actívelo cuando su sitio añade parámetros de seguimiento, sesión o ordenación que producen muchas páginas casi duplicadas. Déjelo desactivado si contenido real vive detrás de una cadena de consulta, como /docs?page=intro — esas páginas también se omitirían.
Audiencias objetivo
El paso Target le permite establecer una audiencia predeterminada para todas las páginas sincronizadas y crear reglas basadas en URL para asignar audiencias específicas automáticamente según patrones de URL — sin etiquetado manual.
Primero decida si el contenido de esta fuente está habilitado para Fin AI Agent y/o Copilot.
Luego puede establecer una audiencia Fin predeterminada que se aplicará a todas las páginas sincronizadas desde esta fuente (si no se establece una predeterminada, el contenido por defecto será Everyone), o crear reglas para asignar audiencias específicas según patrones de URL.
Por ejemplo: Si la URL contiene /uk, asigne la audiencia UK. Las reglas se evalúan durante la sincronización, por lo que Fin y Copilot siempre sirven el contenido correcto a la audiencia adecuada.
Cada regla admite tres comparadores de URL:
Comienza con — coincide con URLs que empiezan con un prefijo dado.
Termina con — coincide con URLs que terminan con un sufijo dado.
Contiene — coincide con URLs que contienen una subcadena dada.
Nota:
Una vista previa en vivo muestra cuántas páginas coinciden con cada regla, ayudándole a validar las reglas antes de guardar. Esto requiere que un sitemap esté disponible para su fuente de sincronización web. Sin un sitemap, las reglas aún se aplican pero no puede previsualizar coincidencias.
Las reglas se nombran automáticamente al crearlas pero se pueden renombrar. Se aplica un máximo de 10 reglas por fuente de sincronización web.
Las reglas de audiencia son solo aditivas: añaden audiencias al contenido pero nunca eliminan asignaciones existentes. Eliminar una regla no deshace sus asignaciones de audiencia pasadas.
Revisar configuración de sincronización
Por último, revise su configuración de sincronización y haga clic en Sync website para comenzar a sincronizar el contenido de su sitio web con Intercom.
Administrar sincronizaciones de sitios web
Una vez que la sincronización esté completa, recibirá una notificación por correo electrónico y el sitio web aparecerá como una fuente sincronizada bajo Fin AI Agent > Train > Content.
Configurar ajustes para páginas específicas
Vaya a Fin AI Agent > Train > Content seleccione la fuente del sitio web, luego haga clic en una página que haya sincronizado. Encontrará un panel "Detalles" a la derecha que contiene:
Datos: Vea el tipo de contenido, idioma, fecha de creación y última actualización (cuando se sincronizó por última vez con la fuente).
Fin settings: Para habilitar/deshabilitar para Fin AI Agent y Copilot. Cuando están habilitados, el contenido se vuelve accesible para los clientes a través de Fin AI Agent y para los compañeros de equipo vía Copilot, respectivamente.
Enlace: La URL pública para esta fuente del sitio web.
Informes: Las conversaciones de Fin en las que esta fuente del sitio web ha estado involucrada o resuelta.
Etiquetas: Para aplicar sus propias etiquetas personalizadas para agrupar y organizar contenido en Intercom.
Carpeta: La carpeta donde vive esta URL pública en el Knowledge Hub. No puedes cambiar la carpeta del contenido sincronizado.
Nota: Las fuentes de sitios web son de solo lectura y no se pueden editar dentro de Intercom; deben editarse en la fuente.
Hazla disponible para Fin y Copilot
Para poner una fuente web a disposición de Fin AI Agent y/o Copilot, ve a Fin AI Agent > Train > Content y selecciona la fuente web, luego haz clic en la(s) página(s) en vivo que sincronizaste y selecciona Cambiar estado del agente de IA > Habilitar para AI Agent o Cambiar estado de Copilot > Habilitar para Copilot.
También puedes administrar estos ajustes desde una página web individual en el panel Details; desplázate hacia abajo hasta las configuraciones de Fin y elige si activar:
Fin AI Agent - Esta configuración hará que la URL pública esté disponible para que Fin la use al responder a los clientes.
Copilot - Esta configuración hará que la URL pública esté disponible para que Copilot la use al responder preguntas de compañeros en la inbox a través del panel de Copilot.
Aprende cómo configurar Fin AI Agent para tus clientes o habilitar a tu equipo para usar Copilot en la inbox.
Hazla disponible para una audiencia específica
Puedes asignar audiencias al contenido sincronizado automáticamente usando reglas basadas en URL durante la creación de la sincronización web, o manualmente por página. Primero, necesitarás crear y definir la audiencia que quieres dirigir.
Para asignar una audiencia manualmente a páginas individuales, ve a Fin AI Agent > Train > Content y selecciona la fuente, luego haz clic en la(s) página(s) en vivo que sincronizaste y selecciona Más acciones > Cambiar audiencia de Fin.
Nota:
La audiencia predeterminada para las URL públicas es “Everyone”.
Fin respetará cualquier audiencia que apliques a una URL pública y solo usará este artículo para responder preguntas de clientes si coinciden con las reglas de audiencia.
Agregar o editar reglas de audiencia en sincronizaciones existentes
No necesitas recrear una sincronización para agregar segmentación de audiencia. Ve a Fin AI Agent > Train > Content, selecciona la fuente, haz clic en el menú de ajustes en la esquina superior derecha y selecciona Abrir ajustes. Navega al paso Target para agregar o editar reglas basadas en URL.
Nota: Cuando se agregan reglas de audiencia a una sincronización web existente, se aplican retroactivamente a todo el contenido ya ingestado desde esa fuente —no solo al contenido nuevo que venga después.
Volver a sincronizar o eliminar un sitio web como fuente
Si deseas volver a sincronizar o eliminar una URL pública como fuente, ve a Fin AI Agent > Train > Content y selecciona la fuente. Luego haz clic en el menú de ajustes en la esquina superior derecha y selecciona Re-sincronizar o Eliminar esta fuente.
Consejo: Las re-sincronizaciones de sitios web generalmente ocurren semanalmente (dependiendo del tamaño de la fuente) y se pueden re-sincronizar manualmente en cualquier momento.
Administrar ajustes de sincronización del sitio web
Si deseas ajustar las configuraciones avanzadas para una sincronización de sitio web, ve a Fin AI Agent > Train > Content y selecciona la fuente. Luego haz clic en el menú de ajustes en la esquina superior derecha y selecciona Abrir ajustes.
Ver historial de sincronización del sitio web
Puedes ver una lista de sincronizaciones pasadas para ver cuándo se ejecutaron por última vez, qué páginas se encontraron y las páginas fallidas. Ve a Fin AI Agent > Train > Content y selecciona la fuente del sitio web, luego haz clic en el menú de ajustes en la esquina superior derecha y selecciona Ver historial de sincronización.
Cada fila de la tabla representa una ejecución pasada o activa, y puedes filtrar las ejecuciones por estado. Incluye la siguiente información:
Fecha de sincronización
Estado
Páginas sincronizadas
Páginas excluidas
Páginas fallidas
Duración
Sincronización iniciada por
Si una sincronización ha fallado, puedes pasar el cursor sobre el estado para ver una explicación detallada del porqué.
Las sincronizaciones automáticas se pausan cuando Fin no está usando un sitio web
Una nueva fuente se sincroniza según el calendario durante sus primeros 90 días sin falta. Después de eso, sigue sincronizándose automáticamente si se cumple alguna de las siguientes condiciones:
Una página de ella se usó en una respuesta de Fin en los últimos 90 días.
De lo contrario, las sincronizaciones programadas se pausan.
Cuando está pausado: las páginas permanecen en tu Knowledge Hub y siguen estando disponibles para Fin y Copilot (nada se elimina). Solo se detiene la reexploración, por lo que las ediciones en tu sitio no se captarán.
Para restaurarlo: El botón Sync now actualiza el contenido una vez pero no reinicia el calendario. La sincronización automática se reanuda por sí sola una vez que Fin usa la fuente de nuevo.
Los sitios web que son costosos de rastrear se sincronizan con menos frecuencia
Los sitios muy grandes y los sitios que requieren renderizado completo de JavaScript cuestan mucho más rastrear. Cuando una fuente resulta ser intensiva en recursos, la movemos de una programación semanal a una cada 14 días.
Esto ocurre automáticamente, por fuente. Para mantener un sitio grande en un calendario más rápido, reduce el rastreo usando exclusiones de URL, o agrega subpáginas específicas en lugar de todo un domain.
Solución de problemas de sincronización del sitio web
Problemas comunes
Al importar contenido del sitio web para habilitar a Fin, necesitas ingresar la URL pública. Esto buscará todas las páginas anidadas bajo esa URL y las sincronizará para que Fin AI Agent las use.
Si el importador no devolvió el número de páginas que esperabas, hay varias razones...
La URL proporcionada no es el domain de nivel superior
La sincronización del sitio web funciona yendo a la URL que proporciones y luego buscando todas las páginas anidadas bajo esa URL. Estas páginas deben tener el mismo patrón de URL que la URL que proporciones.
Por ejemplo, si el dominio de nivel superior es https://myhelpcenter.com/home, entonces todas las páginas que quieras importar deben incluir el prefijo /home en la URL, p. ej. https://myhelpcenter.com/home/article. Si no lo hacen, elimina el prefijo y usa el tallo de URL más básico, p. ej. https://myhelpcenter.com, luego intenta la importación nuevamente.
La URL es privada
Si el contenido que deseas usar está detrás de un inicio de sesión, Fin no podrá acceder ni importarlo.
Límites de páginas
La sincronización del sitio web tiene dos límites:
Domains: puedes sincronizar hasta 100 dominios de nivel superior diferentes.
Pages per source: Fin sincroniza un máximo de 4.000 páginas de cada fuente.
Una sincronización también puede fallar si una sola página contiene una cantidad muy grande de contenido. Recibirás una notificación por correo electrónico cada vez que falle una sincronización.
Nota:
Si una fuente tiene más de 4.000 páginas, divídela en varias fuentes para que cada una permanezca por debajo del límite:
Divide el sitio en secciones más pequeñas y agrega cada sección como su propia fuente.
Sincroniza rutas URL diferentes por separado; por ejemplo, una fuente por área de producto o categoría.
Esto mantiene cada fuente por debajo del límite de páginas y reduce el contenido procesado por sincronización.
Sitios web restringidos a IPs regionales específicas
La sincronización de sitios web de Intercom (usada para agregar URL públicas para Fin AI Agent y Copilot) no utiliza actualmente una cadena user-agent dedicada y personalizada.
Para identificar o permitir estas solicitudes:
By IP address: Nuestro rastreador normalmente usa IP dinámicas. Si tu sitio requiere allowlisting, contáctanos y podemos habilitar IPs estáticas específicas por región para tu espacio de trabajo.
Estas solicitudes se usan solo para la sincronización de sitios web. No afectan tu tráfico de Messenger ni el seguimiento de usuarios finales.
Las páginas de sitios internacionales o no ingleses no se sincronizan
Si tu sitemap incluye URLs con caracteres no ASCII (como letras acentuadas o escrituras como chino o árabe), algunas de esas páginas pueden no sincronizarse como se espera. El descubrimiento del sitemap ahora admite estas URLs, pero aún pueden tener problemas en otras partes del proceso de sincronización. Intenta volver a sincronizar manualmente para resolverlo. Si las páginas siguen faltando, contacta al support.
Errores de sincronización del sitio web
Cuando sincronizas contenido, puedes ver diferentes estados que indican lo que ocurrió durante el proceso. Para ver el estado de sincronización de tu sitio web ve a Fin AI Agent > Train > Content y selecciona la fuente del sitio web, luego usa el desplegable Status para filtrar por:
Sincronizando
En vivo
Fallado
Excluido
Esto es lo que significa cada uno y qué puedes hacer a continuación:
Sincronizando
La sincronización de páginas aún está en progreso. Una sincronización inicial puede tardar desde unos minutos hasta más de una hora según la cantidad de contenido que tengas.
En vivo
La página se sincronizó correctamente y puede habilitarse para Fin y Copilot.
Nota: Una sincronización exitosa no siempre significa que pudimos extraer todo el contenido de la página. Si quieres confirmar la cobertura completa, recomendamos previsualizar Fin con respuestas que esperas encontrar en esa página.
Excluido
Estas páginas no se sincronizan intencionalmente porque las excluiste en tu configuración de sincronización. No se pueden reintentar ni incluir a menos que se especifique lo contrario.
Fallado
Estos errores significan que la sincronización no se completó y pueden requerir cambios de tu parte antes de reintentar:
1. Unknown error
Message: “This page couldn't be accessed. It may be slow or blocked. Try syncing again, or contact support if it fails.”
What it means: Algo impidió que accediéramos a la página, pero la causa no está clara.
2. Session blocked / Rate limited
Message: “The website is preventing us from accessing its content. Check if it's being blocked by an anti-crawler setting or firewall. Check your site configuration and try syncing again. If the issue persists, contact support.”
What it means: Tu sitio está bloqueando o limitando activamente nuestro rastreador.
3. Network, timeout, or similar errors
Message: “This page couldn't be accessed. It may be slow to load or blocked by anti-crawler settings or a firewall. Check your site configuration and try syncing again. If the issue persists, contact support.
What it means: La página no se cargó a tiempo o no se pudo alcanzar debido a problemas de red o bloqueo.
What to do: Un error de "Navigation timeout" a menudo es causado por protección contra bots o software de seguridad en tu sitio que bloquea el rastreador de Intercom. Para resolver esto, permite en la lista blanca las static proxy IP addresses que figuran en la sección de Configuración avanzada arriba, luego selecciona la región de proxy correspondiente bajo Advanced settings al crear o editar tu sincronización de sitio web, y vuelve a intentar la sincronización.
4. Duplicate
Message: “This page has the same content as another that's already synced. Only one version will be included.”
What it means: Detectamos contenido idéntico en otro lugar, por lo que solo se conserva una copia.
5. Keyword filtering
Message: “Pages with keywords like category, collection, or tag in the URL are excluded by default, as they usually don't contain unique content. If this page should be included, contact support.”
What it means: Estas URLs suelen representar listas, no páginas de contenido independientes.
6. Código de estado 400
Mensaje: “No se puede encontrar el contenido de la página. Verifica que la URL sea válida y que la página cargue sin problemas.”
Qué significa: La URL puede estar rota o devolver un error en tu sitio web.
7. URL bloqueada
Mensaje: “This website domain is blocked from being synced. If you require this, contact support.”
Qué significa: El domain está excluido intencionalmente de la sincronización.
Puedes reintentar una sincronización de página fallida pasando el cursor sobre la página, seleccionando el menú de tres puntos y luego Resync.
Nota: Website Sync no admite importar archivos Markdown sin procesar. Para un formato correcto y la detección de título, debes proporcionar el contenido como HTML renderizado o subirlo como fragmento/archivo. La estructura Markdown (p. ej., # encabezados) no se reconocerá a menos que se convierta a HTML.























