Wenn Sie Website-Inhalte in Intercom hinzufügen und dem Fin AI Agent und Copilot zur Verfügung stellen möchten, können Sie dies tun, indem Sie die öffentliche URL Ihrer Seite synchronisieren. Sie können Fin und Copilot auch mit Inhalten aus Blogbeiträgen, Changelogs, News-Updates oder anderen Webseiten mit Datumsangaben trainieren. So stellen Fin und Copilot sicher, dass sie stets die aktuellsten und relevantesten Informationen aus diesen Quellen verwenden.
Hinweis: Diese Funktion funktioniert nur mit öffentlichen URLs. Wenn die Inhalte, die Sie verwenden möchten, hinter einer Anmeldung liegen, kann Fin nicht darauf zugreifen oder sie importieren.
Website-Inhalte mit Fin und Copilot synchronisieren
Gehen Sie zu Fin AI Agent > Train > Content und wählen Sie dann unter „Add content“ Website sync aus.
Geben Sie nun die URL Ihrer externen Support-Inhalte (Top-Level domain) ein und klicken Sie auf Next:
Dies ruft alle Seiten von der von Ihnen angegebenen Website-URL ab und liest alle Seiten der Subdomain.
Tipp: Top-Level-Domains liefern die besten Ergebnisse (z. B. verwenden Sie die Homepage-URL Ihres externen help center https://myhelpcenter.com anstatt Unterseiten https://myhelpcenter.com/articles).
Hinweis: Die Website-Synchronisierung ist auf maximal 100 Websites begrenzt.
Seiten zum Synchronisieren überprüfen
Sobald Sie Ihre URL eingegeben haben, prüfen wir, ob sie gültig und zugänglich ist. Danach müssen Sie die Seiten auswählen, die synchronisiert werden sollen. Alle Unterseiten, die in jedem ausgewählten Abschnitt verlinkt sind, werden synchronisiert. Wählen Sie nur relevante und aktuelle Inhalte aus.
Tipps:
Wählen Sie Seiten und Abschnitte aus, die Support-Inhalte wie Hilfartikel, Anleitungen oder FAQs enthalten.
Vermeiden Sie die Auswahl von Marketingseiten, Produktlisten oder Seiten mit komplexen Layouts.
Alle verlinkten Unterseiten innerhalb ausgewählter Abschnitte werden automatisch eingeschlossen.
Sie können Ihre Auswahl später jederzeit in den erweiterten Einstellungen aktualisieren.
Erweiterte Einstellungen [optional]
Wählen Sie das Dropdown Advanced settings aus, um zusätzliche URLs, auszuschließende URLs, CSS-Selektoren zum Ausschließen und mehr zu konfigurieren.
Zusätzliche URLs
Website-Strukturen können variieren. Um sicherzustellen, dass wir Ihre relevantesten Inhalte synchronisieren, empfehlen wir, zusätzliche URLs für bestimmte Unterseiten hinzuzufügen.
Wenn Sie beispielsweise https://myhelpcenter.com/help oben als primäre URL eingeben, möchten Sie möglicherweise auch die spezifische URL wie https://myhelpcenter.com/help/index.html hinzufügen.
Zu ausschließende URLs
Um bestimmte Seiten auszuschließen, von denen Sie keine Inhalte synchronisieren möchten, können Sie eine Liste von URL-Globs hinzufügen.
Was ist ein URL-Glob?
Ein Glob ist eine Zeichenfolge aus Literal- und/oder Platzhalterzeichen, die verwendet wird, um Dateipfade oder URLs abzugleichen. Globbing ist der Vorgang, Dateien in einem Dateisystem mithilfe eines oder mehrerer Globs zu finden. Die Verwendung von URL-Globs hilft auch dabei, eine Reihe von URLs zu erhalten, die größtenteils gleich sind, wobei nur ein kleiner Teil zwischen den Anfragen variiert.
Beispielsweise lässt dieses URL-Glob https://{store,docs}.example.com/** den Crawler alle URLs zugreifen, die mit https://store.example.com/ oder https://docs.example.com/ beginnen, und https://example.com/**/*\?*foo=*
Tipp: Unsicher, ob Ihr Glob-Muster die URLs trifft, die Sie ausschließen möchten? Sie können DigitalOcean's Glob Tool verwenden, um Muster vor dem Anwenden an Beispieldaten zu testen. (Dies ist ein Drittanbieter-Tool, das nicht von Intercom gewartet wird.)
Auszuschließende CSS-Selektoren
Um bestimmte Seitenelemente auszuschließen, können Sie CSS-Selektoren dieser speziellen Abschnitte oder Elemente verwenden, die Sie ausschließen möchten.
Dies ist nützlich, um irrelevante Seiteninhalte zu überspringen. Der Wert muss ein gültiger CSS-Selektor sein, wie er von der document.querySelectorAll()-Funktion akzeptiert wird. Standardmäßig entfernen wir bereits gängige Navigationselemente, Header, Footer, Modale, Skripte und eingebettete Bilder.
Klickbarer CSS-Selektor
Dadurch können DOM-Elemente, die durch den CSS-Selektor identifiziert werden, während des Web-Synchronisierungsprozesses angeklickt werden.
Dies ist nützlich, um zusammengeklappte Abschnitte zu erweitern, um deren Textinhalt zu erfassen. Der Wert muss ein gültiger CSS-Selektor sein, wie er von der document.querySelectorAll() Funktion akzeptiert wird.
Beispiele sind "[aria-expanded=\"false\"]", #expand_section
Komplexe Bedingungen können auch mit einem CSS-Selektor beschrieben werden. In CSS erzeugt das Aneinanderreihen von Selektoren ohne Leerzeichen eine UND-ähnliche Bedingung, zum Beispiel wird .button.blue.small nur Elemente mit allen drei Klassen abgleichen.
Die Verwendung eines Kommas (,) als Trennzeichen funktioniert wie ODER, zum Beispiel zielt .button, .blue, h1 auf alle Elemente mit der Klasse button, oder der Klasse blue, oder Überschriften der ersten Ebene ab.
Warten, bis CSS-Selektor geladen ist
Um Inhalte anzusprechen, die möglicherweise verzögert auf der Seite erscheinen, können Sie einen CSS-Selektor hinzufügen, der den Web-Scraper vor dem Scrapen warten lässt.
Dies ist nützlich für Seiten, bei denen die standardmäßige Erkennung des Inhaltsladens durch Leerlauf des Netzwerks versagt. Wenn Sie diese Option festlegen, wird das Standardverhalten vollständig deaktiviert und die Seite wird nur verarbeitet, wenn das durch diesen Selektor angegebene Element erscheint.
Hinweis: Der Wert muss ein gültiger CSS-Selektor sein, wie er von der document.querySelectorAll() Funktion akzeptiert wird.
XML-Sitemap
Aktivieren Sie die XML-Sitemap für eine robustere Web-Synchronisierung auf Websites, die Sitemaps unterstützen, sodass auf Seiten zugegriffen werden kann, die vom initialen URLs aus möglicherweise nicht erreichbar sind.
Wenn diese Option aktiviert ist, sucht der Web-Scraper nach Sitemaps in den Domains der angegebenen Quell-URL und reiht passende URLs ähnlich wie die auf gecrawlten Seiten gefundenen Links ein. Sie können auch direkt auf eine sitemap.xml-Datei verweisen, indem Sie sie als weitere Start-URL hinzufügen, z. B. https://www.example.com/sitemap.xml.
Proxy-Region
Sie können einen Proxy auswählen, den der Crawler verwenden soll, wenn Ihre Website mit einem Proxy aus einer bestimmten Region oder einem bestimmten Land gecrawlt werden soll.
Wir unterstützen derzeit die folgenden Proxys:
Rotierend: United States, Germany, France, United Kingdom, Czechia, Hungary
Statisch:
United States - 119.13.211.225, 161.123.167.215, 94.176.49.232, 185.223.56.90, 154.17.143.135
Europa - 178.171.116.231, 206.232.77.243, 206.232.90.11, 209.20.175.180, 45.94.247.149
Australien - 154.220.151.84, 173.254.193.121, 160.224.101.213, 160.224.100.176, 212.70.22.41
Crawler-Typ
Wählen Sie, wie gründlich der Crawler jede Seite rendert, während diese Website synchronisiert wird.
Wenn Seiten beim Sync leer oder abgeschnitten erscheinen, liegt das meist am JavaScript-Rendering. Wechseln Sie zu Full und synchronisieren Sie erneut.
Full ist ressourcenintensiver und führt daher eher dazu, dass eine große Quelle seltener geplant wird.
Sie können dies bei einer vorhandenen Quelle ändern und zum Vergleich erneut synchronisieren.
Option | Was es bewirkt | Wann verwenden |
Schnell | Liest HTML ohne Ausführen von JavaScript. | Der Inhalt steht im initialen HTML — die meisten Blogs, Docs, help center. |
Auto (Standard) | Wir wählen und wechseln zu Full, wenn die Seite JavaScript benötigt. | Sie sind unsicher. Für nahezu alle geeignet. |
Full | Lädt jede Seite in einem Browser und führt JavaScript aus. Langsamer. | Inhalte erscheinen erst, nachdem Skripte ausgeführt wurden, Single-Page-Apps und JavaScript-lastige Seiten. |
Kanonische URLs ignorieren
Wenn aktiviert, ignoriert der Web-Scraper canonical-Link-Tags (rel="canonical") und behandelt jede URL als eigene Seite. Diese Option ist standardmäßig deaktiviert.
Das ist nützlich, wenn eine Site viele Seiten auf eine kanonische URL verweist und Inhalte dadurch übersehen werden.
Abfrageparameter ausschließen und robots.txt beachten
Unter Advanced settings gibt es zwei weitere Umschalter. Beide sind standardmäßig ausgeschaltet.
Respect robots.txt: lässt den Crawler die Disallow-Regeln in der robots.txt Ihrer Site beachten. Schalten Sie es ein, um die Synchronisierung mit dem, was Sie anderen Crawlern erlauben, konsistent zu halten. Wenn robots.txt Pfade verbietet, die Inhalte enthalten, die Sie in Fin haben möchten, reduziert dies, was synchronisiert wird.
Exclude query parameters: überspringt jede URL mit einer Query-String (?). Schalten Sie es ein, wenn Ihre Site Tracking-, Session- oder Sortierparameter anhängt, die viele nahezu doppelte Seiten erzeugen. Lassen Sie es aus, wenn echter Inhalt hinter einem Query-String steht, wie /docs?page=intro — diese Seiten würden sonst ebenfalls übersprungen.
Zielgruppen
Der Target-Schritt ermöglicht es Ihnen, eine Standard-Zielgruppe für alle synchronisierten Seiten festzulegen und URL-basierte Regeln zu erstellen, um automatisch bestimmte Zielgruppen basierend auf URL-Mustern zuzuweisen — keine manuelle Kennzeichnung erforderlich.
Entscheiden Sie zuerst, ob Inhalte aus dieser Quelle für Fin AI Agent und/oder Copilot aktiviert sind.
Dann können Sie entweder eine Standard-Fin-Zielgruppe festlegen, die auf alle von dieser Quelle synchronisierten Seiten angewendet wird (wenn keine Standard festgelegt ist, wird der Inhalt standardmäßig auf Everyone gesetzt), oder Regeln erstellen, um bestimmte Zielgruppen basierend auf URL-Mustern zuzuweisen.
Beispiel: Wenn die URL /uk enthält, weise die UK-Zielgruppe zu. Regeln werden während des Sync ausgewertet, sodass Fin und Copilot stets den richtigen Inhalt an die richtige Zielgruppe liefern.
Jede Regel unterstützt drei URL-Vergleichsoperatoren:
Beginnt mit — entspricht URLs, die mit einem bestimmten Präfix beginnen.
Endet mit — entspricht URLs, die mit einem bestimmten Suffix enden.
Enthält — entspricht URLs, die eine bestimmte Teilzeichenfolge enthalten.
Hinweis:
Eine Live-Vorschau zeigt, wie viele Seiten mit jeder Regel übereinstimmen, und hilft Ihnen, Regeln vor dem Speichern zu validieren. Dafür wird eine Sitemap für Ihre Web-Sync-Quelle benötigt. Ohne Sitemap gelten die Regeln weiterhin, aber Sie können keine Übereinstimmungen in der Vorschau sehen.
Regeln werden bei Erstellung automatisch benannt, können aber umbenannt werden. Pro Web-Sync-Quelle gilt ein Maximum von 10 Regeln.
Audience-Regeln sind nur additiv: Sie fügen Inhalte Zielgruppen hinzu, entfernen aber niemals bestehende Zuordnungen. Das Entfernen einer Regel macht vergangene Zuordnungen nicht rückgängig.
Synchronisierungseinstellungen überprüfen
Überprüfen Sie schließlich Ihre Synchronisierungseinstellungen und klicken Sie dann auf Sync website , um mit der Synchronisierung Ihrer Website-Inhalte mit Intercom zu beginnen.
Website-Syncs verwalten
Sobald die Synchronisierung abgeschlossen ist, erhalten Sie eine E-Mail-Benachrichtigung und die Website wird als synchronisierte Quelle unter Fin AI Agent > Train > Content angezeigt.
Einstellungen für bestimmte Seiten konfigurieren
Gehen Sie zu Fin AI Agent > Train > Content, wählen Sie die Website-Quelle und klicken Sie dann auf eine synchronisierte Seite. Auf der rechten Seite finden Sie ein "Details"-Panel mit:
Daten: Sehen Sie den Inhaltstyp, die Sprache, das Erstellungsdatum und das letzte Update (wann es zuletzt mit der Quelle synchronisiert wurde).
Fin settings: Zum Aktivieren/Deaktivieren für Fin AI Agent und Copilot. Wenn aktiviert, werden die Inhalte Kunden über Fin AI Agent und Teammitgliedern über Copilot zur Verfügung gestellt.
Link: Die öffentliche URL für diese Website-Quelle.
Berichte: Die Fin-Konversationen, an denen diese Website-Quelle beteiligt war oder die gelöst wurden.
Tags: Um eigene benutzerdefinierte Tags zur Gruppierung und Organisation von Inhalten in Intercom anzuwenden.
Ordner: Der Ordner, in dem diese öffentliche URL im Knowledge Hub gespeichert ist. Sie können den Ordner synchronisierter Inhalte nicht ändern.
Hinweis: Website-Quellen sind schreibgeschützt und können nicht innerhalb von Intercom bearbeitet werden, sie müssen an der Quelle bearbeitet werden.
Make it available to Fin and Copilot
Um eine Website-Quelle für Fin AI Agent und/oder Copilot verfügbar zu machen, gehen Sie zu Fin AI Agent > Train > Content, wählen Sie die Website-Quelle aus, klicken Sie dann auf die von Ihnen synchronisierte(n) Live-Seite(n) und wählen Sie Change AI Agent state > Enable for AI Agent oder Change Copilot state > Enable for Copilot.
Sie können diese Einstellungen auch von einer einzelnen Webseite im "Details" Bereich verwalten. Scrollen Sie zu den Fin Einstellungen und wählen Sie, ob Sie umschalten möchten:
Fin AI Agent - Diese Einstellung macht die öffentliche URL für Fin verfügbar, wenn es auf Kundenanfragen antwortet.
Copilot - Diese Einstellung macht die öffentliche URL für Copilot verfügbar, damit Copilot Fragen von Teammitgliedern im inbox über das Copilot-Fenster beantworten kann.
Erfahren Sie, wie Sie Fin AI Agent einrichten für Ihre Kunden oder Ihr Team beim Verwenden von Copilot in the inbox zu aktivieren.
Make it available to a specific audience
Sie können Zielgruppen synchronisierter Inhalte automatisch mit URL-basierten Regeln während der Erstellung der Web-Synchronisierung zuweisen oder manuell pro Seite. Zuerst müssen Sie die Zielgruppe erstellen und definieren, die Sie ansprechen möchten: create and define the audience.
Um eine Zielgruppe manuell einzelnen Seiten zuzuweisen, gehen Sie zu Fin AI Agent > Train > Content, wählen Sie die Website-Quelle aus, klicken Sie auf die von Ihnen synchronisierte(n) Live-Seite(n) und wählen Sie More actions > Change Fin audience.
Hinweis:
Die Standard-Zielgruppe für öffentliche URLs ist „Everyone“.
Fin wird jede auf eine öffentliche URL angewendete Zielgruppe respektieren und diesen Artikel nur zur Beantwortung von Kundenfragen verwenden, wenn sie den Zielgruppenkriterien entsprechen.
Zielgruppenregeln zu vorhandenen Synchronisierungen hinzufügen oder bearbeiten
Sie müssen eine Synchronisierung nicht neu erstellen, um Zielgruppen-Targeting hinzuzufügen. Gehen Sie zu Fin AI Agent > Train > Content, wählen Sie die Quelle aus, klicken Sie auf das Einstellungssymbol oben rechts und wählen Sie Open settings. Navigieren Sie zum Schritt Target, um URL-basierte Regeln hinzuzufügen oder zu bearbeiten.
Hinweis: Wenn Zielgruppenregeln zu einer bestehenden Web-Synchronisierung hinzugefügt werden, gelten sie rückwirkend für alle bereits aus dieser Quelle aufgenommenen Inhalte — nicht nur für neu hinzukommende Inhalte.
Website als Quelle erneut synchronisieren oder entfernen
Wenn Sie eine öffentliche URL als Quelle erneut synchronisieren oder entfernen möchten, gehen Sie zu Fin AI Agent > Train > Content und wählen Sie die Quelle. Klicken Sie dann auf das Einstellungssymbol oben rechts und wählen Sie Re-sync oder Remove this source.
Tipp: Website-Re-Synchronisierungen erfolgen in der Regel wöchentlich (abhängig von der Größe der Quelle) und können jederzeit manuell neu synchronisiert werden.
Website-Synchronisierungseinstellungen verwalten
Wenn Sie die erweiterten Einstellungen für eine Website-Synchronisierung anpassen möchten, gehen Sie zu Fin AI Agent > Train > Content und wählen Sie die Quelle. Klicken Sie dann auf das Einstellungssymbol oben rechts und wählen Sie Open settings.
Website-Synchronisierungsverlauf anzeigen
Sie können eine Liste vergangener Website-Synchronisierungen einsehen, um zu sehen, wann sie zuletzt ausgeführt wurden, welche Seiten gefunden wurden und welche Seiten fehlgeschlagen sind. Gehen Sie zu Fin AI Agent > Train > Content und wählen Sie die Website-Quelle aus, klicken Sie dann auf das Einstellungssymbol oben rechts und wählen Sie View sync history.
Jede Zeile in der Tabelle stellt einen vergangenen oder aktiven Lauf dar, und Sie können die Läufe nach Status filtern. Sie enthält folgende Informationen:
Synchronisierungsdatum
Status
Synchronisierte Seiten
Ausgeschlossene Seiten
Fehlgeschlagene Seiten
Dauer
Synchronisierung gestartet von
Wenn eine Synchronisierung fehlgeschlagen ist, können Sie mit der Maus über den Status fahren, um eine detaillierte Erklärung des Grundes zu sehen.
Automatische Synchronisierungen pausieren, wenn Fin eine Website nicht verwendet
Eine neue Quelle wird in den ersten 90 Tagen planmäßig synchronisiert. Danach wird sie automatisch weiter synchronisiert, wenn eine der folgenden Bedingungen erfüllt ist:
Eine Seite davon wurde in den letzten 90 Tagen in einer Fin-Antwort verwendet.
Andernfalls werden geplante Synchronisierungen pausiert.
Wenn pausiert: Seiten bleiben in Ihrem Knowledge Hub und bleiben Fin und Copilot verfügbar (nichts wird gelöscht). Nur das erneute Crawlen stoppt, sodass Änderungen auf Ihrer Website nicht übernommen werden.
Zum Wiederherstellen: Die Sync now-Schaltfläche aktualisiert den Inhalt einmal, startet den Zeitplan jedoch nicht neu. Die automatische Synchronisierung wird von selbst fortgesetzt, sobald Fin die Quelle wieder verwendet.
Websites, die schwer zu crawlen sind, werden seltener synchronisiert
Sehr große Sites und Sites, die vollständiges JavaScript-Rendering benötigen, kosten beim Crawlen deutlich mehr. Wenn sich eine Quelle als ressourcenintensiv herausstellt, verschieben wir sie von einem wöchentlichen auf einen alle 14 Tage Zeitplan.
Dies geschieht automatisch pro Quelle. Um eine große Site in einem schnelleren Zeitplan zu halten, begrenzen Sie den Crawl, indem Sie URL-Ausschlüsse verwenden oder fügen Sie bestimmte Unterseiten hinzu, anstatt eine ganze domain.
Fehlerbehebung bei Website-Synchronisierung
Häufige Probleme
Beim Importieren von Website-Inhalten, um Fin zu aktivieren, müssen Sie die public URL eingeben. Dadurch werden alle Seiten durchsucht, die unter dieser URL verschachtelt sind, und für Fin AI Agent synchronisiert.
Wenn der Importer nicht die erwartete Anzahl von Seiten zurückgegeben hat, gibt es mehrere Gründe...
Die angegebene URL ist nicht die oberste domain
Die Website-Synchronisierung funktioniert, indem die von Ihnen angegebene URL aufgerufen und dann alle darunter verschachtelten Seiten durchsucht werden. Diese Seiten müssen dasselbe URL-Muster wie die von Ihnen angegebene URL haben.
Zum Beispiel, wenn die oberste Domain https://myhelpcenter.com/home ist, müssen alle Seiten, die Sie importieren möchten, das Präfix /home in der URL enthalten, z. B. https://myhelpcenter.com/home/article. Wenn dies nicht der Fall ist, entfernen Sie das Präfix und verwenden Sie den grundlegendsten URL-Stamm, z. B. https://myhelpcenter.com, und versuchen Sie den Import erneut.
Die URL ist privat
Wenn der Inhalt, den Sie verwenden möchten, hinter einer Anmeldung liegt, kann Fin nicht darauf zugreifen oder ihn importieren.
Seitenlimits
Die Website-Synchronisierung hat zwei Beschränkungen:
Domains: Sie können bis zu 100 verschiedene Top-Level-Domains synchronisieren.
Pages per source: Fin synchronisiert maximal 4.000 Seiten pro Quelle.
Eine Synchronisierung kann auch fehlschlagen, wenn eine einzelne Seite eine sehr große Menge an Inhalten enthält. Sie werden per E-Mail benachrichtigt, wenn eine Synchronisierung fehlschlägt.
Hinweis:
Wenn eine Quelle mehr als 4.000 Seiten hat, teilen Sie sie in mehrere Quellen auf, damit jede unter dem Limit bleibt:
Partitionieren Sie die Website in kleinere Abschnitte und fügen Sie jeden Abschnitt als eigene Quelle hinzu.
Synchronisieren Sie verschiedene URL-Pfade separat, zum Beispiel jeweils eine Quelle pro Produktbereich oder Kategorie.
So bleibt jede Quelle unter dem Seitenlimit und die pro Synchronisierung verarbeiteten Inhalte werden reduziert.
Websites, die auf bestimmte regionale IPs beschränkt sind
Intercom’s Website-Synchronisierung (verwendet, um öffentliche URLs für Fin AI Agent und Copilot hinzuzufügen) verwendet derzeit keinen dedizierten, kundenspezifischen User-Agent-String.
Um diese Anfragen zu identifizieren oder zuzulassen:
By IP address: Unser Crawler verwendet normalerweise dynamische IPs. Wenn Ihre Site Allowlisting erfordert, kontaktieren Sie uns und wir können statische, regionsspezifische IPs für Ihren Workspace aktivieren.
Diese Anfragen werden nur für die Website-Synchronisierung verwendet. Sie beeinflussen nicht Ihren Messenger-Traffic oder das Endnutzer-Tracking.
Seiten von nicht-englischen oder internationalen Websites werden nicht synchronisiert
Wenn Ihre Sitemap URLs mit nicht-ASCII-Zeichen enthält (wie Akzentbuchstaben oder Schriften wie Chinesisch oder Arabisch), werden einige dieser Seiten möglicherweise nicht wie erwartet synchronisiert. Die Sitemap-Erkennung unterstützt diese URLs jetzt, aber sie können in anderen Teilen des Synchronisierungsprozesses weiterhin Probleme verursachen. Versuchen Sie, die Synchronisierung manuell erneut auszuführen, um das Problem zu beheben. Wenn Seiten weiterhin fehlen, kontaktieren Sie den Support.
Fehler bei der Website-Synchronisierung
Wenn Sie Inhalte synchronisieren, können verschiedene Status angezeigt werden, die zeigen, was während des Vorgangs passiert ist. Um den Status Ihrer Website-Synchronisierung zu sehen, gehen Sie zu Fin AI Agent > Train > Content und wählen Sie die Website-Quelle aus. Verwenden Sie dann das Status -Dropdown, um zu filtern nach:
Synchronisierung läuft
Live
Fehlgeschlagen
Ausgeschlossen
Das bedeutet jeder Status und was Sie als Nächstes tun können:
Synchronisierung läuft
Die Seitensynchronisierung ist noch im Gange. Eine erste Synchronisierung kann je nach Inhalt wenige Minuten bis über eine Stunde dauern.
Live
Die Seite wurde erfolgreich synchronisiert und kann für Fin und Copilot aktiviert werden.
Hinweis: Eine erfolgreiche Synchronisierung bedeutet nicht immer, dass wir alle Inhalte der Seite erfassen konnten. Wenn Sie die vollständige Abdeckung bestätigen möchten, empfehlen wir, Fin zu previewen mit Antworten, von denen Sie erwarten, dass sie auf dieser Seite gefunden werden.
Ausgeschlossen
Diese Seiten werden absichtlich nicht synchronisiert, weil Sie sie in Ihren Sync-Einstellungen ausgeschlossen haben. Sie sind nicht erneut versuchbar und können nicht aufgenommen werden, sofern nicht anders angegeben.
Fehlgeschlagen
Diese Fehler bedeuten, dass die Synchronisierung nicht abgeschlossen wurde und vor einem erneuten Versuch Änderungen auf Ihrer Seite erforderlich sein können:
1. Unbekannter Fehler
Message: „Diese Seite konnte nicht aufgerufen werden. Sie ist möglicherweise langsam oder blockiert. Versuchen Sie es erneut zu synchronisieren oder kontaktieren Sie den Support, wenn es fehlschlägt.“
What it means: Etwas hat uns daran gehindert, auf die Seite zuzugreifen, aber die Ursache ist unklar.
2. Sitzung blockiert / Rate limiting
Message: „Die Website verhindert, dass wir auf ihre Inhalte zugreifen. Prüfen Sie, ob sie durch eine Anti-Crawler-Einstellung oder Firewall blockiert wird. Überprüfen Sie Ihre Site-Konfiguration und versuchen Sie erneut zu synchronisieren. Wenn das Problem weiterhin besteht, kontaktieren Sie den Support.“
What it means: Ihre Site blockiert oder begrenzt unseren Crawler aktiv.
3. Netzwerk-, Timeout- oder ähnliche Fehler
Message: „Diese Seite konnte nicht aufgerufen werden. Sie ist möglicherweise langsam zu laden oder wird durch Anti-Crawler-Einstellungen oder eine Firewall blockiert. Überprüfen Sie Ihre Site-Konfiguration und versuchen Sie erneut zu synchronisieren. Wenn das Problem weiterhin besteht, kontaktieren Sie den Support.
What it means: Die Seite wurde nicht rechtzeitig geladen oder konnte aufgrund von Netzwerkproblemen oder Blockierung nicht erreicht werden.
What to do: Ein "Navigation timeout"-Fehler wird oft durch Bot-Schutz oder Sicherheitssoftware auf Ihrer Seite verursacht, die den Crawler von Intercom blockiert. Um dies zu beheben, whitelisten Sie die statischen Proxy-IP-Adressen, die im Abschnitt Erweiterte Einstellungen oben aufgeführt sind, wählen Sie dann die passende Proxy-Region unter Erweiterte Einstellungen, wenn Sie Ihre Website-Synchronisierung erstellen oder bearbeiten, und versuchen Sie die Synchronisierung erneut.
4. Duplikat
Message: „Diese Seite hat denselben Inhalt wie eine andere, die bereits synchronisiert wurde. Es wird nur eine Version aufgenommen.“
What it means: Wir haben identischen Inhalt an anderer Stelle erkannt, daher wird nur eine Kopie behalten.
5. Keyword-Filterung
Message: „Seiten mit Keywords wie category, collection oder tag in der URL werden standardmäßig ausgeschlossen, da sie normalerweise keinen einzigartigen Inhalt enthalten. Wenn diese Seite aufgenommen werden soll, kontaktieren Sie den Support.“
What it means: Diese URLs stellen oft Listen dar und keine eigenständigen Inhaltsseiten.
6. Statuscode 400
Message: „Seiteninhalt kann nicht gefunden werden. Prüfen Sie, ob die URL gültig ist und die Seite ohne Probleme geladen wird.
Was das bedeutet: Die URL ist möglicherweise defekt oder liefert auf Ihrer Website einen Fehler.
7. Blockierte URL
Message: „Diese Website domain ist vom Synchronisieren ausgeschlossen. Wenn Sie dies benötigen, kontaktieren Sie support.“
Was das bedeutet: Die domain ist bewusst vom Synchronisieren ausgeschlossen.
Sie können einen fehlgeschlagenen Seiten-Sync erneut versuchen, indem Sie über die Seite hovern, das Drei-Punkte-Menü wählen und dann Resync. auswählen.
Hinweis: Website Sync unterstützt nicht das Importieren von rohen Markdown-Dateien. Für korrekte Formatierung und Titelerkennung müssen Sie Inhalte als gerendertes HTML bereitstellen oder als Snippet/Datei hochladen. Markdown-Struktur (z. B. # Überschriften) wird nicht erkannt, es sei denn, sie wurde in HTML konvertiert.























