Wenn Sie Fin mit Website-Inhalten trainieren möchten, können Sie dies tun, indem Sie die öffentliche URL der Website synchronisieren.
Loslegen
Gehen Sie zu Train > Content und wählen Sie dann Website sync unter dem Abschnitt „Add content“ aus.
Geben Sie jetzt die öffentliche URL Ihrer Website (Top-Level-domain) ein und klicken Sie auf Weiter.
Dies ruft alle Seiten der von Ihnen angegebenen Website-URL ab und liest alle Subdomain-Seiten.
Tipps:
Geben Sie für beste Ergebnisse den externen help center-Startseitenlink an.
Verwenden Sie Top-Level-Domains (z. B. https://myhelpcenter.com anstelle von https://myhelpcenter.com/articles).
Seiten zum Synchronisieren überprüfen
Sobald Sie Ihre URL eingeben, prüfen wir, ob sie gültig und zugänglich ist. Danach müssen Sie die Seiten auswählen, die synchronisiert werden sollen. Alle in jedem ausgewählten Abschnitt verlinkten Unterseiten werden synchronisiert. Wählen Sie nur relevanten, aktuellen Inhalt aus.
Tipps:
Wählen Sie Seiten und Abschnitte mit Support-Inhalten wie Hilfeartikeln, Anleitungen oder FAQs aus.
Vermeiden Sie die Auswahl von Marketingseiten, Produktlisten oder Seiten mit komplexen Layouts.
Alle verlinkten Unterseiten in den ausgewählten Abschnitten werden automatisch eingeschlossen.
Sie können Ihre Auswahl jederzeit später in den erweiterten Einstellungen aktualisieren.
Erweiterte Einstellungen [optional]
Wählen Sie das Dropdown Erweiterte Einstellungen aus, um zusätzliche URLs zu konfigurieren, URLs auszuschließen, CSS-Selektoren auszuschließen und mehr.
Zusätzliche URLs
Website-Strukturen können variieren. Um sicherzustellen, dass wir Ihren relevantesten Inhalt synchronisieren, empfehlen wir, zusätzliche URLs für diese spezifischen Unterseiten hinzuzufügen.
Wenn Sie beispielsweise https://myhelpcenter.com/help als primäre URL oben eingeben, möchten Sie möglicherweise auch die spezifische URL wie https://myhelpcenter.com/help/index.html hinzufügen.
Auszuschließende URLs
Um bestimmte Seiten auszuschließen, von denen Sie keinen Inhalt synchronisieren möchten, können Sie eine Liste von URL-Globs hinzufügen.
Was ist ein URL-Glob?
Ein Glob ist eine Zeichenfolge aus Literal- und/oder Platzhalterzeichen, die verwendet wird, um Dateipfade oder URLs abzugleichen. Globbing ist das Auffinden von Dateien in einem Dateisystem mit einem oder mehreren Globs. Die Verwendung von URL-Globs hilft auch dabei, einen Bereich von URLs zu erfassen, die größtenteils gleich sind, wobei nur ein kleiner Teil zwischen den Anfragen variiert.
Zum Beispiel lässt dieser URL-Glob https://{store,docs}.example.com/** den Crawler auf alle URLs zugreifen, die mit https://store.example.com/ oder https://docs.example.com/ beginnen, und https://example.com/**/*\?*foo=*
Tipp: Unsicher, ob Ihr Glob-Muster mit den auszuschließenden URLs übereinstimmt? Sie können DigitalOcean's Glob Tool verwenden, um Muster gegen Beispiel-URLs zu testen, bevor Sie sie anwenden. (Dies ist ein Drittanbieter-Tool, das nicht von Intercom gewartet wird.)
Auszuschließende CSS-Selektoren
Um bestimmte Seitenelemente auszuschließen, können Sie CSS-Selektoren dieser spezifischen Abschnitte oder Elemente verwenden, die Sie ausschließen möchten.
Dies ist nützlich, um irrelevante Seiteninhalte zu überspringen. Der Wert muss ein gültiger CSS-Selektor sein, wie er von der Funktion document.querySelectorAll() akzeptiert wird. Standardmäßig entfernen wir bereits gängige Navigationselemente, Header, Footer, Modale, Skripte und Inline-Bilder.
Klickbarer CSS-Selektor
Dies ermöglicht, dass DOM-Elemente, die durch den CSS-Selektor identifiziert werden, während des Web-Sync-Vorgangs angeklickt werden.
Dies ist nützlich, um zusammengeklappte Abschnitte zu erweitern, um ihren Textinhalt zu erfassen. Der Wert muss ein gültiger CSS-Selektor sein, wie er von der Funktion document.querySelectorAll() akzeptiert wird.
Beispiele sind "[aria-expanded=\"false\"]", #expand_section
Komplexe Bedingungen können auch mit einem CSS-Selektor beschrieben werden. Im CSS erzeugt das Aneinanderreihen von Selektoren ohne Leerzeichen eine UND-ähnliche Bedingung, zum Beispiel passt .button.blue.small nur auf Elemente mit allen drei Klassen.
Die Verwendung von Komma (,) als Trenner funktioniert wie ODER, zum Beispiel zielt .button, .blue, h1 auf alle Elemente mit der Klasse button oder der Klasse blue oder Überschriften erster Ebene ab.
Warten, um CSS-Selektor zu laden
Um Inhalte anzusprechen, die mit Verzögerung auf der Seite erscheinen können, können Sie einen CSS-Selektor hinzufügen, der den Web-Scraper warten lässt, bevor Inhalte gescraped werden.
Dies ist nützlich für Seiten, bei denen die standardmäßige Erkennung des Inhaltsladezustands durch inaktives Netzwerk fehlschlägt. Wenn Sie diese Option einstellen, wird das Standardverhalten vollständig deaktiviert, und die Seite wird nur verarbeitet, wenn das durch diesen Selektor angegebene Element erscheint.
Hinweis: Der Wert muss ein gültiger CSS-Selektor sein, wie er von der Funktion document.querySelectorAll() akzeptiert wird.
XML-Sitemap
Aktivieren Sie die XML-Sitemap für einen robusteren Websync auf sitemap-unterstützten Websites, damit auf Seiten zugegriffen werden kann, die von den anfänglichen URLs möglicherweise nicht erreichbar sind.
Wenn diese Option aktiviert ist, sucht der Web-Scraper auf den Domains der angegebenen Quell-URL nach Sitemaps und fügt passende URLs ähnlich wie die auf gecrawlten Seiten gefundenen Links in die Warteschlange ein. Sie können eine sitemap.xml-Datei auch direkt referenzieren, indem Sie sie als weitere Start-URL hinzufügen, z. B. https://www.example.com/sitemap.xml.
Proxy-Region
Sie können einen Proxy für den Crawler auswählen, wenn Sie benötigen, dass Ihre Website mit einem auf eine bestimmte Region oder ein bestimmtes Land eingestellten Proxy gecrawlt wird.
Wir unterstützen derzeit die folgenden Proxys:
Rotierend: United States, Germany, France, United Kingdom, Czechia, Hungary
Statisch:
United States - 119.13.211.225, 161.123.167.215, 94.176.49.232, 185.223.56.90, 154.17.143.135
Europa - 178.171.116.231, 206.232.77.243, 206.232.90.11, 209.20.175.180, 45.94.247.149
Australien - 154.220.151.84, 173.254.193.121, 160.224.101.213, 160.224.100.176, 212.70.22.41
Crawler-Typ
Wählen Sie, wie gründlich der Crawler jede Seite rendert, während diese Website synchronisiert wird.
Wenn beim Synchronisieren Seiten leer oder abgeschnitten sind, liegt das meist an JavaScript-Rendering. Wechseln Sie zu Full und synchronisieren Sie erneut.
Full ist ressourcenintensiver und setzt daher eher eine große Quelle auf einen reduzierten Zeitplan.
Sie können dies an einer bestehenden Quelle ändern und zum Vergleichen neu synchronisieren.
Option | Was es bewirkt | Verwendung |
Schnell | Liest HTML, ohne JavaScript auszuführen. | Der Inhalt befindet sich im initialen HTML — die meisten Blogs, Docs, help centers. |
Auto (Standard) | Wir wählen aus und wechseln zu Full, wenn die Seite JavaScript benötigt. | Sie sind sich nicht sicher. Für nahezu alle geeignet. |
Full | Lädt jede Seite in einem Browser und führt JavaScript aus. Langsamer. | Inhalte erscheinen erst nach Ausführung von Skripten, Single-Page-Apps und JavaScript-lastige Seiten. |
Canonical-URLs ignorieren
Wenn aktiviert, ignoriert der Web-Scraper canonical-Link-Tags (rel="canonical") und behandelt jede URL als eigenständige Seite. Diese Option ist standardmäßig deaktiviert.
Das ist nützlich, wenn eine Website viele Seiten auf eine kanonische URL verweist und dabei Inhalte verloren gehen.
Abfrageparameter ausschließen und robots.txt respektieren
Unter Erweiterte Einstellungen gibt es zwei weitere Umschalter. Beide sind standardmäßig ausgeschaltet.
Robots.txt respektieren: veranlasst den Crawler, die Disallow-Regeln in der robots.txt Ihrer Website zu befolgen. Schalten Sie es ein, um die Synchronisierung mit dem, was Sie anderen Crawlern erlauben, konsistent zu halten. Wenn robots.txt Pfade ausschließt, die Inhalte enthalten, die Sie in Fin haben möchten, reduziert dies, was synchronisiert wird.
Abfrageparameter ausschließen: überspringt jede URL mit einer Abfragezeichenfolge (?). Schalten Sie es ein, wenn Ihre Website Tracking-, Sitzungs- oder Sortierparameter anhängt, die viele fast identische Seiten erzeugen. Lassen Sie es aus, wenn echter Inhalt hinter einer Abfragezeichenfolge liegt, z. B. /docs?page=intro — diese Seiten würden sonst ebenfalls übersprungen werden.
Zielgruppen
Der Target-Schritt ermöglicht es Ihnen, eine Standardzielgruppe für alle synchronisierten Seiten festzulegen und URL-basierte Regeln zu erstellen, um automatisch bestimmte Zielgruppen basierend auf URL-Mustern zuzuweisen — keine manuelle Kennzeichnung erforderlich.
Entscheiden Sie zuerst, ob Inhalte aus dieser Quelle für Fin AI Agent und/oder Copilot aktiviert sind.
Dann können Sie entweder eine Standard-Fin-Zielgruppe festlegen, die auf alle von dieser Quelle synchronisierten Seiten angewendet wird (wenn keine Standard festgelegt ist, werden Inhalte standardmäßig auf Everyone gesetzt), oder Regeln erstellen, um bestimmte Zielgruppen basierend auf URL-Mustern zuzuweisen.
Zum Beispiel: Wenn die URL /uk enthält, weisen Sie die UK-Zielgruppe zu. Regeln werden während der Synchronisierung ausgewertet, sodass Fin und Copilot stets die richtigen Inhalte der richtigen Zielgruppe bereitstellen.
Jede Regel unterstützt drei URL-Vergleicher:
Beginnt mit — stimmt mit URLs überein, die mit einem bestimmten Präfix beginnen.
Endet mit — stimmt mit URLs überein, die mit einer bestimmten Endung enden.
Enthält — stimmt mit URLs überein, die eine bestimmte Teilzeichenfolge enthalten.
Hinweis:
Eine Live-Vorschau zeigt, wie viele Seiten mit jeder Regel übereinstimmen, damit Sie Regeln vor dem Speichern validieren können. Dies erfordert, dass für Ihre Web-Sync-Quelle eine Sitemap verfügbar ist. Ohne Sitemap gelten Regeln weiterhin, aber Sie können Übereinstimmungen nicht in der Vorschau sehen.
Regeln werden bei Erstellung automatisch benannt, können jedoch umbenannt werden. Pro Web-Sync-Quelle gilt ein Maximum von 10 Regeln.
Zielgruppenregeln sind nur additiv: sie fügen Inhalte Zielgruppen hinzu, entfernen aber niemals bestehende Zuordnungen. Das Entfernen einer Regel macht ihre früheren Zielgruppenzuweisungen nicht rückgängig.
Synchronisierungseinstellungen überprüfen
Überprüfen Sie abschließend Ihre Synchronisierungseinstellungen und klicken Sie dann auf Sync website , um die Inhalte Ihrer Website mit Intercom zu synchronisieren.
Website-Quellen verwalten
Sobald die Synchronisierung abgeschlossen ist, erhalten Sie eine E-Mail-Benachrichtigung und die Website erscheint als synchronisierte Quelle in Train > Content im Abschnitt "Content sources".
Wenn Sie in eine Website-Quelle klicken, können Sie die einzelnen Seiten, die von der öffentlichen URL synchronisiert wurden, in der Vorschau anzeigen und verwalten.
Hinweis: Website-Quellen sind schreibgeschützt und können nicht innerhalb Ihres Fin-Arbeitsbereichs bearbeitet werden, sie müssen an der Quelle bearbeitet werden.
Einstellungen konfigurieren
Wenn Sie eine Website-Seite anzeigen, finden Sie ein „Details“-Panel auf der rechten Seite, das enthält:
Daten: Sehen Sie den Inhaltstyp, die Sprache, das Erstellungsdatum und die letzte Aktualisierung (wann es zuletzt mit der Quelle synchronisiert wurde).
Fin: Aktivieren/deaktivieren für Fin Agent und Fin Copilot. Wenn aktiviert, werden die Inhalte Kunden bzw. Teammitgliedern zur Verfügung gestellt
Planung: Aktivieren oder deaktivieren Sie Inhalte für Fin und Copilot an festgelegten Daten.
Audience: Stellen Sie sicher, dass Kund*innen nur Antworten erhalten und Inhalte von Fin Agent sehen, die für sie relevant sind.
Link: Die öffentliche URL für diese Website-Quelle.
Reports: Verfolgt, wie häufig diese Inhalte genutzt werden, um Gespräche durch Fin Agent zu lösen.
Tag: Fügen Sie ein Tag hinzu, um Webseiten zu gruppieren und Inhalte organisiert zu halten.
Make it available to Fin or Copilot
Um eine Website-Quelle für Fin Agent oder Fin Copilot verfügbar zu machen, gehen Sie zu Train > Content und klicken Sie in der Sektion "Content sources" auf die Website-Quelle, öffnen Sie dann die entsprechende synchronisierte Webseite.
From the "Details" panel, scroll down to “Fin” and toggle on:
Fin Agent - Diese Einstellung macht die Webseite für Fin AI verfügbar, damit sie bei Antworten an Kund*innen verwendet wird (sie beachtet alle Audience-Regeln).
Fin Copilot - Diese Einstellung macht die Webseite für Fin Copilot verfügbar, damit sie bei Antworten an Teammitglieder verwendet wird.
Website-Verfügbarkeit planen
Sie können planen, wann synchronisierte Webseiten für Fin und Copilot ein- oder ausgeschaltet werden, einschließlich künftigen Datums, Uhrzeit und Zeitzone. Legen Sie nur ein Startdatum fest oder sowohl Start- als auch Enddatum, um ein zeitlich begrenztes Verfügbarkeitsfenster zu erstellen. Das Planen gilt für einzelne Seiten oder im Bulk.
Eine einzelne Seite planen
Öffnen Sie die Seite. Im rechten Bereich "Details" finden Sie im Fin-Dropdown den Abschnitt Scheduling.
Klicken Sie auf Schedule availability.
Im Modal: Wählen Sie das KI-Produkt (Fin for Service oder Fin Copilot), legen Sie die Verfügbarkeit fest (Enable oder Disable) und wählen Sie Datum, Uhrzeit und Zeitzone aus.
Optional können Sie Set end date aktivieren, um ein Enddatum und eine Endzeit hinzuzufügen — die Aktion wird zu diesem Zeitpunkt automatisch rückgängig gemacht.
Klicken Sie auf Schedule, um zu bestätigen.
Seiten im Bulk planen
Wählen Sie mehrere Seiten aus der Inhaltsliste aus.
Gehen Sie zum Dropdown More actions und wählen Sie Schedule availability.
Das gleiche Scheduling-Modal gilt für alle ausgewählten Einträge.
Wie das Planen funktioniert
Start date only: Die Aktivierungs-/Deaktivierungsaktion erfolgt zur geplanten Zeit und bleibt in Kraft, bis Sie sie manuell ändern.
Start + end date: Inhalte werden zur Startzeit aktiviert (oder deaktiviert) und kehren dann automatisch zur Endzeit zurück.
Manual changes don't cancel a pending schedule: Wenn Sie die Verfügbarkeit nach dem Setzen eines Plans manuell umschalten, wird die geplante Umstellung trotzdem zur geplanten Zeit ausgeführt und Ihre manuelle Änderung überschreiben.
One pending schedule per item per agent: Das Setzen eines neuen Plans ersetzt den vorherigen — keine Duplikate.
Deleted content: Wenn eine Seite gelöscht wird, bevor ihr Plan ausgeführt wird, gilt der Plan einfach nicht und es wird kein Fehler angezeigt.
Für ein bestimmtes Publikum verfügbar machen
Sie können Zielgruppen synchronisierter Inhalte automatisch mithilfe von URL-basierten Regeln während der Erstellung des Web-Syncs zuweisen oder manuell pro Seite. Zuerst müssen Sie die Zielgruppe erstellen und definieren, die Sie anvisieren möchten: create and define the audience.
Gehen Sie dann zu Train > Content und klicken Sie in der Sektion "Content sources" auf die Website-Quelle, öffnen Sie dann die entsprechende synchronisierte Webseite.
From the "Details" panel, scroll down to “Fin” and use the audience dropdown to select one of your pre-defined audiences.
Note:
Die Standard-Zielgruppe für öffentliche URLs ist „Everyone“.
Fin Agent berücksichtigt außerdem jede Zielgruppe, die Sie einer öffentlichen URL zuweisen, und verwendet diesen Artikel nur zur Beantwortung von Kundenfragen, wenn sie den Audience-Regeln entsprechen.
Zielgrupperegeln zu bestehenden Syncs hinzufügen oder bearbeiten
Sie müssen keinen Sync neu erstellen, um Zielgruppen-Targeting hinzuzufügen. Gehen Sie zu Train > Content, wählen Sie die Quelle, klicken Sie auf das Einstellungs-Dropdown oben rechts und wählen Sie Open settings. Navigieren Sie zum Schritt Target, um URL-basierte Regeln hinzuzufügen oder zu bearbeiten.
Note: Wenn Zielgrupperegeln zu einem bestehenden Web-Sync hinzugefügt werden, gelten sie rückwirkend für alle bereits aus dieser Quelle ingestierten Inhalte — nicht nur für neue Inhalte.
Eine Website als Quelle erneut synchronisieren oder entfernen
Wenn Sie eine öffentliche URL als Quelle erneut synchronisieren oder entfernen möchten, gehen Sie zu Train > Content und klicken Sie in der Sektion "Content sources" auf die Website-Quelle, öffnen Sie dann das Dropdown Settings oben rechts.
Hier können Sie auswählen, ob Sie Re-sync oder Remove this source. möchten.
Tip: Änderungen an Ihrer Quell-Website erscheinen nicht sofort in Intercom. Website-Re-Syncs erfolgen automatisch jede Woche, aber Sie können jederzeit einen manuellen Re-Sync auslösen, um die neuesten Inhalte früher anzuzeigen.
Website-Sync-Verlauf anzeigen
Sie können eine Liste vergangener Website-Syncs anzeigen, um zu sehen, wann sie zuletzt ausgeführt wurden, welche Seiten gefunden wurden und welche Seiten fehlgeschlagen sind. Gehen Sie zu Train > Content und klicken Sie in der Sektion "Content sources" auf die Website-Quelle, dann wählen Sie View sync history.
Jede Zeile in der Tabelle stellt einen vergangenen oder aktiven Lauf dar, und Sie können die Läufe nach status (started, success, failed) filtern.
Folgende Informationen sind enthalten:
Sync-Datum
Status
Synchronisierte Seiten
Ausgeschlossene Seiten
Fehlgeschlagene Seiten
Dauer
Sync gestartet von
Wenn ein Sync fehlgeschlagen ist, können Sie mit der Maus über den Status fahren, um eine detaillierte Erklärung des Grundes zu sehen.
Automatische Syncs pausieren, wenn Fin keine Website verwendet
Eine neue Quelle wird in den ersten 90 Tagen planmäßig synchronisiert. Danach wird sie nur weiter automatisch synchronisiert, wenn eine der folgenden Bedingungen zutrifft:
Eine Seite davon wurde in den letzten 90 Tagen in einer Fin-Antwort verwendet.
Andernfalls pausieren geplante Syncs.
Wenn pausiert: Seiten bleiben in Ihrem Knowledge Hub und stehen Fin und Copilot weiterhin zur Verfügung (nichts wird gelöscht). Nur das erneute Crawlen stoppt, sodass Änderungen auf Ihrer Website nicht erfasst werden.
Zum Wiederherstellen: Die Jetzt synchronisieren-Schaltfläche aktualisiert den Inhalt einmal, startet aber den Plan nicht neu. Die automatische Synchronisierung setzt sich von selbst fort, sobald Fin die Quelle wieder verwendet.
Websites, die schwer zu crawlen sind, synchronisieren seltener
Sehr große Seiten und Seiten, die vollständiges JavaScript-Rendering benötigen, verursachen deutlich höhere Crawling-Kosten. Wenn sich eine Quelle als ressourcenintensiv herausstellt, verschieben wir sie von einem wöchentlichen auf einen 14-tägigen Zeitplan.
Dies geschieht automatisch pro Quelle. Um eine große Website in einem schnelleren Zeitplan zu halten, schränken Sie das Crawlen durch URL-Ausnahmen ein oder fügen Sie spezifische Unterseiten statt einer gesamten domain hinzu.
Fehlerbehebung bei Website-Syncs
Häufige Probleme
Beim Import von Website-Inhalten zur Aktivierung von Fin müssen Sie die öffentliche URL angeben. Diese sucht nach allen Seiten, die unter dieser URL verschachtelt sind, und synchronisiert sie, damit der Fin AI Agent sie verwenden kann.
Wenn der Importer nicht die erwartete Seitenanzahl zurückgegeben hat, kann das mehrere Gründe haben...
Die angegebene URL ist nicht die Top-Level-domain
Der Website-Sync funktioniert, indem die angegebene URL aufgerufen und dann alle darunter verschachtelten Seiten gesucht werden. Diese Seiten müssen dasselbe URL-Muster wie die von Ihnen angegebene URL haben.
Zum Beispiel: Wenn die Top-Level-domain https://myhelpcenter.com/home ist, müssen alle zu importierenden Seiten das Präfix /home in der URL enthalten, z. B. https://myhelpcenter.com/home/article. Wenn nicht, entfernen Sie das Präfix und verwenden Sie das grundlegendste URL-Stammteil, z. B. https://myhelpcenter.com, und versuchen Sie den Import erneut.
Die URL ist privat
Wenn die zu verwendenden Inhalte hinter einer Anmeldung liegen, kann Fin nicht darauf zugreifen oder sie importieren.
Seitenbegrenzungen
Der Website-Sync hat zwei Grenzen:
Domains: Sie können bis zu 100 verschiedene Top-Level-domains synchronisieren.
Pages per source: Fin synchronisiert maximal 4.000 Seiten pro Quelle.
Ein Sync kann auch fehlschlagen, wenn eine einzelne Seite sehr viel Inhalt enthält. Sie werden per E-Mail benachrichtigt, wenn ein Sync fehlschlägt.
Hinweis:
Wenn eine Quelle mehr als 4.000 Seiten hat, teilen Sie sie in mehrere Quellen auf, damit jede unter dem Limit bleibt:
Teilen Sie die Website in kleinere Abschnitte und fügen Sie jeden Abschnitt als eigene Quelle hinzu.
Synchronisieren Sie verschiedene URL-Pfade separat, z. B. eine Quelle pro Produktbereich oder Kategorie.
So bleibt jede Quelle unter der Seitenbegrenzung und reduziert den Inhalt, der pro Sync verarbeitet wird.
Websites, die auf bestimmte regionale IPs beschränkt sind
Fin's Website-Sync (used to add public URLs for Fin AI Agent and Copilot) does not use a dedicated, custom user-agent string at this time.
Wenn Ihre Site strenge Anti-Crawling-Schutzmaßnahmen hat, können Sie einen statischen Proxy verwenden, um eine feste Liste von IP-Adressen auf die Allow-List zu setzen und sicherzustellen, dass Ihre Inhalte aufgenommen werden. Wählen Sie beim Erstellen oder Bearbeiten Ihres Website-Syncs unter Erweiterte Einstellungen einen statischen Proxy aus.
Per IP-Adresse: Wenn Ihre Site Allow-Listing erfordert, wählen Sie unter Erweiterte Einstellungen einen statischen Proxy aus — dies gibt Ihnen eine feste IP-Liste, die Sie Ihrer Allow-List hinzufügen.
Diese Anfragen werden nur für das Website-Sync verwendet. Sie wirken sich nicht auf Ihren Messenger-Verkehr oder das Endnutzer-Tracking aus.
Seiten von nicht-englischen oder internationalen Sites werden nicht synchronisiert
Wenn Ihre Sitemap URLs mit nicht-ASCII-Zeichen (z. B. Buchstaben mit Akzent oder Schriften wie Chinesisch oder Arabisch) enthält, werden einige dieser Seiten möglicherweise nicht wie erwartet synchronisiert. Die Sitemap-Erkennung unterstützt diese URLs jetzt, aber sie können in anderen Teilen des Sync-Prozesses weiterhin Probleme verursachen. Versuchen Sie, manuell erneut zu synchronisieren. Wenn Seiten weiterhin fehlen, kontaktieren Sie den Support.
Fehler bei Website-Syncs
Beim Synchronisieren von Website-Inhalten können verschiedene Stati angezeigt werden, die angeben, was während des Prozesses passiert ist. Um Ihren Website-Sync-Status zu sehen, gehen Sie zu Train > Content und wählen Sie die Website-Quelle aus, dann verwenden Sie das Status -Dropdown, um zu filtern nach:
Synchronisiere
Live
Fehlgeschlagen
Ausgeschlossen
Das bedeutet jedes einzelne und was Sie als nächstes tun können:
Synchronisiere
Der Seiten-Sync ist noch im Gange. Ein anfänglicher Sync kann je nach Umfang Ihres Inhalts von wenigen Minuten bis zu über einer Stunde dauern.
Live
Die Seite wurde erfolgreich synchronisiert und kann für Fin und Copilot aktiviert werden.
Hinweis: Ein erfolgreicher Sync bedeutet nicht immer, dass wir allen Inhalt auf der Seite erfassen konnten. Wenn Sie die vollständige Erfassung bestätigen möchten, empfehlen wir, Fin mit erwarteten Antworten von dieser Seite vorzuschauen.
Ausgeschlossen
Diese Seiten sind absichtlich nicht synchronisiert, weil Sie sie in den Advanced sync settings ausgeschlossen haben. Sie können nicht erneut versucht oder einbezogen werden, sofern nichts anderes angegeben ist.
Fehlgeschlagen
Diese Fehler bedeuten, dass die Synchronisierung nicht abgeschlossen wurde und möglicherweise Änderungen Ihrerseits erforderlich sind, bevor Sie es erneut versuchen können:
1. Unbekannter Fehler
Message: „Diese Seite konnte nicht aufgerufen werden. Sie ist möglicherweise langsam oder blockiert. Versuchen Sie erneut zu synchronisieren oder kontaktieren Sie den Support, wenn es weiterhin fehlschlägt.“
What it means: Etwas hat uns daran gehindert, auf die Seite zuzugreifen, aber die Ursache ist nicht klar.
2. Sitzung blockiert / Rate limited
Message: „Die Website verhindert, dass wir auf ihren Inhalt zugreifen. Prüfen Sie, ob sie durch eine Anti-Crawler-Einstellung oder Firewall blockiert wird. Überprüfen Sie Ihre Site-Konfiguration und versuchen Sie erneut zu synchronisieren. Wenn das Problem weiterhin besteht, kontaktieren Sie den Support.“
What it means: Ihre Website blockiert oder beschränkt unseren Crawler aktiv.
3. Netzwerk-, Timeout- oder ähnliche Fehler
Message: „Diese Seite konnte nicht aufgerufen werden. Sie ist möglicherweise langsam beim Laden oder wird durch Anti-Crawler-Einstellungen oder eine Firewall blockiert. Überprüfen Sie Ihre Site-Konfiguration und versuchen Sie erneut zu synchronisieren. Wenn das Problem weiterhin besteht, kontaktieren Sie den Support.“
What it means: Die Seite wurde nicht rechtzeitig geladen oder konnte aufgrund von Netzwerkproblemen oder Blockierungen nicht erreicht werden.
What to do: Ein "Navigation timeout"-Fehler wird häufig durch Bot-Schutz oder Sicherheitssoftware auf Ihrer Website verursacht, die Intercoms Crawler blockiert. Um dies zu beheben, setzen Sie die static proxy IP addresses in den Advanced settings oben auf die Whitelist, wählen Sie dann die passende Proxy-Region unter Advanced settings, wenn Sie Ihre Website-Synchronisierung erstellen oder bearbeiten, und versuchen Sie die Synchronisierung erneut.
4. Duplikat
Message: „Diese Seite hat denselben Inhalt wie eine andere, die bereits synchronisiert wurde. Es wird nur eine Version aufgenommen.“
What it means: Wir haben identischen Inhalt an anderer Stelle erkannt, daher wird nur eine Kopie aufbewahrt.
5. Schlüsselwortfilter
Message: „Seiten mit Schlüsselwörtern wie category, collection oder tag in der URL werden standardmäßig ausgeschlossen, da sie normalerweise keinen einzigartigen Inhalt enthalten. Wenn diese Seite einbezogen werden soll, kontaktieren Sie den Support.“
What it means: Diese URLs repräsentieren oft Listen und keine eigenständigen Inhaltsseiten.
6. Statuscode 400
Message: „Seiteninhalt konnte nicht gefunden werden. Prüfen Sie, ob die URL gültig ist und die Seite ohne Probleme geladen wird.
What it means: Die URL ist möglicherweise defekt oder gibt einen Fehler auf Ihrer Website zurück.
7. Blockierte URL
Message: „Diese Website domain ist vom Synchronisieren ausgeschlossen. Wenn Sie dies benötigen, kontaktieren Sie den Support.“
What it means: Die domain ist absichtlich vom Synchronisieren ausgeschlossen.
Sie können eine fehlgeschlagene Seiten-Synchronisierung erneut versuchen, indem Sie mit der Maus über die Seite fahren, das Drei-Punkte-Menü auswählen und dann Resync.






















