Dieser Artikel erklärt, wann Sie Fin's drei Testwerkzeuge — Simulationen, Batch tests und Previews — verwenden sollten.
Kurzübersicht: Welches Werkzeug was leistet
| Simulationen | Batch tests | Previews |
Was es ist | Automatisierte, KI-gestützte End-to-End-Tests einer einzelnen Procedure. Die KI agiert als simulierte Kundin bzw. simulierter Kunde und bewertet das Ergebnis anhand von definierten Erfolgskriterien. | Ein Frage-Antwort-Testwerkzeug zum Validieren von Fin's Antworten für bis zu 50 Fragen gleichzeitig. Testet, wie Fin über Inhalte, Guidance, users, Sprachen und Automations antwortet. | Ein manuelles, interaktives Testpanel, das in den Trainingsbereichen von Fin verfügbar ist. Sie geben Nachrichten ein und sehen Fin's Antwort und das Ereignisprotokoll in Echtzeit. |
Am besten geeignet für | Validierung komplexer Procedure-Logik End-to-End, bevor sie live geht. Erfassen von Regressionen nach Procedure-Updates. Testen von Randfällen und Verzweigungen. | Überprüfung der Inhaltsabdeckung über viele Fragen hinweg. Diagnose von Lücken in Wissen, Guidance oder Automations. Pre-Launch-QA über Zielgruppen, Marken und Sprachen. | Schnelle manuelle Stichproben während des Aufbaus. Überprüfung, wie sich eine bestimmte Änderung — an Inhalten, Guidance, Attributen, Eskalation oder einer Procedure — sofort auf Fin's Antwort auswirkt. |
Funktioniert mit | Nur Procedures. | Alle Kund:innen, die Fin verwenden — egal ob sie Procedures, Tasks oder nur Wissensinhalte nutzen. | Alle Trainingsbereiche von Fin: Content, Guidance, Attributes, Escalation, Procedures und Deploy. |
Testmodus | Automatisiert — die KI erzeugt die Kundenseite des Gesprächs und bewertet das Ergebnis mit einer Bestanden/Nicht bestanden-Beurteilung. | Automatisiert — Fin erzeugt eine Antwort auf jede Frage. Sie überprüfen und bewerten die Antworten manuell (Good / Acceptable / Poor). | Manuell — Sie geben die Nachrichten selbst ein und beobachten Fin's Antwort und das Ereignisprotokoll. |
Erstellt es ein echtes Gespräch? | Nein — läuft vollständig im Hintergrund. Es wird kein inbox-Gespräch erstellt. | Nein — nur Simulation. Erstellt keine inbox-Gespräche und beeinflusst keine Kundendaten. | Ja — Preview-Gespräche erscheinen in Ihrem inbox, werden jedoch von der Berichterstattung ausgeschlossen. |
Greift es auf Live-APIs zu? | Nein — ruft keine externen Live-APIs (z. B. Shopify, Stripe) auf. Testet nur die Logik. | Nein — Datenconnectoren verwenden konfigurierte Test-/Beispiel-Payloads. Keine Live-API-Aufrufe. | Ja — kann beim Testen als spezifischer user oder Lead auf echte Benutzerdaten und Live-Integrationen zugreifen. |
Speichert & wiederholt | Ja — Simulationen werden gespeichert und können bei Aktualisierung der Procedure jederzeit wieder ausgeführt werden. Unterstützt „Alle ausführen“. | Ja — Testgruppen (bis zu 50 Fragen) können gespeichert, erneut ausgeführt und im Team geteilt werden. | Nein — einmalige manuelle Gespräche. Nicht gespeichert oder wiederholbar. |
Bestanden/Nicht bestanden-Beurteilung | Ja — die KI bewertet das Gespräch anhand der Erfolgskriterien und weist Bestanden oder Nicht bestanden mit vollständiger Begründung zu. | Nein — Sie bewerten jede Antwort manuell als Good, Acceptable oder Poor und wählen eine Grundursache. | Nein — keine automatisierte Beurteilung. Sie beurteilen das Ergebnis selbst. |
Nutzungsgrenzen | Ja — monatliches Ausführungslimit basierend auf dem Workspace-Gesprächsvolumen (250–12.500/Monat). Inklusive bei Procedures ohne zusätzliche Kosten. | Keine Gebühren. Bis zu 50 Fragen pro Testgruppe. | Keine Limits. |
Verfügbarkeit | In der Regel für alle Kund:innen verfügbar, die Procedures verwenden. | In der Regel für alle Fin-Kund:innen mit voller Lizenz und Berechtigung für All conversations verfügbar. | In der Regel für alle Fin-Kund:innen verfügbar. |
Wann welches Werkzeug verwenden
Verwenden Sie Simulationen, wenn
Sie eine Procedure End-to-End validieren müssen, bevor Sie sie live schalten.
Sie automatisierte, wiederholbare Tests wünschen, die Regressionen nach jedem Update aufdecken.
Ihre Procedure Verzweigungslogik, Conditions oder Unterprocedures hat — und Sie für jeden Pfad einen separaten Testfall benötigen.
Sie möchten, dass die KI das Ergebnis anhand definierter Erfolgskriterien bewertet (Fin-Antwort, Attributwerte, Datenconnector-Aufrufe, Ergebnis von Anweisungen).
Sie müssen zeitabhängige Logik (z. B. Rückerstattungsfristen) testen, indem Sie die Simulationszeit und Datenwerte steuern.
Verwenden Sie Batch tests, wenn
Sie Fin's Antworten über eine breite Fragenmenge validieren möchten — nicht nur ein Szenario.
Sie Pre-Launch-QA über Inhalte, Guidance, Zielgruppen oder Marken durchführen.
Sie Diagnose von Inhaltslücken durchführen möchten, indem Sie sehen, aus welchen Quellen Fin für jede Antwort zieht.
Sie Fragen testen möchten, die aus echten vergangenen Gesprächen oder KI-Themen generiert wurden.
Sie einen herunterladbaren CSV-Bericht benötigen, um Ergebnisse mit Ihrem Team oder Führungskräften zu teilen.
Verwenden Sie Previews, wenn
Sie aktiv bauen und eine Änderung sofort stichprobenartig prüfen möchten — an Inhalten, Guidance, einem Attribut, einer Eskalationsregel oder einer Procedure.
Sie manuell ein Gespräch als spezifischer user, für eine Zielgruppe oder in einer bestimmten Sprache durchspielen möchten.
Sie Fin's Ereignisprotokoll sehen müssen, um genau zu verstehen, was angewendet wurde (Personality, Guidance, Tasks, Inhaltsquellen).
Sie Fin Vision testen möchten, indem Sie ein Bild oder einen Screenshot senden.
Sie eine Procedure-Flow validieren und die komplette Kunden- und Team-Postfachexperienz sehen möchten (einschließlich nachgelagerter Automations).
FAQs
Was ist der Unterschied zwischen Simulationen und Previews?
Was ist der Unterschied zwischen Simulationen und Previews?
Previews sind manuell und interaktiv: Sie geben Nachrichten selbst ein und beobachten Fin in Echtzeit antworten. Sie eignen sich hervorragend für schnelle Stichproben während des Aufbaus.
Simulationen sind automatisiert: Die KI spielt die Kundenseite, führt das volle Gespräch und bewertet das Ergebnis anhand der von Ihnen festgelegten Erfolgskriterien.
Simulationen erstellen keine inbox-Gespräche; Preview tut dies. Verwenden Sie Simulationen, wenn Sie Procedure-Logik in großem Maßstab validieren müssen. Verwenden Sie Preview für kontextbezogene manuelle Tests.
Was ist der Unterschied zwischen Simulationen und Batch tests?
Was ist der Unterschied zwischen Simulationen und Batch tests?
Batch tests prüfen, wie Fin auf eine breite Fragenmenge antwortet — sie testen Inhaltsabdeckung, Guidance und Automations über viele Szenarien hinweg. Sie bewerten Antworten manuell.
Simulationen testen eine einzelne Procedure End-to-End mit automatischer KI-Beurteilung.
Batch tests funktionieren mit allen Fin-Setups. Simulationen sind exklusiv für Procedures.
Was ist der Unterschied zwischen Batch tests und Previews?
Was ist der Unterschied zwischen Batch tests und Previews?
Batch tests sind strukturierte, wiederholbare QA-Läufe über bis zu 50 Fragen — nützlich für Pre-Launch-Checks und zur Diagnose von Inhaltslücken.
Previews sind unstrukturiert und manuell — ein Gespräch nach dem anderen, nützlich für sofortiges Feedback während des Aufbaus.
Batch-Test-Ergebnisse werden gespeichert und können als CSV exportiert werden. Preview-Gespräche erscheinen in Ihrem inbox, werden jedoch nicht als Testruns gespeichert.
Rufen Simulationen Live-APIs auf oder beeinflussen sie echte Daten?
Rufen Simulationen Live-APIs auf oder beeinflussen sie echte Daten?
Nein. Simulationen rufen keine externen Live-APIs (wie Shopify oder Stripe) auf und beeinflussen keine echten Daten. Sie testen nur Logik. Wenn Sie mit echten API-Aufrufen testen müssen, verwenden Sie Preview und wählen Sie einen spezifischen user mit echten Daten in dessen externen System aus.
Werden mir Simulationen oder Batch tests berechnet?
Werden mir Simulationen oder Batch tests berechnet?
Simulationen sind bei Procedures ohne zusätzliche Kosten enthalten. Batch tests sind ebenfalls kostenlos (Ihnen werden keine Gebühren für Antworten aus Batch tests berechnet).
Hinweis: Simulationen haben ein monatliches Ausführungslimit (250–12.500 pro Monat je nach Gesprächsvolumen), das am ersten eines jeden Monats zurückgesetzt wird.
Kann ich Batch tests verwenden, um eine Procedure zu testen?
Kann ich Batch tests verwenden, um eine Procedure zu testen?
Batch tests zeigen, ob eine Procedure für eine bestimmte Frage ausgelöst worden wäre, aber sie führen die Procedure nicht aus oder bewerten deren End-to-End-Logik. Für vollständige Procedure-Validierung (einschließlich Verzweigungen, Datenconnector-Aufrufen und Anweisungsergebnissen) verwenden Sie Simulationen.
Welches Testwerkzeug sollte ich vor dem Livegang verwenden?
Welches Testwerkzeug sollte ich vor dem Livegang verwenden?
Verwenden Sie alle drei in Kombination: Preview für schnelle manuelle Prüfungen beim Aufbau; Simulationen zur End-to-End-Validierung der Procedure-Logik mit automatischen Bestanden/Nicht bestanden-Ergebnissen; Batch tests zur Bestätigung von Fin's Antworten über eine breite Menge realer Kundenfragen.
Es wird dringend empfohlen, Simulationen vor jedem Procedure-Launch auszuführen.
Wichtige Fakten zum Merken
Simulationen sind exklusiv für Procedures. Sie können nicht mit Tasks, Workflows oder allgemeinen Inhaltstests verwendet werden.
Batch tests funktionieren für alle Fin-Kunden — egal ob sie Procedures, Tasks oder nur Wissensinhalte nutzen.
Preview-Gespräche erscheinen im inbox, werden jedoch von der Berichterstattung ausgeschlossen.
Nur Preview kann Live-APIs aufrufen. Simulationen und Batch tests sind sichere, Sandbox-Umgebungen.
Simulation-Ausführungslimits gelten pro Workspace, nicht pro Teammitglied, und werden monatlich zurückgesetzt.
Antwortbewertungen in Batch tests trainieren Fin nicht — sie dienen nur der menschlichen Überprüfung und Ursachenanalyse.
In Simulationen kann ein Test bestehen, aber die Erfolgskriterien zu streng sein (z. B. verlangen, dass Fin genau die Frage findet, die es selbst gestellt hat), sodass der Test dennoch fehlschlägt. Konzentrieren Sie Erfolgskriterien auf Ergebnisse, nicht auf Zwischenschritte.
