Dokumentation / Anleitungen
Testen Sie Ihren Agenten mit skriptgesteuerten Szenarien
Die Registerkarte Testing führt skriptgesteuerte UAT-Gespräche mit dem echten Agenten aus, mit Prüfungen für jeden Gesprächszug.
Zuletzt aktualisiert:
Öffnen Sie einen Agenten und wechseln Sie zur Registerkarte Testing (unterhalb von Advanced). Ein Szenario ist ein vorgeschriebener Gesprächsverlauf: die Nachrichten, die ein Anrufer oder Besucher senden würde, und was der Agent in jedem Zug tun muss. Die Durchläufe werden gegen die echten Anweisungen und echten Tools des Agenten ausgeführt - eine im Test vorgenommene Buchung ist eine echte Buchung in Ihrem Kalender. Richten Sie Szenarien deshalb auf ein Test-Mitglied aus und beenden Sie sie mit einem Zug, der storniert.
Sie möchten Szenarien nicht von Hand schreiben? Die Schaltfläche AI Assistant auf der Registerkarte Scenarios liest die Konfiguration des Agenten - seine Anweisungen und seine Tools - und entwirft UAT-Szenarien für Sie. Ergänzen Sie optional eine Zeile mit Vorgaben (zum Beispiel „Schwerpunkt auf Stornierungen per Rufnummer“), prüfen Sie die Entwürfe, bearbeiten Sie beliebige davon und speichern Sie die, die Sie behalten möchten.
Ein Szenario schreiben#
Jeder Zug besteht aus der Nachricht des Nutzers und einer Liste von Prüfungen:
tool- der Agent muss dieses Tool aufrufen (zum Beispielcheck_availability, bevor er eine Uhrzeit anbietet).args_contain- der Tool-Aufruf muss diese Argumentwerte enthalten.tool_result_contains- das Ergebnis des Tools muss diesen Text enthalten (zum BeispielBooked).reply_contains/reply_not_contains- die Antwort des Agenten muss diesen Text enthalten (oder darf ihn nicht enthalten).no_tool- der Zug darf überhaupt kein Tool verwenden.
Schreiben Sie {{last_uid}} in eine spätere Nachricht, um auf die zuvor im selben Durchlauf erstellte Buchung zu verweisen - nützlich für Züge wie „Storniere diesen Termin“.
Setzen Sie caller_phone im Szenario, um die Rufnummer zu simulieren, von der aus der Anrufer anruft: Der Agent kann dessen bestehende Buchungen dann über die Rufnummer finden (das Tool find_bookings), so wie ein echter Anruf die Rufnummernkennung erkennt.
Kanäle#
- chat verhält sich wie das Web-Widget: Tools, die nur bei Anrufen sinnvoll sind, werden ausgeblendet.
- voice verhält sich wie ein Telefonanruf: Der Agent wird angehalten, sich kurz zu fassen und E-Mail-Adressen nie zu buchstabieren. Der Ton selbst wird nicht simuliert - geprüft wird, wofür sich der Agent entscheidet.
Ausführen#
Drücken Sie Run, und Sie erhalten das vollständige Transkript zurück: jeden Tool-Aufruf mit seinen Argumenten und seinem Ergebnis, die Antwort und jede Prüfung als bestanden oder fehlgeschlagen. Die Registerkarte ist in Scenarios, Run history und Reports unterteilt: Wählen Sie unter Reports die Szenarien aus, die Sie interessieren, um eine Übersicht der Erfolgsquote samt den Details des jüngsten Transkripts zu erhalten, und exportieren Sie sie als Excel-Datei oder als PDF. Dieselben Szenarien lassen sich über die API auch aus Ihrem eigenen Code erstellen und ausführen - siehe die API-Referenz unter Agent testing.