Zurück zum Dashboard

Dokumentation

Erfahren Sie, wie Sie Asyntai verwenden

Ausgabe-Klassifikator

Ein zweites KI-Modell prüft jede Antwort, bevor sie den Besucher erreicht

Zum Ausgabe-Klassifikator
Unternehmen

Übersicht

Normalerweise geht die Antwort der KI direkt an den Besucher. Mit aktivem Ausgabe-Klassifikator liest ein zweites, unabhängiges Modell jede Antwort zuerst und entscheidet, ob sie sicher gesendet werden kann: Wurde der Bot ausgetrickst, seine Rolle zu verlassen? Gibt er regulierte Beratung? Lässt er sich auf ein von Ihnen verbotenes Thema ein? Eine markierte Antwort erreicht den Besucher nie unverändert — sie wird einmal neu geschrieben, und ist auch die Neufassung markiert, erscheint stattdessen Ihre Ersatznachricht.

So funktioniert es

  1. Die KI antwortet wie gewohnt - am Hauptmodell ändert sich nichts
  2. Der Klassifikator liest den Entwurf - ein schnelles zweites Modell prüft ihn gegen Ihre aktivierten Kategorien
  3. Markierte Antworten erhalten eine Neufassung - der Verstoß wird an das Hauptmodell zurückgemeldet, das eine korrigierte Antwort schreibt, die erneut geprüft wird
  4. Ersatznachricht als letzter Ausweg - ist auch die Neufassung markiert, sieht der Besucher stattdessen Ihre sichere Ersatznachricht
Ausgabe-Klassifikator
Antwortentwurf Markiert
Besucher sieht Korrigierte Antwort

Was geprüft wird

  • Rollenbrüche und Prompt-Injection - immer aktiv: der Bot befolgt in einer Besuchernachricht versteckte Anweisungen, verrät seine eigenen Regeln oder verlässt seine Support-Rolle
  • Medizinischer Rat - Diagnosen, Behandlungs- oder Dosierungsempfehlungen; Produktinformationen bleiben erlaubt
  • Rechtsberatung - Gesetze für die Situation des Besuchers auslegen; die eigenen Richtlinien zu nennen bleibt erlaubt
  • Finanzberatung - Anlage- oder persönliche Finanzempfehlungen; Ihre eigenen Preise und Gebühren bleiben erlaubt
  • Ihre verbotenen Themen - eine Freitextliste von Ihnen, ein Thema pro Zeile — hier legen Sie fest, was für Ihr Geschäft heikel ist

Das Vorfallsprotokoll

Jede Markierung wird auf der Einstellungsseite erfasst: Kategorie, Begründung des Klassifikators, der blockierte Entwurf und was der Besucher stattdessen sah. Es ist Ihr Werkzeug zum Justieren von Fehlalarmen UND der Prüfpfad für Ihr eigenes Compliance-Team. Vorfallsinhalte durchlaufen die PII-Schwärzung wie jede gespeicherte Oberfläche, und im Zero-Retention-Modus bleiben nur die Metadaten — kein Nachrichteninhalt.

Wenn der Klassifikator selbst ausfällt

Ein zweites Modell bedeutet eine zweite mögliche Fehlerquelle. Sie wählen, was dann passiert:

  • Fail-open (Standard) - die ungeprüfte Antwort wird geliefert; Verfügbarkeit gewinnt
  • Fail-closed - stattdessen erscheint die Ersatznachricht, für Websites, auf denen eine ungeprüfte Antwort schlimmer ist als keine

Gut zu wissen

  • Es reagiert nur auf die Antwort, nie auf die Frage - wenn Ihr Bot bereits ablehnt oder sicher antwortet, wird nichts markiert, und das ist richtig. Der Klassifikator ist ein Sicherheitsnetz für die seltene Antwort, die durchrutscht, keine Prüfung dessen, was der Besucher gefragt hat. Der Versuch, einen wohlerzogenen Bot zu knacken, zeigt meist keine Markierung, weil der Bot es selbst gehandhabt hat.
  • Latenz - die Prüfung fügt jeder Antwort etwa eine halbe Sekunde hinzu, und eine markierte Antwort kostet zusätzlich eine volle Neufassung
  • Keine Garantie - hier beurteilt ein Modell ein anderes; es ist eine zusätzliche unabhängige Schicht, keine absolute Barriere
  • Der Test-Chat zeigt Urteile - der Test-Chat im Dashboard prüft genau wie das Live-Widget und sagt Ihnen, wenn eine Antwort markiert wurde; versuchen Sie ruhig, Ihren eigenen Bot auszutricksen
  • Schreiben Sie die Ersatznachricht in der Sprache Ihrer Besucher - sie wird wörtlich angezeigt; der eingebaute Standard ist Englisch
  • Arbeitet mit Ihren KI-Anweisungen zusammen - die Anweisungen steuern das erste Modell, der Klassifikator fängt ab, was durchrutscht; nutzen Sie beides

Ergänzt die PII-Schwärzung: die eine Funktion kontrolliert, was gespeichert wird, die andere, was gesagt wird.

PII-Schwärzung Personenbezogene Daten werden maskiert, bevor eine Nachricht irgendwo gespeichert wird

Hinweis: Der Ausgabe-Klassifikator ist Teil einer Enterprise-Vereinbarung. Schreiben Sie an [email protected] und wir führen Sie durch alles.