Tilbage til dashboard

Dokumentation

Lær, hvordan du bruger Asyntai

Svarklassifikator

En anden AI-model tjekker hvert svar, før det når besøgeren

Gå til svarklassifikatoren
Enterprise

Oversigt

Normalt går AI'ens svar direkte til besøgeren. Med klassifikatoren slået til læser en anden, uafhængig model først hvert svar og afgør, om det er sikkert at sende: blev botten narret ud af sin rolle, giver den reguleret rådgivning, går den ind på et emne, du har forbudt? Et markeret svar når aldrig besøgeren, som det er — det omskrives én gang, og hvis omskrivningen også markeres, vises din reservebesked i stedet.

Sådan fungerer det

  1. AI'en svarer som sædvanligt - intet ændres ved hovedmodellen
  2. Klassifikatoren læser udkastet - en hurtig anden model tjekker det mod dine aktiverede kategorier
  3. Markerede svar får én omskrivning - overtrædelsen sendes tilbage til hovedmodellen, som skriver et rettet svar, der tjekkes igen
  4. Reserven som sidste udvej - hvis omskrivningen også markeres, ser besøgeren din sikre reservebesked
Svarklassifikator
Svarudkast Markeret
Besøgeren ser Rettet svar

Hvad der tjekkes

  • Rollebrud og prompt injection - altid aktivt: botten adlyder skjulte instruktioner i en besked, afslører sine egne regler eller forlader sin supportrolle
  • Medicinsk rådgivning - diagnose, behandling eller dosering; produktinformation forbliver tilladt
  • Juridisk rådgivning - at fortolke loven for besøgerens situation; at beskrive jeres egne politikker forbliver tilladt
  • Finansiel rådgivning - investerings- eller privatøkonomiske anbefalinger; jeres egne priser og gebyrer forbliver tilladt
  • Dine forbudte emner - en fri liste, du selv skriver, ét emne pr. linje — her definerer du, hvad der er følsomt for din forretning

Hændelsesloggen

Hver markering registreres på indstillingssiden: kategorien, klassifikatorens begrundelse, det blokerede udkast og hvad besøgeren så i stedet. Det er både dit værktøj til at justere falske alarmer OG revisionssporet til dit eget compliance-team. Hændelsesindhold går gennem PII-maskering som enhver gemt overflade, og i Zero Retention-tilstand beholdes kun metadata — intet beskedindhold.

Hvis klassifikatoren selv fejler

En anden model er en anden ting, der kan nå tidsgrænsen. Du vælger, hvad der så sker:

  • Fail-open (standard) - det utjekkede svar leveres; tilgængelighed vinder
  • Fail-closed - reserven vises i stedet, for sites hvor et utjekket svar er værre end intet svar

Godt at vide

  • Det handler kun på svaret, aldrig på spørgsmålet - hvis din bot allerede afviser eller svarer sikkert, markeres intet, og det er korrekt. Klassifikatoren er et sikkerhedsnet for det sjældne svar, der slipper igennem, ikke en kontrol af, hvad den besøgende spurgte om. At forsøge at narre en velopdragen bot viser som regel ingen markering, fordi botten håndterede det selv.
  • Latens - tjekket tilføjer cirka et halvt sekund til hvert svar, og et markeret svar betaler derudover en fuld omskrivning
  • Ikke en garanti - én model bedømmer en anden; det er et ekstra uafhængigt lag, ikke en absolut barriere
  • Testchatten viser domme - dashboardets testchat håndhæver som live-widgetten og fortæller dig, når et svar blev markeret; prøv at narre din egen bot
  • Skriv reserven på dine besøgendes sprog - den vises ordret; den indbyggede standard er på engelsk
  • Fungerer sammen med dine AI-instruktioner - instruktionerne styrer den første model, klassifikatoren fanger det, der slipper igennem; brug begge

Danner par med PII-maskering: den ene funktion styrer, hvad der gemmes, den anden, hvad der siges.

PII-maskering Persondata maskeres, før en besked gemmes noget sted

Bemærk: Svarklassifikatoren er en del af en Enterprise-aftale. Skriv til [email protected], så gennemgår vi det hele.