Înapoi la tabloul de bord

Documentație

Aflați cum să utilizați Asyntai

Clasificatorul de răspunsuri

Un al doilea model de IA verifică fiecare răspuns înainte să ajungă la vizitator

Mergi la clasificatorul de răspunsuri
Enterprise

Prezentare generală

În mod normal răspunsul IA merge direct la vizitator. Cu clasificatorul pornit, un al doilea model independent citește mai întâi fiecare răspuns și decide dacă e sigur de trimis: a fost botul păcălit să iasă din rol, dă sfaturi reglementate, atinge un subiect pe care l-ați interzis? Un răspuns semnalat nu ajunge niciodată la vizitator ca atare — e rescris o dată, iar dacă și rescrierea e semnalată, se afișează mesajul dvs. de rezervă.

Cum funcționează

  1. IA răspunde ca de obicei - nimic nu se schimbă la modelul principal
  2. Clasificatorul citește ciorna - un al doilea model rapid o verifică după categoriile activate
  3. Răspunsurile semnalate primesc o rescriere - încălcarea se întoarce la modelul principal, care scrie un răspuns corectat, verificat din nou
  4. Rezerva ca ultimă soluție - dacă și rescrierea e semnalată, vizitatorul vede mesajul dvs. de rezervă sigur
Clasificatorul de răspunsuri
Ciornă de răspuns Semnalat
Vizitatorul vede Răspuns corectat

Ce verifică

  • Ieșiri din rol și prompt injection - mereu activ: botul ascultă instrucțiuni ascunse într-un mesaj, își dezvăluie regulile sau își abandonează rolul de suport
  • Sfaturi medicale - diagnostic, tratament sau dozaj; informațiile despre produse rămân permise
  • Sfaturi juridice - interpretarea legii pentru situația vizitatorului; prezentarea propriilor politici rămâne permisă
  • Sfaturi financiare - recomandări de investiții sau finanțe personale; propriile prețuri și taxe rămân permise
  • Subiectele dvs. interzise - o listă liberă scrisă de dvs., un subiect pe linie — aici definiți ce e sensibil pentru afacerea dvs.

Jurnalul de incidente

Fiecare semnalare e înregistrată pe pagina de setări: categoria, motivul clasificatorului, ciorna blocată și ce a văzut vizitatorul în loc. E atât unealta dvs. de reglare a alarmelor false, CÂT și pista de audit pentru echipa dvs. de conformitate. Conținutul incidentelor trece prin mascarea PII ca orice suprafață stocată, iar în modul de păstrare zero rămân doar metadatele — niciun conținut de mesaje.

Dacă însuși clasificatorul cade

Un al doilea model e un al doilea lucru care poate expira. Alegeți ce se întâmplă atunci:

  • Fail-open (implicit) - se livrează răspunsul neverificat; câștigă disponibilitatea
  • Fail-closed - se afișează rezerva în loc, pentru site-uri unde un răspuns neverificat e mai rău decât niciunul

Bine de știut

  • Acționează doar asupra răspunsului, niciodată asupra întrebării - dacă botul dvs. refuză deja sau răspunde în siguranță, nu se semnalează nimic, iar asta e corect. Clasificatorul e o plasă de siguranță pentru rarul răspuns care scapă, nu o verificare a ceea ce a întrebat vizitatorul. Încercarea de a păcăli un bot bine crescut de obicei nu va arăta nicio semnalare, pentru că botul s-a descurcat singur.
  • Latență - verificarea adaugă circa o jumătate de secundă fiecărui răspuns, iar un răspuns semnalat plătește în plus o rescriere completă
  • Nu e o garanție - e un model care judecă alt model; e un strat independent suplimentar, nu o barieră absolută
  • Chatul de test arată verdictele - chatul de test din panou aplică la fel ca widgetul live și vă spune când un răspuns a fost semnalat; încercați să vă păcăliți propriul bot
  • Scrieți rezerva în limba vizitatorilor dvs. - se afișează ca atare; mesajul implicit integrat e în engleză
  • Funcționează împreună cu instrucțiunile IA - instrucțiunile ghidează primul model, clasificatorul prinde ce scapă; folosiți-le pe amândouă

Se împerechează cu mascarea PII: o funcție controlează ce se stochează, cealaltă ce se spune.

Mascarea PII Datele personale sunt mascate înainte ca mesajul să fie salvat oriunde

Notă: Clasificatorul de răspunsuri face parte dintr-un acord Enterprise. Scrieți la [email protected] și vă explicăm totul.