Enterprise
Prezentare generală
În mod normal răspunsul IA merge direct la vizitator. Cu clasificatorul pornit, un al doilea model independent citește mai întâi fiecare răspuns și decide dacă e sigur de trimis: a fost botul păcălit să iasă din rol, dă sfaturi reglementate, atinge un subiect pe care l-ați interzis? Un răspuns semnalat nu ajunge niciodată la vizitator ca atare — e rescris o dată, iar dacă și rescrierea e semnalată, se afișează mesajul dvs. de rezervă.
Cum funcționează
- IA răspunde ca de obicei - nimic nu se schimbă la modelul principal
- Clasificatorul citește ciorna - un al doilea model rapid o verifică după categoriile activate
- Răspunsurile semnalate primesc o rescriere - încălcarea se întoarce la modelul principal, care scrie un răspuns corectat, verificat din nou
- Rezerva ca ultimă soluție - dacă și rescrierea e semnalată, vizitatorul vede mesajul dvs. de rezervă sigur
Ciornă de răspuns
Semnalat
Vizitatorul vede
Răspuns corectat
Ce verifică
- Ieșiri din rol și prompt injection - mereu activ: botul ascultă instrucțiuni ascunse într-un mesaj, își dezvăluie regulile sau își abandonează rolul de suport
- Sfaturi medicale - diagnostic, tratament sau dozaj; informațiile despre produse rămân permise
- Sfaturi juridice - interpretarea legii pentru situația vizitatorului; prezentarea propriilor politici rămâne permisă
- Sfaturi financiare - recomandări de investiții sau finanțe personale; propriile prețuri și taxe rămân permise
- Subiectele dvs. interzise - o listă liberă scrisă de dvs., un subiect pe linie — aici definiți ce e sensibil pentru afacerea dvs.
Jurnalul de incidente
Fiecare semnalare e înregistrată pe pagina de setări: categoria, motivul clasificatorului, ciorna blocată și ce a văzut vizitatorul în loc. E atât unealta dvs. de reglare a alarmelor false, CÂT și pista de audit pentru echipa dvs. de conformitate. Conținutul incidentelor trece prin mascarea PII ca orice suprafață stocată, iar în modul de păstrare zero rămân doar metadatele — niciun conținut de mesaje.
Dacă însuși clasificatorul cade
Un al doilea model e un al doilea lucru care poate expira. Alegeți ce se întâmplă atunci:
- Fail-open (implicit) - se livrează răspunsul neverificat; câștigă disponibilitatea
- Fail-closed - se afișează rezerva în loc, pentru site-uri unde un răspuns neverificat e mai rău decât niciunul
Bine de știut
- Acționează doar asupra răspunsului, niciodată asupra întrebării - dacă botul dvs. refuză deja sau răspunde în siguranță, nu se semnalează nimic, iar asta e corect. Clasificatorul e o plasă de siguranță pentru rarul răspuns care scapă, nu o verificare a ceea ce a întrebat vizitatorul. Încercarea de a păcăli un bot bine crescut de obicei nu va arăta nicio semnalare, pentru că botul s-a descurcat singur.
- Latență - verificarea adaugă circa o jumătate de secundă fiecărui răspuns, iar un răspuns semnalat plătește în plus o rescriere completă
- Nu e o garanție - e un model care judecă alt model; e un strat independent suplimentar, nu o barieră absolută
- Chatul de test arată verdictele - chatul de test din panou aplică la fel ca widgetul live și vă spune când un răspuns a fost semnalat; încercați să vă păcăliți propriul bot
- Scrieți rezerva în limba vizitatorilor dvs. - se afișează ca atare; mesajul implicit integrat e în engleză
- Funcționează împreună cu instrucțiunile IA - instrucțiunile ghidează primul model, clasificatorul prinde ce scapă; folosiți-le pe amândouă
Notă: Clasificatorul de răspunsuri face parte dintr-un acord Enterprise. Scrieți la [email protected] și vă explicăm totul.