Späť na panel

Dokumentácia

Naučte sa používať Asyntai

Klasifikátor odpovedí

Druhý model AI kontroluje každú odpoveď skôr, než sa dostane k návštevníkovi

Prejsť na klasifikátor odpovedí
Enterprise

Prehľad

Normálne ide odpoveď AI rovno k návštevníkovi. So zapnutým klasifikátorom si každú odpoveď najprv prečíta druhý, nezávislý model a rozhodne, či je bezpečné ju odoslať: nechal sa bot vylákať z roly, dáva regulované rady, púšťa sa do témy, ktorú ste zakázali? Označená odpoveď sa k návštevníkovi nikdy nedostane tak, ako je — raz sa prepíše, a ak je označený aj prepis, zobrazí sa vaša náhradná správa.

Ako to funguje

  1. AI odpovedá ako zvyčajne - na hlavnom modeli sa nič nemení
  2. Klasifikátor číta koncept - rýchly druhý model ho kontroluje podľa zapnutých kategórií
  3. Označené odpovede dostanú jeden prepis - porušenie sa vráti hlavnému modelu, ktorý napíše opravenú odpoveď, ktorá sa kontroluje znova
  4. Náhradná správa ako posledná možnosť - ak je označený aj prepis, návštevník uvidí vašu bezpečnú náhradnú správu
Klasifikátor odpovedí
Koncept odpovede Označená
Návštevník vidí Opravená odpoveď

Čo sa kontroluje

  • Porušenia roly a prompt injection - vždy aktívne: bot plní inštrukcie skryté v správe, prezrádza vlastné pravidlá alebo opúšťa rolu podpory
  • Lekárske rady - diagnóza, liečba alebo dávkovanie; informácie o produktoch zostávajú povolené
  • Právne rady - výklad práva pre situáciu návštevníka; uvádzať vlastné zásady zostáva povolené
  • Finančné rady - investičné odporúčania alebo osobné financie; vaše vlastné ceny a poplatky zostávajú povolené
  • Vaše zakázané témy - voľný zoznam, ktorý píšete vy, jedna téma na riadok — tu určujete, čo je pre váš biznis citlivé

Protokol incidentov

Každé označenie sa zaznamenáva na stránke nastavení: kategória, zdôvodnenie klasifikátora, zablokovaný koncept a to, čo návštevník videl namiesto neho. Je to váš nástroj na ladenie falošných poplachov AJ auditná stopa pre váš compliance tím. Obsah incidentov prechádza maskovaním PII ako každý ukladaný povrch a v režime nulového uchovávania zostávajú len metadáta — žiadny obsah správ.

Keď zlyhá sám klasifikátor

Druhý model je druhá vec, ktorej môže vypršať čas. Vy volíte, čo sa potom stane:

  • Fail-open (predvolené) - doručí sa neskontrolovaná odpoveď; vyhráva dostupnosť
  • Fail-closed - namiesto nej sa zobrazí náhradná, pre weby, kde je neskontrolovaná odpoveď horšia než žiadna

Dobré vedieť

  • Reaguje len na odpoveď, nikdy na otázku - ak váš bot už odmieta alebo odpovedá bezpečne, nič sa neoznačí a to je správne. Klasifikátor je záchranná sieť pre vzácnu odpoveď, ktorá prekĺzne, nie kontrola toho, na čo sa návštevník spýtal. Pokus oklamať slušného bota zvyčajne neukáže žiadne označenie, pretože si to bot vybavil sám.
  • Latencia - kontrola pridáva každej odpovedi zhruba pol sekundy a označená odpoveď platí navyše celým prepisom
  • Nie je to záruka - jeden model posudzuje druhý; je to ďalšia nezávislá vrstva, nie absolútna bariéra
  • Testovací chat ukazuje verdikty - testovací chat v prehľade vynucuje ako živý widget a povie vám, kedy bola odpoveď označená; pokojne skúste prekabátiť vlastného bota
  • Náhradnú správu napíšte v jazyku svojich návštevníkov - zobrazuje sa doslovne; vstavaná predvolená je po anglicky
  • Funguje spolu s vašimi inštrukciami AI - inštrukcie riadia prvý model, klasifikátor chytá, čo prekĺzne; používajte oboje

Dopĺňa maskovanie PII: jedna funkcia riadi, čo sa ukladá, druhá, čo sa hovorí.

Maskovanie PII Osobné údaje sa maskujú skôr, než sa správa kdekoľvek uloží

Poznámka: Klasifikátor odpovedí je súčasťou zmluvy Enterprise. Napíšte na [email protected] a všetko vám vysvetlíme.