Atpakaļ uz informācijas paneli

Dokumentācija

Uzziniet, kā lietot Asyntai

Atbilžu klasifikators

Otrs MI modelis pārbauda katru atbildi, pirms tā sasniedz apmeklētāju

Doties uz atbilžu klasifikatoru
Enterprise

Pārskats

Parasti MI atbilde nonāk tieši pie apmeklētāja. Ar ieslēgtu klasifikatoru otrs, neatkarīgs modelis vispirms izlasa katru atbildi un izlemj, vai to droši sūtīt: vai robots tika apmānīts iziet no lomas, vai tas sniedz regulētus padomus, vai skar jūsu aizliegtu tēmu? Atzīmēta atbilde nekad nesasniedz apmeklētāju tāda, kāda tā ir — to vienreiz pārraksta, un ja atzīmē arī pārrakstīto, tās vietā parādās jūsu rezerves ziņa.

Kā tas darbojas

  1. MI atbild kā parasti - galvenajā modelī nekas nemainās
  2. Klasifikators lasa melnrakstu - ātrs otrs modelis to pārbauda pēc ieslēgtajām kategorijām
  3. Atzīmētās atbildes saņem vienu pārrakstīšanu - pārkāpums atgriežas pie galvenā modeļa, kas uzraksta izlabotu atbildi, kuru pārbauda vēlreiz
  4. Rezerves ziņa kā pēdējais līdzeklis - ja atzīmē arī pārrakstīto, apmeklētājs redz jūsu drošo rezerves ziņu
Atbilžu klasifikators
Atbildes melnraksts Atzīmēta
Apmeklētājs redz Izlabota atbilde

Ko pārbauda

  • Lomas pārkāpumi un prompt injection - vienmēr aktīvs: robots izpilda ziņā paslēptas instrukcijas, atklāj savus noteikumus vai pamet atbalsta lomu
  • Medicīniski padomi - diagnoze, ārstēšana vai devas; produktu informācija paliek atļauta
  • Juridiski padomi - likuma interpretēšana apmeklētāja situācijai; savu noteikumu izklāstīšana paliek atļauta
  • Finanšu padomi - ieguldījumu vai personīgo finanšu ieteikumi; jūsu pašu cenas un maksas paliek atļautas
  • Jūsu aizliegtās tēmas - brīvs saraksts, ko rakstāt jūs, pa vienai tēmai rindā — šeit jūs nosakāt, kas ir jutīgs jūsu biznesam

Incidentu žurnāls

Katra atzīme tiek reģistrēta iestatījumu lapā: kategorija, klasifikatora pamatojums, bloķētais melnraksts un tas, ko apmeklētājs redzēja tā vietā. Tas ir gan jūsu viltus trauksmju pielāgošanas rīks, GAN audita pēdas jūsu atbilstības komandai. Incidentu saturs iziet PII maskēšanu kā katra saglabātā virsma, un nulles glabāšanas režīmā paliek tikai metadati — nekāda ziņu satura.

Ja pats klasifikators atsakās

Otrs modelis ir otra lieta, kam var beigties laiks. Jūs izvēlaties, kas tad notiek:

  • Fail-open (noklusējums) - tiek piegādāta nepārbaudītā atbilde; uzvar pieejamība
  • Fail-closed - tās vietā parādās rezerves, vietnēm, kur nepārbaudīta atbilde ir sliktāka par nekādu

Der zināt

  • Tas darbojas tikai ar atbildi, nekad ar jautājumu - ja jūsu robots jau atsakās vai atbild droši, nekas netiek atzīmēts, un tas ir pareizi. Klasifikators ir drošības tīkls retajai atbildei, kas izsprūk, nevis pārbaude tam, ko apmeklētājs jautāja. Mēģinājums pievilt labi audzinātu robotu parasti nerādīs atzīmi, jo robots tika galā pats.
  • Aizture - pārbaude pievieno katrai atbildei aptuveni pussekundi, un atzīmēta atbilde papildus maksā pilnu pārrakstīšanu
  • Ne garantija - viens modelis vērtē otru; tas ir papildu neatkarīgs slānis, ne absolūta barjera
  • Testa saruna rāda spriedumus - vadības paneļa testa saruna piemēro kā dzīvais logrīks un pasaka, kad atbilde tika atzīmēta; pamēģiniet apmānīt savu robotu
  • Rakstiet rezerves ziņu savu apmeklētāju valodā - tā tiek rādīta burtiski; iebūvētā noklusējuma ir angļu valodā
  • Darbojas kopā ar jūsu MI instrukcijām - instrukcijas vada pirmo modeli, klasifikators notver to, kas izsprūk; izmantojiet abus

Veido pāri ar PII maskēšanu: viena funkcija nosaka, kas tiek saglabāts, otra — kas tiek pateikts.

PII maskēšana Personas dati tiek maskēti, pirms ziņa kaut kur tiek saglabāta

Piezīme: Atbilžu klasifikators ir daļa no Enterprise līguma. Rakstiet uz [email protected], un mēs visu izskaidrosim.