Enterprise
Oversigt
Normalt går AI'ens svar direkte til besøgeren. Med klassifikatoren slået til læser en anden, uafhængig model først hvert svar og afgør, om det er sikkert at sende: blev botten narret ud af sin rolle, giver den reguleret rådgivning, går den ind på et emne, du har forbudt? Et markeret svar når aldrig besøgeren, som det er — det omskrives én gang, og hvis omskrivningen også markeres, vises din reservebesked i stedet.
Sådan fungerer det
- AI'en svarer som sædvanligt - intet ændres ved hovedmodellen
- Klassifikatoren læser udkastet - en hurtig anden model tjekker det mod dine aktiverede kategorier
- Markerede svar får én omskrivning - overtrædelsen sendes tilbage til hovedmodellen, som skriver et rettet svar, der tjekkes igen
- Reserven som sidste udvej - hvis omskrivningen også markeres, ser besøgeren din sikre reservebesked
Svarudkast
Markeret
Besøgeren ser
Rettet svar
Hvad der tjekkes
- Rollebrud og prompt injection - altid aktivt: botten adlyder skjulte instruktioner i en besked, afslører sine egne regler eller forlader sin supportrolle
- Medicinsk rådgivning - diagnose, behandling eller dosering; produktinformation forbliver tilladt
- Juridisk rådgivning - at fortolke loven for besøgerens situation; at beskrive jeres egne politikker forbliver tilladt
- Finansiel rådgivning - investerings- eller privatøkonomiske anbefalinger; jeres egne priser og gebyrer forbliver tilladt
- Dine forbudte emner - en fri liste, du selv skriver, ét emne pr. linje — her definerer du, hvad der er følsomt for din forretning
Hændelsesloggen
Hver markering registreres på indstillingssiden: kategorien, klassifikatorens begrundelse, det blokerede udkast og hvad besøgeren så i stedet. Det er både dit værktøj til at justere falske alarmer OG revisionssporet til dit eget compliance-team. Hændelsesindhold går gennem PII-maskering som enhver gemt overflade, og i Zero Retention-tilstand beholdes kun metadata — intet beskedindhold.
Hvis klassifikatoren selv fejler
En anden model er en anden ting, der kan nå tidsgrænsen. Du vælger, hvad der så sker:
- Fail-open (standard) - det utjekkede svar leveres; tilgængelighed vinder
- Fail-closed - reserven vises i stedet, for sites hvor et utjekket svar er værre end intet svar
Godt at vide
- Det handler kun på svaret, aldrig på spørgsmålet - hvis din bot allerede afviser eller svarer sikkert, markeres intet, og det er korrekt. Klassifikatoren er et sikkerhedsnet for det sjældne svar, der slipper igennem, ikke en kontrol af, hvad den besøgende spurgte om. At forsøge at narre en velopdragen bot viser som regel ingen markering, fordi botten håndterede det selv.
- Latens - tjekket tilføjer cirka et halvt sekund til hvert svar, og et markeret svar betaler derudover en fuld omskrivning
- Ikke en garanti - én model bedømmer en anden; det er et ekstra uafhængigt lag, ikke en absolut barriere
- Testchatten viser domme - dashboardets testchat håndhæver som live-widgetten og fortæller dig, når et svar blev markeret; prøv at narre din egen bot
- Skriv reserven på dine besøgendes sprog - den vises ordret; den indbyggede standard er på engelsk
- Fungerer sammen med dine AI-instruktioner - instruktionerne styrer den første model, klassifikatoren fanger det, der slipper igennem; brug begge
Bemærk: Svarklassifikatoren er en del af en Enterprise-aftale. Skriv til [email protected], så gennemgår vi det hele.