องค์กร
ภาพรวม
ปกติคำตอบของ AI จะไปถึงผู้เยี่ยมชมโดยตรง เมื่อเปิดตัวคัดกรอง โมเดลตัวที่สองที่เป็นอิสระจะอ่านทุกคำตอบก่อนและตัดสินว่าปลอดภัยที่จะส่งหรือไม่: บอทถูกหลอกให้หลุดบทบาทหรือไม่ ให้คำแนะนำที่ถูกกำกับดูแลหรือไม่ แตะหัวข้อที่คุณห้ามหรือไม่? คำตอบที่ถูกแฟล็กจะไม่มีวันถึงผู้เยี่ยมชมตามเดิม — มันถูกเขียนใหม่หนึ่งครั้ง และหากการเขียนใหม่ยังถูกแฟล็ก ข้อความสำรองของคุณจะแสดงแทน
วิธีการทำงาน
- AI ตอบตามปกติ - ไม่มีอะไรเปลี่ยนในโมเดลหลัก
- ตัวคัดกรองอ่านร่าง - โมเดลตัวที่สองที่รวดเร็วตรวจสอบตามหมวดหมู่ที่เปิดใช้
- คำตอบที่ถูกแฟล็กได้เขียนใหม่หนึ่งครั้ง - การละเมิดถูกส่งกลับให้โมเดลหลักเขียนคำตอบที่แก้ไขแล้ว ซึ่งถูกตรวจสอบอีกครั้ง
- ข้อความสำรองเป็นทางเลือกสุดท้าย - หากการเขียนใหม่ยังถูกแฟล็ก ผู้เยี่ยมชมจะเห็นข้อความสำรองที่ปลอดภัยของคุณ
ร่างคำตอบ
ถูกแฟล็ก
ผู้เยี่ยมชมเห็น
คำตอบที่แก้ไขแล้ว
ตรวจสอบอะไรบ้าง
- การหลุดบทบาทและ prompt injection - เปิดเสมอ: บอทเชื่อฟังคำสั่งที่ซ่อนในข้อความ เปิดเผยกฎของตัวเอง หรือละทิ้งบทบาทฝ่ายสนับสนุน
- คำแนะนำทางการแพทย์ - การวินิจฉัย การรักษา หรือขนาดยา; ข้อมูลผลิตภัณฑ์ยังคงได้รับอนุญาต
- คำแนะนำทางกฎหมาย - การตีความกฎหมายสำหรับสถานการณ์ของผู้เยี่ยมชม; การระบุนโยบายของคุณเองยังคงได้รับอนุญาต
- คำแนะนำทางการเงิน - คำแนะนำการลงทุนหรือการเงินส่วนบุคคล; ราคาและค่าธรรมเนียมของคุณเองยังคงได้รับอนุญาต
- หัวข้อต้องห้ามของคุณ - รายการอิสระที่คุณเขียนเอง หนึ่งหัวข้อต่อบรรทัด — ที่นี่คุณกำหนดว่าอะไรอ่อนไหวสำหรับธุรกิจของคุณ
บันทึกเหตุการณ์
ทุกแฟล็กถูกบันทึกในหน้าตั้งค่า: หมวดหมู่ เหตุผลของตัวคัดกรอง ร่างที่ถูกบล็อก และสิ่งที่ผู้เยี่ยมชมเห็นแทน มันเป็นทั้งเครื่องมือปรับแจ้งเตือนผิดพลาดของคุณ และหลักฐานการตรวจสอบสำหรับทีมกำกับดูแลของคุณเอง เนื้อหาเหตุการณ์ผ่านการปกปิดข้อมูลส่วนบุคคลเหมือนทุกพื้นผิวที่จัดเก็บ และในโหมดไม่เก็บข้อมูลจะเก็บเฉพาะเมทาดาทา — ไม่มีเนื้อหาข้อความ
หากตัวคัดกรองเองล้มเหลว
โมเดลตัวที่สองหมายถึงสิ่งที่สองที่อาจหมดเวลาได้ คุณเลือกว่าจะเกิดอะไรขึ้น:
- Fail-open (ค่าเริ่มต้น) - ส่งคำตอบที่ยังไม่ตรวจสอบ; ความพร้อมใช้งานชนะ
- Fail-closed - แสดงข้อความสำรองแทน สำหรับไซต์ที่คำตอบที่ยังไม่ตรวจสอบแย่กว่าไม่มีคำตอบ
ควรทราบ
- มันทำงานกับคำตอบเท่านั้น ไม่ใช่คำถาม - ถ้าบอทของคุณปฏิเสธหรือตอบอย่างปลอดภัยอยู่แล้ว จะไม่มีอะไรถูกแฟล็ก และนั่นถูกต้อง ตัวคัดกรองคือตาข่ายนิรภัยสำหรับคำตอบที่หลุดรอดออกมาซึ่งพบได้ยาก ไม่ใช่การตรวจสิ่งที่ผู้เยี่ยมชมถาม การพยายามเจาะบอทที่ประพฤติดีมักไม่แสดงแฟล็ก เพราะบอทจัดการมันได้เอง
- ความหน่วง - การตรวจสอบเพิ่มประมาณครึ่งวินาทีต่อทุกคำตอบ และคำตอบที่ถูกแฟล็กต้องจ่ายค่าเขียนใหม่เต็มรูปแบบเพิ่ม
- ไม่ใช่การรับประกัน - โมเดลหนึ่งตัดสินอีกโมเดล; เป็นชั้นอิสระเพิ่มเติม ไม่ใช่กำแพงสมบูรณ์
- แชททดสอบแสดงคำตัดสิน - แชททดสอบในแดชบอร์ดบังคับใช้เหมือนวิดเจ็ตจริงและบอกเมื่อคำตอบถูกแฟล็ก; ลองหลอกบอทของคุณเองดู
- เขียนข้อความสำรองด้วยภาษาของผู้เยี่ยมชม - แสดงตามที่เขียนทุกตัวอักษร; ค่าเริ่มต้นในตัวเป็นภาษาอังกฤษ
- ทำงานร่วมกับคำสั่ง AI ของคุณ - คำสั่งชี้นำโมเดลแรก ตัวคัดกรองจับสิ่งที่หลุดรอด; ใช้ทั้งคู่
หมายเหตุ: ตัวคัดกรองคำตอบเป็นส่วนหนึ่งของข้อตกลง Enterprise เขียนถึง [email protected] แล้วเราจะอธิบายทุกอย่างให้ฟัง