Quay lại bảng điều khiển

Tài liệu

Tìm hiểu cách sử dụng Asyntai

Bộ phân loại câu trả lời

Một mô hình AI thứ hai kiểm tra mọi câu trả lời trước khi đến khách truy cập

Đi đến Bộ phân loại câu trả lời
Doanh nghiệp

Tổng quan

Thông thường câu trả lời của AI đi thẳng đến khách. Khi bật bộ phân loại, một mô hình thứ hai độc lập đọc mọi câu trả lời trước và quyết định có an toàn để gửi không: bot có bị lừa phá vai không, có đưa ra tư vấn được quản lý không, có chạm vào chủ đề bạn đã cấm không? Câu trả lời bị gắn cờ không bao giờ đến khách nguyên trạng — nó được viết lại một lần, và nếu bản viết lại vẫn bị gắn cờ, tin nhắn dự phòng của bạn sẽ hiện thay thế.

Cách hoạt động

  1. AI trả lời như thường lệ - không có gì thay đổi ở mô hình chính
  2. Bộ phân loại đọc bản nháp - một mô hình thứ hai nhanh kiểm tra theo các danh mục bạn bật
  3. Câu trả lời bị gắn cờ được viết lại một lần - vi phạm được gửi lại mô hình chính, viết câu trả lời sửa chữa và được kiểm tra lại
  4. Dự phòng là phương án cuối - nếu bản viết lại vẫn bị gắn cờ, khách thấy tin nhắn dự phòng an toàn của bạn
Bộ phân loại câu trả lời
Bản nháp câu trả lời Bị gắn cờ
Khách thấy Câu trả lời đã sửa

Kiểm tra những gì

  • Phá vai và prompt injection - luôn bật: bot nghe theo chỉ dẫn ẩn trong tin nhắn, tiết lộ quy tắc của mình hoặc rời bỏ vai trò hỗ trợ
  • Tư vấn y tế - chẩn đoán, điều trị hoặc liều lượng; thông tin sản phẩm vẫn được phép
  • Tư vấn pháp lý - diễn giải luật cho tình huống của khách; nêu chính sách của riêng bạn vẫn được phép
  • Tư vấn tài chính - khuyến nghị đầu tư hoặc tài chính cá nhân; giá và phí của riêng bạn vẫn được phép
  • Chủ đề bị cấm của bạn - danh sách tự do bạn viết, mỗi dòng một chủ đề — đây là nơi bạn xác định điều gì nhạy cảm với doanh nghiệp mình

Nhật ký sự cố

Mỗi cờ được ghi lại trên trang cài đặt: danh mục, lý do của bộ phân loại, bản nháp bị chặn và những gì khách thấy thay thế. Nó vừa là công cụ tinh chỉnh cảnh báo sai của bạn VỪA là dấu vết kiểm toán cho đội tuân thủ của bạn. Nội dung sự cố đi qua che dữ liệu cá nhân như mọi bề mặt lưu trữ, và trong chế độ Không lưu trữ chỉ giữ siêu dữ liệu — không có nội dung tin nhắn.

Nếu chính bộ phân loại lỗi

Mô hình thứ hai nghĩa là thứ hai có thể hết thời gian. Bạn chọn điều gì xảy ra khi đó:

  • Fail-open (mặc định) - câu trả lời chưa kiểm tra được gửi; tính sẵn sàng thắng
  • Fail-closed - dự phòng hiện thay thế, cho trang mà câu trả lời chưa kiểm tra tệ hơn không có câu trả lời

Nên biết

  • Nó chỉ tác động lên câu trả lời, không bao giờ lên câu hỏi - nếu bot của bạn đã từ chối hoặc trả lời an toàn, không có gì bị gắn cờ, và điều đó là đúng. Bộ phân loại là lưới an toàn cho câu trả lời hiếm hoi lọt qua, không phải kiểm tra những gì khách đã hỏi. Cố gắng bẻ khóa một bot cư xử tốt thường sẽ không hiện cờ, vì bot đã tự xử lý.
  • Độ trễ - kiểm tra thêm khoảng nửa giây cho mỗi câu trả lời, và câu trả lời bị gắn cờ trả thêm chi phí viết lại đầy đủ
  • Không phải bảo đảm - một mô hình đánh giá mô hình khác; là lớp độc lập bổ sung, không phải rào cản tuyệt đối
  • Trò chuyện thử nghiệm cho thấy phán quyết - trò chuyện thử nghiệm của bảng điều khiển thực thi như widget thật và báo khi câu trả lời bị gắn cờ; cứ thử lừa bot của chính bạn
  • Viết dự phòng bằng ngôn ngữ khách truy cập - hiển thị nguyên văn; mặc định tích hợp là tiếng Anh
  • Hoạt động cùng Hướng dẫn AI của bạn - hướng dẫn định hướng mô hình đầu, bộ phân loại bắt những gì lọt qua; dùng cả hai

Kết đôi với Che dữ liệu cá nhân: một tính năng kiểm soát những gì được lưu, tính năng kia kiểm soát những gì được nói.

Che dữ liệu cá nhân (PII) Dữ liệu cá nhân được che trước khi tin nhắn được lưu ở bất kỳ đâu

Lưu ý: Bộ phân loại câu trả lời là một phần của thỏa thuận Enterprise. Gửi email đến [email protected] và chúng tôi sẽ giải thích mọi thứ.