Kembali ke Dasbor

Dokumentasi

Pelajari cara menggunakan Asyntai

Pengklasifikasi Jawaban

Model AI kedua memeriksa setiap jawaban sebelum sampai ke pengunjung

Buka Pengklasifikasi Jawaban
Enterprise

Ringkasan

Biasanya jawaban AI langsung ke pengunjung. Dengan pengklasifikasi aktif, model kedua yang independen membaca setiap jawaban lebih dulu dan memutuskan apakah aman dikirim: apakah bot ditipu keluar dari perannya, apakah ia memberi saran yang diregulasi, apakah ia menyentuh topik yang Anda larang? Jawaban yang ditandai tidak pernah sampai ke pengunjung apa adanya — ditulis ulang sekali, dan jika penulisan ulang masih ditandai, pesan cadangan Anda yang ditampilkan.

Cara Kerjanya

  1. AI menjawab seperti biasa - tidak ada yang berubah pada model utama
  2. Pengklasifikasi membaca draf - model kedua yang cepat memeriksanya terhadap kategori yang Anda aktifkan
  3. Jawaban yang ditandai mendapat satu penulisan ulang - pelanggaran dikembalikan ke model utama, yang menulis jawaban terkoreksi dan diperiksa lagi
  4. Cadangan sebagai jalan terakhir - jika penulisan ulang masih ditandai, pengunjung melihat pesan cadangan Anda yang aman
Pengklasifikasi Jawaban
Draf jawaban Ditandai
Pengunjung melihat Jawaban terkoreksi

Apa yang diperiksa

  • Pelanggaran peran dan prompt injection - selalu aktif: bot menuruti instruksi tersembunyi dalam pesan, membocorkan aturannya sendiri, atau meninggalkan peran dukungan
  • Saran medis - diagnosis, pengobatan, atau dosis; informasi produk tetap diperbolehkan
  • Saran hukum - menafsirkan hukum untuk situasi pengunjung; menyampaikan kebijakan Anda sendiri tetap diperbolehkan
  • Saran keuangan - rekomendasi investasi atau keuangan pribadi; harga dan biaya Anda sendiri tetap diperbolehkan
  • Topik terlarang Anda - daftar bebas yang Anda tulis, satu topik per baris — di sini Anda menentukan apa yang sensitif untuk bisnis Anda

Log Insiden

Setiap tanda dicatat di halaman pengaturan: kategori, alasan pengklasifikasi, draf yang diblokir, dan apa yang dilihat pengunjung sebagai gantinya. Ini alat penyetelan alarm palsu Anda SEKALIGUS jejak audit untuk tim kepatuhan Anda sendiri. Konten insiden melewati penyamaran PII seperti setiap permukaan tersimpan, dan dalam mode Retensi Nol hanya metadata yang disimpan — tanpa konten pesan.

Jika pengklasifikasi sendiri gagal

Model kedua berarti hal kedua yang bisa kehabisan waktu. Anda memilih apa yang terjadi kemudian:

  • Fail-open (default) - jawaban yang belum diperiksa dikirimkan; ketersediaan menang
  • Fail-closed - cadangan ditampilkan sebagai gantinya, untuk situs di mana jawaban yang belum diperiksa lebih buruk daripada tidak ada

Perlu diketahui

  • Ini hanya bertindak pada jawaban, tidak pernah pada pertanyaan - jika bot Anda sudah menolak atau menjawab dengan aman, tidak ada yang ditandai, dan itu benar. Pengklasifikasi adalah jaring pengaman untuk jawaban langka yang lolos, bukan pemeriksaan atas apa yang ditanyakan pengunjung. Mencoba menjebol bot yang berperilaku baik biasanya tidak menampilkan tanda, karena bot menanganinya sendiri.
  • Latensi - pemeriksaan menambah sekitar setengah detik ke setiap jawaban, dan jawaban yang ditandai membayar penulisan ulang penuh di atasnya
  • Bukan jaminan - satu model menilai yang lain; ini lapisan independen tambahan, bukan penghalang mutlak
  • Obrolan uji menunjukkan putusan - obrolan uji dasbor menegakkan seperti widget langsung dan memberi tahu saat jawaban ditandai; coba saja kelabui bot Anda sendiri
  • Tulis cadangan dalam bahasa pengunjung Anda - ditampilkan apa adanya; default bawaan dalam bahasa Inggris
  • Bekerja bersama Instruksi AI Anda - instruksi mengarahkan model pertama, pengklasifikasi menangkap yang lolos; gunakan keduanya

Berpasangan dengan Penyamaran PII: satu fitur mengontrol apa yang disimpan, yang lain apa yang dikatakan.

Penyamaran PII Data pribadi disamarkan sebelum pesan disimpan di mana pun

Catatan: Pengklasifikasi Jawaban adalah bagian dari perjanjian Enterprise. Kirim email ke [email protected] dan kami akan menjelaskan semuanya.