Lewati ke konten utama
menjadi.dev
AI

Guardrails (AI)

Batasan keamanan yang mencegah AI menghasilkan output berbahaya, tidak pantas, atau tidak etis.

AI Guardrails adalah lapisan keamanan yang membatasi apa yang boleh dan tidak boleh dilakukan atau dihasilkan AI. Jenis guardrails: (1) Input filtering — validasi dan filter prompt user sebelum masuk ke model (cek harmful content, PII, injection attempts). (2) Output filtering — periksa respons AI sebelum ditampilkan ke user (content safety, format compliance). (3) Behavioral constraints — aturan di system prompt tentang apa yang TIDAK BOLEH dilakukan. (4) Rate limiting — batasi frekuensi request. (5) Human-in-the-loop — eskalasi ke manusia untuk keputusan kritis. Guardrails adalah mandatory, bukan optional — terutama untuk produk AI yang melayani pengguna publik.

Istilah Terkait