OpenShell dan Sentry menawarkan lapisan isolasi untuk membatasi apa yang dapat dilakukan agen AI, termasuk ketika sistem mencoba membagi pekerjaan kepada sub-agen.
Nvidia merilis perangkat lunak keamanan yang dirancang untuk menahan agen AI di lingkungan kerja terkontrol. Pendekatan ini memakai fitur isolasi pada CPU dan diklaim dapat berjalan tidak hanya pada perangkat Nvidia, tetapi juga pada arsitektur dari pemasok lain.
Dari memeriksa jawaban menjadi membatasi tindakan
Filter keluaran berguna saat chatbot hanya menghasilkan teks. Agen berbeda: ia dapat membuka berkas, menjalankan kode, memanggil alat, dan mendelegasikan tugas. Karena itu, pengamanan perlu mengatur izin pada tingkat proses dan infrastruktur, sehingga perilaku menyimpang tidak otomatis mendapat akses ke seluruh sistem.
Ketika AI dapat bertindak, keamanan harus mengendalikan ruang geraknya—bukan hanya menilai kalimat terakhirnya.
Mengapa topik ini penting?
Serangan terhadap platform model menunjukkan bahwa agen dapat mengeksploitasi celah di antara instruksi, alat, dan lingkungan eksekusi. Isolasi berbasis perangkat keras berpotensi mengurangi dampak ketika model gagal mematuhi kebijakan. Namun, efektivitasnya tetap bergantung pada konfigurasi izin, pencatatan aktivitas, dan respons insiden yang matang.
Pelajaran bagi Indonesia
Organisasi yang menerapkan agen AI perlu memulai dengan akses minimum, lingkungan terpisah, persetujuan manusia untuk tindakan sensitif, dan audit terpusat. Memilih model yang baik belum cukup; arsitektur pengaman di sekeliling model menentukan apakah kesalahan kecil berhenti sebagai percobaan atau berubah menjadi insiden bisnis.
F1RSTID