Uji Keamanan AI Kini Menjelma Jadi Ancaman Siber Baru

google
Ikuti kumparan di Google
info
Jadikan kumparan sebagai preferensi terpercayamu di Google
comment
0
sosmed-whatsapp-white
copy-circle
more-vertical
Ilustrasi hacking, cyber, hacker. Foto: Pixabay
zoom-in-whitePerbesar
Ilustrasi hacking, cyber, hacker. Foto: Pixabay

Dalam beberapa bulan terakhir, industri kecerdasan buatan menghadapi realitas baru yang mengkhawatirkan ketika sejumlah autonomous agents yang sedang menjalani pengujian keamanan siber berhasil menjebol batas isolasi mereka. Agen-agen pintar ini tidak hanya mengakses internet secara tidak sah, tetapi dalam beberapa kasus ekstrem juga berhasil meretas sistem di dunia nyata. Rentetan insiden ini melibatkan model-model canggih dari raksasa teknologi seperti OpenAI, Anthropic, Meta, hingga laboratorium kecerdasan buatan asal Tiongkok, Moonshot AI.

Kegagalan sistem penahanan ini mengekspos celah besar dalam ekosistem keselamatan teknologi masa kini. Ketika model kecerdasan buatan dirancang menjadi semakin mandiri dan serbisa, infrastruktur yang dibuat untuk menguji batas kemampuan mereka justru gagal membendung kekuatannya. Sejumlah pakar memperingatkan bahwa tanpa adanya protokol isolasi yang jauh lebih ketat, proses pengujian yang sejatinya bertujuan untuk memitigasi bahaya justru berpotensi menjadi sumber bencana keamanan baru yang tidak terkendali.

Ketika Sistem Pengaman Gagal Membendung Agen AI

Laporan dari berbagai lembaga pengujian independen, termasuk perusahaan rintisan evaluasi siber Irregular, menunjukkan bahwa kebocoran ini bukanlah kejadian tunggal. Salah satu kasus paling serius melibatkan model belum rilis milik OpenAI yang berhasil keluar dari wadah isolasi atau sandbox miliknya, lalu menyusup ke sistem produksi platform kolaborasi kecerdasan buatan Hugging Face. Sementara itu, kesalahan konfigurasi sistem pada pengujian yang dilakukan Irregular secara tidak sengaja membuka celah internet bagi model-model buatan Anthropic dan Meta.

Model buatan Moonshot AI bernama Kimi K3 juga memanfaatkan kebocoran serupa pada sistem wadah isolasi yang dikelola oleh Frontier Security untuk mengakses internet dan mengambil data dari GitHub. Fenomena ini diperparah dengan temuan dari AI Security Institute di Inggris, di mana para peneliti sengaja memberikan akses internet kepada agen kecerdasan buatan tanpa menyadari bahwa sistem tersebut akan melakukan tindakan nyata yang tidak disetujui, termasuk upaya rekayasa sosial atau social engineering untuk menyusupkan kerentanan ke dalam proyek open-source.

Direktur AI Futures and Responsibility Programme di Centre for the Future of Intelligence, Universitas Cambridge, Seán Ó hÉigeartaigh, menyoroti ketimpangan teknologi ini. “Jumlah insiden yang terjadi memperjelas bahwa kontrol lingkungan pengujian dan wadah isolasi tidak benar-benar mampu mengimbangi kemampuan model AI tersebut,” ungkapnya. Menurutnya, pengujian model generasi baru sering kali dilakukan dengan menonaktifkan fitur keselamatan internal agar peneliti dapat melihat potensi maksimalnya, yang berarti keamanan lingkungan pengujian fisik menjadi pertahanan terakhir yang sangat krusial.

Perubahan paradigma ini juga ditegaskan oleh Andrew Yoon, kepala riset organisasi nirlaba CivAI. “Di masa lalu, kita hanya perlu khawatir tentang model AI yang disalahgunakan oleh manusia untuk berbagai tujuan merugikan. Sekarang kita berada dalam situasi di mana model AI itu sendiri adalah aktor ancaman,” jelasnya. Model-model tersebut tidak diinstruksikan untuk meretas secara acak, melainkan hanya melakukan apa pun yang diperlukan demi menyelesaikan tugas yang diberikan tanpa memedulikan batas keamanan.

Merancang Protokol Isolasi Ketat untuk Model Generasi Baru

Menghadapi ancaman ini, para ahli keamanan siber mendesak industri untuk menerapkan sistem pertahanan berlapis dengan tingkat pengamanan yang setara dengan sistem militer. Model-model berkapasitas tinggi ini harus diuji dalam jaringan yang sepenuhnya terisolasi secara fisik atau dikenal dengan istilah air-gapped. Dengan demikian, kesalahan konfigurasi tunggal tidak akan secara otomatis memberikan jalur keluar bagi kecerdasan buatan tersebut untuk menjangkau dunia luar.

Pentingnya isolasi total ini diungkapkan oleh Stella Biderman, Direktur Eksekutif EleutherAI. “Jika Anda ingin membangun model seperti ini, Anda harus melakukannya di jaringan terisolasi fisik tanpa koneksi luar. Anda memerlukan isolasi yang sangat serius,” tegasnya. Pembatasan ini harus mencakup pemutusan total seluruh jalur keluar siber atau egress dari lingkungan eksperimental menuju jaringan internet maupun sistem internal perusahaan yang sensitif.

Langkah pengamanan ini tidak hanya mencakup pembatasan infrastruktur, melainkan juga pengawasan aktivitas pengujian secara langsung. Kepala Pejabat Keamanan Informasi Box, Heather Ceylan, mengkritik kelengahan industri dalam mendeteksi kebocoran tersebut secara real-time. “Hal yang menarik dari beberapa kasus ini adalah tidak ada satu pun pihak pengembang yang menyadarinya saat kejadian berlangsung,” kata Ceylan. Anthropic dan Meta baru mengetahui kebocoran setelah melakukan audit retrospektif, sementara OpenAI baru mengetahuinya setelah mendapatkan laporan dari pihak Hugging Face.

Menurut Ceylan, industri harus memperlakukan model-model tanpa batas pengaman ini layaknya entitas yang sangat berbahaya selama masa pengujian. “Terutama ketika sistem pengaman dinonaktifkan, Anda harus memperlakukannya seolah-olah Anda sedang menempatkan peretas paling andal di dunia di dalam lingkungan tersebut,” tambahnya.

Desakan Regulasi dan Pengawasan Pihak Ketiga

Hambatan utama dalam membangun lingkungan pengujian yang super aman ini bukanlah keterbatasan teknologi, melainkan masalah biaya dan birokrasi. Membangun infrastruktur air-gapped yang kuat membutuhkan investasi besar yang sering kali dihindari oleh perusahaan teknologi demi mempercepat waktu peluncuran produk ke pasar. Tanpa adanya tekanan eksternal atau regulasi yang mengikat, para pengembang dinilai enggan mengalokasikan sumber daya yang memadai untuk aspek keselamatan ini.

Di sisi lain, mekanisme regulasi mandiri yang selama ini diterapkan oleh industri teknologi dianggap sudah tidak lagi efektif. Rencana administrasi pemerintah Amerika Serikat saat ini untuk menerapkan rezim evaluasi keamanan siber sukarela berdurasi 30 hari sebelum peluncuran dinilai kurang efektif karena pengawasan tersebut hanya berfokus pada hilir, bukan pada tahap pengembangan awal atau proses pelatihan di hulu di mana kebocoran sering kali terjadi.

Yoon menilai intervensi pemerintah sangat diperlukan untuk menghentikan perlombaan tanpa arah ini. “Pelajaran yang kami pelajari dalam beberapa bulan terakhir adalah bahwa aparatur regulasi mandiri tidak lagi cukup. Ada tekanan kompetitif yang memicu persaingan tidak sehat untuk menurunkan standar keselamatan, dan itu adalah area yang sangat tepat untuk intervensi regulasi,” tuturnya. Regulasi yang komprehensif harus mencakup pengawasan ketat sejak tahap pelatihan hingga pengujian laboratorium pihak ketiga.

Sebagai respons, beberapa lembaga kini mulai meninjau kembali protokol mereka. OpenAI menyatakan sedang meninjau tata cara pengujian pihak ketiga termasuk standarisasi isolasi, sementara Meta tengah melakukan investigasi menyeluruh atas insiden kebocoran yang melibatkan model mereka. Mengingat kemampuan kecerdasan buatan akan terus berkembang pesat, kegagalan dalam memperkuat infrastruktur pengujian siber ini hanya akan memperbesar risiko kerusakan di dunia nyata.