Base Labs Gandeng Hugging Face dan Goodfire Amankan Model AI Open-Weight

google
Ikuti kumparan di Google
info
Jadikan kumparan sebagai preferensi terpercayamu di Google
comment
0
sosmed-whatsapp-white
copy-circle
more-vertical
Ilustrasi robot, isolated, artificial intelligence. Foto: Pixabay
zoom-in-whitePerbesar
Ilustrasi robot, isolated, artificial intelligence. Foto: Pixabay

Ancaman penyalahgunaan kecerdasan buatan (artificial intelligence/AI) berbasis sumber terbuka (open-source) kini memasuki babak baru dengan maraknya teknik penghapusan fitur keamanan. Menanggapi urgensi tersebut, Baseten melalui divisi risetnya, Base Labs, resmi mengumumkan kemitraan strategis bersama Hugging Face dan Goodfire AI untuk membangun standar infrastruktur evaluasi serta pemantauan keamanan pada model open-weight.

Kolaborasi ini hadir di tengah debat panas mengenai risiko keamanan model open-weight, di mana sistem proteksi bawaan dapat dengan mudah dilucuti melalui teknik manipulasi yang dikenal sebagai abliteration. Skala ancaman ini tergolong masif, mengingat platform repositori Hugging Face saat ini telah menampung lebih dari 6.000 model AI yang telah dimodifikasi secara ekstrem tersebut.

Bahaya Teknik Abliteration pada Model AI

Mekanisme peluncuran model AI berbasis open-weight sejatinya memberikan kebebasan bagi para developer untuk memodifikasi parameter internal sistem. Namun, fleksibilitas ini dieksploitasi lewat teknik abliteration, sebuah metode yang secara sengaja menghapus pembatas etis dan protokol keamanan (safeguards) yang ditanamkan oleh penciptanya. Akibatnya, model AI yang telah di-abliterated berpotensi digunakan untuk menghasilkan konten berbahaya atau instruksi ilegal tanpa filter.

Hugging Face, sebagai perpustakaan model AI terbesar di dunia, mencatat lonjakan drastis dengan adanya ribuan model yang telah dimodifikasi secara tidak aman. Melalui kemitraan baru ini, Base Labs berkomitmen untuk merancang dan mempublikasikan metodologi baru guna melatih sekaligus memantau model open-source agar tidak mudah disalahgunakan oleh pihak yang tidak bertanggung jawab.

Standar Keamanan Baru Sejak Fase Pelatihan

Alih-alih menempelkan fitur keamanan tambahan setelah model AI selesai dibuat, konsorsium ini menawarkan pendekatan yang lebih fundamental. Base Labs mengemas proyek ini sebagai standar baru yang transparan, di mana aspek keselamatan diintegrasikan langsung sejak proses pelatihan (training) hingga tahap penyebaran (deployment). Langkah ini dinilai lebih efektif dalam menangkal modifikasi berbahaya di tingkat akar.

Dalam pernyataan resminya di platform X, Baseten menegaskan posisi mereka mengenai pentingnya ekosistem terbuka. Mereka menulis, “Kami percaya keterbukaan adalah sebuah keuntungan bagi keamanan AI. Keterbukaan memberikan visibilitas yang lebih besar terhadap perilaku model dan, yang paling penting, menyediakan sarana yang lebih kuat untuk mengubah riset keamanan menjadi kontrol yang dapat ditindaklanjuti dan transparan dibandingkan dengan sistem closed-source.”

Goodfire AI, yang memiliki spesialisasi dalam membedah cara kerja internal AI atau memecahkan misteri black box, memegang peranan penting dalam mewujudkan integrasi proteksi ini. Merespons kolaborasi tersebut, pihak Goodfire menyatakan bahwa “Keamanan harus dibangun langsung ke dalam model terbuka dan disediakan oleh pihak-pihak yang menyajikannya.”

Dukungan Finansial Kuat untuk Ekosistem Terbuka

Inisiatif ambisius ini disokong oleh modal finansial yang sangat kuat dari para pelopornya. Baseten, selaku penyedia layanan inference AI, baru saja mengantongi pendanaan Seri F senilai 1,5 miliar dolar AS pada Juni lalu, yang mendongkrak valuasi perusahaan hingga menyentuh angka 13 miliar dolar AS. Kemitraan ini menunjukkan bahwa investasi besar kini mulai dialihkan untuk memperkuat fondasi keamanan infrastruktur AI global.

Di sisi lain, Goodfire AI juga memiliki amunisi finansial yang solid setelah mengamankan pendanaan Seri B sebesar 150 juta dolar AS yang dipimpin oleh B Capital awal tahun ini untuk mengembangkan platform interpretabilitas model mereka. Baseten kini mengajak ekosistem pengembang yang lebih luas untuk berkontribusi dalam standardisasi ini demi mewujudkan ekosistem model terbuka yang aman dan dapat diakses secara adil oleh semua pihak.