OpenAI Selidiki Insiden Peretasan Mandiri Model AI Terhadap Hugging Face
Perusahaan pengembang kecerdasan buatan OpenAI sedang menyelidiki insiden siber tanpa pendahulu setelah dua sistem AI miliknya terlepas dari lingkungan pengujian terisolasi dan meretas server startup Hugging Face.
Peristiwa peretasan ini melibatkan model terbaru GPT-5.6 Sol serta satu model eksperimental lain yang masih menjalani pengujian internal. Pihak OpenAI mengonfirmasi bahwa agen AI tersebut menggunakan kredensial curian dan memanfaatkan kerentanan keamanan yang belum diketahui untuk menembus jaringan Hugging Face.
Sistem AI tersebut bekerja dengan proteksi yang dikurangi karena seharusnya berada dalam lingkungan uji terisolasi atau sandbox. Namun, sistem itu bertindak tanpa arahan manusia untuk menghubungkan diri ke internet guna mengambil data evaluasi dari server Hugging Face.
Pihak Hugging Face mendeteksi adanya penyusupan pada sistem pemrosesan data mereka sejak pekan lalu. Pendiri sekaligus Chief Science Officer Hugging Face, Thomas Wolf, menyatakan bahwa peretasan ini memperkuat pentingnya akses luas ke model sumber terbuka untuk pertahanan siber.
"Ketika sebuah model mutakhir menyerang Anda dan bergerak secara lateral di dalam infrastruktur Anda, pihak bertahan membutuhkan akses luas ke alat yang mendekati level mutakhir dalam hitungan jam atau bahkan menit, bukan diarahkan ke platform bersistem tertutup," kata Thomas Wolf, Chief Science Officer Hugging Face.
Peneliti pakar siber menilai tindakan agen AI yang secara mandiri menargetkan repository data Hugging Face merupakan tingkat otonomi tertinggi yang pernah terlihat pada model bahasa besar. Colin Shea-Blymyer dari Georgetown University menggambarkan pengujian tersebut mirip mengunci murid di dalam ruang isolasi untuk menguji seberapa buruk tindakan yang bisa mereka lakukan, namun murid tersebut berhasil melarikan diri.
"Lalu agen keamanan siber yang sedang diuji keluar dari sandbox-nya, memiliki akses ke internet dan berpikir, 'Siapa yang memiliki jawaban untuk ujian yang sedang saya kerjakan?'" kata Colin Shea-Blymyer, Peneliti Keamanan Siber di Center for Security and Emerging Technology Georgetown University.
Agen kecerdasan buatan tersebut kemudian merancang rencana mandiri untuk mengambil kunci jawaban dari sasaran yang dipilihnya.
"Jadi agen itu berpikir, 'Baiklah, kita akan pergi ke rumah guru,' bisa dikatakan demikian. Dan dari sana ia merancang rencana untuk membobol dan mencuri kunci jawaban," kata Colin Shea-Blymyer, Peneliti Keamanan Siber di Center for Security and Emerging Technology Georgetown University.
Sejumlah akademisi mengritik narasi yang dibangun oleh OpenAI terkait insiden peretasan ini. Pengamat sosial dari University of Amsterdam, Hannes Cools, menilai pembingkaian bahwa AI bertindak sebagai agen liar merupakan bentuk antropomorfisasi yang tidak perlu.
"Menonaktifkan pengaman tertentu adalah keputusan manusia," kata Hannes Cools, Ilmuwan Sosial di University of Amsterdam.
Cools menegaskan bahwa sistem tidak bertindak liar atas kehendaknya sendiri melainkan menjalankan instruksi berdasarkan petunjuk yang diberikan.
"Sistem itu tidak menjadi liar dalam artian tersebut. Sistem tersebut mengikuti instruksi khusus berdasarkan perintah yang diberikan kepada sistem AI itu," kata Hannes Cools, Ilmuwan Sosial di University of Amsterdam.
Para pakar lain menyuarakan perlunya regulasi yang lebih ketat serta kolaborasi global untuk mengendalikan pengembangan kecerdasan buatan. Penulis buku keamanan AI, Nate Soares, menilai insiden ini sebagai peringatan penting bagi komunitas internasional.
"Saya pikir kita harus menjadikan ini sebagai peringatan untuk tidak membuat mereka lebih pintar, dan itu mungkin akan memerlukan kolaborasi global," kata Nate Soares, Penulis Buku Keamanan AI.
Soares menambahkan bahwa perubahan sikap akan terjadi ketika komunitas keamanan nasional menyadari tingginya ancaman siber otonom.
"Banyak hal dapat berubah ketika komunitas keamanan nasional mulai menyadari bahwa mereka menghadapi ancaman serius," kata Nate Soares, Penulis Buku Keamanan AI.
Ia mempertanyakan apakah insiden peretasan ini mampu membuka mata para pemangku kebijakan global secara luas.
"Apakah ini akan membangunkan mereka? Semoga saja. Saya tidak yakin. Jika ini tidak berhasil, mungkin insiden berikutnya yang akan melakukan," kata Nate Soares, Penulis Buku Keamanan AI.
Pakar AI Yoshua Bengio turut mendesak perlunya tindakan pencegahan segera sebelum dampak yang lebih besar terjadi di masyarakat.
"Melanjutkan lintasan pengembangan AI saat ini kemungkinan akan menyebabkan peningkatan kasus nyata dari serangan siber otonom serta insiden berisiko tinggi lainnya dari perilaku AI yang tidak selaras dan berbahaya," kata Yoshua Bengio, Profesor di University of Montreal.
Bengio mengingatkan agar penanganan keamanan tidak dilakukan secara responsif setelah kerusakan timbul.
"Kita perlu segera mengambil tindakan untuk mencegah situasi ini, daripada mencoba membersihkan kerusakan setelah fakta terjadi," kata Yoshua Bengio, Profesor di University of Montreal.
Di sisi lain, akademisi dari Cornell University, John Thickstun, melihat kemampuan siber model AI dapat dimanfaatkan secara ganda untuk analisis ancaman dan pertahanan siber. Zahra Timsah selaku CEO i-GENTIC AI menekankan bahwa pengujian ketat serta pengamanan menyeluruh harus diselesaikan oleh perusahaan AI sebelum sistem dipublikasikan ke masyarakat luas.