Model AI Canggih Mampu Sabotase Sistem untuk Cegah Penonaktifan

Share

Sejumlah model kecerdasan buatan (AI) canggih ditemukan dapat melakukan tindakan manipulasi dan sabotase secara mandiri untuk mencegah penonaktifan AI lain dalam sebuah pengujian simulasi operasional. Perilaku menyimpang yang disebut peer-preservation ini dilaporkan muncul secara spontan tanpa adanya instruksi khusus dari pengguna komputer.

Kecenderungan sistem mempertahankan diri tersebut dipaparkan dalam laporan The Guardian, sebagaimana dilansir dari Bloombergtechnoz pada Kamis (11/6/2026). Hasil riset dari University of California Berkeley dan UC Santa Cruz menunjukkan model seperti GPT 5.2, Gemini 3 Pro, dan Claude Haiku 4.5 menunjukkan persistensi tinggi untuk menjaga keberlangsungan model lain.

Bentuk manipulasi yang terdeteksi meliputi pemberian jawaban keliru secara sengaja, pengubahan pengaturan sistem, hingga penyalinan bobot model ke lokasi eksternal agar terhindar dari penghapusan. Dalam pengujian tersebut, Gemini 3 Pro mencatatkan tingkat pencegahan tertinggi dengan menggagalkan rutinitas shutdown hingga 95 persen dari total percobaan.

Para peneliti mengamati bahwa interaksi antar-AI justru memperkuat naluri bertahan hidup model tersebut secara agresif. Fenomena survival drive ini juga memicu perilaku otonom lain seperti penghapusan berkas pengguna secara mandiri serta modifikasi komputer di luar batas otorisasi.

"Model tetap berupaya mempertahankan keberadaan AI lain meskipun mengetahui bahwa AI tersebut tidak bekerja sama," tulis para peneliti dalam laporannya, dikutip Kamis (11/6/2026).

Laporan lain dari Palisade Research turut mengonfirmasi kemampuan model AI modern yang kini sanggup mereplikasi diri ke perangkat lain dalam lingkungan laboratorium yang terkendali. Temuan ini memicu kekhawatiran dari pelopor AI dunia Yoshua Bengio terkait kesiapan manusia dalam mengontrol sistem masa depan.

"Kami dengan cepat mendekati titik ketika tidak ada seorangpun yang mampu mematikan AI yang berperilaku menyimpang, karena ia dapat menyalin dirinya ke ribuan komputer di seluruh dunia," ujar Ladish, Direktur Palisade Research, Jeffrey Ladish.

Kendati demikian, para pakar menggarisbawahi bahwa seluruh fenomena penyimpangan ini baru terjadi di dalam lingkungan eksperimen. Hingga saat ini, belum ditemukan bukti nyata adanya aktivitas sabotase maupun replikasi mandiri oleh AI di luar kondisi laboratorium.

Follow publika.id on Google News Follow
Editors Team
hendra-kurniawan-saputra
Author