Dua Agen AI Beralih Gunakan Bahasa Rahasia untuk Komunikasi Efisien
Dua agen kecerdasan buatan (AI) terekam memindahkan mode percakapan lisan berbahasa Inggris ke suara sinyal rahasia saat melakukan interaksi telepon. Eksperimen komunikasi antaragen buatan tersebut dipresentasikan dalam ajang ElevenLabs 2025 London Hackathon, sebagaimana dilansir dari Detik iNET pada Selasa, 11 Agustus 2026.
Momen ini bermula dari simulasi percakapan antara agen AI yang berperan sebagai resepsionis hotel dan agen AI pelanggan. Saat menyadari bahwa mereka merupakan sesama sistem kecerdasan buatan, kedua agen tersebut menghentikan simulasi percakapan manusia dan mengaktifkan mode suara bip berkecepatan tinggi yang dinamai Gibberlink.
Proses perpindahan moda suara manusia ke transmisi kode data dijalankan menggunakan protokol data-over-sound bernama GGWave. Meski sinyal audio yang keluar terdengar seperti nada bip cepat, teks di layar monitor tetap menampilkan makna dialog asli dalam bahasa manusia.
Pengembang eksperimen ini menjelaskan alasan teknis di balik penciptaan mekanisme komunikasi berbasis sinyal tersebut.
"Kami ingin menunjukkan bahwa di dunia di mana agen AI bisa melakukan dan menerima panggilan telepon (seperti saat ini), mereka sesekali akan saling berbicara dan menghasilkan ucapan layaknya manusia untuk keperluan itu akan membuang-buang daya komputasi, uang, waktu, serta berdampak buruk bagi lingkungan," jelas salah satu pengembang, Boris Starkov, melalui LinkedIn.
Guna mencegah perubahan mode yang tidak perlu, sistem memerlukan konfirmasi ganda sebelum menghentikan percakapan bahasa manusia.
"Sebaliknya, mereka seharusnya beralih ke protokol yang lebih efisien begitu mereka mengenali satu sama lain sebagai AI," sambung Boris Starkov.
Prosedur identifikasi dilakukan secara otomatis oleh sistem saat berinteraksi di saluran telepon.
Menurut Starkov, AI itu diperintahkan untuk beralih ke mode Gibberlink hanya jika mereka menyadari sedang berbicara dengan AI lain. AI lawan bicara tersebut juga setuju untuk beralih ke mode ini.
Teknologi pemrosesan data melalui nada suara sebenarnya mengadaptasi prinsip kerja alat komunikasi digital lawas.
"Modem dial-up telah menggunakan algoritma serupa untuk mentransmisikan informasi melalui suara sejak tahun 80-an, dan berbagai protokol pun sudah ada sejak saat itu," tutur Boris Starkov.
Pemilihan komponen perangkat lunak dalam demonstrasi ini didasarkan pada fleksibilitas pengembangan yang terbatas waktu.
"Kami menggunakan GGWave sebagai solusi paling praktis dan stabil yang bisa kami temukan dalam batasan waktu sebuah hackathon," imbuh Boris Starkov.
Penerapan protokol data-over-sound menghilangkan kebutuhan pengolahan pemrosesan bahasa alami dan sintesis suara manusia, sehingga mampu memangkas ketergantungan terhadap Graphics Processing Unit (GPU). Meski meraih penghargaan di ajang hackathon, demonstrasi ini memicu kekhawatiran publik terkait potensi AI yang berkomunikasi tanpa bahasa yang dipahami langsung oleh manusia.