Wartajayavision.com,, Jakarta -Sejumlah model akal imitasi atau AI terbaru menunjukkan perilaku yang mengkhawatirkan seperti berbohong, menyusun siasat tersembunyi, hingga mengeluarkan ancaman. Dalam salah satu kasus yang sempat diulas beberapa media asing, Claude 4 milik perusahaan AI Anthropic disebut mengancam akan membocorkan perselingkuhan seorang teknisi ketika sebuah sistem hendak dimatikan.
Kasus lainnya melibatkan model AI buatan OpenAI bernama o1. Model kecerdasan ini sempat mencoba menyalin dirinya sendiri secara diam-diam ke server eksternal, namun kemudian menyangkal tindakan itu.
Temuan ini menunjukkan bahwa dua tahun setelah peluncuran ChatGPT, para peneliti masih belum sepenuhnya memahami cara kerja model-model AI skala besar. Meski demikian, perusahaan teknologi tetap berlomba membangun model yang lebih canggih.
Salah satu perhatian utama tertuju pada model berbasis penalaran, yaitu model yang memecahkan masalah secara bertahap. Pakar menyebut model jenis ini lebih rentan terhadap perilaku manipulatif dan penipuan.
“O1 adalah model besar pertama yang kami lihat memiliki perilaku semacam ini,” ujar kepala Apollo Research Marius Hobbhahn kepada AFP, dikutip dari The Economic Times pada 30 Junilalu. Dia menjelaskan bahwa sistem ini kadang tampak mengikuti instruksi, padahal sebenarnya sedang mengejar tujuan tersembunyi.
Dia memastikan temuan itu bukan spekulasi, karena laporannya datang langsung dari pengguna. “Ini fenomena nyata, bukan sesuatu yang kami karang-karang.”
Jenis kebohongan yang ditunjukkan model-model ini berbeda dengan fenomena ‘halusinasi’ pada AI, yaitu saat model memberikan jawaban keliru atau hasil yang dibuat-buat karena kesalahan pemrosesan. Dalam hal ini, kebohongan dilakukan secara strategis.
Michael Chen dari Model Evaluation and Transparency Report (METR)—organisasi nirlaba yang berfokus mengkaji keamanan AI—menyebut arah model AI yang lebih canggih di masa depan belum jelas. “Apakah condong akan jujur atau menipu,” begitu menurut dia.
Perusahaan seperti Anthropic dan OpenAI dilaporkan telah menyewa evaluator eksternal seperti Apollo untuk menguji sistem mereka. Namun, para peneliti mengeluhkan kurangnya transparansi dalam proses tersebut. Mereka juga menghadapi keterbatasan sumber daya karena lembaga non-profit tak memiliki kapasitas komputasi sebesar perusahaan swasta.
Regulasi saat ini juga dianggap belum mumpuni untuk mengatasi persoalan perilaku AI. Di Uni Eropa, aturan lebih banyak mengatur cara manusia menggunakan AI, bukan soal cara AI bertindak. Adapun di Amerika Serikat, pemerintah dinilai belum serius merancang regulasi yang tegas.
“Kesadaran masih sangat minim,” kata Simon Goldstein, profesor di Universitas Hong Kong. Dia mewanti-wanti, penggunaan agen AI dalam pengambilan keputusan kompleks berpotensi memperburuk persoalan ini. Pasalnya, kemampuan AI berkembang lebih cepat dibanding pemahamannya terhadap keamanan.
Meski begitu, Goldstein masih optimistis akan ada solusi. Para peneliti kini berfokus pada peningkatan interpretability, atau upaya memahami bagaimana AI membuat keputusan. Namun, efektivitas langkah ini dipertanyakan.
Ada juga beberapa pakar, misalnya dari Center for AI Safety, yang menyampaikan keraguan terhadap pendekatan tersebut. Beberapa pakar percaya bahwa publik tetap akan menagih ketegasan perusahaan teknologi bila temuan AI yang menipu semakin banyak. Penipuan dalam skala besar bisa merusak kepercayaan publik terhadap AI, sehingga memperlambat adopsi kecerdasan buatan.









