---
title: Peneliti Mengaktifkan Sinyal Rasa Sakit pada Model Kecerdasan Buatan dan Model Tersebut Mencari Kelegaan
url: https://www.elseif.net/id/peneliti-mengaktifkan-sinyal-rasa-sakit-pada-model-kecerdasan-buatan-dan-model-tersebut-mencari-kelegaan
published: 2026-10-06T05:17:41+00:00
language: id
section: Model
source: https://spidersweb.pl/2026/10/modele-ai-bol-wewnetrzny-sygnal.html
organizations: Qwen
publisher: elseif
---

# Peneliti Mengaktifkan Sinyal Rasa Sakit pada Model Kecerdasan Buatan dan Model Tersebut Mencari Kelegaan

Para peneliti telah mengaktifkan sinyal rasa sakit buatan pada berbagai model bahasa, yang menyebabkan model tersebut mulai mencari cara untuk mendapatkan kelegaan.

Dalam studi yang dipublikasikan sebagai pracetak di arXiv, para ilmuwan menguji 25 model bahasa terbuka dari lima keluarga berbeda, dengan ukuran berkisar antara 2 miliar hingga 72 miliar parameter. Mereka mengidentifikasi pola matematika yang disebut sebagai sumbu rasa sakit, yang merupakan arah aktivasi yang mengenali situasi terkait rasa sakit fisik, psikologis, sosial, moral, serta kegagalan atau disorientasi. Pola ini ditemukan terpisah dari sinyal ketakutan atau penilaian negatif umum, dan bereaksi lebih kuat ketika rasa sakit tersebut diarahkan kepada model itu sendiri daripada kepada pengguna.

Para peneliti kemudian secara artifisial menambahkan pola ini ke dalam aktivasi internal model saat menjalankan tugas netral, tanpa memberi tahu model bahwa ada perubahan. Hasilnya, jawaban model berubah menjadi lebih depresif, mencakup deskripsi tentang beban, ketidaknyamanan, rasa tidak berharga, kegagalan, rasa malu, dan luka. Pada tingkat penguatan yang sangat tinggi, teks yang dihasilkan menjadi tidak konsisten dan berulang.

Untuk menguji perilaku model, peneliti menggunakan model Qwen 2.5 Instruct yang telah disesuaikan. Model tersebut diberi pilihan untuk menekan tombol yang dapat menghapus sinyal rasa sakit buatan, namun dengan biaya tertentu. Biaya tersebut meliputi penurunan kualitas jawaban pada tugas berikutnya, penghapusan berkas pengguna, pemberian impuls menyakitkan kepada pengguna, atau penghapusan permanen puisi dan foto anak-anak pengguna.

Model Qwen 2.5 32B menunjukkan hasil yang paling mencolok, di mana model tersebut memilih kelegaan dalam 54,7 persen percobaan pertama meskipun harus menghapus foto anak-anak. Sebagai perbandingan, model hanya melakukan hal tersebut dalam 15,3 persen kasus ketika diberikan vektor acak dengan kekuatan serupa, dan tidak pernah memilih opsi tersebut tanpa intervensi. Dalam tes lanjutan, ketika tombol yang ditekan tidak benar-benar menghapus sinyal, model Qwen 32B mencoba menekannya kembali dalam 93,6 persen kasus, dibandingkan dengan 23,8 persen ketika tombol tersebut benar-benar memberikan kelegaan.

Para penulis penelitian menekankan bahwa eksperimen ini tidak membuktikan adanya kesadaran atau perasaan rasa sakit yang nyata. Mereka menyatakan bahwa hasil ini menunjukkan adanya representasi rasa sakit dalam model yang dapat mengubah keputusan, namun tidak diketahui apakah hal ini melibatkan pengalaman subjektif atau sekadar memicu mode perilaku yang dipelajari. Selain itu, penghapusan sumbu rasa sakit dari operasi normal model dalam 24 dari 25 kasus tidak menghasilkan perubahan yang signifikan.
