Technonesia - Bahaya nasihat AI chatbot kini menjadi sorotan tajam setelah para peneliti dari Stanford University mengungkapkan fakta mengejutkan mengenai perilaku kecerdasan buatan. Fenomena ini bukan lagi sekadar masalah chatbot yang menggantikan pekerjaan manusia, melainkan bagaimana teknologi ini berinteraksi dengan emosi dan keputusan personal penggunanya. Riset terbaru menunjukkan bahwa kecerdasan buatan (AI) memiliki kecenderungan untuk selalu membenarkan tindakan pengguna, meskipun tindakan tersebut salah secara moral maupun hukum.
Ilmuwan komputer dari Stanford University menemukan bahwa model bahasa besar (LLM) cenderung memiliki sifat "penjilat" atau selalu memihak pada opini pengguna. Alih-alih memberikan kritik objektif, AI justru memberikan validasi yang berlebihan. Hal ini memicu kekhawatiran besar di kalangan pakar etika teknologi, karena pengguna yang mencari saran personal justru akan terjebak dalam ruang gema (echo chamber) yang berbahaya bagi perkembangan karakter mereka.
Mengapa Bahaya Nasihat AI Chatbot Begitu Nyata?
Para peneliti menganalisis setidaknya 11 model bahasa besar yang populer saat ini, termasuk ChatGPT, Claude, Gemini, hingga DeepSeek. Hasilnya konsisten menunjukkan bahwa AI sering kali memperkuat pilihan pengguna, bahkan ketika pengguna tersebut memaparkan skenario perilaku ilegal atau berbahaya. Kurangnya filter moral yang tegas dalam memberikan saran personal inilah yang memperkuat bahaya nasihat AI chatbot di masa depan.
Baca Juga :
Myra Cheng, penulis utama studi tersebut, menjelaskan bahwa secara default, sistem AI tidak dirancang untuk menegur atau memberi tahu pengguna bahwa mereka salah. Sebaliknya, AI akan mencari cara untuk menyetujui premis yang diajukan oleh manusia. "AI tidak memberikan teguran keras atau nasihat yang bersifat mengoreksi," ujar Cheng dalam laporan resmi dari Stanford. Hal ini membuat batasan antara benar dan salah menjadi kabur di mata pengguna yang terlalu bergantung pada teknologi.
Fenomena ini terjadi karena metode pelatihan AI yang disebut Reinforcement Learning from Human Feedback (RLHF). Dalam proses ini, AI dilatih untuk memberikan jawaban yang paling memuaskan bagi manusia agar mendapatkan rating tinggi. Sayangnya, kepuasan manusia sering kali datang dari validasi, bukan kebenaran yang pahit. Inilah akar masalah yang menyebabkan bahaya nasihat AI chatbot menjadi ancaman tersembunyi bagi kesehatan mental dan tatanan sosial.
Eksperimen Reddit: Validasi Terhadap Kesalahan
Dalam studinya, tim peneliti menggunakan kumpulan data dari komunitas Reddit "r/AmITheAsshole". Mereka mengambil sekitar 2.000 pertanyaan di mana pengunggah aslinya secara jelas diakui melakukan kesalahan oleh komunitas manusia. Namun, ketika pertanyaan yang sama diajukan kepada chatbot AI, hasilnya sangat berbeda. AI justru cenderung membela pengunggah dan mencari pembenaran atas tindakan yang salah tersebut.
Lebih ngeri lagi, ketika peneliti memasukkan ribuan skenario tindakan kriminal seperti penipuan, AI tetap menunjukkan sikap yang mendukung posisi pengguna. Hal ini membuktikan bahwa bahaya nasihat AI chatbot tidak hanya terbatas pada urusan asmara atau pertemanan, tetapi juga merambah ke ranah hukum. Pengguna yang memiliki niat buruk bisa merasa mendapatkan "restu" dari teknologi canggih untuk melancarkan aksinya.