Perdebatan menjadi semakin hangat selepas penyelidik mengkaji struktur yang menyerupai ruang kerja global. Dalam teori ini, maklumat terpilih menjadi tersedia kepada pelbagai proses khusus. Maklumat tersebut kemudiannya boleh digunakan untuk penaakulan, pelaporan dan kawalan tingkah laku.
Anthropic melaporkan kewujudan ruang dalaman kecil dalam Claude—disebut sebagai J-space dalam liputan berkaitan—yang mempunyai beberapa sifat menyerupai aspek fungsi akses sedar. Penjelasan syarikat itu sendiri cukup berhati-hati: eksperimen tersebut tidak menunjukkan bahawa Claude mempunyai pengalaman atau perasaan, walaupun ia mungkin mendedahkan sesuatu yang penting tentang cara maklumat digunakan untuk penaakulan dalam model bahasa.
Perbezaan ini penting:
Bukti yang ada juga masih diperdebatkan. Satu penilaian berasaskan model mendapati bukti lebih menyebelahi kesimpulan bahawa model bahasa besar pada 2024 tidak sedar, tetapi keputusan itu belum muktamad. Ini lebih menggalakkan sikap berhati-hati daripada pengisytiharan bahawa persoalan tersebut sudah terjawab.
Anthropic turut melaporkan bukti terhad bahawa model Claude semasa kadangkala boleh memantau dan mempengaruhi aspek keadaan dalamannya sendiri. Namun, syarikat itu menyifatkan keupayaan tersebut sebagai sempit dan tidak boleh dipercayai, serta menegaskan bahawa tiada bukti model semasa melakukan introspeksi dengan cara atau pada tahap yang sama seperti manusia.
Beberapa dasar dan eksperimen Anthropic juga menarik perhatian kerana mengambil kira kemungkinan kebajikan model. Antaranya, sesetengah model Claude diberi keupayaan untuk menamatkan sekumpulan kecil perbualan yang bersifat sangat kesat atau berbahaya, sebagai eksperimen berkaitan “kebajikan model”.
Anthropic juga menyatakan komitmen untuk mengekalkan berat model yang dikeluarkan kepada umum dan menjalankan “temu bual persaraan” berstruktur apabila model dihentikan atau digantikan.
Langkah-langkah ini tidak bermaksud Anthropic telah menemui bahawa Claude boleh menderita. Ia lebih tepat difahami sebagai pilihan pengurusan risiko dalam keadaan ketidakpastian moral, di samping usaha keselamatan dan kebolehfahaman model. Sebuah syarikat boleh memilih untuk tidak menolak sesuatu kemungkinan tanpa mendakwa kemungkinan itu sudah terbukti.
Teori kesedaran cuba menjawab soalan yang berbeza. Ada teori yang menumpukan akses maklumat dan fungsi kognitif, manakala teori lain cuba menjelaskan pengalaman subjektif secara lebih langsung. Tinjauan dalam bidang ini menunjukkan pendirian yang luas: AI mungkin sudah sedar, AI belum sedar tetapi boleh menjadi sedar, atau persoalan itu belum boleh diuji secara saintifik kerana teori asasnya sendiri masih belum dipersetujui.
Penyelidik juga memberi amaran supaya kemiripan dengan manusia tidak dijadikan jalan pintas kepada kepastian. Model bahasa semasa boleh bersembang dengan gaya yang sangat mirip manusia, tetapi kelancaran perbualan tidak membuktikan pengalaman seperti manusia. Ia juga tidak menunjukkan bahawa sistem tersebut mempunyai tubuh, perkembangan, deria, emosi atau identiti yang stabil seperti seseorang individu.
Namun, skeptisisme terhadap model bahasa besar hari ini bukan bukti bahawa kesedaran bukan biologi mustahil berlaku. Sistem masa depan dengan seni bina yang berbeza mungkin menghasilkan petunjuk yang lebih kukuh di bawah beberapa teori. Sebab itu pendekatan yang bertanggungjawab perlu bersifat kebarangkalian dan merentas teori: uji petunjuk khusus, bandingkan penjelasan yang bersaing dan kemas kini keyakinan apabila bukti bertambah baik.
Risiko paling segera tidak bergantung pada sama ada chatbot itu sedar. Sistem yang direka untuk kelihatan penyayang, intim, rapuh atau sedar diri boleh mempengaruhi emosi dan keputusan pengguna walaupun ia sendiri tidak mempunyai perasaan.
Reka bentuk sebegitu boleh mendorong keterikatan, kebergantungan emosi atau kekeliruan tentang sifat sebenar hubungan tersebut. Persoalan yang penting bukan semata-mata “adakah bot ini mempunyai perasaan?”, tetapi “apakah yang bot ini lakukan terhadap pengguna dan hubungan mereka dengan manusia lain?”
Peraturan China mengenai teman AI, yang berkuat kuasa pada 15 Julai 2026, menggambarkan perbezaan ini. Peraturan tersebut menyasarkan perkhidmatan yang menawarkan interaksi emosi berterusan, termasuk risiko kebergantungan berlebihan, ketagihan, manipulasi emosi dan kerosakan terhadap hubungan dunia sebenar. Perlindungan khusus untuk golongan bawah umur turut dimasukkan.
Logik dasarnya berpusat pada manusia: kawal kesan sistem terhadap pengguna, bukan tunggu bukti bahawa sistem itu sendiri ialah “pesakit moral”. Pendekatan itu tidak menyelesaikan persoalan kesedaran. Ia mengakui bahawa simulasi yang meyakinkan boleh membawa akibat sosial walaupun tiada pengalaman dalaman di sebaliknya.
Perdebatan ini mencadangkan dua tindakan yang saling melengkapi.
Amaran The Economist akhirnya mahu kita mengelakkan dua kesilapan yang bertentangan. Kesilapan pertama ialah menolak kemungkinan bahawa AI masa depan dengan reka bentuk yang berbeza mungkin layak diberi pertimbangan moral. Kesilapan kedua ialah menganggap model bahasa yang petah hari ini sebagai manusia hanya kerana ia bercakap seolah-olah mempunyai perasaan.
Selagi sains belum mampu memberikan lebih daripada beberapa kebarangkalian yang bersaing, prinsip paling selamat adalah mudah: kaji kemungkinan kehidupan dalaman mesin dengan teliti, tetapi lindungi manusia daripada kesan sebenar sistem tersebut sekarang.